{"as_of":"2026-08-08T01:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e18797839492f16118e48b1b369ed92b93a368e5f4c1ffbbd632e23efb60c80","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:20:13.434436Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:20:10.527238Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T12:09:49.455046Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02858","snapshot_observed_at":"2026-08-07T11:20:10.527238Z","title":"A cat is meowing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:10.527238Z"},"links":{"cited_paper":"/paper/2506.02858","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:db0d2c50521f3ea6bba54e602345043d675633f579d5e898efd640559fb0c122","observation_id":"8e6a2bde-34e2-46f8-ae97-4b14ab0815d6","resolution":{"observed_at":"2026-08-07T11:20:10.527238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"cited_work":{"arxiv_id":"2506.02858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02858","snapshot_observed_at":"2026-07-04T12:09:49.455046Z","title":"Keon Lee, Kyumin Park, and Daeyoung Kim","venue":null,"work_id":"3755b62f-b0e2-4be9-a9f1-6cf10456970a","year":2023},"citing_paper":{"arxiv_id":"2606.23139","last_updated":"2026-06-22T10:32:25Z","snapshot_observed_at":"2026-08-03T12:53:27.814197Z","submitted_at":"2026-06-22T10:32:25Z","title":"Audio Editing in the Era of Foundation Models: A Survey","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T07:10:49.047784Z"},"links":{"cited_paper":"/paper/2506.02858","citing_paper":"/paper/2606.23139"},"observation_digest":"sha256:7cfddf57dc07a2e36d041afe438afe34b089ec6c1aee7ab618339f907ecee4d6","observation_id":"62ddaa29-ccb2-47a4-911d-59ebd14e2bcb","resolution":{"observed_at":"2026-07-04T12:09:49.456447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02858/citation-record","integrity":"/paper/2506.02858/integrity","json":"/paper/2506.02858/citation-record.json","paper":"/paper/2506.02858"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:16.106791Z","title":"Computational models aim to replicate this ability through sound separation, isolating target sources from audio mix- tures","venue":null,"work_id":"356c13c2-d05e-498d-92c5-628e4aff44e3","year":null},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:10.455479Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:4b20631c3bcf17a06fa2d9e1efbd7ea2a6a505827da25ad1b52b6114194589f3","observation_id":"7e9cee9e-1638-4464-a400-f619655afc7b","resolution":{"observed_at":"2026-08-07T11:20:16.168610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02858","snapshot_observed_at":"2026-08-07T11:20:10.527238Z","title":"A cat is meowing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:10.527238Z"},"links":{"cited_paper":"/paper/2506.02858","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:db0d2c50521f3ea6bba54e602345043d675633f579d5e898efd640559fb0c122","observation_id":"8e6a2bde-34e2-46f8-ae97-4b14ab0815d6","resolution":{"observed_at":"2026-08-07T11:20:10.527238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:16.013882Z","title":null,"venue":null,"work_id":"130a61c9-ff70-42e2-b4be-afef9c663115","year":null},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:10.610196Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:b03beff552611167c5526d889ba4ea0a47cf7d2cbaa9d5f18b10596761ec51dc","observation_id":"d6787cc3-4547-4741-a6eb-39ac8fefe95a","resolution":{"observed_at":"2026-08-07T11:20:16.058705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:15.906335Z","title":"Evaluation Benchmarks For evaluation, we use four publicly available text-aligned au- dio datasets and construct artificial mixtures following prior re- search in LASS [3, 4]","venue":null,"work_id":"188f79e0-89a2-4f46-ba9e-7922bec204e1","year":null},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:10.717988Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:195f2721e4d06c736bf3812e3ee30b076f34c415991935ca2e3a799417b6ee16","observation_id":"0983e868-166a-4628-8882-11bd21c57549","resolution":{"observed_at":"2026-08-07T11:20:15.945231Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:15.799223Z","title":"We analyzed na¨ıve adaptations of diffusion models to LASS and identified key lim- itations","venue":null,"work_id":"f4b6f9fe-ef0b-4ffa-9491-ce9d0dae2003","year":null},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:10.828713Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:ef86aa96f1ff1feae8543464a6d0e39925a44915b7222e43f0a7e0d8cb82ef6c","observation_id":"368ce8af-73b5-4f83-8789-897591f6144a","resolution":{"observed_at":"2026-08-07T11:20:15.865675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:15.687968Z","title":null,"venue":null,"work_id":"1aececd9-d192-400b-85c8-479c63dc9a50","year":2025},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:10.893944Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:9048ee8eef2aa08306e52fccd05a60dc6c3635b3d1d18537477339efd53cb2ee","observation_id":"4ef1bfa3-92b5-4227-83db-d16bd2c3c28b","resolution":{"observed_at":"2026-08-07T11:20:15.717558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:10.974188Z","title":"The cocktail party problem,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:10.974188Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:2bebce23faa4635797ff54bf8cfa4222bac57609686a34b695136ccb5945440b","observation_id":"4556db06-61f6-4c29-967e-bbdb7a7513aa","resolution":{"observed_at":"2026-08-07T11:20:10.974188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:15.548199Z","title":"Separate what you describe: Language- queried audio source separation,","venue":null,"work_id":"24c6dc7b-4f46-4299-a5fe-0028bda9d8e4","year":2022},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.063353Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:65caa121a50bc7c1ea56c301096373a5f410ce7be55aecaf0bf400c15671c87a","observation_id":"14f16842-445c-44cf-b9cc-3cca96dc1c57","resolution":{"observed_at":"2026-08-07T11:20:15.593216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07065","last_updated":"2023-03-03T08:37:38Z","snapshot_observed_at":"2026-07-06T14:30:29.323059Z","submitted_at":"2022-12-14T07:21:45Z","title":"CLIPSep: Learning Text-queried Sound Separation with Noisy Unlabeled Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07065","snapshot_observed_at":"2026-08-07T11:20:11.244437Z","title":"Clipsep: Learning text-queried sound separation with noisy unlabeled videos,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.244437Z"},"links":{"cited_paper":"/paper/2212.07065","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:c3cb74604115249f02ab93b5ebb35099b06d54efe4f8754ce6a4634de7c78d76","observation_id":"8a964106-5133-442a-a49c-d84cb42f207e","resolution":{"observed_at":"2026-08-07T11:20:11.244437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:15.431646Z","title":"Separate anything you describe,","venue":null,"work_id":"f4fcf850-cf06-472d-9342-14fa9260f501","year":2024},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.354174Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:1f15231f61c572e5b235ea755c8252a25c4044c9b7c43c17a1fe87fb739d26e2","observation_id":"b844ed36-8154-4e28-b38f-f3334d3339d8","resolution":{"observed_at":"2026-08-07T11:20:15.487297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07614","last_updated":"2025-01-09T15:48:23Z","snapshot_observed_at":"2026-08-06T19:09:08.527380Z","submitted_at":"2024-09-11T20:54:23Z","title":"FlowSep: Language-Queried Sound Separation with Rectified Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07614","snapshot_observed_at":"2026-08-07T11:20:11.440942Z","title":"Flowsep: Language-queried sound separation with rectified flow matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.440942Z"},"links":{"cited_paper":"/paper/2409.07614","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:4668c137c841ad082168711456d44dd5cc37c4e224d03a25ef1c9f91c89ebf18","observation_id":"a917e2ee-a5c5-49bc-af3c-e64771e6a89f","resolution":{"observed_at":"2026-08-07T11:20:11.440942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:15.306869Z","title":"Soloaudio: Target sound extraction with language-oriented audio diffusion transformer,","venue":null,"work_id":"15337989-485d-4294-a3ae-7a979df82bc5","year":2025},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.556063Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:f46352425d8bb903152cca6a4afae5a0b3d37c0cdacb0b2b17e1f5120c3a3b8a","observation_id":"903f4d1b-d2bd-4596-86f4-d7152185e606","resolution":{"observed_at":"2026-08-07T11:20:15.359499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:15.215056Z","title":"AudioLDM: Text-to-audio generation with latent diffusion models,","venue":null,"work_id":"553508da-202c-4a3d-a0d9-4675b941f929","year":2023},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.666796Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:d09f4d7c4f54de732ca70f951d4ecd1c9b18639be42494eebf17797a319d85dd","observation_id":"8956d83f-2fab-48cb-8547-6caf6027c03d","resolution":{"observed_at":"2026-08-07T11:20:15.245854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:15.092354Z","title":"Auffusion: Leveraging the power of diffusion and large language models for text-to-audio generation,","venue":null,"work_id":"112c998a-038f-438b-8171-460f8723804a","year":2024},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.756254Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:2031a8d5c87d5e7795632143c788d7bd43ecbb28bcbc188f96518ff94ca1ed17","observation_id":"d5c9b149-0586-4f27-9776-d68682dabaab","resolution":{"observed_at":"2026-08-07T11:20:15.143106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13224","last_updated":"2023-06-21T12:35:16Z","snapshot_observed_at":"2026-08-07T09:31:28.957302Z","submitted_at":"2022-11-23T18:59:05Z","title":"Peekaboo: Text to Image Diffusion Models are Zero-Shot Segmentors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13224","snapshot_observed_at":"2026-08-07T11:20:11.795728Z","title":"Peekaboo: Text to image diffusion models are zero-shot segmentors,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.795728Z"},"links":{"cited_paper":"/paper/2211.13224","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:aa295fb160d0dc80b6a99ebdd04f81ae72d1837234d9add155fb02f92b33400b","observation_id":"c9aeeafb-828f-421c-afc0-9446222059b6","resolution":{"observed_at":"2026-08-07T11:20:11.795728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:14.970057Z","title":"Decoupling magnitude and phase estimation with deep resunet for music source separation,","venue":null,"work_id":"5d3e8d44-06a4-49bf-8d15-849ba78665e7","year":2021},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.823413Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:68db30bfdf46f48ab34e7ba612096aa67fe8f8e5bf1c5e338c008d9f44787d69","observation_id":"029e9c41-a9df-408f-a42d-55d8e57c6bcc","resolution":{"observed_at":"2026-08-07T11:20:15.034150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:11.874751Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.874751Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:d6667c62c472dc84a31755ca3a5d4f412025a281bdce25ad079e9d6526cfbb5b","observation_id":"5eef99d9-8411-4f41-9f2f-817e05a0a923","resolution":{"observed_at":"2026-08-07T11:20:11.874751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:14.881213Z","title":"Audio prompt tuning for universal sound separation,","venue":null,"work_id":"40822da7-9c37-4ce5-a69b-331b0336baf2","year":2024},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:11.944020Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:071acc2381523186201ef56c17b9302cb23f0b18a444baf3dff3f353cd541803","observation_id":"deafc59a-f6bf-4b8a-84f6-28c56046e604","resolution":{"observed_at":"2026-08-07T11:20:14.915476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:14.768228Z","title":"The sound of pixels,","venue":null,"work_id":"b67cf581-97c8-4c59-a820-c1d894068a47","year":2018},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.009360Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:8928054b57b4179daaa67e4e231c15ed2529316cbc2e78973436379c1a15223e","observation_id":"678e251f-e077-4673-896f-622404135c97","resolution":{"observed_at":"2026-08-07T11:20:14.777697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07447","last_updated":"2023-05-11T16:41:55Z","snapshot_observed_at":"2026-08-03T04:37:00.279223Z","submitted_at":"2023-05-11T16:41:55Z","title":"Universal Source Separation with Weakly Labelled Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07447","snapshot_observed_at":"2026-08-07T11:20:12.058900Z","title":"Universal source separation with weakly labelled data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.058900Z"},"links":{"cited_paper":"/paper/2305.07447","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:cf168958025bd8c83bf5aaf56bccd692202330e11739b9605c6aaf2c4ecd4133","observation_id":"9693f69d-5c97-4016-84f6-3e137b64aac6","resolution":{"observed_at":"2026-08-07T11:20:12.058900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:12.147368Z","title":"Clap learning audio concepts from natural language supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.147368Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:7eb5d6eec5282eb65677aed1ab92804ec439b2f4107a41824fdfd5516b7a39ba","observation_id":"2d6b60f5-3ca0-41ed-a9aa-542cb915cc1a","resolution":{"observed_at":"2026-08-07T11:20:12.147368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:12.196924Z","title":"Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.196924Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:4ad90b99d2f6ab97956d560cfbe10a7a1eb7fa5325178dfda671de8cf635b265","observation_id":"765e424b-e437-4524-8423-b41b99adceb0","resolution":{"observed_at":"2026-08-07T11:20:12.196924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:12.246500Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.246500Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:42023e556db0f71f9e7bd883e2757615da1273cf46569780e59b78c4b99f5f86","observation_id":"575fff8e-8e70-452f-a38e-812406972e90","resolution":{"observed_at":"2026-08-07T11:20:12.246500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:12.346292Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.346292Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:b7a6b1b31381ab44304a87d75fa82bcc78dc298e305703a4357cf74d631344e5","observation_id":"714a1fc6-0a7b-43be-9598-4c8cea034175","resolution":{"observed_at":"2026-08-07T11:20:12.346292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:14.593713Z","title":"Scaling rectified flow transformers for high-resolution im- age synthesis,","venue":null,"work_id":"68fe3322-2449-4bd5-8127-efe420f9ef88","year":2024},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.472817Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:15d98af419f1d5e91d5f75d3668dc6f2b271aa28b2db23b1487d9cdad706e9f0","observation_id":"8d17d801-b83d-4b2d-87bc-8e82dd0dd970","resolution":{"observed_at":"2026-08-07T11:20:14.653854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:14.400790Z","title":"Audioldm 2: Learn- ing holistic audio generation with self-supervised pretraining,","venue":null,"work_id":"c0cdc583-4b0d-449b-b572-3ce408dfbfa7","year":2024},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.684722Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:1ffc2185634d652aafdc3b4ba9c5a24981b6dfb653dd5361b0c67d29a28a1700","observation_id":"35410eda-d571-4f80-833f-3af867b0e9d1","resolution":{"observed_at":"2026-08-07T11:20:14.503985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-07T11:20:12.794540Z","title":"Dreamfusion: Text-to-3d using 2d diffusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.794540Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:3f5fcb2a7a718e877e28332d56685976d2584c629c0299d64e58a72e96591875","observation_id":"33d4b280-65cc-4e86-b0e9-ee9b9fc37e1b","resolution":{"observed_at":"2026-08-07T11:20:12.794540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:14.259153Z","title":"Audit: Audio editing by following instructions with latent diffusion models,","venue":null,"work_id":"bb3ad8c0-6fc9-4b96-817b-f0598f5c6e8d","year":2023},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.928502Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:64e88d89a795d3f21fcc2c7572fd7a3cf3792a55ab45e8d7ed575d7cab420ed6","observation_id":"ee82518c-9729-45d4-a81d-3b102481b868","resolution":{"observed_at":"2026-08-07T11:20:14.328497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04350","last_updated":"2024-05-11T07:41:27Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-05-11T07:41:27Z","title":"Prompt-guided Precise Audio Editing with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04350","snapshot_observed_at":"2026-08-07T11:20:12.940408Z","title":"Prompt-guided precise audio editing with diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:12.940408Z"},"links":{"cited_paper":"/paper/2406.04350","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:2101949b8d3c9acf649e0b6bafbbb15f78117003bf819de8e5c8dd9a854f2119","observation_id":"bd3e8d42-2b0b-4fd7-a75c-79cfcd9c54ab","resolution":{"observed_at":"2026-08-07T11:20:12.940408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T11:20:13.013086Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.013086Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:10c0348e5c74a006c5acb66d455933e31cbed75e09201da4199170e19acd8110","observation_id":"044df5ff-48ac-4fbf-95dd-ed2120f0f158","resolution":{"observed_at":"2026-08-07T11:20:13.013086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09794","last_updated":"2022-11-17T18:58:14Z","snapshot_observed_at":"2026-08-04T20:45:04.370492Z","submitted_at":"2022-11-17T18:58:14Z","title":"Null-text Inversion for Editing Real Images using Guided Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09794","snapshot_observed_at":"2026-08-07T11:20:13.087528Z","title":"Null-text inversion for editing real images using guided diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.087528Z"},"links":{"cited_paper":"/paper/2211.09794","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:6855bea48a968ca30ad1ce6f3a9bfb8975b37e8b95647e62b8f17aac7f18cdb6","observation_id":"950eb791-2843-44f9-b1c3-f8deb46445bd","resolution":{"observed_at":"2026-08-07T11:20:13.087528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:14.127242Z","title":"Denoising diffusion probabilis- tic models,","venue":null,"work_id":"87790321-63a1-434d-8799-3dccf31affc2","year":2020},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.146581Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:377d9c5f63bb2806d9b35e2494b564a53bdc9bce1dbe9984eec08d16910226c9","observation_id":"c472c1d8-c0f8-4e9c-aef7-671feb4a1921","resolution":{"observed_at":"2026-08-07T11:20:14.166897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:13.179546Z","title":"Vggsound: A large-scale audio-visual dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.179546Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:f93d229375f96fa4ac5c06269d41a3a72e76f7f3f692055f726414bd15ae645c","observation_id":"1fde0118-37e4-4628-8550-8a7155b42d7e","resolution":{"observed_at":"2026-08-07T11:20:13.179546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:14.003007Z","title":"Audiocaps: Generating captions for audios in the wild,","venue":null,"work_id":"191c084c-d535-40a8-9d78-ee76388179f0","year":2019},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.220297Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:c74b57b375dbc7bf86f31868291e46fbc6ea17160158976c8a1cd66fd1f4637b","observation_id":"9522a672-3b76-4f25-bd6e-32cf4760e242","resolution":{"observed_at":"2026-08-07T11:20:14.047176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:13.937082Z","title":"Esc: Dataset for environmental sound classifica- tion,","venue":null,"work_id":"e3a8ffa7-e7c1-4c14-8bed-cbb54aea1031","year":2015},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.261415Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:41876ec8bffe4a2594acf2e9b403d9f854cf5d147dbcb828fbdf7e5898a7f832","observation_id":"579e4005-c0fd-4561-89c8-d0570b8c65a7","resolution":{"observed_at":"2026-08-07T11:20:13.972616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:13.300750Z","title":"Sdr– half-baked or well done?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.300750Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:7ec881f068569f0d748a4017fcedfe5753ef8ed37f0defdddcf98fc568fb885c","observation_id":"a7b86e79-094f-4089-af53-41a7c86876e3","resolution":{"observed_at":"2026-08-07T11:20:13.300750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:13.862235Z","title":"A reference-free metric for language- queried audio source separation using contrastive language-audio pretraining,","venue":null,"work_id":"9554d0b7-5d2c-4e56-91c1-9667363d92ed","year":2024},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.336498Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:bd4c760380fcea5a033d27978dcb01ba10e135a7f4ab094e77c291c1baa377f6","observation_id":"75c1793f-cb8b-4bdd-80f6-26a4aa6272a0","resolution":{"observed_at":"2026-08-07T11:20:13.884572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T11:20:13.370915Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.370915Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:be827a8643d289278f7d976330aabbaa6cb71a7b4ac10b5035a45c9f5a3923a1","observation_id":"cc63a523-42ec-4b29-9573-1b1a4e2df93e","resolution":{"observed_at":"2026-08-07T11:20:13.370915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:13.757748Z","title":"Resunet- a: A deep learning framework for semantic segmentation of re- motely sensed data,","venue":null,"work_id":"a4c2c043-42c7-40d7-96ca-416a8ee34eec","year":2020},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.403631Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:833bdbcb000d413c603de4b9a53f49e5cc08dc6295d0bce670e8f750dd7fecab","observation_id":"ca76cfd0-fcf3-4ded-9418-3875f2d6753d","resolution":{"observed_at":"2026-08-07T11:20:13.803825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:20:13.667008Z","title":"Clotho: an audio cap- tioning dataset,","venue":null,"work_id":"75dd1255-e503-49c2-8206-2ce901bf7506","year":2020},"citing_paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:13.434436Z"},"links":{"citing_paper":"/paper/2506.02858"},"observation_digest":"sha256:7dfe024a8c80764f54ba1ea6c989e1955f9d5c2b03b05830efe51cc8b0285093","observation_id":"624856e4-e0a2-49f4-835d-207f6517c8d2","resolution":{"observed_at":"2026-08-07T11:20:13.698592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02858","last_updated":"2025-06-05T04:46:57Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T11:11:39.850300Z","submitted_at":"2025-06-03T13:24:57Z","title":"DGMO: Training-Free Audio Source Separation through Diffusion-Guided Mask Optimization"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 2 inbound Pith citation observations for arXiv:2506.02858."}