{"as_of":"2026-08-06T15:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7be42d3a2d709deb23d7b2b832ad310d15d0c482200cf95697f81e0485cb34cb","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:54:57.714051Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17297/citation-record","integrity":"/paper/2507.17297/integrity","json":"/paper/2507.17297/citation-record.json","paper":"/paper/2507.17297"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10676","last_updated":"2025-06-12T13:07:54Z","snapshot_observed_at":"2026-07-06T21:41:00.113637Z","submitted_at":"2025-06-12T13:07:54Z","title":"Description and Discussion on DCASE 2025 Challenge Task 4: Spatial Semantic Segmentation of Sound Scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10676","snapshot_observed_at":"2026-08-06T14:54:57.646321Z","title":"Description and discussion on dcase 2025 challenge task 4: Spatial semantic segmentation of sound scenes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.646321Z"},"links":{"cited_paper":"/paper/2506.10676","citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:d7d40a1574e59ec59016fae2956964bf3ffb2a4cbfb39c17332b5111ad6cec4f","observation_id":"aeae136c-be11-4c48-b2fa-9ceecc7f8af3","resolution":{"observed_at":"2026-08-06T14:54:57.646321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22088","last_updated":"2025-06-09T08:23:48Z","snapshot_observed_at":"2026-07-06T21:00:03.466241Z","submitted_at":"2025-03-28T02:08:58Z","title":"Baseline Systems and Evaluation Metrics for Spatial Semantic Segmentation of Sound Scenes","version":2},"cited_work":{"arxiv_id":"2503.22088","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.22088","snapshot_observed_at":"2026-08-06T14:54:57.750744Z","title":"Baseline Systems and Evaluation Metrics for Spatial Semantic Segmentation of Sound Scenes","venue":"eess.AS","work_id":"f3a01aef-ca19-49a6-974a-2cddf62e49de","year":2025},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.650288Z"},"links":{"cited_paper":"/paper/2503.22088","citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:4fac96a1e8288d653ecad18d7614e6a07b8bd14a55ab30fc3829afe8b5036984","observation_id":"2bcc9a40-804e-4fc0-aa55-6c7995bc76fd","resolution":{"observed_at":"2026-08-06T14:54:57.755997Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.918272Z","title":"Masked modeling duo: Towards a universal audio pre-training framework,","venue":null,"work_id":"03606dde-2081-4766-989e-ff24cee5c6a2","year":2024},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.653568Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:b5b981c7b6fb8437d9f0a05e4b789c3ba9a815598d47862ccf848c87ac223db8","observation_id":"512c634e-7df1-40aa-ac0d-59d6e1e8ea93","resolution":{"observed_at":"2026-08-06T14:54:57.921587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.909367Z","title":"Film: Visual reasoning with a general conditioning layer,","venue":null,"work_id":"c0cb2e4f-16fa-4321-85cd-725e6cb89e20","year":2018},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.660345Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:c5e58ba2e740fb808afec9b2424b38ff234d2f92c6170dd776bdbb8ac4a577c2","observation_id":"0d4f698a-9370-401d-bf00-c6b63cb27a84","resolution":{"observed_at":"2026-08-06T14:54:57.912535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.900553Z","title":"Transformer- aided audio source separation with temporal guidance and iterative refinement,","venue":null,"work_id":"758539f6-e271-4f45-8c4b-6dd534bbbfb7","year":2025},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.663744Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:b931124079a5d1cbb52738e462a5e058534925575fde54f40d7a5a9f436f2d16","observation_id":"b6deb0b9-ee48-4f6c-92fc-22572ab59747","resolution":{"observed_at":"2026-08-06T14:54:57.903720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.891794Z","title":"Effective pre-training of audio transformers for sound event detection,","venue":null,"work_id":"36d84cd0-28ae-4acc-860c-e662f4fbdf19","year":2025},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.667280Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:fc46c06fa97999f4e68c4e49e95fded9f73a148748c9f974ffb4f563f49e3db5","observation_id":"6f4101a4-6e10-4929-9966-ade7c9ebc198","resolution":{"observed_at":"2026-08-06T14:54:57.895035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.883007Z","title":"M2D-CLAP: masked modeling duo meets CLAP for learning general-purpose audio-language representation,","venue":null,"work_id":"09ea08d7-7486-40e0-acbb-be2d3b414cc7","year":2024},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.670447Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:5b75c22c9c7b2622269ce0b02f4fbab3b648c4ae8347ed29ec9afa14739fdbb4","observation_id":"b6bbc162-0746-4673-824d-094d3729d536","resolution":{"observed_at":"2026-08-06T14:54:57.886305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.874042Z","title":"Dual-path RNN: efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"ae07995f-9342-41b0-ad31-0cd78fda2f77","year":2020},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.673565Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:885b583b78d18deee2b57a46eef4bdc41c04dc5b1ce9cf3c7c223a11428a28ed","observation_id":"90a9b4b5-6272-4e7e-975d-7f7d263ce392","resolution":{"observed_at":"2026-08-06T14:54:57.877329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.865322Z","title":"Flowsep: Language-queried sound separation with rectified flow matching,","venue":null,"work_id":"4d658f4e-0f88-4d5f-83b9-7e789e45fc7b","year":2025},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.676641Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:63e4c5920de8fe5012cc49e39f2b501491606d71804b1e4d6a6b0680e1bbc748","observation_id":"b35ae643-ad75-403b-8d23-abb91a84814a","resolution":{"observed_at":"2026-08-06T14:54:57.868404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.856521Z","title":"Soundbeam meets m2d: Target sound extraction with audio foundation model,","venue":null,"work_id":"982f65ed-1881-4a42-8cb3-fe4cd8a699e0","year":2025},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.679712Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:42db39989f7896284e7b194d533c40e20485fd0ee178f997d2154a296d28ef23","observation_id":"a962532d-b940-404b-b4b5-8f11daf6be87","resolution":{"observed_at":"2026-08-06T14:54:57.859653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.847766Z","title":"Learning phrase representations using RNN encoder-decoder for statistical machine translation,","venue":null,"work_id":"ef5ad628-0fe4-4afc-bd77-c044aec01682","year":2014},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.682594Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:454dd400a6dec76388baae2e76bff8100eed70eff2fb91e86404423aa9dff3c6","observation_id":"eb849d78-80c4-4f5c-bb01-cf8ea11fb39d","resolution":{"observed_at":"2026-08-06T14:54:57.850935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.839217Z","title":"Spatial scaper: A library to simulate and augment soundscapes for sound event localization and detection in realistic rooms,","venue":null,"work_id":"ecce34ed-7587-410f-8387-bf6682068f37","year":2024},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.685545Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:e553e5c8593ab173af67bff7ff4aa1c115ef764d3fce15d179e0e9b775fd9552","observation_id":"71098065-a11d-4e28-b6eb-c47b556e2c4c","resolution":{"observed_at":"2026-08-06T14:54:57.842281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.830096Z","title":"FSD50K: an open dataset of human-labeled sound events,","venue":null,"work_id":"637cd730-c0cc-4eee-8ad7-090fd55a7d26","year":2022},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.689132Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:341d1d013484c22759bda3cf85fd59b337ce450798ba59e65d1dc9ff86cac002","observation_id":"dcfbe607-447e-4f04-ae5b-50966f276873","resolution":{"observed_at":"2026-08-06T14:54:57.833401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.821157Z","title":"EARS: an anechoic fullband speech dataset bench- marked for speech enhancement and dereverberation,","venue":null,"work_id":"bc13e8d6-d9ad-4dbe-80fd-b4632a89a2b5","year":2024},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.692120Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:0bd850a1ad41cca776edf4d143a8fdecaee0d121556c82d52945d8686bede3ba","observation_id":"588f3cf2-6340-4b63-9198-3f3285d30123","resolution":{"observed_at":"2026-08-06T14:54:57.824314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.812068Z","title":"Semantic hearing: Programming acoustic scenes with binaural hearables,","venue":null,"work_id":"8ba4294c-3094-4510-a17d-a57fb0b0c6fa","year":2023},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.695100Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:e667aa90d02abcfa252aa31970b611f13fa6cd77ec06324dba3faefe1611e059","observation_id":"2c5ce6e4-5594-4009-9af4-984ce57df855","resolution":{"observed_at":"2026-08-06T14:54:57.815213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.803461Z","title":"Echo-aware adaptation of sound event localization and detection in unknown environments,","venue":null,"work_id":"a81b05c8-d8df-4685-812f-ab4167e40448","year":2022},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.698175Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:4f4957b420c5541d4d1489e743486a248c0c973ef3fe2d2413a34d2dee73a4f7","observation_id":"2db95da1-e834-4640-9206-e89028c0aad9","resolution":{"observed_at":"2026-08-06T14:54:57.806437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.794687Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":"ee15b2c2-f856-4929-8734-1a79ff590823","year":2017},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.701120Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:81c811d920f3ccb20c1716c2e6388e2c8f35d623a0458b0d0985649eb8880f54","observation_id":"f51964ff-3b4b-4f2d-aa82-cb7c374fff90","resolution":{"observed_at":"2026-08-06T14:54:57.797654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.785941Z","title":"The benefit of temporally-strong labels in audio event classification,","venue":null,"work_id":"3e13e3f3-b613-4647-9b7e-32f3c1415072","year":2021},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.704137Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:a274017e11c92cf7cf1afe3ed340dd0f4f5c6ce4698b680bf508b0d23775d0dd","observation_id":"e3c673f5-ff01-4169-9149-33d039dcd8e9","resolution":{"observed_at":"2026-08-06T14:54:57.788872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.707141Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.707141Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:cbf37a5cda7e7c325406a8e2255ae6ea1825230c071e37ad4dbad691104d6a32","observation_id":"0665414c-508f-45e7-b4ac-fc7a6670fe8c","resolution":{"observed_at":"2026-08-06T14:54:57.707141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07447","last_updated":"2023-05-11T16:41:55Z","snapshot_observed_at":"2026-08-03T04:37:00.279223Z","submitted_at":"2023-05-11T16:41:55Z","title":"Universal Source Separation with Weakly Labelled Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07447","snapshot_observed_at":"2026-08-06T14:54:57.710087Z","title":"Universal source separation with weakly labelled data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.710087Z"},"links":{"cited_paper":"/paper/2305.07447","citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:856e8bd5546fe0840d6fa7df082d46d386320ec0b61041a5d11882dd51ed1cda","observation_id":"5f0cd77f-7cc8-4805-854d-382058b1b5dd","resolution":{"observed_at":"2026-08-06T14:54:57.710087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:54:57.771418Z","title":"Separate anything you describe,","venue":null,"work_id":"2755133d-9409-4d0a-b0f1-f5c217446087","year":2024},"citing_paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:54:57.714051Z"},"links":{"citing_paper":"/paper/2507.17297"},"observation_digest":"sha256:95b94a01ea0de5666ffe4edaa4701f33abe80561f4bbcfde78be0cfdf4edf851","observation_id":"58032927-4d92-4453-aa5e-5518b7953b0f","resolution":{"observed_at":"2026-08-06T14:54:57.774674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17297","last_updated":"2025-07-23T07:58:28Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T14:49:23.749860Z","submitted_at":"2025-07-23T07:58:28Z","title":"On Temporal Guidance and Iterative Refinement in Audio Source Separation"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2507.17297."}