{"as_of":"2026-08-23T17:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea6efe9517ecccca11c2159e40c16bf7586673ac2c27ed6cb7bc3c650ac3635d","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:17:06.447689Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.12385/citation-record","integrity":"/paper/2501.12385/integrity","json":"/paper/2501.12385/citation-record.json","paper":"/paper/2501.12385"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.971247Z","title":"Sound texture perception via statistics of the auditory periphery: evidence from sound synthesis,","venue":null,"work_id":"31eb7c05-d1fc-451c-b3f3-bbecfd26dc93","year":2011},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.279656Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:7a309a42b5a8cdf290c341dcb98d816fd900e58eadfa75fc736ff70e8a71abed","observation_id":"dba73111-c562-477b-90e5-0196281713d5","resolution":{"observed_at":"2026-08-10T17:17:06.975454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.957432Z","title":"Trends in audio texture analysis, synthesis, and applications,","venue":null,"work_id":"addd3bb2-8ad3-4986-9b69-2ea7f572e091","year":2022},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.284888Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:11bbad2188f6a3a2665d5bdc532ee02d796a870af83db68eb7707a84c0ab4dac","observation_id":"8355990b-e99a-4806-b156-c60f2c1db737","resolution":{"observed_at":"2026-08-10T17:17:06.962179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.944609Z","title":"V oco: Text- based insertion and replacement in audio narration,","venue":null,"work_id":"c2b6dd4c-b70a-497c-83da-debed87f13dc","year":2017},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.288965Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:fa1e93623410e2a28e33197c4f1bed4b8f637824b7f59b8cb287ff32127b6679","observation_id":"90d559bc-19ae-4a58-a153-8a05fdde2af4","resolution":{"observed_at":"2026-08-10T17:17:06.949441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.930309Z","title":"Audit: Audio editing by following instructions with latent diffusion models,","venue":null,"work_id":"50e76255-2b04-4125-88d0-614ed09b4ede","year":2023},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.293075Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:de86dec17aca4ac3dab4a3bc0521f63817435e06f1d89cb786d395b7824a51f8","observation_id":"0741dddb-3e73-4a9d-926b-1899018e31c7","resolution":{"observed_at":"2026-08-10T17:17:06.935964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.13504","last_updated":"2021-10-26T08:56:09Z","snapshot_observed_at":"2026-08-20T11:42:00.272573Z","submitted_at":"2021-10-26T08:56:09Z","title":"Managing Bias in Human-Annotated Data: Moving Beyond Bias Removal","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.13504","snapshot_observed_at":"2026-08-10T17:17:06.297449Z","title":"Managing bias in human-annotated data: Moving beyond bias removal,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.297449Z"},"links":{"cited_paper":"/paper/2110.13504","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:c0494ca77e713ebbe850078f25b18022d15dd02a6ece54db82129841bf94ef6a","observation_id":"c354540c-b648-4c82-8dfa-7ce14a73b79d","resolution":{"observed_at":"2026-08-10T17:17:06.297449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.915482Z","title":"Bbc sound effects,","venue":null,"work_id":"13876a69-4fe7-4ef5-8110-0dc2938b8f45","year":2017},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.302227Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:3e01aa03c8121fbf5a140c356335ebbd4f053cc3de1f5ca470ab3adc82fdb10e","observation_id":"070f24db-b634-4ac3-a74e-fef3ed02720c","resolution":{"observed_at":"2026-08-10T17:17:06.920355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.901241Z","title":"Skousen, Analogical modeling of language","venue":null,"work_id":"222b4679-1e77-4b25-bf33-ac40ad3d87aa","year":2012},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.306504Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:299f64ec32e4f097a519f6f4439a504ba94f9e05182e58b3408cd8b94b1a7d7e","observation_id":"e827441f-44e6-48ec-8110-23b16cdacfc2","resolution":{"observed_at":"2026-08-10T17:17:06.905811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.887025Z","title":"Image analogies,","venue":null,"work_id":"01886319-0cc0-4249-811f-740a22f28d09","year":2001},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.310312Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:21fb4fffc5895cea001fd1bd65cf11c5ae5a9022205a49fff299a0e5863de327","observation_id":"7c23807e-c103-4c0b-bb7d-e468456bf592","resolution":{"observed_at":"2026-08-10T17:17:06.891545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.872632Z","title":"Vi- sual prompting via image inpainting,","venue":null,"work_id":"6797c5d8-7f19-4eb2-a881-47dd8728db12","year":2022},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.314283Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:637d0b45ff0887e4d83dc354a91a999115474b281159e8f180bb583fc405f16b","observation_id":"3db4817a-450a-47b9-ab68-b24d8da4ac90","resolution":{"observed_at":"2026-08-10T17:17:06.877305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.858535Z","title":"Sequential modeling enables scalable learning for large vision models,","venue":null,"work_id":"dd2a26c2-9255-48cc-bf36-1504e66bd20e","year":2024},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.319021Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:99df0e12075a1e9e08c071dbb2487cb5f7eca883380af25428755ddfe829e483","observation_id":"7e8a3c7e-b86d-447f-960b-b5457090ebfd","resolution":{"observed_at":"2026-08-10T17:17:06.863883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.846451Z","title":"Conditional generation of audio from video via foley analogies,","venue":null,"work_id":"69cf86b4-f484-4558-9d41-aa34ba5aab39","year":2023},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.323408Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:86f1aa8fe59cfcea2192d37eee327b0fae1395345e4d5f282cb5ce66fbb85a16","observation_id":"953b1fef-31f4-40a8-8c7b-a52b199fd555","resolution":{"observed_at":"2026-08-10T17:17:06.850486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.834471Z","title":"Self- supervised audio-visual soundscape stylization,","venue":null,"work_id":"7bc34f5c-3e38-476a-bf13-dd89ff8e6237","year":2024},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.328038Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:57ccadd8a7e8177d2ef3b5f5f6cdfaa45d3c87b278235760f92924fa452cd314","observation_id":"deb1081b-b0f9-40a0-ad22-3cb180579051","resolution":{"observed_at":"2026-08-10T17:17:06.838254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.332228Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.332228Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:e31b49331910c7de6e9fe9c08b07e8b542b14cf616ccfbd69c4757629562f4cc","observation_id":"8e09ca28-7751-4235-b6cd-f5a1b66c1e7e","resolution":{"observed_at":"2026-08-10T17:17:06.332228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-10T17:17:06.336270Z","title":"Automatic chain of thought prompting in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.336270Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:7d6b11f64e5052df7249a4c6e3409982af1f32cc525c0083fb9ae3d9eeb1c688","observation_id":"1ee38e79-a304-40ab-8941-5ca32168237e","resolution":{"observed_at":"2026-08-10T17:17:06.336270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01714","last_updated":"2024-03-09T05:54:39Z","snapshot_observed_at":"2026-08-16T14:55:39.362326Z","submitted_at":"2023-10-03T00:57:26Z","title":"Large Language Models as Analogical Reasoners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01714","snapshot_observed_at":"2026-08-10T17:17:06.341038Z","title":"Large language models as analogical reasoners,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.341038Z"},"links":{"cited_paper":"/paper/2310.01714","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:897b1455ec0de115cb8cbac4cc6a18413f2d9548629f60b9d14bd3e186bc9466","observation_id":"c0d1e10f-7dc1-4e12-85b1-18076618c1b0","resolution":{"observed_at":"2026-08-10T17:17:06.341038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.345717Z","title":"Librispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.345717Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:9b46874ad63cf63f80a27a6a424279fbdd9b2a40955d13a4b2c009e3d202d619","observation_id":"08e938f0-3e5d-405d-ba2f-d4e7b1288a99","resolution":{"observed_at":"2026-08-10T17:17:06.345717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.350035Z","title":"CSTR VCTK Corpus: English Multi-speaker Corpus for CSTR V oice Cloning Toolkit,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.350035Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:e5848d35e6ee27822b3aaba3d234b56cc16bb73cabd18e2ce15dc57edd0d8f2a","observation_id":"79140780-43e0-4da5-ad67-f5e1335ad3e6","resolution":{"observed_at":"2026-08-10T17:17:06.350035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.354427Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.354427Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:ec848ff228a57c5276dd960370a45a7eff833b6db01b311776b93246878aeb6a","observation_id":"77f0ee40-bf38-415d-b78a-21bf65e8dcc2","resolution":{"observed_at":"2026-08-10T17:17:06.354427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.358617Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.358617Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:67a3f243bf82c47f2770985799cf9238c8f52e41083207d8d2219066814edc72","observation_id":"ece2e145-4857-4f14-897c-42287d57d6bf","resolution":{"observed_at":"2026-08-10T17:17:06.358617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-10T17:17:06.362842Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.362842Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:1408159525049c2863b57bc1c790fda4c824004efae6758989da2b881671cc99","observation_id":"3e6c975e-1dc9-4f0a-a6f2-0be6fc2af013","resolution":{"observed_at":"2026-08-10T17:17:06.362842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.369188Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.369188Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:b2cae4c2293f8e7714144a767ef2a5d106cbd22f561f7804b7f54c61a44e52ef","observation_id":"4ca39ca1-db57-470b-9625-5627cc923005","resolution":{"observed_at":"2026-08-10T17:17:06.369188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-10T17:17:06.374003Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.374003Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:32d41f9bdc80998bfbb8b4dc6a0689fecd358cbed644eef2df0438a1a12578bb","observation_id":"092653a6-7995-4984-b2e7-13e70a450635","resolution":{"observed_at":"2026-08-10T17:17:06.374003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.778296Z","title":"A scale for the measurement of the psychological magnitude pitch,","venue":null,"work_id":"5b91c6de-ee7e-4059-974d-db03ffeaa78b","year":1937},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.378658Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:b9fb6b0da1d50eaed7201ae20f92b2a5d75f956100c9cee0092a87f7d29b7e91","observation_id":"58b1e05e-880a-4f73-b229-528cbb90e8cd","resolution":{"observed_at":"2026-08-10T17:17:06.782256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12503","last_updated":"2023-09-09T15:27:58Z","snapshot_observed_at":"2026-08-16T15:59:22.404915Z","submitted_at":"2023-01-29T17:48:17Z","title":"AudioLDM: Text-to-Audio Generation with Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12503","snapshot_observed_at":"2026-08-10T17:17:06.382944Z","title":"Audioldm: Text-to-audio generation with latent diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.382944Z"},"links":{"cited_paper":"/paper/2301.12503","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:3b6d065f19c60b4782e74923a1ca8928a37d57a898855d93228062ee8319dfa8","observation_id":"8d25bb7a-1ee0-4d4f-a945-e75fbde4bcc9","resolution":{"observed_at":"2026-08-10T17:17:06.382944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.763898Z","title":"Clap learning audio concepts from natural language supervision,","venue":null,"work_id":"f138a447-e361-47d6-b066-9cbcbefe023d","year":2023},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.387722Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:a0c87d6797d590b83171a8070c137c723934a6136c5483bf6ff2f7b9b2844eef","observation_id":"7d0cf53f-a518-4393-8a90-89dc2419d957","resolution":{"observed_at":"2026-08-10T17:17:06.768924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.392109Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.392109Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:ca5809c544cd5255101ba155f9df6939aca4d9814748d60aa5d7511bbb042d05","observation_id":"109b07a8-0c36-42ec-9a08-019372b438c6","resolution":{"observed_at":"2026-08-10T17:17:06.392109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T17:17:06.395952Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.395952Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:7ceefc47fe2bd86e700dfd412f0bea8d70a662b6e8f17fd452e572cb92a03d3b","observation_id":"bd251a3a-f09c-4cea-8bea-212ff35e08fb","resolution":{"observed_at":"2026-08-10T17:17:06.395952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-10T17:17:06.400412Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.400412Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:d964948f66e0251d6ea641e12d62c9d5e97318ae9c55276aee8bb793440e0be2","observation_id":"9b0429b6-591a-47d0-af36-f87645e7f6d6","resolution":{"observed_at":"2026-08-10T17:17:06.400412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.405895Z","title":"Hifi-gan: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.405895Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:1fe6ded8e0da012b6e339da64d66884c0dc45368cdb08eaefffc38a07b3dc449","observation_id":"1fce8bd7-18e0-4888-87bf-a6757c9d5fbf","resolution":{"observed_at":"2026-08-10T17:17:06.405895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.732338Z","title":"Audiocaps: Generating captions for audios in the wild,","venue":null,"work_id":"a8b01993-7d98-4610-85a2-2bfcca9a5901","year":2019},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.409892Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:3729f3f19b2b06469dc270d8db75c21926821cfe3b2a2ca730c35308b1a199e6","observation_id":"1e8fb66d-2ade-4bc9-9cc1-7d1edfce176b","resolution":{"observed_at":"2026-08-10T17:17:06.737043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.413446Z","title":"Audio set: An ontology and human- labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.413446Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:1958cbbe1d2259444d65f8e1691dccb99453cadb6c5a74fa902710996b7f9e9c","observation_id":"6c24a387-d14e-431e-8ed5-3845b3a68e95","resolution":{"observed_at":"2026-08-10T17:17:06.413446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.709991Z","title":"Fsd50k: an open dataset of human-labeled sound events,","venue":null,"work_id":"f8b1978c-076a-4760-ae45-712ece27fb3d","year":2021},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.417056Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:a1d85f6dcc0f21ee3712d70c612c3bfb05d956b1d43a3ce84a28c0eda09f8314","observation_id":"d5699b0a-85d9-446f-bf24-abb025305e42","resolution":{"observed_at":"2026-08-10T17:17:06.714818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.420580Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.420580Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:a05dc3f34ab619b7867bd8f7c4f69a339a972e67f0fa54969fdad80d571e5a1e","observation_id":"b3088c44-961e-4ffa-ba0d-b5466277e16d","resolution":{"observed_at":"2026-08-10T17:17:06.420580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T17:17:06.423952Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.423952Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:64357e8aafd17f6e41f7f5f5ad8ec1bd16d16c759448dc30a5ceb1a458f248c1","observation_id":"25b0b86a-aa13-4b11-b249-db2e7126c307","resolution":{"observed_at":"2026-08-10T17:17:06.423952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-15T08:25:11.276003Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-10T17:17:06.427676Z","title":"Fr \\’echet audio distance: A metric for evaluating music enhancement algorithms,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.427676Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:40f151f4e8660e28248aa2cc275c0d61fb0ea8e0e8aa78477aa68ef38999f29b","observation_id":"651c548c-1ff9-40d3-a491-94bd63c62a17","resolution":{"observed_at":"2026-08-10T17:17:06.427676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.431360Z","title":"On information and sufficiency,","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.431360Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:6dd2ca0e632eb5f3c60803df8ea588d6fd18520b2bbd91d8d23c0cbbfc042349","observation_id":"f6f8660d-c7ff-482f-bbbd-2236627ffc73","resolution":{"observed_at":"2026-08-10T17:17:06.431360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.434927Z","title":"Per- ceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.434927Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:9ca71babc4fc17c347ce195ca42867351a9442017165b5e690dfb5b5f84accb7","observation_id":"e38a0b8c-b397-49d1-9722-81f8c42e4a74","resolution":{"observed_at":"2026-08-10T17:17:06.434927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.666721Z","title":"A short- time objective intelligibility measure for time-frequency weighted noisy speech,","venue":null,"work_id":"53f9527d-ea1b-4bb8-a6fa-5fd3ec0768cc","year":2010},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.439258Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:3b7db0becc272dc01681a4afa14d29ef10cf5da559a751d189ff6c6a1f198e3a","observation_id":"1a8f1079-8eb9-4f85-9740-eac669f8f195","resolution":{"observed_at":"2026-08-10T17:17:06.673091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13686","last_updated":"2023-05-23T04:48:51Z","snapshot_observed_at":"2026-08-18T11:37:40.512558Z","submitted_at":"2023-05-23T04:48:51Z","title":"MP-SENet: A Speech Enhancement Model with Parallel Denoising of Magnitude and Phase Spectra","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13686","snapshot_observed_at":"2026-08-10T17:17:06.443302Z","title":"Mp-senet: A speech enhancement model with parallel denoising of magnitude and phase spectra,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.443302Z"},"links":{"cited_paper":"/paper/2305.13686","citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:ae061745dd58494bdb9f52e9b36b48c4a0c8d9e149ab4a06988d2ddddc64ba07","observation_id":"32c221c0-e6b8-4b28-beee-906f4a445d2f","resolution":{"observed_at":"2026-08-10T17:17:06.443302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:17:06.447689Z","title":"Investi- gating rnn-based speech enhancement methods for noise-robust text-to- speech","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T17:17:06.447689Z"},"links":{"citing_paper":"/paper/2501.12385"},"observation_digest":"sha256:a86329ce6e15d24b2dcc9d0e0550d835b7953e0b896e8837216f31b26bf1ec9f","observation_id":"fc6bf479-ab32-4818-a178-6460ca578c38","resolution":{"observed_at":"2026-08-10T17:17:06.447689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.12385","last_updated":"2025-01-21T18:58:38Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-17T23:54:53.778676Z","submitted_at":"2025-01-21T18:58:38Z","title":"Audio Texture Manipulation by Exemplar-Based Analogy"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2501.12385."}