{"as_of":"2026-08-17T15:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:35b7459a0326d91a85f1f516401faca0bf4af1beb8fdc714e3c288452b5ea995","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:37:49.997321Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T13:28:18.721905Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-12T16:37:25.334264Z","title":"Diff- tts: A denoising diffusion model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.13314","last_updated":"2025-09-03T04:42:41Z","snapshot_observed_at":"2026-08-15T14:12:02.506966Z","submitted_at":"2024-11-20T13:28:42Z","title":"I2TTS: Image-indicated Immersive Text-to-speech Synthesis with Spatial Perception","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T16:37:25.334264Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2411.13314"},"observation_digest":"sha256:aaca4d58ef2195c321bc9f5de463ae935620fac95196ecd25da0121dcdd0cb68","observation_id":"69b0d3b4-99c5-4976-9e38-e90db2844ca6","resolution":{"observed_at":"2026-08-12T16:37:25.334264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-11T20:18:10.455465Z","title":"Diff-tts: A denoising diffusion model for text-to-speech","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.05926","last_updated":"2024-12-08T12:45:21Z","snapshot_observed_at":"2026-08-16T08:40:17.255784Z","submitted_at":"2024-12-08T12:45:21Z","title":"BiDM: Pushing the Limit of Quantization for Diffusion Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:18:10.455465Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2412.05926"},"observation_digest":"sha256:a5b7d74d0c93866b3a48ccf2de8747c4b827db224d36508d3232dd6832867cd6","observation_id":"a71b7461-2d48-43c5-b9e0-0ccf15f548ad","resolution":{"observed_at":"2026-08-11T20:18:10.455465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-11T14:59:27.629372Z","title":"Diff-tts: A denois- ing diffusion model for text-to-speech","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11441","last_updated":"2025-02-28T04:36:39Z","snapshot_observed_at":"2026-08-14T22:25:09.087407Z","submitted_at":"2024-12-16T04:47:55Z","title":"UIBDiffusion: Universal Imperceptible Backdoor Attack for Diffusion Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:27.629372Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2412.11441"},"observation_digest":"sha256:b8a24914b03e4da6958569761881c34988013a4818ce570a865dfca62aab87f6","observation_id":"25d5390d-fcd5-4d57-bfbf-717db62961ca","resolution":{"observed_at":"2026-08-11T14:59:27.629372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-09T16:43:08.742096Z","title":"Diff-tts: A denoising diffusion model for text-to-speech","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01084","last_updated":"2025-02-13T09:25:03Z","snapshot_observed_at":"2026-08-12T14:31:13.290515Z","submitted_at":"2025-02-03T05:53:59Z","title":"Continuous Autoregressive Modeling with Stochastic Monotonic Alignment for Speech Synthesis","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T16:43:08.742096Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2502.01084"},"observation_digest":"sha256:8af95ebe32cf7082c3c1bcf80bfe20357db1b22e22d0e7a4698783ba8cbfaaa0","observation_id":"caa7e61c-5546-4f50-bd15-c1fdc9ccb94e","resolution":{"observed_at":"2026-08-09T16:43:08.742096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-08T21:12:22.491013Z","title":"Diff-tts: A denoising diffusion model for text-to- speech","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-16T11:25:04.356690Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:22.491013Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:668bead9131aaa3571b1037bced985383d9504ccc4307d6b51d2bbd3c8f2b337","observation_id":"f2ba1678-4716-4563-8a31-4ac646a617a2","resolution":{"observed_at":"2026-08-08T21:12:22.491013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-16T05:37:49.997321Z","title":"Diff- TTS: A denoising diffusion model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20334","last_updated":"2025-05-02T04:16:24Z","snapshot_observed_at":"2026-08-16T05:29:27.313404Z","submitted_at":"2025-04-29T00:54:15Z","title":"Towards Flow-Matching-based TTS without Classifier-Free Guidance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:37:49.997321Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2504.20334"},"observation_digest":"sha256:84c8d03d42058ea2ed13067ff8b03c00ad6a5b98c08f35f9817c502c8f7ecec9","observation_id":"28eeff79-995a-4718-8680-a967211824a5","resolution":{"observed_at":"2026-08-16T05:37:49.997321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-16T01:03:14.125761Z","title":"Myeonghun Jeong, Hyeongju Kim, Sung Jun Cheon, Byoung Jin Choi, and Nam Soo Kim","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.04639","last_updated":"2025-05-04T23:23:46Z","snapshot_observed_at":"2026-08-17T12:38:26.769357Z","submitted_at":"2025-05-04T23:23:46Z","title":"Language translation, and change of accent for speech-to-speech task using diffusion model","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T01:03:14.125761Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2505.04639"},"observation_digest":"sha256:3f0bb631bbc6e264ecc610212b63aa701c888cd2ba2ca679bcdd4d06bd66acbb","observation_id":"beb6ccda-a997-4dd8-86b0-3ae4f7f25889","resolution":{"observed_at":"2026-08-16T01:03:14.125761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-15T20:26:52.676400Z","title":"Jeong, H","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13131","last_updated":"2025-05-19T14:00:17Z","snapshot_observed_at":"2026-08-16T15:58:20.235973Z","submitted_at":"2025-05-19T14:00:17Z","title":"Constraint-Aware Diffusion Guidance for Robotics: Real-Time Obstacle Avoidance for Autonomous Racing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:26:52.676400Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2505.13131"},"observation_digest":"sha256:e5537ab6250ef3490ed58415b9dce3827e9890c1a32acae9eaa6ae72da4caebe","observation_id":"48f9d036-8c4d-4757-b766-4d72b26dd8fb","resolution":{"observed_at":"2026-08-15T20:26:52.676400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-07T14:25:01.278354Z","title":"Diff-tts: A denoising diffusion model for text-to-speech","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19119","last_updated":"2025-05-25T12:22:00Z","snapshot_observed_at":"2026-08-09T08:08:38.091653Z","submitted_at":"2025-05-25T12:22:00Z","title":"CloneShield: A Framework for Universal Perturbation Against Zero-Shot Voice Cloning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:25:01.278354Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2505.19119"},"observation_digest":"sha256:c03275d0b82f05366346cffed6e00c7dfacd5634eab64e280d0a3fb6c44719ff","observation_id":"f6e01e88-bcb3-4361-aba5-afa975df48de","resolution":{"observed_at":"2026-08-07T14:25:01.278354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-04T19:11:59.528332Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09748","last_updated":"2025-09-11T12:32:08Z","snapshot_observed_at":"2026-08-16T14:03:25.998004Z","submitted_at":"2025-09-11T12:32:08Z","title":"DiTReducio: A Training-Free Acceleration for DiT-Based TTS via Progressive Calibration","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T19:11:59.528332Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2509.09748"},"observation_digest":"sha256:b05926fcd80808ec96c94e0f7abd57443281fdeadc175539f606acfff30f1567","observation_id":"c636cfa4-0e30-4c23-86b8-2db483dbb3c3","resolution":{"observed_at":"2026-08-04T19:11:59.528332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":"2104.01409","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-07-03T13:28:18.721905Z","title":"Diff- tts: A denoising diffusion model for text-to-speech","venue":null,"work_id":"b784490d-242f-43ad-9192-c6711f0ac2b1","year":2021},"citing_paper":{"arxiv_id":"2510.21783","last_updated":"2026-04-17T15:10:02Z","snapshot_observed_at":"2026-08-15T02:46:25.172420Z","submitted_at":"2025-10-18T16:28:48Z","title":"Noise Aggregation Analysis Driven by Small-Noise Injection: Efficient Membership Inference for Diffusion Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T06:02:41.596562Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2510.21783"},"observation_digest":"sha256:67221bdbf590d6600fd66b091246b9903362b1a736785fa47895139f94a0d6db","observation_id":"6046f9ba-f728-4514-a924-9f35f1ed279c","resolution":{"observed_at":"2026-05-18T06:05:57.947285Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":"2104.01409","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-07-03T13:28:18.721905Z","title":"Diff- tts: A denoising diffusion model for text-to-speech","venue":null,"work_id":"b784490d-242f-43ad-9192-c6711f0ac2b1","year":2021},"citing_paper":{"arxiv_id":"2604.06327","last_updated":"2026-04-07T18:05:28Z","snapshot_observed_at":"2026-08-13T15:12:14.664753Z","submitted_at":"2026-04-07T18:05:28Z","title":"A Novel Automatic Framework for Speaker Drift Detection in Synthesized Speech","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:24:54.627215Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2604.06327"},"observation_digest":"sha256:e5e275092fb5603007be99385968c50fedc19a48a7623c352f9d7372c4f25e52","observation_id":"eedb4db5-9011-4342-8c38-b03710722572","resolution":{"observed_at":"2026-05-11T00:41:00.776378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":"2104.01409","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-07-03T13:28:18.721905Z","title":"Diff- tts: A denoising diffusion model for text-to-speech","venue":null,"work_id":"b784490d-242f-43ad-9192-c6711f0ac2b1","year":2021},"citing_paper":{"arxiv_id":"2604.24416","last_updated":"2026-04-27T12:45:18Z","snapshot_observed_at":"2026-08-16T23:04:20.752839Z","submitted_at":"2026-04-27T12:45:18Z","title":"Scaling Properties of Continuous Diffusion Spoken Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T03:43:10.132447Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2604.24416"},"observation_digest":"sha256:77f2f5f24e14d467fb448c2672489dfd7ac9d32c22f2918ae1b52c9cd3d2a47e","observation_id":"5070c683-7319-4e9e-9a25-75b95cf08c01","resolution":{"observed_at":"2026-05-11T21:56:28.056125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":"2104.01409","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-07-03T13:28:18.721905Z","title":"Diff- tts: A denoising diffusion model for text-to-speech","venue":null,"work_id":"b784490d-242f-43ad-9192-c6711f0ac2b1","year":2021},"citing_paper":{"arxiv_id":"2606.03455","last_updated":"2026-06-02T10:33:20Z","snapshot_observed_at":"2026-08-05T18:48:21.902772Z","submitted_at":"2026-06-02T10:33:20Z","title":"WavTTS: Towards High-Quality Zero-Shot TTS via Direct Raw Waveform Modeling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T08:18:42.002083Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2606.03455"},"observation_digest":"sha256:85f45a854e0c48e3af4ccfdbd07093b4aa1929f8cd3d18262820878d86488590","observation_id":"1548522f-cae0-4606-8915-4cccf0898484","resolution":{"observed_at":"2026-07-02T05:16:39.812312Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":"2104.01409","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-07-03T13:28:18.721905Z","title":"Diff- tts: A denoising diffusion model for text-to-speech","venue":null,"work_id":"b784490d-242f-43ad-9192-c6711f0ac2b1","year":2021},"citing_paper":{"arxiv_id":"2606.12555","last_updated":"2026-07-02T19:10:03Z","snapshot_observed_at":"2026-07-12T14:16:32.755376Z","submitted_at":"2026-06-10T18:06:27Z","title":"AudioX-Turbo: A Unified Framework for Efficient Anything-to-Audio Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-27T08:04:48.283908Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2606.12555"},"observation_digest":"sha256:3a5fb4681aa5ed0d41033f9a97d65aef5c4c6c3158209de38ea74a0d2f62ad3d","observation_id":"61d39f3b-6218-466b-b649-3ce44a09eabf","resolution":{"observed_at":"2026-07-03T13:28:18.723282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01409","snapshot_observed_at":"2026-08-01T10:45:21.609565Z","title":"The recur- rent tsetlin machine,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20124","last_updated":"2026-07-22T13:28:28Z","snapshot_observed_at":"2026-08-12T20:10:45.790989Z","submitted_at":"2026-07-22T13:28:28Z","title":"Autonomous Collaborative Learning Among an Ensemble of Tsetlin Machines with Consensus-Based Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T10:45:21.609565Z"},"links":{"cited_paper":"/paper/2104.01409","citing_paper":"/paper/2607.20124"},"observation_digest":"sha256:fd4ea0729a3a64150b502485fb974602d766c7a57b89c9774fd78ea18e5376ca","observation_id":"581e6858-b141-4dce-ad42-fa3ef2d7af1e","resolution":{"observed_at":"2026-08-01T10:45:21.609565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2104.01409/citation-record","integrity":"/paper/2104.01409/integrity","json":"/paper/2104.01409/citation-record.json","paper":"/paper/2104.01409"},"outbound":[],"paper":{"arxiv_id":"2104.01409","last_updated":"2021-04-03T13:53:19Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-16T18:34:05.074693Z","submitted_at":"2021-04-03T13:53:19Z","title":"Diff-TTS: A Denoising Diffusion Model for Text-to-Speech"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2104.01409."}