{"as_of":"2026-08-07T11:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a254aa25d5c7d03b9cd00a8be618ca1facb020c483c3ad2d4a6094c5539f0349","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:01:35.504834Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:01:35.389936Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:01:35.649189Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2507.08012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08012","snapshot_observed_at":"2026-08-06T20:01:35.649189Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","venue":"cs.CL","work_id":"47a4d182-3aae-442b-b1fe-32de9dcc5cf6","year":2025},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.389936Z"},"links":{"cited_paper":"/paper/2507.08012","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:99ef5c63bc75b40fc8eb6c388b1435cb0ae3ac38ea1f1e68eb94c062cbcbefe1","observation_id":"88c4474d-38bd-4648-9b9d-8edf46eaec14","resolution":{"observed_at":"2026-08-06T20:01:35.653217Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.08012/citation-record","integrity":"/paper/2507.08012/integrity","json":"/paper/2507.08012/citation-record.json","paper":"/paper/2507.08012"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.919508Z","title":"Given text, TTS models pre- dict a probable speech rendition under the statistics of the train- ing data","venue":null,"work_id":"819839b6-433e-4d3f-a64a-855add81925f","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.385645Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:8501d14cd5d7cf905b7895b60e30aaa2d16a25563668583e32c107ce7c684f8d","observation_id":"3af133f6-c2b7-49c2-88d6-ff2680602b7b","resolution":{"observed_at":"2026-08-06T20:01:35.922910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2507.08012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08012","snapshot_observed_at":"2026-08-06T20:01:35.649189Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","venue":"cs.CL","work_id":"47a4d182-3aae-442b-b1fe-32de9dcc5cf6","year":2025},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.389936Z"},"links":{"cited_paper":"/paper/2507.08012","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:99ef5c63bc75b40fc8eb6c388b1435cb0ae3ac38ea1f1e68eb94c062cbcbefe1","observation_id":"88c4474d-38bd-4648-9b9d-8edf46eaec14","resolution":{"observed_at":"2026-08-06T20:01:35.653217Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.908682Z","title":"Sections 3.1-3.2 discuss which TTS architecture, training data, and utterance representations we use to support the model analysis","venue":null,"work_id":"c15bd663-423f-40b8-a7db-3cab2fe49704","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.394620Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:7d6622a7f55a223d1c456bb5c623cae7217d88b9c7f3fbee8f7bbd0c5d1cfc01","observation_id":"8c2cff13-0060-4fcc-8a7c-60fc6acf4401","resolution":{"observed_at":"2026-08-06T20:01:35.912375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.887113Z","title":null,"venue":null,"work_id":"7792fc0a-aaf4-4635-9b28-5e0ad0f80243","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.402284Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:fd5ea908a136ff1767205240ce8fcc8d930625a7ff1729b47841bf4b8dad1bc1","observation_id":"4ce67f57-cfef-405c-bedf-c68ac945336f","resolution":{"observed_at":"2026-08-06T20:01:35.890387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.866081Z","title":null,"venue":null,"work_id":"767e5025-d92b-4512-80f4-2e052c8fe6d0","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.409780Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:af85908929d351a2153ee98842242f4c526b4aa3b798661b376dcf8818990c2a","observation_id":"7b679e89-c1a3-4ef3-a7ca-e8cb0841a153","resolution":{"observed_at":"2026-08-06T20:01:35.869302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.876392Z","title":"We then re-label the In- grid subset again according to cosine distance to cluster means","venue":null,"work_id":"debf25ff-c653-4faf-8680-10e0d953692b","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.405881Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:cfc82285e421d8034a6326238b7d7c5f3956d51b952c95677a17fef7857de874","observation_id":"a4333fd1-0af5-4cf4-91dc-988573f30063","resolution":{"observed_at":"2026-08-06T20:01:35.880082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.01891","last_updated":"2021-05-05T06:49:21Z","snapshot_observed_at":"2026-07-06T11:06:25.130394Z","submitted_at":"2021-05-05T06:49:21Z","title":"Exploring emotional prototypes in a high dimensional TTS latent space","version":1},"cited_work":{"arxiv_id":"2105.01891","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.01891","snapshot_observed_at":"2026-08-06T20:01:35.601725Z","title":"Exploring emotional prototypes in a high dimensional TTS latent space","venue":"cs.HC","work_id":"febb0749-f018-45ae-81bc-73f2d6bfe4e4","year":2021},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.438717Z"},"links":{"cited_paper":"/paper/2105.01891","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:44449b8028ff3d1e53b7f33dfaa3472b0d448c6c7a67d9f40efa72f21e0f896b","observation_id":"6b6c151b-76ca-4492-be8a-f26e45229c8d","resolution":{"observed_at":"2026-08-06T20:01:35.607446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.855243Z","title":null,"venue":null,"work_id":"a384e2e9-308d-441d-8989-496b3e5c6f08","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.413785Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:e2be3b2a08018816c7e31d1ca24e985f166b6b111f1ef241852c50cec3b5eda2","observation_id":"c94b6108-59d4-4e77-935d-610ada287b22","resolution":{"observed_at":"2026-08-06T20:01:35.858954Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.843581Z","title":"To- wards end-to-end prosody transfer for expressive speech synthesis with tacotron,","venue":null,"work_id":"51cef31e-17b5-44d3-b995-36e7639482b1","year":2018},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.417178Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:7fa296863417262f10bec7e59585bb21dd303bffd7c9e185f70fc3cd296c02e0","observation_id":"94a2c64b-5d1f-4484-a148-3304c3639bd9","resolution":{"observed_at":"2026-08-06T20:01:35.847501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04558","last_updated":"2022-08-08T01:53:05Z","snapshot_observed_at":"2026-08-06T18:05:37.673476Z","submitted_at":"2020-06-08T13:05:40Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04558","snapshot_observed_at":"2026-08-06T20:01:35.420849Z","title":"Fastspeech 2: Fast and high-quality end-to-end text to speech,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.420849Z"},"links":{"cited_paper":"/paper/2006.04558","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:5822789dca26f3539442193f5d634f129046635db56fc06acd805a117eccba51","observation_id":"5402b3f9-b82d-4aa5-aab3-8a802652788f","resolution":{"observed_at":"2026-08-06T20:01:35.420849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.832579Z","title":"Natural language guidance of high-fidelity text-to-speech with synthetic annotations,","venue":null,"work_id":"60394260-58b3-4745-aedb-f82fdfd2f91d","year":2024},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.424834Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:35b118b198e75a59036c3e71ea11db4c8a9d7dccca247deb2ba471628d2ef97f","observation_id":"53dbecd0-8f35-48b7-aaca-31c666ea434c","resolution":{"observed_at":"2026-08-06T20:01:35.836321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.897613Z","title":"The names of those speakers can be included in the description prompt to re- call the chosen speaker identity","venue":null,"work_id":"47f76125-c485-41ca-8e97-9479ba679767","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.398527Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:93d8fa659018240d50ef55830b73cd983da1a2c625989c27c402382632d77104","observation_id":"b5b1c51d-808c-472d-99d0-ca7d6bba8d5b","resolution":{"observed_at":"2026-08-06T20:01:35.901498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.821620Z","title":"Fastspeech: Fast, robust and controllable text to speech,","venue":null,"work_id":"6562e14e-af47-48e0-a937-9b9db834d9d7","year":2019},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.428467Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:eb141b3950243cbb6ceb5c262501ed133c42ad05565a956684787955d3f04951","observation_id":"81d55187-f1d4-4972-b8dc-11b4a421fe3d","resolution":{"observed_at":"2026-08-06T20:01:35.825223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.810355Z","title":"A human-in-the-loop approach to improving cross-text prosody transfer","venue":null,"work_id":"caffbbb8-2758-4e32-8cd6-c200202bf592","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.431839Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:2665e800755e161b8876f415c369963f1000f88471d17cd51805ee3a20cd94b9","observation_id":"32b9379a-ab4c-4288-b43e-caec53e2fa2b","resolution":{"observed_at":"2026-08-06T20:01:35.814153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.03763","last_updated":"2020-12-07T15:00:18Z","snapshot_observed_at":"2026-07-06T10:21:26.704390Z","submitted_at":"2020-12-07T15:00:18Z","title":"Using previous acoustic context to improve Text-to-Speech synthesis","version":1},"cited_work":{"arxiv_id":"2012.03763","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.03763","snapshot_observed_at":"2026-08-06T20:01:35.621053Z","title":"Using previous acoustic context to improve Text-to-Speech synthesis","venue":"cs.CL","work_id":"1aaf7314-4399-4877-b537-10e696d6733b","year":2020},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.434910Z"},"links":{"cited_paper":"/paper/2012.03763","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:56a3b329d569ba70ac8baf4d2fd2a29e48e6d2c6cfd3fd5414f1be3f35f3362f","observation_id":"4836fd05-10a0-489e-9c39-9a063f0d5875","resolution":{"observed_at":"2026-08-06T20:01:35.624745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.798234Z","title":"Style tokens: Unsu- pervised style modeling, control and transfer in end-to-end speech synthesis,","venue":null,"work_id":"1ae0d19f-4d4f-4e3d-9423-ca2548440070","year":2018},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.442477Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:b9ddf221276381c23a6c43170b4c6d6ba1501be25250548ffaa35d1d198fbf3c","observation_id":"38a9bf71-3675-4145-a0a5-660d27eea3fc","resolution":{"observed_at":"2026-08-06T20:01:35.802289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.786302Z","title":"Mellotron: Mul- tispeaker expressive voice synthesis by conditioning on rhythm, pitch and global style tokens,","venue":null,"work_id":"2da29ed3-a87c-4df1-bdb9-e907c5ca639c","year":2020},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.445544Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:eee9b7f7319e6fc0f1a4e5f2bda8bcc822ac3509b77b46743c0582e2011c7311","observation_id":"5881b86a-39c2-4174-9295-5d9c8c67e6e0","resolution":{"observed_at":"2026-08-06T20:01:35.789823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.775153Z","title":"Do prosody transfer mod- els transfer prosodyƒ,","venue":null,"work_id":"6c935555-6895-4cdb-af52-fb68696cc2f1","year":2023},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.448724Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:0c441fcc8c324ac53e20bea71519057e9959b9c382652829592b71bbe0f30233","observation_id":"af250d61-e805-4e9d-a027-29310a0ffeed","resolution":{"observed_at":"2026-08-06T20:01:35.778544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.764028Z","title":"Hierarchical generative modeling for controllable speech synthesis,","venue":null,"work_id":"76675e50-d9fa-4642-88f7-b33ee6fb7627","year":2019},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.451835Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:07e4dde2d2b81852bf654439eeffab5c2070cb25ce0a4e3f4916c50b307781fb","observation_id":"21c6f1fd-89fb-43aa-b334-4d550e51d20b","resolution":{"observed_at":"2026-08-06T20:01:35.767567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.752400Z","title":"Parler-tts,","venue":null,"work_id":"03cc8647-15d4-4293-8562-a4633a6a04bc","year":2024},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.455236Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:cf0328b5fa6f0be6a8622e5b2945653efbf3537707fb38d35e6186a957ea77f4","observation_id":"3b672c54-248b-4607-8b09-9ab67851b490","resolution":{"observed_at":"2026-08-06T20:01:35.756076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12171","last_updated":"2022-11-22T10:58:38Z","snapshot_observed_at":"2026-07-06T14:21:38.060588Z","submitted_at":"2022-11-22T10:58:38Z","title":"PromptTTS: Controllable Text-to-Speech with Text Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12171","snapshot_observed_at":"2026-08-06T20:01:35.458407Z","title":"Prompttts: Con- trollable text-to-speech with text descriptions,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.458407Z"},"links":{"cited_paper":"/paper/2211.12171","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:595be326bd46b16aac83bd4994898881bd551f2043daad466e3025b6b9badb07","observation_id":"8940ffb5-6e18-4948-ab54-0e82cd0d3441","resolution":{"observed_at":"2026-08-06T20:01:35.458407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.741336Z","title":"Instructtts: Modelling expressive tts in discrete latent space with natural language style prompt,","venue":null,"work_id":"9b0c0492-c759-4e21-8701-9b13c44d5928","year":2023},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.462256Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:1634e930818f2f4e14fb752095f76b4cc2fc9855d496d46c423ecf891bda02d9","observation_id":"6049c4f3-8645-4b9b-a292-e5a10095a3af","resolution":{"observed_at":"2026-08-06T20:01:35.744754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-06T20:01:35.466074Z","title":"Scaling instruction-finetuned language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.466074Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:93b3995a4fd0a5b0f2022486ba84cf12e17ca6d992f269dbf294df20c5a2aecb","observation_id":"0fe659c6-439d-4a85-a97e-2bb1e78f73e5","resolution":{"observed_at":"2026-08-06T20:01:35.466074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.469532Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.469532Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:2492726ac44301f7f6f17a825b8def831445f676dfc5829a7ad8c708b014aaab","observation_id":"ff6854c7-b7d9-473c-959f-b57bcc9c8540","resolution":{"observed_at":"2026-08-06T20:01:35.469532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.722904Z","title":"Sdr– half-baked or well done?","venue":null,"work_id":"07278c50-61e3-4481-abf0-6ff8518c0111","year":2019},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.472740Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:1eea10ba9df2d1d738c96e02940faf25579a669566cec9b25559355def605a21","observation_id":"0723b4ff-b7a1-4604-9a77-4abf1df5977d","resolution":{"observed_at":"2026-08-06T20:01:35.726107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12258","last_updated":"2024-08-12T03:23:09Z","snapshot_observed_at":"2026-08-01T14:42:12.372500Z","submitted_at":"2023-01-28T17:30:47Z","title":"Cross-domain Neural Pitch and Periodicity Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12258","snapshot_observed_at":"2026-08-06T20:01:35.475879Z","title":"Cross- domain neural pitch and periodicity estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.475879Z"},"links":{"cited_paper":"/paper/2301.12258","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:1970b09b7b8663752ce42cf83446bcd7b414200bcf3db3252822c9dc5076aa6c","observation_id":"232cef0d-96f3-4f68-898d-57ac5e12df3e","resolution":{"observed_at":"2026-08-06T20:01:35.475879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.711761Z","title":"Talrómur 3 v0.1 (24.09),","venue":null,"work_id":"d2687304-9223-4b13-897f-9b7f7a42a954","year":2024},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.479099Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:8d7c93bc43d42d01e6a3b8e56e1feb4bbfa3a686b357d944b8a94405d59cb20e","observation_id":"4bfe7e00-20f0-4098-a0aa-6190f1ced734","resolution":{"observed_at":"2026-08-06T20:01:35.715102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T20:01:35.482339Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.482339Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:b299f58851b41c5bbd840f69f89de96f3aa441feb933119564ab127e6ad2660e","observation_id":"7f8ff515-d74d-4ad5-bdde-81ad26873848","resolution":{"observed_at":"2026-08-06T20:01:35.482339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.700024Z","title":"Mistral 7b,","venue":null,"work_id":"203d1735-c98c-43b8-ae85-521d32a35562","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.485659Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:bd1b8ff808499b7640013009adbca967cf3c512718f50bd39cfa7514835c7272","observation_id":"08fe315f-e365-4d52-8599-2be397c9580d","resolution":{"observed_at":"2026-08-06T20:01:35.703580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09296","last_updated":"2021-12-16T18:29:22Z","snapshot_observed_at":"2026-07-06T12:09:37.468149Z","submitted_at":"2021-11-17T18:49:42Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09296","snapshot_observed_at":"2026-08-06T20:01:35.492150Z","title":"Xls-r: Self- supervised cross-lingual speech representation learning at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.492150Z"},"links":{"cited_paper":"/paper/2111.09296","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:8d9c190b3e8c2243342394d9c79efbdc417b5e751212cf823b6e89ff1583cd88","observation_id":"6910d54b-696a-4824-9f91-cfc860254baf","resolution":{"observed_at":"2026-08-06T20:01:35.492150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.495505Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.495505Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:e6f6d7617435c13d00d3101f2a7647c7f76785ab0e1640dc6d3e9bc21096cb04","observation_id":"80cdb785-1615-43b5-a361-7059e4e8f470","resolution":{"observed_at":"2026-08-06T20:01:35.495505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.498551Z","title":"Opensmile: the mu- nich versatile and fast open-source audio feature extractor,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.498551Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:4f492dbedc4dea33223e472509d43fbededf27a7e942a6fa3ec75619026a47f7","observation_id":"1362a32a-1c55-4ff7-bf04-36afd597e180","resolution":{"observed_at":"2026-08-06T20:01:35.498551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.672974Z","title":"On the utility of self-supervised mod- els for prosody-related tasks,","venue":null,"work_id":"18d93207-6cbe-40fc-9871-3b3ae548df60","year":2022},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.501687Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:3a000528f1bd98739b926d1d0d87c3c05c9e1387d5b95987cd59e00be475827e","observation_id":"d5762b8f-06b2-4f3d-880a-c835ebbef3c0","resolution":{"observed_at":"2026-08-06T20:01:35.676734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.661105Z","title":"Generalized end-to-end loss for speaker verification,","venue":null,"work_id":"3e7e5dad-9c59-4590-98aa-eb67a76dd8e1","year":2018},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.504834Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:4468279f781840dbb90ede34906557c176aed9c8169d1e92a9d1e99338c565b0","observation_id":"98db6c0d-26d1-477b-91fb-902c818fde60","resolution":{"observed_at":"2026-08-06T20:01:35.664938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T20:01:35.488845Z","title":"Available: https://arxiv.org/abs/2310.06825","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.488845Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:4ca53d8d0bea9dd42997014c70697453a495d3bdd0f00446515c792d57be2488","observation_id":"ea4e03d3-4176-42a0-a7f0-2dbda3a4f722","resolution":{"observed_at":"2026-08-06T20:01:35.488845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T19:55:13.707476Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2507.08012."}