{"as_of":"2026-08-07T08:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:23a57b0d6f81d2a46315f3635fe9f7c57357d731f7a295e4c6e6bd3dfb3dc752","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:40:33.570559Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:40:30.251406Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T00:40:33.745238Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"cited_work":{"arxiv_id":"2608.00998","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00998","snapshot_observed_at":"2026-08-06T00:40:33.745238Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","venue":"eess.AS","work_id":"b98efed6-2930-4b81-a34f-83664e063f8d","year":2026},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.251406Z"},"links":{"cited_paper":"/paper/2608.00998","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:3cdd2bcb07a14fc22ca911b03618a220ddd4298d9554d5c49b43e68bdaf47b88","observation_id":"87dd77c5-d20d-4033-959a-e234bd80104c","resolution":{"observed_at":"2026-08-06T00:40:33.852446Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2608.00998/citation-record","integrity":"/paper/2608.00998/integrity","json":"/paper/2608.00998/citation-record.json","paper":"/paper/2608.00998"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"cited_work":{"arxiv_id":"2608.00998","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00998","snapshot_observed_at":"2026-08-06T00:40:33.745238Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","venue":"eess.AS","work_id":"b98efed6-2930-4b81-a34f-83664e063f8d","year":2026},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.251406Z"},"links":{"cited_paper":"/paper/2608.00998","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:3cdd2bcb07a14fc22ca911b03618a220ddd4298d9554d5c49b43e68bdaf47b88","observation_id":"87dd77c5-d20d-4033-959a-e234bd80104c","resolution":{"observed_at":"2026-08-06T00:40:33.852446Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:37.348748Z","title":"happy,” “sad","venue":null,"work_id":"b60ad89c-b3ae-4170-90b1-c877b3a10ed6","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.347861Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:40c31e10cca01996b5ba74309b8c3e25e07e293eedba5e028a24688e96363667","observation_id":"476f4840-a1e4-4b47-886e-ffa429280f14","resolution":{"observed_at":"2026-08-06T00:40:37.374334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:37.203819Z","title":"The overall archi- tecture is illustrated in Fig","venue":null,"work_id":"4b21c100-0e87-4d9c-8c9f-af640f2bd63f","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.430041Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:4cc47192f8b0ff86abcee955c987a3ac2fc5b5d82ff15999a69734f6b2fd39e8","observation_id":"cb99e9a2-78ff-4af5-aca4-66100d606a92","resolution":{"observed_at":"2026-08-06T00:40:37.278267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:37.067928Z","title":"Dataset and Training Setup Dataset:We constructed a 9-hour American English fe- male emotional speech dataset (22.05 kHz) by combining EX- PRESSO [27], EmoV-DB [28], and ESD [9]","venue":null,"work_id":"f1421bb7-0680-4750-8cc9-8c19c17f2aa1","year":2000},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.529042Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:edf19fedabc26798f422f3532f4d3084709653da5ae9c6744b2a43e2d377da4b","observation_id":"fdec17cc-6522-4e88-8b2d-a4df62d5ed53","resolution":{"observed_at":"2026-08-06T00:40:37.133107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.940842Z","title":"Speech Quality and Emotional Similarity Table 1 summarizes the performance of the emotional speech generator before human-in-the-loop IGA personalization","venue":null,"work_id":"ec1a5e6e-0996-4d4d-93cf-7f5472d45038","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.602687Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:5946df5de662016b1d30fe63dcb505ffa0b3474f25dfb22c8d7b5160128a6f72","observation_id":"67fc78a8-aa8c-4c5c-bcf7-92dbc7f62031","resolution":{"observed_at":"2026-08-06T00:40:37.021864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.789207Z","title":null,"venue":null,"work_id":"c66a39e6-a5db-4bed-95a5-0e88d83413ff","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.665976Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:66ca943c5b581039a1d7137d786ab1f1d6ab1c86269ab043a0b6b11ea559ce2f","observation_id":"60568f40-bf3b-4f67-8a45-3481e31f7328","resolution":{"observed_at":"2026-08-06T00:40:36.888921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.685625Z","title":null,"venue":null,"work_id":"b6a3aa34-bf76-4ba0-871e-87e537d98354","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.788230Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:9bc8d63f179070b643565a30f36ac40d9abf7b43dd693d418491291bb945a013","observation_id":"e3e731d8-d12e-4c83-ba15-6da378de5416","resolution":{"observed_at":"2026-08-06T00:40:36.743917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.563637Z","title":null,"venue":null,"work_id":"98e283fc-1612-4213-b242-34df6ebd3c9d","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.836577Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:7bccbe7ede6438364e93e5f1c9b77721068d02f980d74e97b190c7cf807cf1e2","observation_id":"ec7d53b9-2773-457a-ba68-50620023c3aa","resolution":{"observed_at":"2026-08-06T00:40:36.616598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.428921Z","title":"Gender and culture differences in emotion","venue":null,"work_id":"15050010-0af8-4a77-ac67-c00451b574ea","year":2004},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.937171Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:64389a9930f2bc781c69156676436fd03a29554fe078a0d1e9ddcf3030f2b8a4","observation_id":"8db80bbf-936f-483a-b44f-caee1b988950","resolution":{"observed_at":"2026-08-06T00:40:36.472364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.299687Z","title":"Plutchik and H","venue":null,"work_id":"0abe2a40-4b43-4503-8c79-d1cf719428aa","year":2013},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.046065Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:901a98b44f19787b744638875a4f547a1cadbb881fbde15ad130572c37af18df","observation_id":"7c14b4bd-c2e6-4928-96ec-5d3bb94701bc","resolution":{"observed_at":"2026-08-06T00:40:36.333999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:31.114160Z","title":"A circumplex model of affect","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.114160Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:73b99966c11a41a887b52f96c29745cff96f23747d71ba647484a93e13cb82fb","observation_id":"d537065b-afdc-4fe7-9240-8da84afb3e8f","resolution":{"observed_at":"2026-08-06T00:40:31.114160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.176751Z","title":"Matcha-tts: A fast tts architecture with conditional flow match- ing,","venue":null,"work_id":"50dac78c-c983-4ff8-9727-05060f959d3e","year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.267269Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:6a1ca42d116a2b525eb93c2075c3d13dd42d405f41ab2f4ab0db0d1fcdecb183","observation_id":"8f0a4d78-256b-420b-8680-a819c73d70ad","resolution":{"observed_at":"2026-08-06T00:40:36.247515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.022556Z","title":"F5-tts: A fairytaler that fakes fluent and faithful speech with flow matching,","venue":null,"work_id":"5f21b248-1f99-47ee-a50b-30570dfc2492","year":2025},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.345222Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:60a3b4c88dc3382fc2ed9a608007f68c0c6e6a8864c5c5c6b9a47b0cf2fa3a85","observation_id":"0fe06c2e-1dd2-4760-a7f6-e76420d936dd","resolution":{"observed_at":"2026-08-06T00:40:36.095107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09116","last_updated":"2023-05-30T16:09:10Z","snapshot_observed_at":"2026-07-06T15:17:05.623407Z","submitted_at":"2023-04-18T16:31:59Z","title":"NaturalSpeech 2: Latent Diffusion Models are Natural and Zero-Shot Speech and Singing Synthesizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09116","snapshot_observed_at":"2026-08-06T00:40:31.445968Z","title":"Naturalspeech 2: Latent diffusion models are natu- ral and zero-shot speech and singing synthesizers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.445968Z"},"links":{"cited_paper":"/paper/2304.09116","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:4d7d356abba0f32746d304ab0cc9ef118a88347a5088060906bcecab31c6f29f","observation_id":"43fc6afc-8c13-4382-8c7d-7ab8c9e49b12","resolution":{"observed_at":"2026-08-06T00:40:31.445968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.887106Z","title":"Styletts 2: Towards human-level text-to-speech through style dif- fusion and adversarial training with large speech language mod- els,","venue":null,"work_id":"c53ab173-6bcb-4d49-a62c-957d631eb9a8","year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.545433Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:5f8fcd43214adbaecff4f814ade2541aaa9a37acbb36c78f2a7620c93718ff83","observation_id":"de92c9e1-4f62-4423-8f7b-2bfbf6e60422","resolution":{"observed_at":"2026-08-06T00:40:35.950183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.792080Z","title":"Deep learning-based expressive speech synthesis: a systematic review of approaches, challenges, and resources,","venue":null,"work_id":"f6d9eaee-b940-414f-93b1-1b225e866e16","year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.668538Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:ed51d4df0465abd8da77669211bfada0218a7eb8f7d984b6daefac64d251913d","observation_id":"e13e5cb2-c75c-4a3f-9135-8c9c75a16f9f","resolution":{"observed_at":"2026-08-06T00:40:35.807134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:31.729302Z","title":"Emotional voice con- version: Theory, databases and esd,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.729302Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:525ffd286a4f8872b30794736d04fd27329c143f472e8cfdc68bd8a621c49fc6","observation_id":"15eefaf9-2e45-4268-8cb1-e2e339b63e16","resolution":{"observed_at":"2026-08-06T00:40:31.729302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00024","last_updated":"2023-06-28T19:34:16Z","snapshot_observed_at":"2026-08-04T00:44:58.442066Z","submitted_at":"2023-06-28T19:34:16Z","title":"EmoSpeech: Guiding FastSpeech2 Towards Emotional Text to Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00024","snapshot_observed_at":"2026-08-06T00:40:31.803047Z","title":"Emospeech: Guiding fast- speech2 towards emotional text to speech,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.803047Z"},"links":{"cited_paper":"/paper/2307.00024","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:291c83cb1073be46d65fe8b432f3669a005bcc4992d4dd22ba8f0d8ee67e1b33","observation_id":"5677a6ab-52a9-4e6b-9959-4381e03d0394","resolution":{"observed_at":"2026-08-06T00:40:31.803047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.638264Z","title":"Emo-dpo: Controllable emotional speech synthesis through direct preference optimization,","venue":null,"work_id":"0d76c0fb-c978-4a3f-8198-e7a729538645","year":2025},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.874922Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:fcda2e3da67d8af1dc0eae9f3fc1893072ba30f759ad467dcb271cf82b617bd6","observation_id":"5016b677-dd33-4a12-8fb2-e42d234a6b44","resolution":{"observed_at":"2026-08-06T00:40:35.707838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07803","snapshot_observed_at":"2026-08-06T00:40:31.981929Z","title":"Emosphere-tts: Emotional style and intensity modeling via spherical emotion vector for controllable emotional text-to- speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.981929Z"},"links":{"cited_paper":"/paper/2406.07803","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:6a38c60eb2aeb0ad119a79661344d0c2db36772f19db9d20cb96378d37bbaa15","observation_id":"65497633-8d62-4147-9814-61760154a903","resolution":{"observed_at":"2026-08-06T00:40:31.981929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.508959Z","title":"Emo- sphere++: Emotion-controllable zero-shot text-to-speech via emotion-adaptive spherical vector,","venue":null,"work_id":"df3415e5-e44d-41c6-9ef1-a920aa0de5b5","year":2025},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.063046Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:614ad35df6fd65ffc022a6d9835b8fb46afcc25055d61353bc2a534f4cdc1347","observation_id":"8bff6bd7-7293-46d7-8adc-f8831b139de6","resolution":{"observed_at":"2026-08-06T00:40:35.578040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.344963Z","title":"Ece-tts: A zero-shot emotion text-to-speech model with simplified and precise control,","venue":null,"work_id":"dbd59cf0-82d2-42ee-a0fd-3c5328e9d8bf","year":2025},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.161696Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:0ebc60c57d088ccf07b9f148f603e665682ef7c51eca947808f512261d401468","observation_id":"624643ac-4e99-4a8e-8e76-abd4b4700f16","resolution":{"observed_at":"2026-08-06T00:40:35.435343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.259184Z","title":"Train- ing language models to follow instructions with human feedback,","venue":null,"work_id":"f3a108cd-707d-4d38-88f6-b6a81075e58b","year":2022},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.277630Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:8a9d87af1f95667a2e0890bf0536e523128488cbd8119757dcb1b99774817008","observation_id":"2c770e51-00f1-4861-8173-4acb0f792a0d","resolution":{"observed_at":"2026-08-06T00:40:35.301686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.114657Z","title":"A survey of reinforcement learning from human feedback,","venue":null,"work_id":"c819f659-f8de-4b45-902d-54a8f12fa15c","year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.363036Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:82a847a1da57e61edf6c4a1670c620401fb8d2b7f0897edda93e0863ee6c9ef4","observation_id":"06ce9602-19e3-4ba2-b248-c7625b77afae","resolution":{"observed_at":"2026-08-06T00:40:35.176451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.975425Z","title":"Towards creative evolutionary systems with interac- tive genetic algorithm,","venue":null,"work_id":"d79cfc0a-8a86-486a-982a-16b7ad9f6017","year":2002},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.475286Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:492e91185a3bff4129f496cb74ba0a0af0f121cf51a85b3fd6e2ce66ccf10e81","observation_id":"d8a846b0-8a87-4368-8c18-8ec14a2e2733","resolution":{"observed_at":"2026-08-06T00:40:35.015952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.07217","last_updated":"2018-12-27T06:50:41Z","snapshot_observed_at":"2026-07-06T07:08:41.080825Z","submitted_at":"2018-10-16T18:20:02Z","title":"Hierarchical Generative Modeling for Controllable Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.07217","snapshot_observed_at":"2026-08-06T00:40:32.535351Z","title":"Hierarchical genera- tive modeling for controllable speech synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.535351Z"},"links":{"cited_paper":"/paper/1810.07217","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:ba5bf0a73e0d377b246c4e859cd4418ebd80503380c596f679acbd520362771f","observation_id":"523abf36-8c69-4e8c-81a0-454091c9705c","resolution":{"observed_at":"2026-08-06T00:40:32.535351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:32.619041Z","title":"Natural tts synthesis by conditioning wavenet on mel spectrogram pre- dictions,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.619041Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:2755738c23113d8aac4bc02ec18a8148e7078367e15b1993b6e65b368fc2ccd5","observation_id":"371d7791-a45d-4849-b532-ba03c33b012c","resolution":{"observed_at":"2026-08-06T00:40:32.619041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.812785Z","title":"Yourtts: Towards zero-shot multi-speaker tts and zero-shot voice conversion for everyone,","venue":null,"work_id":"5ac0583b-9ad2-45c6-ba7e-c021ee424cd2","year":2022},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.706485Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:6d89e468da9ee6e6118df8627399c19f86d472694c5876606367b184c4d2f356","observation_id":"d9114ced-9711-468d-9f36-4bde37d4cca3","resolution":{"observed_at":"2026-08-06T00:40:34.888705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.667988Z","title":"A review on genetic algorithm: past, present, and future,","venue":null,"work_id":"de45e680-8f48-4eb5-8e0e-4658c55bbe90","year":2021},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.815243Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:e4339d422c4917cdd8b7d8c430722b50e5c71a9e0c27a4d85583675bd9b45491","observation_id":"5309c1f2-0736-4be8-ae0d-426defedd13d","resolution":{"observed_at":"2026-08-06T00:40:34.761534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.515807Z","title":"Optimization of sound of au- tonomous sensory meridian response with interactive genetic al- gorithm,","venue":null,"work_id":"45da3b21-6d1f-442d-a262-4acd19dca2f6","year":2020},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.868607Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:aad178fc0cd3155d9cc9f815eaca684717786a703b6284d19e93e7058cac8a05","observation_id":"348e1d3b-d88e-4414-8331-242627fae2e7","resolution":{"observed_at":"2026-08-06T00:40:34.598701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.373946Z","title":"Evolutionary process indi- cators for active igas applied to weight tuning in unit selection tts synthesis,","venue":null,"work_id":"9e67ac16-c9ea-4c68-a880-ef7591885d66","year":2010},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.988519Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:ca0709b762e4ae0b1121c90b3925b1dd1bf8beb5d3528298b5adea194d2a6986","observation_id":"027e3eca-243a-44b9-9fcd-a70791aefa94","resolution":{"observed_at":"2026-08-06T00:40:34.448311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:33.055255Z","title":"Grad-tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.055255Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:ae02d0c681f3178fa05c2019b555d5a3ac1b5ccc6d62a6e4ac049ee32e74165a","observation_id":"a5a7032c-70ef-4898-85bf-ab7f8fe6a604","resolution":{"observed_at":"2026-08-06T00:40:33.055255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04558","last_updated":"2022-08-08T01:53:05Z","snapshot_observed_at":"2026-08-06T18:05:37.673476Z","submitted_at":"2020-06-08T13:05:40Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04558","snapshot_observed_at":"2026-08-06T00:40:33.129335Z","title":"Fastspeech 2: Fast and high-quality end-to-end text to speech,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.129335Z"},"links":{"cited_paper":"/paper/2006.04558","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:1e819c14deb48e0fbdba1d63ccdbf1e187e1b03990b295b0ae08083d18f0fa11","observation_id":"b272a6a6-74fa-42e1-a810-a34233ee9888","resolution":{"observed_at":"2026-08-06T00:40:33.129335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.235483Z","title":"Dawn of the trans- former era in speech emotion recognition: Closing the valence gap,","venue":null,"work_id":"60f1d0e5-16ea-4a07-937d-27171969e1ca","year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.204592Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:86d597111d08a8744ef473b6d5b54e1b06cdfb3fb2c781a4a386aa9aa740e45f","observation_id":"35a9640d-cc1f-408d-88db-b4b8edc9f65e","resolution":{"observed_at":"2026-08-06T00:40:34.308425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05725","last_updated":"2023-08-10T17:41:19Z","snapshot_observed_at":"2026-07-06T16:04:58.235073Z","submitted_at":"2023-08-10T17:41:19Z","title":"EXPRESSO: A Benchmark and Analysis of Discrete Expressive Speech Resynthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05725","snapshot_observed_at":"2026-08-06T00:40:33.274250Z","title":"Ex- presso: A benchmark and analysis of discrete expressive speech resynthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.274250Z"},"links":{"cited_paper":"/paper/2308.05725","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:8653779b347f9dd63d609e75e72cf35434c5af8c48242d6afe62064a6c21370b","observation_id":"fec8ed68-93ac-427b-a97e-d3dea908ede9","resolution":{"observed_at":"2026-08-06T00:40:33.274250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.09514","last_updated":"2018-06-25T15:01:54Z","snapshot_observed_at":"2026-07-06T06:46:39.730728Z","submitted_at":"2018-06-25T15:01:54Z","title":"The Emotional Voices Database: Towards Controlling the Emotion Dimension in Voice Generation Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.09514","snapshot_observed_at":"2026-08-06T00:40:33.372841Z","title":"The emotional voices database: Towards controlling the emotion dimension in voice generation systems,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.372841Z"},"links":{"cited_paper":"/paper/1806.09514","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:e4325811b14e61d87e95b828d82b7c324fe806f8499c4ea52da995a2631f3b19","observation_id":"070f1d6b-6366-4d50-8d63-e7bb95e6adf7","resolution":{"observed_at":"2026-08-06T00:40:33.372841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.060547Z","title":"HiFi-GAN: Generative adversar- ial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"4f2de8a5-e067-40dd-a8fd-bac267b49a73","year":2020},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.471015Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:ed396e70819f14333df44dc1fa2058ce1c1aacc2dbada88ad99179835e13b1e5","observation_id":"ef8f98d2-9986-42b2-8b50-0344c31779a9","resolution":{"observed_at":"2026-08-06T00:40:34.156060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:33.947807Z","title":"Evaluation of error- And correlation- based loss functions for multitask learning dimensional speech emotion recognition,","venue":null,"work_id":"a21cc02a-035c-4ab3-b26d-d1f965efa0dd","year":2021},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.570559Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:a1e03f5102ec89100ab02ddfd782f9f6e70d8119c7b72fb3de37cae60abcea3f","observation_id":"512f789f-8bad-45af-8a98-9bc54dc0a140","resolution":{"observed_at":"2026-08-06T00:40:33.985820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T23:25:17.401601Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2608.00998."}