{"as_of":"2026-08-20T16:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7cda406d4f9b8757c55c5b6b2874f51f6278a1d42397848166d7adbbd0c0dbf","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:16:51.818816Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09930/citation-record","integrity":"/paper/2608.09930/integrity","json":"/paper/2608.09930/citation-record.json","paper":"/paper/2608.09930"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.171313Z","title":null,"venue":null,"work_id":"c0396802-8d69-4739-85f1-942c26812c95","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.739925Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:8fb9aa2a40c95eaa07f07ad984913d4ff87bb33a42d73e82a37058bdede7f4a9","observation_id":"bb186f30-0364-4812-98a4-b79a5ea7b199","resolution":{"observed_at":"2026-08-11T04:16:52.175550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.160020Z","title":null,"venue":null,"work_id":"95fac228-1131-4021-9679-7d57fd559a84","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.743740Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:f3831f9e086d72b77aa300fd1244ccd023ee00a42277f46b4fa82291f58d707d","observation_id":"88e8580f-1e71-4c4a-8b03-9220b5e6fb96","resolution":{"observed_at":"2026-08-11T04:16:52.163443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.146414Z","title":"Do not swap schwas in fully reduced syllables (inaudible in synthesis)","venue":null,"work_id":"7463c798-ff83-4c0e-a7db-098a91306b60","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.747105Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:ddd6e03a7dda5623fafbd0a11ee43a77d706b80f42431a65517386e5e9491f4a","observation_id":"4a24557b-3ec6-4376-9e8f-6c788628502b","resolution":{"observed_at":"2026-08-11T04:16:52.152433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.136594Z","title":null,"venue":null,"work_id":"1b3a21b5-756b-4b82-949f-7e37be43869b","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.750872Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:21e7699eef9bfb58e99592af92880789a09280d9a038bfd05c5ccec09d1912b7","observation_id":"74a0388b-7443-4cbe-9692-2bbcad6746b7","resolution":{"observed_at":"2026-08-11T04:16:52.139879Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.125074Z","title":"Do not introduce ÉŽ, Éń, É¿, ÊŤ, length marks, or diacritics absent from the table; write ÉŽ as Éİ (stressed) or ÉŹ|Éź (unstressed)","venue":null,"work_id":"0b8f2bf0-35e2-4c07-b333-dd7a352c5b3b","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.756529Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:c20ddd0d53318b8f8cf0b9977acc8259ad934542cf7e8bdac88c2d310da42465","observation_id":"142e7eb2-bf10-407e-be2d-b99eb8084e87","resolution":{"observed_at":"2026-08-11T04:16:52.129673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.113948Z","title":"target_word","venue":null,"work_id":"abc66d88-fce1-4b53-a1e8-99b514abbe40","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.762692Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:4e9d9f068dae99f3ed572253b6883cf555c601f2a00048ac7cb6e898cc296f40","observation_id":"d73b365b-6d00-4f4a-8269-9198e53c0951","resolution":{"observed_at":"2026-08-11T04:16:52.117591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.957544Z","title":null,"venue":null,"work_id":"06cd7e7d-cec0-457f-a095-a22d92d9a4cc","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.818816Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:d5c7e6fcf4d65770cda5ab245cd56e990ee2deb1c2436b62dfeaaf2d92b594a6","observation_id":"cab3fd6b-bd3a-4aab-8e74-46048f00a9c2","resolution":{"observed_at":"2026-08-11T04:16:51.961806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.103375Z","title":"If monosyllabic, return an empty versions array","venue":null,"work_id":"bcf071eb-fdf7-46ca-acec-43eebe364fdc","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.766721Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:a8e8a14fcf1f981bcd21d5488993dfd6431023bec788dbb926099eb416a435b3","observation_id":"5dcb38d4-eee1-4092-9ff9-f03364817d48","resolution":{"observed_at":"2026-08-11T04:16:52.107142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.092921Z","title":"If a secondary stress exists, swapping primary and secondary is preferred","venue":null,"work_id":"4a7511c7-d0e2-4f58-b32f-7ff14d3f9619","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.771107Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:f50eaa02b481f38818dd517fa33c4d2901b5bbafba6a89d4869d92c69865a154","observation_id":"dec1d040-9641-4e9e-a528-e146ec2a7c24","resolution":{"observed_at":"2026-08-11T04:16:52.097038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.082780Z","title":null,"venue":null,"work_id":"b6295eb1-0964-4f1f-bf17-75964fc2351f","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.774853Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:f06441d515bbe5e781e145e21eae512802823b43791fec366360545bbe5ded31","observation_id":"4cecae94-9a8d-4761-9645-8207e0d88d0d","resolution":{"observed_at":"2026-08-11T04:16:52.086521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.071762Z","title":"that” as demonstrative→ function word; “that","venue":null,"work_id":"b3e009a9-7211-42ad-a463-7c3a53f7a548","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.778656Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:7f1f0fa3c078bee41c51b2b01fcf5fc50aea2d999452ef5c10ebe9904fa1b9fa","observation_id":"9f4311d6-bfdd-4ef3-95eb-679ce7e49889","resolution":{"observed_at":"2026-08-11T04:16:52.075890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.060730Z","title":"Sentence-final punctuation stays outside any quoted span","venue":null,"work_id":"ec274f26-1d3e-42eb-a858-ed9de975bd35","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.782453Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:524d55b4e54c45c050e46f711d03018cbb2afc5ab19e86c1a69025f0b43deb0c","observation_id":"af4e92fa-bdbc-4904-9662-1a20ca3a8639","resolution":{"observed_at":"2026-08-11T04:16:52.064559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.049530Z","title":null,"venue":null,"work_id":"68f5c6ea-f650-49b9-aa3d-4e2e8b7854d6","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.786655Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:e12de553edf1d5168a0cf004093b035cfe18c8c9a692f1352c96968181ffd1e7","observation_id":"43cc34c8-6ea8-450a-92a5-e0afa0bd94a3","resolution":{"observed_at":"2026-08-11T04:16:52.053006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.039659Z","title":"stress\" (used for folder naming). {","venue":null,"work_id":"d204d4b0-e7e8-48e3-aba9-4fb06b97f97c","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.791179Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:bb50a3330b8a1a71d8ba6d1a3927ffe5f42b3c4b8b4dee6bc696533cd679fe55","observation_id":"c2a61eb3-ab6e-4ce5-9384-7f5933006cca","resolution":{"observed_at":"2026-08-11T04:16:52.043333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.029115Z","title":null,"venue":null,"work_id":"77a1486e-af4b-4976-b829-fc754c0ac784","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.795371Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:75056b71a7a6c9ba18b18f8580d34053007bbf26c1730aafab5a8e9b4e01f4f9","observation_id":"10f2a6dc-0fd0-45e3-8fa3-2f3aa5da728e","resolution":{"observed_at":"2026-08-11T04:16:52.032696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.017040Z","title":"artifacts","venue":null,"work_id":"86b7775c-e436-403e-a7fd-0b89ad2beac4","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.799897Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:82b94cd435f427cc280ad78f8819853b36fea646d4d08e5631b5b00cc9013f81","observation_id":"aa215347-0c6a-42dc-93b5-9c01024ca1ab","resolution":{"observed_at":"2026-08-11T04:16:52.021329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.005277Z","title":null,"venue":null,"work_id":"b84f5db2-5d6c-46a4-a985-6c95f4d221ba","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.803507Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:2fbc7d23d370a4fd85745a328447684b7e3948cad26ce87c28325df6d5616104","observation_id":"3d43f0af-5bd7-4450-8c92-b9afc4719606","resolution":{"observed_at":"2026-08-11T04:16:52.008965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.993681Z","title":null,"venue":null,"work_id":"fc1343aa-732a-453c-8144-16e3568c6660","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.807307Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:b6bd46b379ad00491335adf9e9aa419837338f0575e4b16bfa1f769fbc6638d7","observation_id":"57c518d7-4cd6-47bd-82b5-6726817a77ef","resolution":{"observed_at":"2026-08-11T04:16:51.997807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.980990Z","title":"Use throughout for diffuse artifacts (noise, compression, hum)","venue":null,"work_id":"cffef413-dcd3-473f-b735-e6f2a951e3f4","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.811504Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:fb3441f44f5b9161fa30fac91d9a1a72f00098ef9e145071faab824fb1d5a4ed","observation_id":"c804f934-faf8-4c71-bf73-80b31f62a836","resolution":{"observed_at":"2026-08-11T04:16:51.985555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.969198Z","title":"A sharp digital stutter interrupts the stressed vowel of ‘eclipse’, looping a tiny slice twice before the sentence continues","venue":null,"work_id":"b8ab233a-34d5-45f2-9ffe-a178bfb8bb00","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.815084Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:0728db10135a59b4cdb5e554d8d1834fee69d63357add148ecd8bf66145b8640","observation_id":"93d0a020-8f81-4928-8dac-750c74d58636","resolution":{"observed_at":"2026-08-11T04:16:51.973233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.183140Z","title":"InNIPS 2016 End-to-end Learning for Speech and Audio Processing Work- shop","venue":null,"work_id":"360cdb17-75dd-4007-8c6b-4652b7fe1635","year":2016},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.726340Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:9f92665f5269416582d6a978e9ee1b8223d52a870c0b24a4b0ec112837abcc06","observation_id":"af1f11d7-7238-4c5d-a8ad-5e5500768f81","resolution":{"observed_at":"2026-08-11T04:16:52.187082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.193858Z","title":"Journal of Speech, Language, and Hearing Research, 60(1):190–198","venue":null,"work_id":"949e42c0-277c-4d2a-ae57-f131b082db51","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.711756Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:fb9f292a0cd4a34e96f53c622c4de11a00024bb1d34e3d0e979c441645ca76ba","observation_id":"fc804cfa-9478-4d6f-a2aa-da9651c2ac90","resolution":{"observed_at":"2026-08-11T04:16:52.197645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15561","last_updated":"2021-07-23T12:32:52Z","snapshot_observed_at":"2026-08-16T18:13:35.460831Z","submitted_at":"2021-06-29T16:50:51Z","title":"A Survey on Neural Speech Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15561","snapshot_observed_at":"2026-08-11T04:16:51.730328Z","title":"InICASSP 2021-2021 IEEE International Confer- ence on Acoustics, Speech and Signal Processing (ICASSP), pages 6493–6497","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.730328Z"},"links":{"cited_paper":"/paper/2106.15561","citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:f485d847467faf69359fe68ce3e5102524967852588445b3001f8eea16daf153","observation_id":"2a50e313-854d-4e6a-9786-3c456ff2992d","resolution":{"observed_at":"2026-08-11T04:16:51.730328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.735107Z","title":"She will lead the group to the lead mine","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.735107Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:eb0a8e9f1b0daed53c095a58504ea75713d990ea1cffea0f821c3f8d852aab1c","observation_id":"4b6ba261-7c75-48f4-9da5-43a62f869c33","resolution":{"observed_at":"2026-08-11T04:16:51.735107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04029","last_updated":"2026-04-20T13:53:49Z","snapshot_observed_at":"2026-07-06T22:41:01.254450Z","submitted_at":"2026-01-07T15:45:41Z","title":"SpeakerSleuth: Can Large Audio-Language Models Judge Speaker Consistency across Multi-turn Dialogues?","version":2},"cited_work":{"arxiv_id":"2601.04029","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.04029","snapshot_observed_at":"2026-08-11T04:16:51.943081Z","title":"SpeakerSleuth: Can Large Audio-Language Models Judge Speaker Consistency across Multi-turn Dialogues?","venue":"cs.CL","work_id":"d128b0f2-c12d-465a-ae67-a12bb1581ea7","year":2026},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.717069Z"},"links":{"cited_paper":"/paper/2601.04029","citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:82a4451e257b141ed46ddd24fdbd68007a4953e82e50a359c98bea551e5d1047","observation_id":"27d24f65-634f-4ad1-82b2-718fbce1351a","resolution":{"observed_at":"2026-08-11T04:16:51.949377Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09494","last_updated":"2021-04-19T17:56:59Z","snapshot_observed_at":"2026-08-18T17:44:33.818307Z","submitted_at":"2021-04-19T17:56:59Z","title":"NISQA: A Deep CNN-Self-Attention Model for Multidimensional Speech Quality Prediction with Crowdsourced Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09494","snapshot_observed_at":"2026-08-11T04:16:51.721966Z","title":"InPro- ceedings of the 19th Conference of the European Chapter of the Association for Computational Lin- guistics (V olume 1: Long Papers), pages 3644–3663","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.721966Z"},"links":{"cited_paper":"/paper/2104.09494","citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:4630990ccb2f5bfca3286c75fe76e6f94965c91d26925052168f3dbf541d5e97","observation_id":"19601c4e-067d-4dc4-ac06-f51e5edc8609","resolution":{"observed_at":"2026-08-11T04:16:51.721966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2608.09930."}