{"as_of":"2026-08-08T10:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:afc3df64ebdee1229614193b978a6a4f4e96446c94700ef829bec2289e746517","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:07:16.011508Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:07:15.848160Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T11:07:16.177718Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"cited_work":{"arxiv_id":"2506.03515","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03515","snapshot_observed_at":"2026-08-07T11:07:16.177718Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","venue":"eess.AS","work_id":"945f727f-65b1-4527-a6b3-9834b7a2ea76","year":2025},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.848160Z"},"links":{"cited_paper":"/paper/2506.03515","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:191e57877f03be2234f5ce47ea1ac78a22ed7053571b18306733917fbb5ff57a","observation_id":"1f18dc73-88da-4123-af45-e7050772b698","resolution":{"observed_at":"2026-08-07T11:07:16.183631Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03515","snapshot_observed_at":"2026-08-02T18:35:52.019662Z","title":"Bittts: Highly compact text-to-speech using 1.58-bit quanti- zation and weight indexing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08173","last_updated":"2026-07-18T12:50:12Z","snapshot_observed_at":"2026-08-07T18:54:26.046430Z","submitted_at":"2026-03-09T09:53:05Z","title":"Evolution Strategy-Based Calibration for Low-Bit Quantization of Speech Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T18:35:52.019662Z"},"links":{"cited_paper":"/paper/2506.03515","citing_paper":"/paper/2603.08173"},"observation_digest":"sha256:37df0855fc9317d8ea9faff144875571fc37ff96663d26684e7720d621931cf6","observation_id":"6e6c3700-f386-4b40-be90-0d514395735b","resolution":{"observed_at":"2026-08-02T18:35:52.019662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03515/citation-record","integrity":"/paper/2506.03515/integrity","json":"/paper/2506.03515/citation-record.json","paper":"/paper/2506.03515"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:17.253894Z","title":"With the advancement of these TTS models, they are increasingly being integrated into mobile applications, such as car navigation systems and conver- sational bots, among others","venue":null,"work_id":"a744e526-ca32-43a1-b181-395836fc3bc1","year":null},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.842559Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:29604f7e819081c6ae79b12a1ccba11ecde949ecd1df9fe54fa58407b3b207b2","observation_id":"93fdb897-080f-4ebe-82f9-e6a9cf47d0ad","resolution":{"observed_at":"2026-08-07T11:07:17.294286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"cited_work":{"arxiv_id":"2506.03515","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03515","snapshot_observed_at":"2026-08-07T11:07:16.177718Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","venue":"eess.AS","work_id":"945f727f-65b1-4527-a6b3-9834b7a2ea76","year":2025},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.848160Z"},"links":{"cited_paper":"/paper/2506.03515","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:191e57877f03be2234f5ce47ea1ac78a22ed7053571b18306733917fbb5ff57a","observation_id":"1f18dc73-88da-4123-af45-e7050772b698","resolution":{"observed_at":"2026-08-07T11:07:16.183631Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:17.222606Z","title":"Experimental conditions We conducted experiments to evaluate the effectiveness of quantization in TTS and the proposed methods","venue":null,"work_id":"f161a6a2-44a2-4ce7-be7a-4d0a1793fffa","year":2000},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.852545Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:2ae965b2c5e229acecbe86f5814c2029e9990372031926408ffa5628ac0d5f0f","observation_id":"c190793b-cedf-4a57-aa83-31e17fa73b4d","resolution":{"observed_at":"2026-08-07T11:07:17.233809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:17.175777Z","title":"Additionally, we introduced a method called weight indexing to further re- duce model size","venue":null,"work_id":"40641763-7cb8-464e-a222-ca21e8624e2a","year":null},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.856669Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:67488ed2f575d95f0623c14e542adec59f9e9cdbc01e9d0ab7ea3089f591002f","observation_id":"a02ebf19-4ce9-49e3-88f7-2d821f947136","resolution":{"observed_at":"2026-08-07T11:07:17.208813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:17.103937Z","title":"Statistical parametric speech synthesis using deep neural networks,","venue":null,"work_id":"02249fa7-e5e9-46ed-882f-d9b3f582dc59","year":2013},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.860660Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:7a7d1bc387193d4e4553ee82fe48f585cf99efd5398920678c86cf7d7723b18e","observation_id":"a8a8e447-a7ec-4f60-89d4-67d25a9e6042","resolution":{"observed_at":"2026-08-07T11:07:17.132185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:17.012193Z","title":"A review of deep learning based speech synthesis,","venue":null,"work_id":"304e90a1-e61e-414d-b7a5-529ba919ecce","year":2019},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.864452Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:a52c1bba4a105ff75ca47679c3d37ed8e2886d9f2a2dd6224a98b03b85ae4f49","observation_id":"00cded20-c3d4-4e11-87c1-444357fbd23f","resolution":{"observed_at":"2026-08-07T11:07:17.052148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15561","last_updated":"2021-07-23T12:32:52Z","snapshot_observed_at":"2026-08-08T00:23:53.256906Z","submitted_at":"2021-06-29T16:50:51Z","title":"A Survey on Neural Speech Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15561","snapshot_observed_at":"2026-08-07T11:07:15.868253Z","title":"A survey on neural speech synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.868253Z"},"links":{"cited_paper":"/paper/2106.15561","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:a040d5effa9f45d2882cfd3c1c8ccb6f108ee8ef9b8521cb2f380cce0b5846ba","observation_id":"be387944-fbb5-4f57-b581-8a029deb39bd","resolution":{"observed_at":"2026-08-07T11:07:15.868253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.957807Z","title":"An overview of affective speech synthesis and conversion in the deep learning era,","venue":null,"work_id":"23379b5c-00f1-44f1-9f9d-7f3a72ab78b9","year":2023},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.872438Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:6d7ee60c9fa516ff37303026c0ce47545b502201b6af9c0c03fa7cb80a8e2be2","observation_id":"0d2a5ed2-54ca-4500-9de1-dd48f9fc7aaf","resolution":{"observed_at":"2026-08-07T11:07:16.982845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:15.876798Z","title":"A review of deep learning techniques for speech processing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.876798Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:3ebf0810253031f4a91f63436671bcb8098f385cf38dfe3edbb81eb2689fb10d","observation_id":"1717cfa0-e933-462f-9bf0-49be3b888c6d","resolution":{"observed_at":"2026-08-07T11:07:15.876798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.901376Z","title":"Lightspeech: Lightweight and fast text to speech with neural architecture search,","venue":null,"work_id":"f2838cc2-c5a7-405f-9e94-51d86a7ee7d1","year":2021},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.880481Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:305a108b9f04aa5e7c760db6dbe3b93c6f589a65f70278e6aefd935e5200c1ba","observation_id":"ff73a621-2552-4308-938e-0e2960bdff46","resolution":{"observed_at":"2026-08-07T11:07:16.920178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.824036Z","title":"NIX- TTS: Lightweight and end-to-end text-to-speech via module-wise distillation,","venue":null,"work_id":"5fcb2b09-9ed2-4ca0-98c2-84fa4c07b188","year":2023},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.884177Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:06d48303652de9aed4a63a7cee4d90e38814fbdb986ef52404040d357a599bd5","observation_id":"a8ed470d-17de-4b6f-ba92-ff516a3754ab","resolution":{"observed_at":"2026-08-07T11:07:16.854393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.758769Z","title":"ConvNeXt-TTS and ConvNeXt-VC: ConvNeXt-based fast end-to-end sequence- to-sequence text-to-speech and voice conversion,","venue":null,"work_id":"fe052534-86a4-4d30-987f-00aeeea3b2f4","year":2024},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.888596Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:6bc88ecc5ee96f2e7286e7b5e15cbb1d18d451651be54ef05f9b1971176e05b6","observation_id":"7a415607-475b-45f1-8746-f69a3fd4655a","resolution":{"observed_at":"2026-08-07T11:07:16.793431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.692639Z","title":"Lightweight and high-fidelity end-to-end text-to-speech with multi-band generation and inverse short-time fourier transform,","venue":null,"work_id":"7361efd1-1428-42c1-9be0-6185b7be0865","year":2023},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.892719Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:0db99f9613fd0c256a9277636fbb7471a6304b15f4024444ed499bdd92365a87","observation_id":"faec4f0e-4527-4b9f-ba91-ef103d5b4775","resolution":{"observed_at":"2026-08-07T11:07:16.712520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.644953Z","title":"SpeedySpeech: Efficient neural speech synthesis,","venue":null,"work_id":"de8eaa32-6a5f-4c22-acba-e6f3f7e9d016","year":2020},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.896472Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:bb797b4eb289cd47455a553cec45730c1a892a278b67eb5dbff92eab80e9522e","observation_id":"e63e2514-0b24-475b-84a1-56ea7d69b8c0","resolution":{"observed_at":"2026-08-07T11:07:16.668543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.504813Z","title":"ClariNet: Parallel wave genera- tion in end-to-end text-to-speech,","venue":null,"work_id":"6e705eea-7303-43bd-ac6b-7d9ab8b37e1a","year":2019},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.900026Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:87394bd4be70fdd1dd2563ec7ba25914fb8970e817aebe221160390c3ba42612","observation_id":"8334b82f-376e-445c-8e6d-a9aab0b5ef3b","resolution":{"observed_at":"2026-08-07T11:07:16.519069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.475306Z","title":"Learning trans- ferable architectures for scalable image recognition,","venue":null,"work_id":"5ce2f17d-6eda-48f1-9f29-16fe9b1d47d9","year":2018},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.903782Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:33170cbf9835d23b9083ab3f814c18e14e11e2c16d603c127c2376c8eca02521","observation_id":"bd1b415c-6d0c-4b8b-98f8-cd73b22e992f","resolution":{"observed_at":"2026-08-07T11:07:16.487361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.448560Z","title":"Neural architec- ture optimization,","venue":null,"work_id":"282e29bc-2776-43fb-aa84-3262745773f7","year":2018},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.907750Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:25fe889fafab871e5f6cc680969c68367299a1317e1040b6c4b4b6722fd94d32","observation_id":"0fd2d75a-7601-4844-9575-afb478bdf03e","resolution":{"observed_at":"2026-08-07T11:07:16.458710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-07T11:07:15.911425Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.911425Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:5368cf8bcaab05382be6d7067fdc0d45dcc6519d929b7cbe0b5545f9406395f1","observation_id":"e365ab8a-b784-4406-927b-dea0195e3e40","resolution":{"observed_at":"2026-08-07T11:07:15.911425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08295","last_updated":"2021-06-15T17:12:42Z","snapshot_observed_at":"2026-08-02T11:19:40.664702Z","submitted_at":"2021-06-15T17:12:42Z","title":"A White Paper on Neural Network Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08295","snapshot_observed_at":"2026-08-07T11:07:15.915617Z","title":"A white paper on neural network quantization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.915617Z"},"links":{"cited_paper":"/paper/2106.08295","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:f2a230ed9b69cf6e126a83e998580b7e3b413a5bc9ac8ab544c9ec77b5b73fe6","observation_id":"66e34141-59a7-4542-98c8-f157e66ef0df","resolution":{"observed_at":"2026-08-07T11:07:15.915617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:15.920093Z","title":"Quantization and training of neural networks for efficient integer-arithmetic-only inference,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.920093Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:e15e42c6bef28f77a802be2d3a4b30d049496a7f717e8ec107803e067b0a7761","observation_id":"b73fbfdc-6eb7-47f8-997b-85e084ef77d8","resolution":{"observed_at":"2026-08-07T11:07:15.920093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.414029Z","title":"4-bit conformer with native quantization aware training for speech recognition,","venue":null,"work_id":"8e583d44-e441-40de-8e5f-b68699ba6a82","year":2022},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.924201Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:c4df2cf71011a7b98d07160b9b6cc52ebd5fb786514389732fdfb0b6831580db","observation_id":"8860598c-a142-46b9-b2e3-0ba8a37830e6","resolution":{"observed_at":"2026-08-07T11:07:16.422181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.389016Z","title":"Sub-8-bit quantization aware training for 8-bit neural network accelerator with on-device speech recog- nition,","venue":null,"work_id":"7ea03fe7-a233-405a-8fc7-bfe68acd0b88","year":2022},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.928060Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:ccf6bd57f19707883f677e7aac27fb0817b1cf664a7383954228901155824c29","observation_id":"e1fb35f9-ac92-434d-a860-391eb6f714c5","resolution":{"observed_at":"2026-08-07T11:07:16.400339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-07T11:07:15.932038Z","title":"Bitnet: Scaling 1-bit transformers for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.932038Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:d20a3823f54ca3d6294750af8b9c19921a9c039a377dcb1b6bc577f83fc3d34a","observation_id":"b01f8e91-e75b-42df-9030-4c1bb95b2a43","resolution":{"observed_at":"2026-08-07T11:07:15.932038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T11:07:15.936246Z","title":"The era of 1-bit llms: All large lan- guage models are in 1.58 bits,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.936246Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:634566c79ebf1142fcd6cb9cb71e6da3ccfcaffca6784ecad55b3dee41e69d88","observation_id":"84545911-dfa3-4c53-8391-f89bb49083ec","resolution":{"observed_at":"2026-08-07T11:07:15.936246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.373575Z","title":"Xnor- net: Imagenet classification using binary convolutional neural net- works,","venue":null,"work_id":"dc76ba00-bc3e-441d-af70-78d420c526e4","year":2016},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.940246Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:8a11ba5cb20c2f06623848295da804ba998ee5b9ce2f71b1f702adb467a8104a","observation_id":"ca473a28-af43-4a51-b873-ce0797929651","resolution":{"observed_at":"2026-08-07T11:07:16.378017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.359544Z","title":"Xnor-net++: Improved binary neural networks,","venue":null,"work_id":"053b2d09-1a2f-45a2-bf46-8b3731221e4c","year":2019},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.944136Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:3353980361ad851bc59d78f5c9363c99cf412112689a0559c4c2b4ae2f89a057","observation_id":"936962bc-4b6c-4a87-a362-e9eb04fa7182","resolution":{"observed_at":"2026-08-07T11:07:16.363698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.345187Z","title":"Bi- nary neural networks: A survey,","venue":null,"work_id":"f99665ce-4e90-4b98-853c-bc3a3de66626","year":2020},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.947826Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:b124f9fbfc116dc982d59775a31416c548cd62d0f88ce4441eb12fd9fbb6a631","observation_id":"5d847e2c-0d6d-4c87-b603-f1474ac19363","resolution":{"observed_at":"2026-08-07T11:07:16.350061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.02830","last_updated":"2016-03-17T14:54:25Z","snapshot_observed_at":"2026-07-06T04:45:31.463087Z","submitted_at":"2016-02-09T01:01:59Z","title":"Binarized Neural Networks: Training Deep Neural Networks with Weights and Activations Constrained to +1 or -1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.02830","snapshot_observed_at":"2026-08-07T11:07:15.952081Z","title":"Binarized neural networks: Training deep neural networks with weights and activations constrained to +1 or -1,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.952081Z"},"links":{"cited_paper":"/paper/1602.02830","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:d35960456890e3cf601aeeae58c5f6d3b5ebf14b78a8247aa50376249d9397dc","observation_id":"67157648-b8a5-4448-99fd-8055fc7b4463","resolution":{"observed_at":"2026-08-07T11:07:15.952081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:15.956304Z","title":"Basic binary convolution unit for binarized image restoration network,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.956304Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:e7b86ba1d4f25263a8c1f42099e1736f5ac466f62c45b5a8b001f6807642deb5","observation_id":"1f5bd55e-4c7c-455f-85fb-f0a5a23aa082","resolution":{"observed_at":"2026-08-07T11:07:15.956304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.320884Z","title":"2-bit conformer quantization for automatic speech recog- nition,","venue":null,"work_id":"f32126f1-7e6d-4f77-bf76-f15062e966df","year":2023},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.960196Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:db34f4ae9193d34d972edbc64c9a47cfc6b1e8fd1d4b71ea7c9be3788291964e","observation_id":"f0b1b8b5-a980-49dc-874e-1fb7a1824320","resolution":{"observed_at":"2026-08-07T11:07:16.325105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T11:07:15.964019Z","title":"Layer normalization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.964019Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:8c60b58b272d00b3a206ccd32950d6fe8143713d930dae4fe354304858ecdc4a","observation_id":"1316b40f-bedc-464f-b6fb-aaaffeee4a0c","resolution":{"observed_at":"2026-08-07T11:07:15.964019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-07T11:07:15.968294Z","title":"Estimating or propa- gating gradients through stochastic neurons for conditional com- putation,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.968294Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:9f011b37a04b3948d2824ffbcabbcc8cd052ab0dba0feffbfa82f5a030a6368a","observation_id":"b43d84c3-ccbe-47c0-b79a-d99ecc326002","resolution":{"observed_at":"2026-08-07T11:07:15.968294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.306678Z","title":"LibriTTS-R: A re- stored multi-speaker text-to-speech corpus,","venue":null,"work_id":"842a01e3-7d74-4979-9829-8ada3a0ee3ca","year":2023},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.972329Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:4c32249dbd75a65b636cce8111e4178f863a1d919e73882adabf641ca75eda5e","observation_id":"fdd45b6a-61db-44f3-a43d-6ae33f3a847e","resolution":{"observed_at":"2026-08-07T11:07:16.311000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:15.976191Z","title":"Montreal forced aligner: Trainable text-speech align- ment using kaldi","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.976191Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:a21d17e205e1cac47871be332ff9ebd24a58b4abdfbd203914055397ce7b3b86","observation_id":"3c061aa4-0e4d-4483-abff-bcc75e52e1a1","resolution":{"observed_at":"2026-08-07T11:07:15.976191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.283889Z","title":"JETS: Jointly training FastSpeech2 and HiFi-GAN for end to end text to speech,","venue":null,"work_id":"9e5f8ec0-fb63-4ee1-ad71-13587871d870","year":2022},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.980263Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:fdcb9b50bf3138c88d62cbaac61c40f537518902798a690e0f105f6b76bd6024","observation_id":"d6d8f0d3-7416-4d71-9a2d-48f364840280","resolution":{"observed_at":"2026-08-07T11:07:16.288337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.270166Z","title":"Attention is all you need,","venue":null,"work_id":"7dd28fd0-a632-4b49-a2b4-21bfe99966b0","year":2017},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.984376Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:6f4a27d33512f3f32449cad6769b3bf43931f315fbef491b8865c6050c0184c7","observation_id":"3fbcff8e-7765-488c-9c19-77f52fb983a2","resolution":{"observed_at":"2026-08-07T11:07:16.274414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:15.988524Z","title":"HiFi-GAN: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.988524Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:836fbbdd905bebe616013e089b3c30973572ad78a466bc462c2a667de9e0e2cb","observation_id":"dd81318d-60cb-4fc6-9aa7-6d153005d1be","resolution":{"observed_at":"2026-08-07T11:07:15.988524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.246391Z","title":"Mixture density networks,","venue":null,"work_id":"13b27327-efb4-43d8-b7ea-f2a9093cac0b","year":1994},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.992409Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:42518435575c63b169edf3ba15b08fbb777d1af139365db9c0899ea96ce8bac3","observation_id":"ef1e13bf-870b-48e6-95e9-399534091eb8","resolution":{"observed_at":"2026-08-07T11:07:16.250799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.231985Z","title":"Phone-level prosody modelling with GMM- based MDN for diverse and controllable speech synthesis,","venue":null,"work_id":"1501831a-e2f9-4286-81bb-31efe53f6275","year":2022},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.996167Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:cec43582fd4fb6306fb4d328308670514e3181cd467e34aea299720a05f0f780","observation_id":"173f5761-5bf6-44ac-bb83-bed9835ba29e","resolution":{"observed_at":"2026-08-07T11:07:16.236549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:15.999816Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.999816Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:069e85ad60df81597adafd2e9251de01b010fab62e8750d0ab889cb47e429260","observation_id":"d6f607e7-86e4-42f1-85b7-7924bfe6a5fe","resolution":{"observed_at":"2026-08-07T11:07:15.999816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07454","last_updated":"2019-11-21T11:01:34Z","snapshot_observed_at":"2026-07-06T08:30:04.777443Z","submitted_at":"2019-10-16T16:22:58Z","title":"An Exponential Learning Rate Schedule for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07454","snapshot_observed_at":"2026-08-07T11:07:16.003624Z","title":"An exponential learning rate schedule for deep learning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:16.003624Z"},"links":{"cited_paper":"/paper/1910.07454","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:998dbff28b6905ffec3c4a50d11def96115af07a22e31ac533d8fd9afa364dee","observation_id":"66ccd60d-2f71-4b6a-8be3-0647b003832d","resolution":{"observed_at":"2026-08-07T11:07:16.003624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.208336Z","title":"ESPnet-TTS: Uni- fied, reproducible, and integratable open source end-to-end text- to-speech toolkit,","venue":null,"work_id":"3f9ef261-ba2b-440c-a93f-b646d556c81a","year":2020},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:16.007798Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:c135eb9baa0d4c6d2b20973bfaa86f3801d24cca0fa73002ce2687b274e289f2","observation_id":"77ea45f8-2840-451b-9988-e33d945942d2","resolution":{"observed_at":"2026-08-07T11:07:16.212447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:07:16.194327Z","title":"A method for the construction of minimum- redundancy codes,","venue":null,"work_id":"cc2715a0-efbd-4886-90e4-34dc3d531c20","year":1952},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:16.011508Z"},"links":{"citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:b288b2447b38ce83ee684feef85a44af3d0a408a6e3a0c06297ce2c05b9c645c","observation_id":"185acd47-4d21-42b7-9c1a-2d5c26d6f8d0","resolution":{"observed_at":"2026-08-07T11:07:16.198390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 2 inbound Pith citation observations for arXiv:2506.03515."}