{"as_of":"2026-08-12T17:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bc4de2a996790f7b530e28ca2f93e03c18ddd04f2c2ad5100227bf2237ad2def","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:22:49.287604Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.21407/citation-record","integrity":"/paper/2508.21407/integrity","json":"/paper/2508.21407/citation-record.json","paper":"/paper/2508.21407"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:53.345755Z","title":"MusicLDM: Enhancing novelty in text-to-music generation using beat-synchronous mixup strategies,","venue":null,"work_id":"942e3e37-c22c-4405-b223-0746b4681f2d","year":2024},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:46.856069Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:3372e20e2eba892f36cff98675dfda8b43f480491ae521484859102bf2060d38","observation_id":"84b03811-5093-4eb6-94a5-2226e005abfb","resolution":{"observed_at":"2026-08-05T14:22:53.413254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:53.151056Z","title":"Masked audio generation using a single non- autoregressive transformer,","venue":null,"work_id":"a2fd463d-853e-4cdc-83a5-fcd1a847843b","year":2024},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:46.931830Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:f4d944e394f048df5d5e9ba9db2bc06d8f82efd46298433a8084028d67c7572c","observation_id":"28fd8169-c73d-4beb-9aae-2fbf6d893ef6","resolution":{"observed_at":"2026-08-05T14:22:53.234220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05370","last_updated":"2024-06-17T04:39:08Z","snapshot_observed_at":"2026-08-08T07:23:06.245954Z","submitted_at":"2024-06-08T06:31:03Z","title":"VALL-E 2: Neural Codec Language Models are Human Parity Zero-Shot Text to Speech Synthesizers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05370","snapshot_observed_at":"2026-08-05T14:22:47.001462Z","title":"V ALL-E 2: Neural codec language models are hu- man parity zero-shot text to speech synthesizers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.001462Z"},"links":{"cited_paper":"/paper/2406.05370","citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:34d498c95bf205ce8fb95a1432a9001da0976cbb0a51ff100706b2a38cbbd0e1","observation_id":"986fe835-d4af-4a6d-886d-bc6c77efe5ff","resolution":{"observed_at":"2026-08-05T14:22:47.001462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-01T23:52:25.071174Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06885","snapshot_observed_at":"2026-08-05T14:22:47.082941Z","title":"F5-TTS: A fairytaler that fakes fluent and faithful speech with flow matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.082941Z"},"links":{"cited_paper":"/paper/2410.06885","citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:255b5c63b12d4d2740e79eca6a628f34b602d4e2bf2d058681df57583131998b","observation_id":"c30e0ee2-aebe-45ec-8876-4811e67e03ed","resolution":{"observed_at":"2026-08-05T14:22:47.082941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:52.994722Z","title":"Tango 2: Aligning diffusion-based text-to-audio generations through direct preference optimization,","venue":null,"work_id":"50b7335a-6a90-416e-a87f-de41672842bf","year":2024},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.171359Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:5e27de28656ba6f5681075c9318651648137b18e1a12710ae03d45e8c059d2a4","observation_id":"fa93170d-47f3-4b1d-8bac-a0df666e2b12","resolution":{"observed_at":"2026-08-05T14:22:53.073409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-08T16:07:44.435146Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-05T14:22:47.246835Z","title":"Fr ´echet audio distance: A metric for evaluating music enhancement algorithms,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.246835Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:ae63917f20369fcc1946b1c7fb92c0b883d0c50fa8d847061b3f31d14c8d5002","observation_id":"d4b63afb-1f56-45d2-9a00-ba91da03b10e","resolution":{"observed_at":"2026-08-05T14:22:47.246835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:52.839916Z","title":"Deep neural network embeddings for text-independent speaker verification,","venue":null,"work_id":"8dd71530-a32d-47fc-979a-0762099f17c4","year":2017},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.311643Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:ed4b1a146db608f1bcf7cd2a180cdc8b92dd72625a811258c35b05f735157114","observation_id":"6b61b1bd-8399-4eb1-9558-8f83c2327b46","resolution":{"observed_at":"2026-08-05T14:22:52.913364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:52.701402Z","title":"Attentive statistics pooling for deep speaker embedding,","venue":null,"work_id":"e1906785-8109-4600-bc82-37af029a2170","year":2018},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.394547Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:babf91f68f398f800513a4a915bd1d570dd1724d5405d352e6272eb7308380f3","observation_id":"80069db0-5db2-4642-8f8e-ed3b6fa9a8f6","resolution":{"observed_at":"2026-08-05T14:22:52.770044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:52.547240Z","title":"Attention is all you need,","venue":null,"work_id":"296bb44f-38d7-4163-a80c-192a6dbfeddc","year":2017},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.479909Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:5a6ae1647dcffc294d20ced546daa0e41dfedb150e710628519b8768f3b53d45","observation_id":"303bc5b7-7073-4533-a08a-664be24aaa33","resolution":{"observed_at":"2026-08-05T14:22:52.649181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:52.399066Z","title":"ECAPA-TDNN: Emphasized channel attention, propagation and aggregation in TDNN based speaker verification,","venue":null,"work_id":"e4ab6d57-b311-449a-9391-a2709679f9f7","year":2020},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.586839Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:0e933a74da82de00cffb9a91d89272c96bd1c78b0423c0f7a9b119c54c70a237","observation_id":"b2407de8-6d14-4c26-b8a1-0bc9c1ec0403","resolution":{"observed_at":"2026-08-05T14:22:52.471924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00332","last_updated":"2023-06-16T09:07:11Z","snapshot_observed_at":"2026-08-10T08:47:47.332079Z","submitted_at":"2023-03-01T08:50:31Z","title":"CAM++: A Fast and Efficient Network for Speaker Verification Using Context-Aware Masking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00332","snapshot_observed_at":"2026-08-05T14:22:47.686311Z","title":"CAM++: A fast and efficient network for speaker verification using context-aware masking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.686311Z"},"links":{"cited_paper":"/paper/2303.00332","citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:c7ac804d3e213e4f940c38f65d1e447b55074b7f64e8e2f4ca7faecdbe1abb5d","observation_id":"30aa2119-5b56-43ca-b1f6-497c92a57ab1","resolution":{"observed_at":"2026-08-05T14:22:47.686311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:52.287575Z","title":"V oiceID loss: Speech enhancement for speaker verification,","venue":null,"work_id":"93168f19-f23e-4c6f-ab8a-ec283f45b7e9","year":2019},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.750265Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:3dd18b90bd4797ef95df3ae46c3e71ff7c4a30da856ad5e005d17c52688027f7","observation_id":"9e2ce2ba-c6cd-4428-b5ee-e207f9ec895e","resolution":{"observed_at":"2026-08-05T14:22:52.357835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.00526","last_updated":"2020-05-07T04:45:41Z","snapshot_observed_at":"2026-08-10T04:35:39.726344Z","submitted_at":"2020-04-01T15:51:56Z","title":"Improved RawNet with Feature Map Scaling for Text-independent Speaker Verification using Raw Waveforms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.00526","snapshot_observed_at":"2026-08-05T14:22:47.829849Z","title":"Improved RawNet with feature map scaling for text-independent speaker verifica- tion using raw waveforms,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.829849Z"},"links":{"cited_paper":"/paper/2004.00526","citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:c173d3ba823756c540aa581e7a039742aefe0234562cae9c459920959e9f36fa","observation_id":"9cefc8d0-d6c0-4304-a551-947839580113","resolution":{"observed_at":"2026-08-05T14:22:47.829849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:52.144452Z","title":"ResSKNet-SSDP: Effective and light end-to-end architecture for speaker recognition,","venue":null,"work_id":"839926eb-d80b-4097-8539-31dd5b93a468","year":2023},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.905766Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:e4b209757b00ac091fcd6edf4d62b779b9913269eb87269c0d8e619a0941ece3","observation_id":"c4da1a5b-0efb-4cc3-9ec1-50344dbe91f4","resolution":{"observed_at":"2026-08-05T14:22:52.213291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:52.024284Z","title":"Deep segment attentive embedding for duration robust speaker verification,","venue":null,"work_id":"998e60f2-5370-4517-b934-315c2bba1ca6","year":2019},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:47.970305Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:e5cc42a8b5e98a2ca82e7ba592aaff1159f87ba99e29337cc46fb5ab5e5508ed","observation_id":"9e539c80-9abc-4f77-8381-0f6126dfc92c","resolution":{"observed_at":"2026-08-05T14:22:52.075819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:51.850845Z","title":"MusicEval: A generative music dataset with expert ratings for automatic text-to-music evaluation,","venue":null,"work_id":"bb9a2c58-128c-49a6-99e0-94b785095e3f","year":2025},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.049496Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:53e9c1837df897bc3fa250434cd456840b211166a36814dab2c0db111aee8927","observation_id":"1010ba86-8bc0-4751-b77d-2d4056acebb4","resolution":{"observed_at":"2026-08-05T14:22:51.919927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05139","last_updated":"2025-02-07T18:15:57Z","snapshot_observed_at":"2026-07-06T20:33:01.960703Z","submitted_at":"2025-02-07T18:15:57Z","title":"Meta Audiobox Aesthetics: Unified Automatic Quality Assessment for Speech, Music, and Sound","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05139","snapshot_observed_at":"2026-08-05T14:22:48.102873Z","title":"Meta audiobox aesthetics: Unified automatic quality assessment for speech, music, and sound,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.102873Z"},"links":{"cited_paper":"/paper/2502.05139","citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:790409c471b512a151f598d58b1ede84fd5a46489249d262afa958ae29164dc6","observation_id":"e799f815-b3ba-4efe-8770-aab7ca3e8a79","resolution":{"observed_at":"2026-08-05T14:22:48.102873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:51.718088Z","title":"Large-scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation,","venue":null,"work_id":"830d2675-53a5-42c8-8739-411018cb7736","year":2023},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.111551Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:81420f51295fb80335f45baf01289ccc0e49c7faa4ea18e6d272950e12c0e5a3","observation_id":"f340da02-f107-4fcf-9261-29ea9e2f197d","resolution":{"observed_at":"2026-08-05T14:22:51.775500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:51.571100Z","title":"Exploring the encoding layer and loss function in end-to-end speaker and language recognition system,","venue":null,"work_id":"7cefca9b-c8b9-4dfe-bfb6-8a7dc4eb0111","year":2018},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.201404Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:862267b98320ee17b35bd364a44485d2b7be664381f9e018f3be014c47080e9f","observation_id":"11f20ea0-7f46-4042-b0ba-f56291dc6e67","resolution":{"observed_at":"2026-08-05T14:22:51.644718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:51.407790Z","title":"Self-attentive speaker embeddings for text-independent speaker verification,","venue":null,"work_id":"c16f4d60-b1c6-4c21-b9b8-3abc2023f715","year":2018},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.310128Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:f4679f406c51dd97583fbd8132b93f25cc402d771ed959814ca7750fc430e494","observation_id":"c3a3fc5f-e16b-4464-9373-4d58ee843195","resolution":{"observed_at":"2026-08-05T14:22:51.488658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:51.244001Z","title":"Self multi-head attention for speaker recognition,","venue":null,"work_id":"679514e2-f5c5-4a9a-915d-5a86fcc46925","year":2019},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.355394Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:c4aa39f59204b3ae34424b24e7acd85c03cbb6bf094572fc4334ef552966c9e0","observation_id":"76aa0763-e766-4222-910f-2041090107cd","resolution":{"observed_at":"2026-08-05T14:22:51.347918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:51.028720Z","title":"Vector-based attentive pooling for text-independent speaker verification,","venue":null,"work_id":"871f9797-6f47-44ba-8c45-a62c881a0c47","year":2020},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.460106Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:3bd3cb9897fa0385a9b909476753c41c19dfab72c3a5c64518d827d6f1faa804","observation_id":"69d5331b-0e83-447e-af62-82ef3fb87abc","resolution":{"observed_at":"2026-08-05T14:22:51.109082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:50.853897Z","title":"RSKNet-MTSP: Effective and portable deep architecture for speaker verification,","venue":null,"work_id":"f2fd59a4-75f8-457b-af3b-9909c2f68f07","year":2022},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.617793Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:b90967f86c62b58b706a860786c655cad3d21b28102b338ed2417bc21a374716","observation_id":"34c9633a-d80e-47df-b619-11db0f25d735","resolution":{"observed_at":"2026-08-05T14:22:50.923273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:50.713541Z","title":"Multi-resolution multi-head attention in deep speaker embedding,","venue":null,"work_id":"80d8708c-b075-48c8-a4e0-f30cb9be1096","year":2020},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.699514Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:6ae22f3e49c07d05920e80d29ac4bbfa1987082871d576b42558e0b5a7bd110b","observation_id":"d08f0789-eb84-4b38-b35c-882de7af8221","resolution":{"observed_at":"2026-08-05T14:22:50.807057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:50.493053Z","title":"NetVLAD: CNN architecture for weakly supervised place recognition,","venue":null,"work_id":"4c7451c6-123c-478a-bf4d-9f905ce99d99","year":2016},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.820549Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:44e53c2870b0173fb58dca49c9f245be35b51f0ff76cdac608eddb070df49868","observation_id":"8383e420-07fa-492e-bb4d-084a7e2678db","resolution":{"observed_at":"2026-08-05T14:22:50.587804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:50.226463Z","title":"GhostVLAD for set- based face recognition,","venue":null,"work_id":"007eda74-da71-4c5a-bd6b-bfaff9e90135","year":2018},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:48.967002Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:1e49f923d121986387748eef40949ae9135f82917acc5830fefee634c36f0c27","observation_id":"9e220270-3237-4e30-9fd1-53948ad89b52","resolution":{"observed_at":"2026-08-05T14:22:50.391939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:50.030509Z","title":"Neural aggregation network for video face recognition,","venue":null,"work_id":"54a5e322-c946-4e52-8e1a-85b9a2091496","year":2017},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:49.070316Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:0bf7f43b458809e8ad76370f958e41c76e8e667bff0d749405718428cdef75bf","observation_id":"82e405d1-2ce7-47ba-ba52-1461df4b3428","resolution":{"observed_at":"2026-08-05T14:22:50.124959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:49.777728Z","title":"Quality aware network for set to set recognition,","venue":null,"work_id":"590a72f0-553e-4146-a81b-20c4d9f5a656","year":2017},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:49.168400Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:e3b7da0baade2c1659b4bdbfeac01f3931f38fa7bdd8dfb07c8bb8bba00064ac","observation_id":"17410fc8-c5de-4c95-adcd-a3307f759b23","resolution":{"observed_at":"2026-08-05T14:22:49.885954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:22:49.516599Z","title":"Generalization ability of MOS prediction networks,","venue":null,"work_id":"2432aa1a-20f5-48d8-9297-6a5147ec6375","year":2022},"citing_paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:49.287604Z"},"links":{"citing_paper":"/paper/2508.21407"},"observation_digest":"sha256:528fb91bfc0594bd7126fe475a2eeaa19a30439ec2de89fc65dc8770f02d9430","observation_id":"ad12a7fa-8fc7-4893-b1ca-71140829cde9","resolution":{"observed_at":"2026-08-05T14:22:49.597372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.21407","last_updated":"2025-08-29T08:27:17Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-10T05:31:41.315495Z","submitted_at":"2025-08-29T08:27:17Z","title":"DRASP: A Dual-Resolution Attentive Statistics Pooling Framework for Automatic MOS Prediction"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2508.21407."}