{"as_of":"2026-08-08T14:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:27e027cbf81232e1814a9c259cceb331a603a82ae3ced6f2ddf44f39b0b668b0","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:32:33.285818Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:32:30.545138Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-09T05:50:28.389296Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21445","snapshot_observed_at":"2026-08-07T13:32:30.545138Z","title":"However, both face challenges related to aging [3, 4, 5]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:30.545138Z"},"links":{"cited_paper":"/paper/2505.21445","citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:be0fbb02b51b8dc2cf6693f0c41416d352e22211d8cab6c99277ff0ad383a478","observation_id":"a59cbd6c-1c5b-437b-affe-cc855b45a828","resolution":{"observed_at":"2026-08-07T13:32:30.545138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"cited_work":{"arxiv_id":"2505.21445","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21445","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V oxaging: Continuously tracking speaker aging with a large-scale longitudinal dataset in english and mandarin","venue":null,"work_id":"27bc4a84-86ba-47f2-8da8-bca0733357f2","year":2025},"citing_paper":{"arxiv_id":"2605.01597","last_updated":"2026-05-02T20:11:12Z","snapshot_observed_at":"2026-08-03T00:52:48.762187Z","submitted_at":"2026-05-02T20:11:12Z","title":"Toward Fair Speech Technologies: A Comprehensive Survey of Bias and Fairness in Speech AI","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-08T19:27:18.774649Z"},"links":{"cited_paper":"/paper/2505.21445","citing_paper":"/paper/2605.01597"},"observation_digest":"sha256:bc8548c784cd3dd14f8a735aa0250f837b0439f81ed7940ec371f7d2054dc35c","observation_id":"7e4fa5dd-adcb-44ae-9807-643420cbe6ab","resolution":{"observed_at":"2026-05-09T05:50:28.393244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21445/citation-record","integrity":"/paper/2505.21445/integrity","json":"/paper/2505.21445/citation-record.json","paper":"/paper/2505.21445"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21445","snapshot_observed_at":"2026-08-07T13:32:30.545138Z","title":"However, both face challenges related to aging [3, 4, 5]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:30.545138Z"},"links":{"cited_paper":"/paper/2505.21445","citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:be0fbb02b51b8dc2cf6693f0c41416d352e22211d8cab6c99277ff0ad383a478","observation_id":"a59cbd6c-1c5b-437b-affe-cc855b45a828","resolution":{"observed_at":"2026-08-07T13:32:30.545138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:39.753201Z","title":"Previous speaker aging datasets As shown in Table 1, existing speaker aging datasets can be classified into two types: discrete and continuous, based on ses- sion intervals","venue":null,"work_id":"ab8ee4e3-3116-4e5e-bc76-c6e735253413","year":2017},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:30.676994Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:e03d430f2161bcf3665177148408d4f31bb0292f9a3550b421b4d73c371cd25e","observation_id":"787d9d0f-c7c1-464c-a759-a5c6581d997c","resolution":{"observed_at":"2026-08-07T13:32:39.854114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:39.373938Z","title":"Data setting As shown in Table 2, the data settings of V oxAging include ”X- Independent” and ”X-Dependent” configurations","venue":null,"work_id":"2b183f9c-19cb-4417-9f79-ed35a4d4bdae","year":null},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:30.867113Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:ef31665095843a14f6122b4d25089b1e54868600d16b4b10f027fd05ee3be517","observation_id":"419fc275-e8fd-4662-a6de-1d1552fe1986","resolution":{"observed_at":"2026-08-07T13:32:39.463512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:39.254294Z","title":"Impact of speaker aging on advanced speaker verifica- tion systems Table 3 shows the impact of speaker aging on advanced speaker verification systems","venue":null,"work_id":"ca650ec1-cf46-439d-8917-f2dcf67bb298","year":null},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:30.936503Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:98a17380cc422920e2e35aa4c556a3966f92a0182c3f51d4fe9aab168c36f2b3","observation_id":"78b6ec77-124d-4c20-9858-4492577d5956","resolution":{"observed_at":"2026-08-07T13:32:39.306386Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:39.028361Z","title":"It includes recordings from 293 speakers (226 English and 67 Mandarin) over a span of 17 years, totaling 7,522 hours, with weekly samples","venue":null,"work_id":"f9127821-81ed-4a9b-adb3-85498758847a","year":null},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:30.979112Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:ef6d4d85eb8e8ffe39bbc7a9d22bf6f932cf8b42db3a6f728163a962bc3dadb4","observation_id":"cee93563-b08d-4a3e-8f5a-d67c3a2863f9","resolution":{"observed_at":"2026-08-07T13:32:39.123741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:37.981848Z","title":"Evaluation and calibration of short- term aging effects in speaker verification,","venue":null,"work_id":"708d047a-1be7-4756-952c-e8134eb54fb4","year":2015},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.187436Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:b45819e9d0f6a3b84bae3797f68cb30bb53259a97e58c95b60eeca72759918b0","observation_id":"4d04559f-7b37-4521-ab3a-bb087b759c7b","resolution":{"observed_at":"2026-08-07T13:32:38.066388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:38.850823Z","title":"Face recognition: A literature survey,","venue":null,"work_id":"4480c422-8ea8-4f02-ac9a-67ee26dcf73b","year":2003},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.008965Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:2127446db8f3e35f92e344f7b4ecddd6bd22ecc217ec3e35ad7761f3ccfb04f9","observation_id":"fa4df2ca-69c3-4610-aaa5-0f4bfbdc36a1","resolution":{"observed_at":"2026-08-07T13:32:38.929128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:38.682091Z","title":"A survey of speaker recognition: Fundamental theories, recogni- tion methods and opportunities,","venue":null,"work_id":"ace3283b-1850-4a1b-95d1-9fc5ebb95218","year":2021},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.033755Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:9d027e6a0eacbeb5c8e600d71d41e214329666c6bbfe88916d68b8447845e98b","observation_id":"1a200372-9553-4c78-b402-a3294ffee69e","resolution":{"observed_at":"2026-08-07T13:32:38.757482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:38.494367Z","title":"Investigating long-term and short-term time-varying speaker verification,","venue":null,"work_id":"bdc56e11-f0d9-43c8-ac63-602a5d2e7e47","year":2024},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.057914Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:623942d6a5e2fbbacb297ec645c6270c344a89b699e45ec1dabf5fac7cb8a40b","observation_id":"ba9b94f6-935c-43cc-ab94-908d1209d3e3","resolution":{"observed_at":"2026-08-07T13:32:38.590873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:38.311760Z","title":"Speaker verification with long-term ageing data,","venue":null,"work_id":"e7074629-df46-44b4-8628-64f499fca1e3","year":2012},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.084755Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:31136e574076dad921567b878c089cb2b3329dd4a00f3b9d97632a3e7f58d62c","observation_id":"cf744214-054f-4fe4-b22a-8ed5eaa8f213","resolution":{"observed_at":"2026-08-07T13:32:38.397086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:38.174046Z","title":"Age invariant face recognition methods: A review,","venue":null,"work_id":"d861d219-7413-4be3-a296-bb5687c49d8c","year":2021},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.159794Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:171fe772700ecc6b343f597cda5d9fe0b38a67aa70e01ead565fc507923a8654","observation_id":"de5e4a97-865d-4c5f-bb1e-0b304195ae6b","resolution":{"observed_at":"2026-08-07T13:32:38.226978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:37.048274Z","title":"Effects of physiological aging on selected acoustic characteristics of voice,","venue":null,"work_id":"bf5ce913-4490-4784-be77-8b8a28c85f55","year":1983},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.534039Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:ecbdb97978e23348dbc48c25e012ccb742c6f8bfb4522813ebc5de69d0633d90","observation_id":"2bf23a17-f30e-432f-ad60-2bf33eb23d1b","resolution":{"observed_at":"2026-08-07T13:32:37.139929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:37.809664Z","title":"Score-aging calibration for speaker verification,","venue":null,"work_id":"b63b5b85-fcca-43fd-bfb8-687b5ec483c3","year":2016},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.241696Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:11bf985c40ceaf00104adc6db49d3fdfe2523cc197d91dbe93b241797c77faab","observation_id":"960d122f-b4e5-476c-b409-d87f180169e2","resolution":{"observed_at":"2026-08-07T13:32:37.903529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:37.680539Z","title":"Cross-age speaker verification: Learning age-invariant speaker embeddings,","venue":null,"work_id":"69108b9e-7c87-4148-86dd-db2cb0d7f068","year":2022},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.285174Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:50a1a001d6b4455b5e977c35b1cde4c2074385698744c7229d0c5cff726f0fa0","observation_id":"ff3449c2-1510-4957-b3ee-9db6d1bf7b09","resolution":{"observed_at":"2026-08-07T13:32:37.724077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:37.526184Z","title":"Speaker verification across ages: Investigating deep speaker embedding sensitivity to age mismatch in enrollment and test speech,","venue":null,"work_id":"35e42d1d-7e24-4162-b240-63c6ab506e93","year":2023},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.326400Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:4e8e9d09ebea14d75043534ece657fc8705b2c787832b7f8cb7b4d433fcc3ff5","observation_id":"219b8e7b-bc1b-4bc1-88b8-de7e08d21fb8","resolution":{"observed_at":"2026-08-07T13:32:37.571838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:37.410933Z","title":"V ocal aging effects on f0 and the first formant: A longitudinal analysis in adult speakers,","venue":null,"work_id":"50b72b00-9c43-4734-aa70-fc3354d41ae7","year":2010},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.398723Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:0e9ad5cfc8d8c8d97e0a8425fed206ddc3a0ffe454bedc3f86e25f142781939f","observation_id":"c9ee2c5c-a92e-4cb8-8402-d3fb9c84e4e9","resolution":{"observed_at":"2026-08-07T13:32:37.452757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:37.236568Z","title":"The role of age in factor analysis for speaker identification,","venue":null,"work_id":"d43e2077-af1b-46f5-a14f-ee0c40d220bb","year":2009},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.455515Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:0ffc206d67b78f39a09a37d218c46ce06471606f21a9f9c6db993fda3a8f89ec","observation_id":"0e15feba-3108-4bbc-9277-71737c30fba8","resolution":{"observed_at":"2026-08-07T13:32:37.309558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:35.824979Z","title":"Cn-celeb- av: A multi-genre audio-visual dataset for person recognition,","venue":null,"work_id":"60ff29de-c851-4f95-81ea-7016419149f5","year":2023},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.043599Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:f9f10ae909512f2ac7326d0b3b543f2da267b077c7b1ae2b5efecba9b01c2e2b","observation_id":"01a884fb-79c0-483e-867d-8c639b7c9833","resolution":{"observed_at":"2026-08-07T13:32:35.919064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:36.859940Z","title":"Speaker veri- fication using adapted gaussian mixture models,","venue":null,"work_id":"d758a7ff-86d9-4fd2-b65a-94350c0ea55a","year":2000},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.644584Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:ea0e2fba9482daab46dcd8caca60a3f617b07bc19e5fc85e4c516e5fbe63ea72","observation_id":"e9a94cd6-00cd-48ad-808e-2626fdfefa9e","resolution":{"observed_at":"2026-08-07T13:32:36.959051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:39.593940Z","title":"The intersection of visual and audio boundaries is then calculated to define each seg- ment","venue":null,"work_id":"b9b14e0c-cd5d-4226-90f8-eed88f9df177","year":null},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:30.736351Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:9288a3fae43a9b18b1548cd4d8d72cb5cbcc6ac7e9c11c5fe3bda90ab6a4e9a6","observation_id":"90e9cf6c-3dfd-4d63-ae5e-4965835ca842","resolution":{"observed_at":"2026-08-07T13:32:39.658978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:36.682394Z","title":"Improving speaker verification performance against long-term speaker vari- ability,","venue":null,"work_id":"fa343a05-be89-43f9-93ac-b418633709fc","year":2016},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.743033Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:e75ccb247087f7870f41afd426b44a164048fdcd37dd63634410294c88913417","observation_id":"e3c5e6c9-0add-49e6-ba6e-922682433429","resolution":{"observed_at":"2026-08-07T13:32:36.746668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:36.510040Z","title":"The multi-session audio research project (marp) corpus: goals, design and initial findings,","venue":null,"work_id":"cc658cd7-2da8-4802-b7c4-cf62a22d6a3b","year":2009},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.870560Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:2ee9362386349cba3d94065e67e551d679f1afb781e8554cd652aee099a7e6af","observation_id":"41c54b13-3d97-4dea-a117-24e8423488a1","resolution":{"observed_at":"2026-08-07T13:32:36.589068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:36.274767Z","title":"Investigating long-term and short-term time-varying speaker verification,","venue":null,"work_id":"2d925bdc-66a2-41b3-af7d-a9280e075686","year":2024},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.911563Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:c53330b525df48be5e0c218186f5c31dcfa1700443cd0871260ec92b8bf47bb0","observation_id":"4fa41e8d-653f-4796-b9d2-f66a866a19bb","resolution":{"observed_at":"2026-08-07T13:32:36.370259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:36.025910Z","title":"V oxceleb: A large- scale speaker identification dataset,","venue":null,"work_id":"ea61f0da-a9fb-4b65-a14d-1e2d4022a8a1","year":2017},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:31.946140Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:83aa8e3cc24b164511b5ee27acdd9617aa818eb9a2b06852abc9ea3f739ac414","observation_id":"d9bcfd85-2a68-4f12-8250-137d91975668","resolution":{"observed_at":"2026-08-07T13:32:36.139684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:35.612562Z","title":"Yolo- world: Real-time open-vocabulary object detection,","venue":null,"work_id":"73092b30-5cd3-48aa-bb59-824b60cdedfb","year":2024},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.126429Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:810e3c2a443efae183c7c0ee20f41e96ea775e37f97c333d038c5bed11aa80bd","observation_id":"429b923a-32a1-424c-90eb-d0494c687346","resolution":{"observed_at":"2026-08-07T13:32:35.695269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:35.392505Z","title":"Funasr: A fundamental end-to-end speech recognition toolkit,","venue":null,"work_id":"361ef2d2-fd12-4035-8dea-257e8578706f","year":2023},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.182565Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:63ae904836c36e0acbff8630d6f08040a72ffd684642d536f78132cfb1b704f9","observation_id":"69f2cc28-3bd8-4899-93bc-f52b4e8394e7","resolution":{"observed_at":"2026-08-07T13:32:35.474101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:32.269133Z","title":"Arcface: Additive angular margin loss for deep face recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.269133Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:85e620f4531c80072ab62a6b204e4aa4765314c5e7c005cac513464afc25518c","observation_id":"eed86edd-d775-4ca3-a09d-154aaa6695df","resolution":{"observed_at":"2026-08-07T13:32:32.269133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:32.376783Z","title":"Ecapa-tdnn: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.376783Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:a62c25db4b1c0ffb726bb144a0069513122f80560723135d42d0da752c09530c","observation_id":"0164df48-11c1-428e-b5ca-3c9e2da65ec8","resolution":{"observed_at":"2026-08-07T13:32:32.376783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:32.442229Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.442229Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:a586e163a307a3ad3bd8cbb1b76bf3cf0aa933a0304a2c2a22d9711965460d45","observation_id":"5ef32ed7-c332-489a-be18-268b0892d5cb","resolution":{"observed_at":"2026-08-07T13:32:32.442229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:35.056747Z","title":"Hyperextended lightface: A facial attribute analysis framework,","venue":null,"work_id":"63dc143f-faeb-4716-9d9c-3b78793415ba","year":2021},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.525990Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:a7fdf38fd4d52c949b18d9f2efac9737e65c993bf34e4448c7d723bce20ff094","observation_id":"5ada4760-9d9a-4cfb-8a6c-3849b4235646","resolution":{"observed_at":"2026-08-07T13:32:35.156508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:34.808898Z","title":"Emobox: Multilingual multi-corpus speech emotion recognition toolkit and benchmark,","venue":null,"work_id":"0963bc3e-d67f-4cc5-bb7f-60180286bbd0","year":2024},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.586269Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:052873fe68aa87c38aca10a25cb534c8ac2c954dfa229ba0f59948311f6c405c","observation_id":"c70c1f55-981b-434f-9a32-bcc411373af8","resolution":{"observed_at":"2026-08-07T13:32:34.946739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15147","last_updated":"2022-03-28T23:47:57Z","snapshot_observed_at":"2026-08-05T16:38:44.509543Z","submitted_at":"2022-03-28T23:47:57Z","title":"Separate What You Describe: Language-Queried Audio Source Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15147","snapshot_observed_at":"2026-08-07T13:32:32.706788Z","title":"Separate what you describe: Language-queried audio source separation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.706788Z"},"links":{"cited_paper":"/paper/2203.15147","citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:98bb74c6d0435181eea07cae99205956cabc68a2dd6b471a8e6fd87eaf32848d","observation_id":"be35bd20-bff7-4f64-a496-769d60154a69","resolution":{"observed_at":"2026-08-07T13:32:32.706788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15354","last_updated":"2023-09-25T02:36:41Z","snapshot_observed_at":"2026-08-07T07:23:53.931725Z","submitted_at":"2023-06-27T10:09:43Z","title":"3D-Speaker: A Large-Scale Multi-Device, Multi-Distance, and Multi-Dialect Corpus for Speech Representation Disentanglement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15354","snapshot_observed_at":"2026-08-07T13:32:32.813536Z","title":"3d-speaker: A large-scale multi-device, multi-distance, and multi-dialect cor- pus for speech representation disentanglement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.813536Z"},"links":{"cited_paper":"/paper/2306.15354","citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:8b0346090a890e37acb2d329e77b690fac20c070875cbc836c70e22eb8c51307","observation_id":"05674538-aa95-487b-adc8-d195f47d14ff","resolution":{"observed_at":"2026-08-07T13:32:32.813536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:34.538801Z","title":"Pushing the limits of self-supervised speaker verification using regular- ized distillation framework,","venue":null,"work_id":"3e4e8955-02ec-467a-a80f-9179925764db","year":2023},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:32.887356Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:8663ed2d4d13fa00b469f8ffcec5e0fa078340079a2def69919b830f98a5a10b","observation_id":"030f84fe-bf2b-43e6-85a0-535678e6e0b2","resolution":{"observed_at":"2026-08-07T13:32:34.657025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:34.275358Z","title":"X-vectors: Robust dnn embeddings for speaker recognition,","venue":null,"work_id":"292cc291-c0ef-47e2-b827-d3aad2e7c9c7","year":2018},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:33.012315Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:09fd93a382994406dc9814d25f83d731156e18ebd176e0b6fe114e0890d0279e","observation_id":"ad507074-ac13-4858-9f3e-67c2699b1145","resolution":{"observed_at":"2026-08-07T13:32:34.428007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11169","last_updated":"2024-06-25T06:24:39Z","snapshot_observed_at":"2026-07-06T18:31:53.591578Z","submitted_at":"2024-06-17T03:20:11Z","title":"Self-Distillation Prototypes Network: Learning Robust Speaker Representations without Supervision","version":2},"cited_work":{"arxiv_id":"2406.11169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.11169","snapshot_observed_at":"2026-08-07T13:32:33.608413Z","title":"Self-Distillation Prototypes Network: Learning Robust Speaker Representations without Supervision","venue":"eess.AS","work_id":"c94f902c-36b4-4abc-8474-f006b39db2a6","year":2024},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:33.063427Z"},"links":{"cited_paper":"/paper/2406.11169","citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:00e67da285e6f40b7cccc51bfd0cf63945e1db73320f92bd953f3f547cf2b80d","observation_id":"b9d26070-d13f-40d7-8016-65ef03fb74a2","resolution":{"observed_at":"2026-08-07T13:32:33.694107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00332","last_updated":"2023-06-16T09:07:11Z","snapshot_observed_at":"2026-08-05T18:44:00.793642Z","submitted_at":"2023-03-01T08:50:31Z","title":"CAM++: A Fast and Efficient Network for Speaker Verification Using Context-Aware Masking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00332","snapshot_observed_at":"2026-08-07T13:32:33.180493Z","title":"Cam++: A fast and efficient network for speaker verification using context- aware masking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:33.180493Z"},"links":{"cited_paper":"/paper/2303.00332","citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:4efec7f12a36c174718c91196c0a0937a3fe39145353ae97f9c24fccd357e84a","observation_id":"e320bea5-6e39-462c-a823-256f39134ddf","resolution":{"observed_at":"2026-08-07T13:32:33.180493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:32:34.035325Z","title":"An enhanced res2net with local and global feature fusion for speaker verification,","venue":null,"work_id":"9a1a6c2b-dc27-4001-b7d2-7c55a7d40201","year":2023},"citing_paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:32:33.285818Z"},"links":{"citing_paper":"/paper/2505.21445"},"observation_digest":"sha256:86731a3d0068d43392ebf27d9c52f4f581d1eaa2419cee41dd088d0de15bbc6a","observation_id":"8530901d-01a7-456b-88da-cb198997a729","resolution":{"observed_at":"2026-08-07T13:32:34.117825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21445","last_updated":"2025-05-27T17:16:59Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T13:25:17.303544Z","submitted_at":"2025-05-27T17:16:59Z","title":"VoxAging: Continuously Tracking Speaker Aging with a Large-Scale Longitudinal Dataset in English and Mandarin"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":29},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 2 inbound Pith citation observations for arXiv:2505.21445."}