{"as_of":"2026-08-07T10:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d60a392d82c042e54dcf6373d5fb7f435e02018a964d8d0e4eac838eee66bc1b","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:42:21.010007Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.15221/citation-record","integrity":"/paper/2507.15221/integrity","json":"/paper/2507.15221/citation-record.json","paper":"/paper/2507.15221"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.108894Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":"af6625bc-3961-4d71-964d-c811c401e9ea","year":2023},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.976759Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:e06a1ade29fa779a754a1bd59de566d7f980caab283370c9f14aa76941399892","observation_id":"7b33ba1b-3ef2-4e7a-840b-ab8de728d625","resolution":{"observed_at":"2026-08-06T15:42:21.111597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.101363Z","title":"Generalization through memorization: Nearest neighbor language models","venue":null,"work_id":"01d94c5a-896f-455e-81dc-fb58e229ac7d","year":2020},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.979585Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:1e3efaf5c29efae0cd2cab654ace46287708fa5f64ff9bfda988570cb1a40a87","observation_id":"04de155a-5985-471f-8f4a-84b6ae32a1d7","resolution":{"observed_at":"2026-08-06T15:42:21.104099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.093532Z","title":"Knn-ctc: Enhancing asr via retrieval of ctc pseudo labels","venue":null,"work_id":"063ccef9-bf4d-4cb1-a851-838b13a310ba","year":2023},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.982190Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:b4d3e50cca7b2ef8ad899b97091decd13831d45608ec08c4764e15466344f471","observation_id":"15149c78-6d82-4a48-9e5a-ccb549ee453e","resolution":{"observed_at":"2026-08-06T15:42:21.096729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.084961Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech","venue":null,"work_id":"a31be940-fcd7-4097-80dd-504b1510d8c5","year":2021},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.984718Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:eb3c6c46f099a824e42755d020b62aff0c6f2e04caaecb9c8ef09f0a28b8b548","observation_id":"0ded522b-8726-4cb4-b81a-3c92b226b445","resolution":{"observed_at":"2026-08-06T15:42:21.087602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-06T15:42:20.987345Z","title":"Neural codec language models are zero-shot text to speech synthesizers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.987345Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:43f8860ca4e46b0273e4d01003a4c5cbbd2542e2ee94a0daf34059f269c0d287","observation_id":"88e2b7df-ef30-4e6d-bbcf-ce04a4fa0eb1","resolution":{"observed_at":"2026-08-06T15:42:20.987345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.077754Z","title":"Retrieval-augmented generation for knowledge-intensive nlp tasks","venue":null,"work_id":"1c308420-2d2e-40fc-a87b-4bf48446e5fd","year":2020},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.990719Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:d1ca4987bf69016652d4423c49c88b99de11e62c2480fc37adea6d8ef64a868f","observation_id":"9dd2efd7-7d09-4e31-bb94-63ffe92ceabe","resolution":{"observed_at":"2026-08-06T15:42:21.080514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.069644Z","title":"Prajwal, V.P","venue":null,"work_id":"6adf7059-b556-45b6-8757-2fdfbb1b1055","year":2020},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.994507Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:8b9fb466cab02f7ddae6bf5a083a1c88fc6930dfdc7d9435f2d07922b5eb8dc9","observation_id":"888618da-f7eb-459a-ac85-4eebd85d27a7","resolution":{"observed_at":"2026-08-06T15:42:21.071959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.062427Z","title":"Geneface: Generalized and high-fidelity audio-driven 3d talking face synthesis","venue":null,"work_id":"7df24817-83f6-4520-ab1b-d7d750f36ac8","year":2023},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.997235Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:b1a7937da2036c4168fe68173a742bcfce4dd0a2ad945e5c7183bd46c06a9b74","observation_id":"84121515-6552-4673-89f8-0d788e8e1609","resolution":{"observed_at":"2026-08-06T15:42:21.065043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.053125Z","title":"Billion-scale similarity search with gpus","venue":null,"work_id":"fe52bd44-c054-4bec-a6f3-1a412a400a4a","year":2019},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:20.999631Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:474667f079d4762830802b828fad8fd14c1760aa30eb80e1a15f74e9b76a3859","observation_id":"450935a2-bdcd-4bb7-922d-e873eb7e28ce","resolution":{"observed_at":"2026-08-06T15:42:21.057499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12345","last_updated":"2024-05-20T19:42:20Z","snapshot_observed_at":"2026-07-06T18:16:59.602510Z","submitted_at":"2024-05-20T19:42:20Z","title":"Existence and uniqueness of solutions in the Lipschitz space of a functional equation and its application to the behavior of the paradise fish","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12345","snapshot_observed_at":"2026-08-06T15:42:21.001873Z","title":"Seniortalk: A chinese conversation dataset with rich annotations for super-aged seniors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:21.001873Z"},"links":{"cited_paper":"/paper/2405.12345","citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:c489c0dcc1947dac63725fa74965aa845f4f29dea31a43928ff76190ebad710c","observation_id":"4a74e431-69e2-4888-95d8-3d935b3310b4","resolution":{"observed_at":"2026-08-06T15:42:21.001873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18584","last_updated":"2025-03-19T12:06:13Z","snapshot_observed_at":"2026-07-06T19:23:15.534104Z","submitted_at":"2024-09-27T09:42:27Z","title":"ChildMandarin: A Comprehensive Mandarin Speech Dataset for Young Children Aged 3-5","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18584","snapshot_observed_at":"2026-08-06T15:42:21.004445Z","title":"Childmandarin: A comprehensive mandarin speech dataset for young children aged 3-5","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:21.004445Z"},"links":{"cited_paper":"/paper/2409.18584","citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:2789727bdcd03e6874795592a6e1ebb5bf622300e7694f18a529e19b8f7a7bdf","observation_id":"e40d4128-0aa4-4059-a1fc-ce39e6195fc0","resolution":{"observed_at":"2026-08-06T15:42:21.004445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.007103Z","title":", \" * write output.state after.block = add.period write","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:21.007103Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:8cf2787e5f8894168d958532dfb30d5c1386844f801e84bb0b55cf586b0774b9","observation_id":"d67ba584-5a70-4c51-b095-16daffcc9d50","resolution":{"observed_at":"2026-08-06T15:42:21.007103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:42:21.010007Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T15:42:21.010007Z"},"links":{"citing_paper":"/paper/2507.15221"},"observation_digest":"sha256:fe943aca6bdfcd18c44b88dfc5e3e1be0388da9728ba3b2a5e19da1832cffe15","observation_id":"6e403390-8e3c-4806-bb88-2e25b0b93d95","resolution":{"observed_at":"2026-08-06T15:42:21.010007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.15221","last_updated":"2025-07-21T03:47:45Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T15:35:28.753621Z","submitted_at":"2025-07-21T03:47:45Z","title":"EchoVoices: Preserving Generational Voices and Memories for Seniors and Children"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2507.15221."}