{"as_of":"2026-08-08T12:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3c40d3c86707b22a01c19abf6e0509c04ada8151d21e7375811247da3e1c3141","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:55:23.570722Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.12948","last_updated":"2024-10-16T18:34:07Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-16T18:34:07Z","title":"What Do Speech Foundation Models Not Learn About Speech?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12948","snapshot_observed_at":"2026-08-07T11:55:23.570722Z","title":"What do speech foundation models not learn about speech?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01133","last_updated":"2025-06-01T19:33:21Z","snapshot_observed_at":"2026-08-07T11:48:13.623646Z","submitted_at":"2025-06-01T19:33:21Z","title":"From Words to Waves: Analyzing Concept Formation in Speech and Text-Based Foundation Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.570722Z"},"links":{"cited_paper":"/paper/2410.12948","citing_paper":"/paper/2506.01133"},"observation_digest":"sha256:209dc88d9be85e704dfdf113016552bea3627560af08d84003f7caa09b23e9e4","observation_id":"40d3f00f-dc15-40de-ae50-6e4e6fbd9f3a","resolution":{"observed_at":"2026-08-07T11:55:23.570722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12948","last_updated":"2024-10-16T18:34:07Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-16T18:34:07Z","title":"What Do Speech Foundation Models Not Learn About Speech?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12948","snapshot_observed_at":"2026-08-07T11:32:44.635167Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02172","last_updated":"2025-06-02T18:58:41Z","snapshot_observed_at":"2026-08-07T11:26:56.619282Z","submitted_at":"2025-06-02T18:58:41Z","title":"Different Speech Translation Models Encode and Translate Speaker Gender Differently","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T11:32:44.635167Z"},"links":{"cited_paper":"/paper/2410.12948","citing_paper":"/paper/2506.02172"},"observation_digest":"sha256:cdb792b7c91b8b95812748a6ae31edb3d4e96130b3a177f864afc8532fc58aa1","observation_id":"999acf68-efbf-4c50-b55b-ff2897eed8a7","resolution":{"observed_at":"2026-08-07T11:32:44.635167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12948","last_updated":"2024-10-16T18:34:07Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-16T18:34:07Z","title":"What Do Speech Foundation Models Not Learn About Speech?","version":1},"cited_work":{"arxiv_id":"2410.12948","doi":"10.48550/arxiv.2410.12948","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What do speech foundation models not learn about speech?","venue":"arXiv (Cornell University)","work_id":"f242e0fc-1be0-406b-bfc6-5c6c49e0e7e6","year":2024},"citing_paper":{"arxiv_id":"2604.26347","last_updated":"2026-07-22T04:43:04Z","snapshot_observed_at":"2026-08-02T15:21:28.271483Z","submitted_at":"2026-04-29T06:59:48Z","title":"The False Resonance: A Critical Examination of Emotion Embedding Similarity for Speech Generation Evaluation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-07T12:34:40.888089Z"},"links":{"cited_paper":"/paper/2410.12948","citing_paper":"/paper/2604.26347"},"observation_digest":"sha256:bbf44e8346f387cea874fac192261eeb45f989111227691c9ef52866a2508554","observation_id":"67bc69b7-df09-40cf-8c2b-d0e31c101e30","resolution":{"observed_at":"2026-05-12T09:11:27.148970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12948","last_updated":"2024-10-16T18:34:07Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-16T18:34:07Z","title":"What Do Speech Foundation Models Not Learn About Speech?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12948","snapshot_observed_at":"2026-08-02T15:21:28.939831Z","title":"What do speech foundation models not learn about speech?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.26347","last_updated":"2026-07-22T04:43:04Z","snapshot_observed_at":"2026-08-02T15:21:28.271483Z","submitted_at":"2026-04-29T06:59:48Z","title":"The False Resonance: A Critical Examination of Emotion Embedding Similarity for Speech Generation Evaluation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T15:21:28.939831Z"},"links":{"cited_paper":"/paper/2410.12948","citing_paper":"/paper/2604.26347"},"observation_digest":"sha256:aa46a9681554ec63bbadc7403b7682bce49888a086ee9a5ef1078fde23f76c71","observation_id":"bbe20810-feb7-4343-9deb-7e70432ed19b","resolution":{"observed_at":"2026-08-02T15:21:28.939831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12948","last_updated":"2024-10-16T18:34:07Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-16T18:34:07Z","title":"What Do Speech Foundation Models Not Learn About Speech?","version":1},"cited_work":{"arxiv_id":"2410.12948","doi":"10.48550/arxiv.2410.12948","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What do speech foundation models not learn about speech?","venue":"arXiv (Cornell University)","work_id":"f242e0fc-1be0-406b-bfc6-5c6c49e0e7e6","year":2024},"citing_paper":{"arxiv_id":"2605.01381","last_updated":"2026-05-02T11:08:10Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T11:08:10Z","title":"A framework for analyzing concept representations in neural models","version":1},"reference_index":140,"source":"arxiv_source","source_observed_at":"2026-05-09T14:49:22.776209Z"},"links":{"cited_paper":"/paper/2410.12948","citing_paper":"/paper/2605.01381"},"observation_digest":"sha256:7dfb142ccc4739213f485121de69dfb0c558a38313dfba908a61445fde5739df","observation_id":"56265e80-ddc4-4b0e-b825-f74c75677b90","resolution":{"observed_at":"2026-05-09T22:18:59.137448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.12948/citation-record","integrity":"/paper/2410.12948/integrity","json":"/paper/2410.12948/citation-record.json","paper":"/paper/2410.12948"},"outbound":[],"paper":{"arxiv_id":"2410.12948","last_updated":"2024-10-16T18:34:07Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-16T18:34:07Z","title":"What Do Speech Foundation Models Not Learn About Speech?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2410.12948."}