{"as_of":"2026-08-08T07:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a53ad596f2f8ed90cec09ae47fa568f07730e0a75e7e826f273aefa1362ed415","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:32:17.610645Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:32:13.765343Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T11:32:17.963370Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"cited_work":{"arxiv_id":"2506.02181","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02181","snapshot_observed_at":"2026-08-07T11:32:17.963370Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","venue":"cs.CL","work_id":"3e06c9d4-24cb-4dce-aa67-06b109b9e287","year":2025},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:13.765343Z"},"links":{"cited_paper":"/paper/2506.02181","citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:fd278bf44154299419587db4b5c51010276c94ebebafa2f388dc4826712e4590","observation_id":"0b075e5a-482f-47e0-ab8a-9b01b6920469","resolution":{"observed_at":"2026-08-07T11:32:18.040121Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02181/citation-record","integrity":"/paper/2506.02181/integrity","json":"/paper/2506.02181/citation-record.json","paper":"/paper/2506.02181"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:25.602331Z","title":null,"venue":null,"work_id":"cae9b231-54ee-4ae3-ae62-4e677f9b4f73","year":null},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:13.696269Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:97a2d05210efc52c41adfa64a499f14ac4f3070ce01684c6bf123a7b10692bf0","observation_id":"32be8668-a1d0-4b36-9bae-41ad920028b8","resolution":{"observed_at":"2026-08-07T11:32:25.650868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"cited_work":{"arxiv_id":"2506.02181","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02181","snapshot_observed_at":"2026-08-07T11:32:17.963370Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","venue":"cs.CL","work_id":"3e06c9d4-24cb-4dce-aa67-06b109b9e287","year":2025},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:13.765343Z"},"links":{"cited_paper":"/paper/2506.02181","citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:fd278bf44154299419587db4b5c51010276c94ebebafa2f388dc4826712e4590","observation_id":"0b075e5a-482f-47e0-ab8a-9b01b6920469","resolution":{"observed_at":"2026-08-07T11:32:18.040121Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:25.433599Z","title":"Output text is encoded into BPE","venue":null,"work_id":"1e751472-8ab0-4f23-914c-39df773c0231","year":null},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:13.851341Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:46592fe358a6e26cd43763b9b3e29eb7826174a6afd68580ba9e8699215ea28e","observation_id":"b0cc402e-91c3-4731-bb11-86d9ab1b1021","resolution":{"observed_at":"2026-08-07T11:32:25.519045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:25.056826Z","title":"Time Fig","venue":null,"work_id":"0a125716-7ad1-4ab8-b730-fdd6d8bbe35f","year":null},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.077263Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:faa24e1a1f8796f4af9642c743d346fa4569d7ae9d9d1248cf6416951aa62908","observation_id":"55b8654c-edf4-4196-a818-749efbd5c139","resolution":{"observed_at":"2026-08-07T11:32:25.090547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:25.161548Z","title":"The encoder layers use a convolution kernel size of31, an em- bedding size of512, and a linear layer hidden size of 2 048","venue":null,"work_id":"e49f7d6e-34d3-4295-9ee5-9ab185d8c6a8","year":null},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:13.957612Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:b7872339a86ff43fb8b5f7966eaaba8bc1feaf96045685130a68dbf3bcab06a4","observation_id":"df277d58-ba0c-4348-87c0-c04a91f3b2e3","resolution":{"observed_at":"2026-08-07T11:32:25.248711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:24.841459Z","title":null,"venue":null,"work_id":"2f086064-7106-4396-aa77-60c4e25927a0","year":null},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.179728Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:e177f989ff12b8131312549b0e327186404bf0ffaa2c756eb1b49fd4203f155b","observation_id":"237cf734-eaba-43a1-a1a0-261ae9493e39","resolution":{"observed_at":"2026-08-07T11:32:24.899323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:24.964832Z","title":"This is the first in-depth analysis of saliency maps in relation to fine-grained acoustic patterns across three phoneme classes","venue":null,"work_id":"54a9dd8b-77cc-4b9a-bc13-0c8b1758f063","year":null},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.125900Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:784696ba9e929db7e988bb6c98234c240367224f9aefcd8b490b6cb45ea59154","observation_id":"192b2f02-aa97-4c3d-82e6-7deffcdda717","resolution":{"observed_at":"2026-08-07T11:32:25.001122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:23.299291Z","title":"Understanding the representa- tion and computation of multilayer perceptrons: A case study in speech recognition,","venue":null,"work_id":"a2ed62e7-cf3a-42d3-82ba-80c7ff1417e0","year":2017},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.927096Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:31761fde77b730d0e9f073859918d36b45ac63922f8a34158e9dc269c00797eb","observation_id":"bfa9bd22-277f-41f7-99d1-40563c5d85ee","resolution":{"observed_at":"2026-08-07T11:32:23.407824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:24.618317Z","title":"Analyzing phonetic and graphemic representations in end-to-end automatic speech recog- nition,","venue":null,"work_id":"34c9f2a4-4ee3-4c41-a263-e0781ee395d0","year":2019},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.217408Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:c161e17ede6fbe0fa8b02ee82cabaddf59e44faf687e97f4604e76aacd4d3c44","observation_id":"8427c8e7-6bed-4d11-9105-189ad95a3a56","resolution":{"observed_at":"2026-08-07T11:32:24.714209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:24.388354Z","title":"Probing phoneme, language and speaker information in unsupervised speech representations,","venue":null,"work_id":"fb4e2295-1d74-4ab1-95c1-9abdf225543f","year":2022},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.303707Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:597a710757d30093987734d9df78ac6fabd22802c4a67969d2b988e8654ee7bd","observation_id":"29201fdd-5aa4-4714-9f74-777854121a46","resolution":{"observed_at":"2026-08-07T11:32:24.485514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:24.257066Z","title":"Domain-Informed Probing of wav2vec 2.0 Embeddings for Pho- netic Features,","venue":null,"work_id":"f12da747-6440-4d37-b135-f64f3d0bb77c","year":2022},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.412565Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:777a653cb6489a53e7e80bbdf72fd6b5832fbf3276fdc76a236088e573250b6a","observation_id":"dbe9d202-7fd3-4c78-aeab-be3dba4606a2","resolution":{"observed_at":"2026-08-07T11:32:24.312303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:24.043243Z","title":"Probing self- supervised speech models for phonetic and phonemic informa- tion: A case study in aspiration,","venue":null,"work_id":"c9ed01ff-0c6b-456a-b890-9d939a3dfb39","year":2023},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.556191Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:529b9cbc81eb6be67dbbed4ec2afd32e6e56f2bbe5eb055e510937adbb158f6d","observation_id":"d1e2d11f-e127-44a7-88c1-9123d62fd077","resolution":{"observed_at":"2026-08-07T11:32:24.127112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:23.818388Z","title":"Self-supervised speech representations are more phonetic than semantic,","venue":null,"work_id":"c5114d3e-d08e-4522-9f8f-853e009e6c1d","year":2024},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.636029Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:b9107317eacc120a5301fbd946bce88058679a306685b034b3ae42f5581662d1","observation_id":"c469bcd5-9759-4445-90a0-6495cc0b9107","resolution":{"observed_at":"2026-08-07T11:32:23.912683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:23.676261Z","title":"Encoding of phonol- ogy in a recurrent neural model of grounded speech,","venue":null,"work_id":"51f65c0a-43b0-4715-8bd3-2731eca2e522","year":2017},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.725407Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:01c4ed0ebad7bfe686682c673b9d21c2332ce6d37515187a3a3810b653ab3f18","observation_id":"a9a232c3-1c1d-478b-b710-8fb9d5be4099","resolution":{"observed_at":"2026-08-07T11:32:23.745518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:23.500349Z","title":"Learn- ing weakly supervised multimodal phoneme embeddings,","venue":null,"work_id":"e4d7c9e5-77d6-43b4-a1c3-df45af143dc1","year":2017},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:14.829948Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:3c6508efe7e0fc6ad81633f16654b36d93b9587db86378ee9e5516a22e46d841","observation_id":"cbaf82b0-f548-412b-b390-a1ef98ef0803","resolution":{"observed_at":"2026-08-07T11:32:23.605363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:22.253522Z","title":"Acous- tic characteristics of American English vowels,","venue":null,"work_id":"8b287103-9ba2-471a-bc08-259c94f6fe20","year":1995},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.511358Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:0580ef8738c9008191a6f93440a21179437cda78eb5146a36aa8de4d30762486","observation_id":"4da04087-fc0b-499c-a2b8-d111cefd052a","resolution":{"observed_at":"2026-08-07T11:32:22.306585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:23.142122Z","title":"Neuron Activation Profiles for Interpreting Convolutional Speech Recognition Models,","venue":null,"work_id":"5ad1a56b-fb7d-4c7e-af11-4a685a97126a","year":2018},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.004400Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:1c082fcd869db5c30391ff4d887d1c0b55f9ff3f1eaa4739891ed5bf4a413c90","observation_id":"235f25a8-d890-43e1-8166-70c1b049d5af","resolution":{"observed_at":"2026-08-07T11:32:23.215208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:22.962369Z","title":"Interpretable Convolutional Filters with SincNet,","venue":null,"work_id":"cdc748b7-2b60-4685-9b81-aa2d4aea9756","year":2018},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.077490Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:5ca0a2a58ef31e5bb4420163de1888ce8aa67eee3d04a001c8dd7ff78acbd0c9","observation_id":"af0cc813-9177-45ea-841e-5d938a432c13","resolution":{"observed_at":"2026-08-07T11:32:23.047254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:22.780102Z","title":"Introspection for convolutional automatic speech recognition,","venue":null,"work_id":"7e4b1e69-715d-4732-b6ae-c7dcb2f64827","year":2018},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.146016Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:74504de91f5a86e8e89570c4efc14c33355c25215ca3abbd469e71cf168d5dfa","observation_id":"1c7f36dc-b57b-4146-8590-64f887c27d60","resolution":{"observed_at":"2026-08-07T11:32:22.858990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:22.577865Z","title":"End-to-end acoustic modeling using convolutional neural networks for HMM- based automatic speech recognition,","venue":null,"work_id":"c2b6f17a-665c-4cce-9f0d-faf48b718f4b","year":2019},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.227371Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:e26405aff268bb40fa190a50dc02e41af3497f7df4fbf28684f3f79e9db506f4","observation_id":"cbad7af6-f918-4f29-b034-15bd8714eaef","resolution":{"observed_at":"2026-08-07T11:32:22.652588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08125","last_updated":"2020-02-19T11:59:36Z","snapshot_observed_at":"2026-08-04T11:43:52.655710Z","submitted_at":"2020-02-19T11:59:36Z","title":"Gradient-Adjusted Neuron Activation Profiles for Comprehensive Introspection of Convolutional Speech Recognition Models","version":1},"cited_work":{"arxiv_id":"2002.08125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.08125","snapshot_observed_at":"2026-08-07T11:32:17.809189Z","title":"Gradient-Adjusted Neuron Activation Profiles for Comprehensive Introspection of Convolutional Speech Recognition Models","venue":"cs.LG","work_id":"d4a415d6-65ba-431c-bb01-e4df23020b4b","year":2020},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.281363Z"},"links":{"cited_paper":"/paper/2002.08125","citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:4322cc29308a18f6b6b0ad4e780c5afdb35ef7a60fe893a8e8fb0f12fead9e69","observation_id":"2c80d404-16f8-4f7f-876e-d7acd6fc5683","resolution":{"observed_at":"2026-08-07T11:32:17.857757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:22.406933Z","title":"Directly Comparing the Listening Strategies of Humans and Machines,","venue":null,"work_id":"c7d957d5-6b7e-495e-91da-89ff59d1d144","year":2021},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.360537Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:17500e377d0ab969a22345fbcf432e2f304084a513caa372574492dd08ea5382","observation_id":"34779c97-1dc5-4c41-89fe-784ecac7585e","resolution":{"observed_at":"2026-08-07T11:32:22.489366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01710","last_updated":"2025-03-14T22:20:26Z","snapshot_observed_at":"2026-07-06T19:44:34.642049Z","submitted_at":"2024-11-03T23:02:30Z","title":"SPES: Spectrogram Perturbation for Explainable Speech-to-Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01710","snapshot_observed_at":"2026-08-07T11:32:15.428570Z","title":"SPES: Spectrogram Perturbation for Explainable Speech-to-Text Generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.428570Z"},"links":{"cited_paper":"/paper/2411.01710","citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:3cfbd8e2857241be03abaacdb0328cb473573c63c0c665c3be662990ae1e3fd4","observation_id":"c0ff9443-cf9f-4f20-b0a5-8365f0174d6d","resolution":{"observed_at":"2026-08-07T11:32:15.428570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:25.311401Z","title":null,"venue":null,"work_id":"db5aefe5-8bcd-4feb-8234-70254a98ea7e","year":null},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:13.923390Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:b516e29eafe8418d8ac3d4275f8e3474f401d1786e529b2dc88664c69162ae7f","observation_id":"b03f39f8-479e-4e1c-85ab-9dd34483a66b","resolution":{"observed_at":"2026-08-07T11:32:25.364852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:22.041855Z","title":"Burst and Transition Cues to V oicing Perception for Spo- ken Initial Stops by Impaired- and Normal-Hearing Listeners,","venue":null,"work_id":"6546530a-41c0-47db-8d0d-aeb2d1553d78","year":1987},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.594193Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:5c93aa0e09ec37196f3eef66e934141db57018fbd0b07c220ea3e738a0ae15a2","observation_id":"9a5d5fc3-9bff-4c7e-9af2-d9bccee1abff","resolution":{"observed_at":"2026-08-07T11:32:22.124476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:21.809818Z","title":"Acoustic cues of voiced and voiceless plosives for determining place of articulation,","venue":null,"work_id":"b02fc274-08d7-4f3d-8d22-e02db4799edc","year":2001},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.692957Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:47674075544d944f7adb1f3757b6a7d6409e41e322508458694981830a03fde0","observation_id":"4c5491e7-8eea-45f3-95e2-2a5e777da75e","resolution":{"observed_at":"2026-08-07T11:32:21.905743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:21.599194Z","title":"Acoustic characteristics of English fricatives,","venue":null,"work_id":"bdfe37b0-0ed8-44c0-b723-560b500ae84d","year":2000},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.779334Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:18741f6586e6d0608454e0f5b972329be4612e7f34a49384ac6111a592f24b2c","observation_id":"1fe81541-41d6-48f7-95b1-c105c5a05685","resolution":{"observed_at":"2026-08-07T11:32:21.687005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:21.419865Z","title":"Acoustic characteristics of clearly spoken English fricatives,","venue":null,"work_id":"43a55625-354e-4664-b7b0-1efb44b2fcdc","year":2009},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.889219Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:42cb1a9d219c8d1d0a9096b9430167c1f2cbe6b342963da1bc53a6589f28c948","observation_id":"24f587b8-0313-400c-866b-b6335394924b","resolution":{"observed_at":"2026-08-07T11:32:21.511061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:21.143897Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition,","venue":null,"work_id":"b41f86fb-10d4-4998-a958-7116ff4a4d0d","year":2020},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:15.968308Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:fe45fbb945724f90ccdf2dd4fc767005b740e9816fed92c330ef99379d9c8ba5","observation_id":"a2da6397-2f44-4d45-ad16-4085f91b2d35","resolution":{"observed_at":"2026-08-07T11:32:21.258248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:16.075519Z","title":"Introducing Parsel- mouth: A Python interface to Praat,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.075519Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:99ba3ebcd727512b072c565532ebe85235ae90e0cf90c3215189901a38dd53c9","observation_id":"8a09b4e1-738f-41ad-b7aa-3375bf1f9000","resolution":{"observed_at":"2026-08-07T11:32:16.075519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:20.908533Z","title":"Pykaldi: A Python Wrapper for Kaldi,","venue":null,"work_id":"095c063e-e364-4923-8350-d2a7cfa9d216","year":2018},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.143157Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:fe69c71eb5d3d8b8468364ab73e66131cdd08fcc8b1c75e3f1be52cd67554f26","observation_id":"af314bcb-d75a-494b-bde2-ee3b78eecc9f","resolution":{"observed_at":"2026-08-07T11:32:21.020089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:20.679750Z","title":"Neural Machine Transla- tion of Rare Words with Subword Units,","venue":null,"work_id":"7a0538be-2b33-476e-9014-293523d345a7","year":2016},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.218548Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:2c8c28a5930e1cbcdab13ce43b51b7004582d7ec0563e967212ccbeb24691638","observation_id":"3effd402-33aa-4488-80dd-0fb1fe60c79c","resolution":{"observed_at":"2026-08-07T11:32:20.786942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:20.412515Z","title":"SentencePiece: A simple and lan- guage independent subword tokenizer and detokenizer for Neural Text Processing,","venue":null,"work_id":"74419b70-7fc9-4b41-a7d7-1c345fff2832","year":2018},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.297689Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:d059bf3af79f85d36811d0615abe6fd62047b756603365af5bce7f0dbccba797","observation_id":"592131ef-154a-4488-bb6f-b1564daa0dd9","resolution":{"observed_at":"2026-08-07T11:32:20.523379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:20.199628Z","title":"Attention is All you Need,","venue":null,"work_id":"0edc4597-63f1-421e-994b-50a7f1d9cef8","year":2017},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.359174Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:f5ca2d5eb12a92e35d616da591f80cb4f024f7416b5da42e788491f905186a6e","observation_id":"3f931957-e4ad-4cb7-95f1-c7a131c9a156","resolution":{"observed_at":"2026-08-07T11:32:20.287706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:16.455994Z","title":"Fairseq S2T: Fast Speech-to-Text Modeling with Fairseq,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.455994Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:b5b9cb22694590103d1de769ab697bcb87276f743296736175a587ccbe824f78","observation_id":"fe1b260f-6a28-4646-9634-947f5a0e244d","resolution":{"observed_at":"2026-08-07T11:32:16.455994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:19.927921Z","title":"Com- mon V oice: A Massively-Multilingual Speech Corpus,","venue":null,"work_id":"74f6e01b-281a-4014-9e25-037734b375d4","year":2020},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.536895Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:497c76d39c97727bec24f21981a2206c2c5a124d027cf25f0e6e228e9a9a38ee","observation_id":"6d166b02-a9eb-4aad-b7b8-5a8562bf286a","resolution":{"observed_at":"2026-08-07T11:32:20.058654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:16.626379Z","title":"Lib- rispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.626379Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:c8cff63ac2a6c048ccec8801592a5a938799d21b68db4fc3326cc56bb9f9c21c","observation_id":"5b9d54ab-ea59-49dd-a540-7eca7aa6a668","resolution":{"observed_at":"2026-08-07T11:32:16.626379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:19.661217Z","title":"TED-LIUM 3: Twice as Much Data and Corpus Repartition for Experiments on Speaker Adaptation,","venue":null,"work_id":"5c535cd8-5966-48e6-867c-102b0ae68833","year":2018},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.724921Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:9c5b36a56d57d981a9a02651efe09e18f9a0b7c47ffa5956866ffe541e33ae55","observation_id":"db3fa82a-0329-4f53-950d-1afe1a917983","resolution":{"observed_at":"2026-08-07T11:32:19.771580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:19.478238Z","title":"V oxPopuli: A Large- Scale Multilingual Speech Corpus for Representation Learning, Semi-Supervised Learning and Interpretation,","venue":null,"work_id":"3e8e3a38-6175-4a61-a3b1-134ce3952d9e","year":2021},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.814577Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:904257bf11b9407f58264c08f1a04b96d682cc2f311eed8181001b8fce942f32","observation_id":"824f9cd2-f374-4c14-b28d-3409165a5104","resolution":{"observed_at":"2026-08-07T11:32:19.558003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:19.294807Z","title":"Rethinking the Inception Architecture for Computer Vision,","venue":null,"work_id":"b84d7c60-74d6-4652-85f6-4a79909824da","year":2016},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:16.949565Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:99d7663dec2469fb45b279c55a7807d6e7475c50b8e514281cb374d0837f68b6","observation_id":"26f4e42a-4f62-481e-9f70-c3a43f6a9d06","resolution":{"observed_at":"2026-08-07T11:32:19.372863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:19.096398Z","title":"Con- nectionist temporal classification: labelling unsegmented se- quence data with recurrent neural networks,","venue":null,"work_id":"33bfad77-731c-4ff5-a11b-df98ba562b9b","year":2006},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:17.048361Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:9a9265a9aee20b189526ed2b1a17499a6ba8b14b7343c8b16d0a80ba58cb63b9","observation_id":"800f6bae-2e69-4255-b17b-ccd2ea389988","resolution":{"observed_at":"2026-08-07T11:32:19.203475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:17.167561Z","title":"Adam: A Method for Stochastic Opti- mization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:17.167561Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:182296812eb433f25bf1c288149a97466eedadfe5a1f9d31a3c8957a44d71fa5","observation_id":"b5794d0f-42b7-49d1-aad3-55220a5f8f8a","resolution":{"observed_at":"2026-08-07T11:32:17.167561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:18.801656Z","title":"SpecAugment: A Simple Data Aug- mentation Method for Automatic Speech Recognition,","venue":null,"work_id":"8a3c5360-8f0c-428d-a7b3-e23071204c7e","year":2019},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:17.259642Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:bfc787553e5d04a0305d7c20511c445750afb83ec81dc35038004a38a99eb6d6","observation_id":"62b93cdb-19e3-43f4-b3ce-ada0bfe6a740","resolution":{"observed_at":"2026-08-07T11:32:18.943826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:18.537308Z","title":"Darpa timit acoustic-phonetic continuous speech corpus cd-rom TIMIT,","venue":null,"work_id":"29f180a3-2833-4ab0-aad7-27098039c339","year":1993},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:17.396416Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:acc91a7820825e48af381b80d4b716ac83ed6f29161da8807dc4393227584d2e","observation_id":"57088e64-c670-4bf6-a24c-a8f1cf64f16e","resolution":{"observed_at":"2026-08-07T11:32:18.661884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:18.343714Z","title":"Twists, humps, and pebbles: Multilingual speech recognition models exhibit gen- der performance gaps,","venue":null,"work_id":"6411c528-8609-450c-9774-35a2d1a54c26","year":2024},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:17.502417Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:abc73cbe04ae76ad3f338c33043975224bc959732d737f9d3ca0522d2130fe8b","observation_id":"53152cd0-8d1c-437f-9961-44133f0028fe","resolution":{"observed_at":"2026-08-07T11:32:18.424129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:18.184609Z","title":"Burst spectrum as a cue for the stop voicing contrast in American English,","venue":null,"work_id":"4404596a-cc3b-49de-8985-678e63195389","year":2014},"citing_paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:17.610645Z"},"links":{"citing_paper":"/paper/2506.02181"},"observation_digest":"sha256:a16f54f9e673eaa433c0bfeefabc65be4896bf1ababde8218903eb16ba53d8e8","observation_id":"a73cfbae-9702-461d-be97-e71fab6edf86","resolution":{"observed_at":"2026-08-07T11:32:18.247636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02181","last_updated":"2025-06-02T19:11:16Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T05:50:50.489478Z","submitted_at":"2025-06-02T19:11:16Z","title":"Echoes of Phonetics: Unveiling Relevant Acoustic Cues for ASR via Feature Attribution"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2506.02181."}