{"as_of":"2026-08-14T02:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:787dc4b2c3ec62aeaf11cd7b8ce13c4dfe05f00dc56a5994c1c4a5252047f0fe","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:27:46.608174Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.04844/citation-record","integrity":"/paper/2501.04844/integrity","json":"/paper/2501.04844/citation-record.json","paper":"/paper/2501.04844"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.976016Z","title":"A high-performance speech neuroprosthesis,","venue":null,"work_id":"ab801340-ec84-40cf-a6df-86bba0fb9984","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.511049Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:8389e444d866ccb6f674a3f7c1485ffde2fe2ea39eb3a7d543bb8bf66d0af49f","observation_id":"8e17222f-7063-46c2-bcd5-d26f0f75c21f","resolution":{"observed_at":"2026-08-10T21:27:46.979755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.965422Z","title":"A high-performance neuroprosthesis for speech decoding and avatar control,","venue":null,"work_id":"5baf3bc0-2caf-488c-862e-f0412ea25b90","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.515207Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:1170ba6171f2fd28ba37c6b0a2414a8588b2ba218f8af123df865cbe345776ec","observation_id":"aa63089f-9d8c-45bf-a3b3-8b3bcff59a89","resolution":{"observed_at":"2026-08-10T21:27:46.969105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.955183Z","title":"Relating eeg to continuous speech using deep neural networks: a review","venue":null,"work_id":"afa8506b-af54-4556-b1a5-fa8af530130f","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.518611Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:745ba9be38997b205df84cf9fa7feed9229a9ba34f14954851acf2128f6054dc","observation_id":"2bb9c5e5-5482-44c8-aa52-5d3dbe4fb4d8","resolution":{"observed_at":"2026-08-10T21:27:46.958750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.944917Z","title":"Knowledge- guided eeg representation learning,","venue":null,"work_id":"97af7e6a-d15b-4357-8712-089db3ddb14e","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.522176Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:00b9168acd3876ddbf6f118ef2ca5a77856f78b33d1c8af570c5ea51c7fa7b71","observation_id":"569346fd-cae2-45e0-b005-49be96a0bee0","resolution":{"observed_at":"2026-08-10T21:27:46.948731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.933627Z","title":"Bendr: using transform- ers and a contrastive self-supervised learning task to learn from massive amounts of eeg data,","venue":null,"work_id":"15f105d8-b7df-4e51-9127-24558cd416c8","year":2021},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.526792Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:f560990fb5b96c71e6594c0cad955fbb879bdf8195105a3e75bc94f5f5503d34","observation_id":"769f59f2-ebad-4379-9df2-535dbb60cb20","resolution":{"observed_at":"2026-08-10T21:27:46.937727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.922704Z","title":"Maeeg: Masked auto-encoder for eeg representation learning,","venue":null,"work_id":"048a88ab-4541-4938-8cc3-c7dba00602d0","year":2022},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.530624Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:329abe455977d43845d7d451bf7fca3a0006b6c18a05ccc2c83f12c750b2e553","observation_id":"8f581d9f-8549-4a5b-a888-76511391b736","resolution":{"observed_at":"2026-08-10T21:27:46.926692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.911939Z","title":"Open vocabulary electroencephalography-to-text decoding and zero-shot sentiment classification,","venue":null,"work_id":"0cef6113-d9e9-4f2f-8c30-a4a03ff41bde","year":2022},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.534503Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:3bbfab52edcb8c56898457696921119a0185b2bc703a02b6677d0ec7d7f9bbeb","observation_id":"76c10f48-e48e-41d0-b31c-01af0cd92ce1","resolution":{"observed_at":"2026-08-10T21:27:46.915777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02165","last_updated":"2024-05-03T15:14:19Z","snapshot_observed_at":"2026-08-13T00:15:19.419010Z","submitted_at":"2024-05-03T15:14:19Z","title":"EEG2TEXT: Open Vocabulary EEG-to-Text Decoding with EEG Pre-Training and Multi-View Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02165","snapshot_observed_at":"2026-08-10T21:27:46.538279Z","title":"Eeg2text: Open vocabulary eeg-to-text decoding with eeg pre-training and multi- view transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.538279Z"},"links":{"cited_paper":"/paper/2405.02165","citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:d58f053e7430306e5049e748f843b23bc341eac018cc9244bb9c7259f5a8cc9a","observation_id":"4df03a52-8997-402c-9ed3-01717e6b25f0","resolution":{"observed_at":"2026-08-10T21:27:46.538279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.901111Z","title":"Dewave: Discrete encoding of eeg waves for eeg to text translation,","venue":null,"work_id":"e97fb05f-3811-4f31-b415-af57423edc83","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.542149Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:1b99feb82e2bb4e5dbc55a07636b3d11c90da040656744a7114379e5e37989f2","observation_id":"a2988576-8403-45df-9616-f1dd3d2619f8","resolution":{"observed_at":"2026-08-10T21:27:46.905098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.890824Z","title":"Decoding of the speech envelope from eeg using the vlaai deep neural network,","venue":null,"work_id":"1fdfe815-b5ec-4a3a-8103-b8e72dcf1976","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.545246Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:21783a60748d9579778c12304750145fef44d10ea23c92e6543de349369c301b","observation_id":"99980010-539e-4047-8ef7-e12e2ef1b000","resolution":{"observed_at":"2026-08-10T21:27:46.894390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04965","last_updated":"2024-01-10T07:15:45Z","snapshot_observed_at":"2026-08-13T04:45:30.837191Z","submitted_at":"2024-01-10T07:15:45Z","title":"ConvConcatNet: a deep convolutional neural network to reconstruct mel spectrogram from the EEG","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04965","snapshot_observed_at":"2026-08-10T21:27:46.548155Z","title":"Convconcatnet: a deep convolutional neural network to reconstruct mel spectrogram from the eeg,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.548155Z"},"links":{"cited_paper":"/paper/2401.04965","citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:94bc80247102c65ba20924e2c09d907bbd4bbd3a633c25d5fd0575679ad1f8d6","observation_id":"55777bd7-348f-4d4a-96ab-1aa89dfec321","resolution":{"observed_at":"2026-08-10T21:27:46.548155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.880528Z","title":"Using articulated speech eeg signals for imagined speech decoding,","venue":null,"work_id":"f0d07695-a78d-432a-bff5-0ba153fac6cc","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.551344Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:7dedd9c9333e6c3eac6c823080527c264cba2110af9b3d0d018aa4934433cd05","observation_id":"bcffa13f-2b24-42ca-a885-68ec1dd1e7a0","resolution":{"observed_at":"2026-08-10T21:27:46.884048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.870407Z","title":"De- coding speech perception from non-invasive brain recordings,","venue":null,"work_id":"31857aa6-e611-4c04-a06b-1709980226f1","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.554372Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:bcc686d4783a178cf37185f291374d7436c0e5ae21b7cd9f2de6a888afe0a934","observation_id":"09861a45-f0ff-40ad-a7a1-20238e73424b","resolution":{"observed_at":"2026-08-10T21:27:46.873828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.859642Z","title":"WaveNet: A Generative Model for Raw Audio,","venue":null,"work_id":"acd31e6a-38b9-4eac-b869-602957e0e206","year":2016},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.557558Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:dbc65174f863a97340902efa5aa4e09c7c83634b3773a3773b66762659794a5d","observation_id":"d5353e0c-41ab-4708-9854-00b2a09e6a2a","resolution":{"observed_at":"2026-08-10T21:27:46.864032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.849112Z","title":"Cross-attention-guided wavenet for mel spectrogram reconstruction in the icassp 2024 auditory eeg challenge,","venue":null,"work_id":"747b09d4-8e8b-4191-bcde-91eeec4b7a6e","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.560799Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:f444854f545c9ca3fe28893996164f6e81f38f75bb06f4b425a5c97f54614f68","observation_id":"0b07b4a5-9904-4f0f-9125-07c4cf882434","resolution":{"observed_at":"2026-08-10T21:27:46.853130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.837018Z","title":"Toward fully-end-to-end listened speech decoding from eeg signals,","venue":null,"work_id":"a4c7f959-8b92-4b54-a0e6-df55b66d02c9","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.563766Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:a3a8a0e9f87219ae27cca0f27e7bbaed35b2440d6ca1559a7cd1f49cd4c391eb","observation_id":"82e18950-ee97-4502-bd51-a4570e00be8d","resolution":{"observed_at":"2026-08-10T21:27:46.841156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.823832Z","title":"Efficiently modeling long sequences with structured state spaces,","venue":null,"work_id":"e7d5cbbd-3c65-4b56-85ee-749ae6f4daec","year":2021},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.567070Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:9a0650839ebc0fc09eb02f3ecf96d13c0f041308eaa94b8c66bc6a6f9f088d6e","observation_id":"443dea34-c94c-43c3-be27-6a215b814515","resolution":{"observed_at":"2026-08-10T21:27:46.828464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.570591Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.570591Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:90fc779e021710df115125f669b291f80ba477c99ba95d1a9c91b201e7ce48a7","observation_id":"e82cefa8-d8a2-45eb-8b37-aaca111d0350","resolution":{"observed_at":"2026-08-10T21:27:46.570591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.574050Z","title":"Hifi-gan: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.574050Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:a4e6356e78410b3de07fcd92696457ef5e09534c885dc3091c675f6c101b2326","observation_id":"83b8d206-5ada-4f9b-b482-8f598bfb603d","resolution":{"observed_at":"2026-08-10T21:27:46.574050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.577683Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.577683Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:18009667c3be31695d96d92b332d5fc7c8a82a87b535732154b26897cbba180e","observation_id":"da2439d5-520c-48bb-8f72-a4f87c937a5e","resolution":{"observed_at":"2026-08-10T21:27:46.577683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.581806Z","title":"Density estimation using real NVP,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.581806Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:ae92a4fc55589b6fb9e9a22597387fd87460d96148ac1c1c78097f7bd7204a3b","observation_id":"45c6a491-6ee7-40c6-8bcf-8e88d93a0cba","resolution":{"observed_at":"2026-08-10T21:27:46.581806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.779992Z","title":"Conformer: Convolution- augmented Transformer for Speech Recognition,","venue":null,"work_id":"e1b12be0-2660-49b1-a3ad-b2b5e1f52e5b","year":2020},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.589419Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:1c16af51d4309401f159869fe3e9cd1ec0e4cd4c7eaa972318a2e427852c19e4","observation_id":"81a360b6-0556-420a-9e26-9f9f6a33c5f9","resolution":{"observed_at":"2026-08-10T21:27:46.783896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.593047Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.593047Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:df27058622251c9655e647d069cfb26cbcd7d3abcd2b577e6070ae78dbdb2335","observation_id":"c6ca949f-c479-49a3-b21a-e6a0e56ee9fc","resolution":{"observed_at":"2026-08-10T21:27:46.593047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.768097Z","title":"Evoking the n400 event-related potential (erp) component using a publicly available novel set of sentences with semantically incongruent or congruent eggplants (endings),","venue":null,"work_id":"75faee6d-af96-49c6-a6ad-0a471134a162","year":2022},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.596655Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:24baca6e841a5ccb7f2a716fe1dcdf3aecac95eebc3895e0b82aea86a5b0ce9b","observation_id":"e57b0c88-bd81-4855-aefc-1fc3d68bb0bb","resolution":{"observed_at":"2026-08-10T21:27:46.772195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.600075Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.600075Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:3894efa531e43eb9cd2936fd2a5655cd67abd4d9c5a9d4dee5ebba95f0e0ff43","observation_id":"13215e53-62c2-43c9-98cb-390e2da0a76a","resolution":{"observed_at":"2026-08-10T21:27:46.600075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.748218Z","title":"Mel-cepstral distance measure for objective speech qual- ity assessment,","venue":null,"work_id":"ff255c7c-7b74-4497-a842-93dfa3d0d829","year":1993},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.604671Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:a350a59bddb81eb85d0215f6b08889586d9845386abcca4aa227f7ee08f20b91","observation_id":"f5287b50-3f2f-4216-8bbe-6202d52f9c88","resolution":{"observed_at":"2026-08-10T21:27:46.754350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.608174Z","title":"Montreal Forced Aligner: Trainable Text-Speech Alignment Using Kaldi,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.608174Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:7a6c0a01490a354025984f2dae8aa854cde758827671cccb07fdd4fdbe432dfd","observation_id":"c0ae6f01-bbfd-40c1-9d42-1bd2fb45cef2","resolution":{"observed_at":"2026-08-10T21:27:46.608174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.585841Z","title":"Available: https://openreview.net/forum?id=HkpbnH9lx","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.585841Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:6b0163d171c68f2377b6004d2cfb7b260c52cc3d8cad70396685ccf7b6517b18","observation_id":"e2b81211-faab-4ae4-8c8b-883f94fbe0e7","resolution":{"observed_at":"2026-08-10T21:27:46.585841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2501.04844."}