{"as_of":"2026-08-08T20:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b83322024e9e69686d577395c8ecdb4671239f7b630ba60230f8f367d318421","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:56:07.868870Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25626/citation-record","integrity":"/paper/2607.25626/integrity","json":"/paper/2607.25626/citation-record.json","paper":"/paper/2607.25626"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:04.372390Z","title":"A high-performance speech neuroprosthesis.Nature, 620(7976):1031–1036, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.372390Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:60df8b2bad6c30f29140bbc79aad63423b799f6c8e3474dbfbe41f7cfb8e4f99","observation_id":"05271df4-5594-4154-b584-93a29ce2c8e5","resolution":{"observed_at":"2026-08-01T01:56:04.372390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:04.416203Z","title":"Transfer learning in brain-computer interfaces.IEEE Computational Intelligence Magazine, 11(1):20–31, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.416203Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:70a77bb77b58b6173db1142e7af1148dd8ccdebce63c1b2fef19e990ae647d86","observation_id":"6b46605d-8d17-4f3d-95f8-fd6f69ebbee7","resolution":{"observed_at":"2026-08-01T01:56:04.416203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:04.486950Z","title":"Reducing the subject variability of eeg signals with adversarial domain generalization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.486950Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:78d306c71ad6f6087e9c446162eb2cbfad4f8cfbb9ebb0f2941b8432d2cc70e0","observation_id":"154c3327-3cee-4497-8e9c-37ce26dee7db","resolution":{"observed_at":"2026-08-01T01:56:04.486950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:04.551454Z","title":"Dewave: Discrete encoding of eeg waves for eeg to text translation.Advances in Neural Information Processing Systems, 36:9907–9918, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.551454Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:a5338b1ab4ad7aa8dab30bd3c4b6ae18d5c15030cb2a16ead16b7263ad37dcca","observation_id":"5d7bfaae-cbec-4e17-9be7-c16f5234d414","resolution":{"observed_at":"2026-08-01T01:56:04.551454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:04.622632Z","title":"Enhancing eeg-to-text decoding through transferable representations from pre-trained contrastive eeg- text masked autoencoder","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.622632Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:fe2015186014b03dd92c7be2c8260a40149ffc5d8ce84192ca4d54e40f37ca17","observation_id":"14a81131-cf7a-49b3-b25a-e4fe160a9b60","resolution":{"observed_at":"2026-08-01T01:56:04.622632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02165","last_updated":"2024-05-03T15:14:19Z","snapshot_observed_at":"2026-08-04T03:00:56.656285Z","submitted_at":"2024-05-03T15:14:19Z","title":"EEG2TEXT: Open Vocabulary EEG-to-Text Decoding with EEG Pre-Training and Multi-View Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02165","snapshot_observed_at":"2026-08-01T01:56:04.699215Z","title":"Eeg2text: Open vocabulary eeg-to-text decoding with eeg pre-training and multi-view transformer.arXiv preprint arXiv:2405.02165, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.699215Z"},"links":{"cited_paper":"/paper/2405.02165","citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:7a6d384ca6bd5c84bfe7f985bebc060826c65fcc8833a0d210b8f583903695d1","observation_id":"633e8a59-d0fd-4837-90db-e581ea8df50b","resolution":{"observed_at":"2026-08-01T01:56:04.699215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00101","last_updated":"2025-03-20T08:26:21Z","snapshot_observed_at":"2026-08-08T08:01:00.232765Z","submitted_at":"2024-08-27T12:07:09Z","title":"NeuroLM: A Universal Multi-task Foundation Model for Bridging the Gap between Language and EEG Signals","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00101","snapshot_observed_at":"2026-08-01T01:56:04.763134Z","title":"Neurolm: A universal multi-task foundation model for bridging the gap between language and eeg signals.arXiv preprint arXiv:2409.00101, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.763134Z"},"links":{"cited_paper":"/paper/2409.00101","citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:c3e849863faf93c9e0e09e4ab224c48f7523532844a84062631d9a66d8643f64","observation_id":"e4aa3417-a475-4431-84cc-a2e2f8e277fe","resolution":{"observed_at":"2026-08-01T01:56:04.763134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:04.828692Z","title":"Guiding llms to decode text via aligning semantics in eeg signals and language.Expert Systems with Applications, page 130300, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.828692Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:abc44a2027dd6162e6213f777c5941b34c619ea4b6b7f9e7c507dbbc6636d9ef","observation_id":"30298d1b-e0f4-41b5-8975-17f84fb06321","resolution":{"observed_at":"2026-08-01T01:56:04.828692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:04.948618Z","title":"Braindec: A multimodal llm for the non-invasive decoding of text from brain recordings","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:04.948618Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:a244c9a810708d4ff7e449b333229c8c0b3ce9bc5c05adbae32b95d9cce2284c","observation_id":"c47f34df-3082-4e49-b068-841bbf6eccef","resolution":{"observed_at":"2026-08-01T01:56:04.948618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:05.050149Z","title":"Ssm2mel: State space model to reconstruct mel spectrogram from the eeg","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:05.050149Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:b4851e7761eea7bc72634a5b3dad3be7036b3e8237e438ebfd179e02c98a78ce","observation_id":"e71867de-9cc4-47de-9ac4-83beb552ab85","resolution":{"observed_at":"2026-08-01T01:56:05.050149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:05.202082Z","title":"Dmf2mel: A dynamic multiscale fusion network for eeg-driven mel spectrogram reconstruction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:05.202082Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:25244c6e4e6d3d8d4d5a9d667b4b1602e33a7ffe985e588bb1bfa722a5654203","observation_id":"138ff24e-3868-46c8-bf0d-a6014167b4c4","resolution":{"observed_at":"2026-08-01T01:56:05.202082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:05.372258Z","title":"Convconcatnet: a deep convolutional neural network to reconstruct mel spectrogram from the eeg","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:05.372258Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:56ba5cde02b8fe1d5879d1f780b9e23dff795ddd9a6f47418fc4dfabcc1c7208","observation_id":"ec4eac1f-6529-40a4-ab53-d552732ab33c","resolution":{"observed_at":"2026-08-01T01:56:05.372258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:05.497276Z","title":"Biot: Biosignal transformer for cross-data learning in the wild.Advances in Neural Information Processing Systems, 36:78240–78260, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:05.497276Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:ce0a14c3f8518e8d412eaddfbb1ca1421ccf017e97c71f59ee88c4fc57d8b73f","observation_id":"3e4ae834-b641-49e8-b30a-bc96b236306c","resolution":{"observed_at":"2026-08-01T01:56:05.497276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18765","last_updated":"2024-05-29T05:08:16Z","snapshot_observed_at":"2026-08-05T22:38:47.617492Z","submitted_at":"2024-05-29T05:08:16Z","title":"Large Brain Model for Learning Generic Representations with Tremendous EEG Data in BCI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18765","snapshot_observed_at":"2026-08-01T01:56:05.637009Z","title":"Large brain model for learning generic representations with tremendous eeg data in bci.arXiv preprint arXiv:2405.18765, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:05.637009Z"},"links":{"cited_paper":"/paper/2405.18765","citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:ac54e5480920a19e1f2be77614bf9ff7433c8ed0402b4132b268bd4a6bcd21eb","observation_id":"96574c89-cfac-4cc3-aa03-4e6290eb8a23","resolution":{"observed_at":"2026-08-01T01:56:05.637009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:05.784960Z","title":"Zuco, a simultaneous eeg and eye-tracking resource for natural sentence reading","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:05.784960Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:69cbb158b7d6497f1f1eb2c27937442c372480eee2255da411aa4755d2f89adc","observation_id":"6041144f-0504-49e2-b731-30ecc7672b3e","resolution":{"observed_at":"2026-08-01T01:56:05.784960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:05.909888Z","title":"Effects of eeg analysis window location on classifying spoken mandarin monosyllables","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:05.909888Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:66000c06e4c45da18ef25a9988d73a6aab60cb01dd317406e4108e6caacceb88","observation_id":"7059acf7-d14f-4ef4-b7e4-bd568acf8202","resolution":{"observed_at":"2026-08-01T01:56:05.909888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:06.035713Z","title":"3m-cpseed, an eeg-based dataset for chinese pinyin production in overt, mouthed, and imagined speech.Scientific Data, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.035713Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:bc03aa7ad10eebfde94f7ca33575e0ebafec7ebc173a4f31ad8c03f6d9b7b92c","observation_id":"f2fe0496-e127-44a7-861f-9591e7c4bd43","resolution":{"observed_at":"2026-08-01T01:56:06.035713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:06.194781Z","title":"Scaling law in neural data: Non-invasive speech decoding with 175 hours of eeg data, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.194781Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:b355537b666c7a99a079b07cca7001da2f5e98555b5d4b90b4cf93d08e482dff","observation_id":"7aaa244e-0a2b-493d-984e-ed1b953d200a","resolution":{"observed_at":"2026-08-01T01:56:06.194781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:06.318979Z","title":"An eeg dataset for multimodal semantic alignment and neural decoding during reading and listening.Scientific Data, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.318979Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:d9834f0c2529890f79f74fbc73bfad509333e30786a478d7dc1112d2af600200","observation_id":"3d807dbc-438f-4a1a-aa94-62b6bf150670","resolution":{"observed_at":"2026-08-01T01:56:06.318979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:06.410693Z","title":"Decoding speech perception from non-invasive brain recordings.Nature Machine Intelligence, 5 (10):1097–1107, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.410693Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:54205918dc5f60a4a88637b12d83e105ad3bfd450955b345874a72184ebe5f42","observation_id":"0143aa60-7a19-48b6-8a26-4a92654a2f26","resolution":{"observed_at":"2026-08-01T01:56:06.410693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:06.517956Z","title":"Eeg-clip: A transformer-based framework for eeg-guided image generation.Neural Networks, page 108167, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.517956Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:013be09c5dfdbb7049b8855d7a21da5b061db624414b94ecfb3a2eeb63389401","observation_id":"5bae62ce-94a1-4604-b421-5fe11a7b2add","resolution":{"observed_at":"2026-08-01T01:56:06.517956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:06.650059Z","title":"Self-supervised speech representation and contextual text embedding for match-mismatch classification with eeg recording","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.650059Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:6b602420a0c743fd00572579db95aecc554f5f493f7eb923fff5d0130a2b449c","observation_id":"746ef147-4c50-4752-98cf-502fe1c2a4fe","resolution":{"observed_at":"2026-08-01T01:56:06.650059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-01T01:56:06.764527Z","title":"Representation learning with contrastive predictive coding.arXiv preprint arXiv:1807.03748, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.764527Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:d9e41cd679dc98299ee209aa97f045b6f5f1b0dbeb8bb74516e7b7fc2727b3f6","observation_id":"7179c339-0bc6-4ea2-8427-e2c05ce34d8c","resolution":{"observed_at":"2026-08-01T01:56:06.764527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:06.836131Z","title":"Lora: Low-rank adaptation of large language models.Iclr, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.836131Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:e99244dd361b40b94e076f8f89d9f6e546b51bd9f129b9518caac35c322f0e7a","observation_id":"673f7e2d-ae80-4813-a24a-571fae38782a","resolution":{"observed_at":"2026-08-01T01:56:06.836131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:06.938469Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:06.938469Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:63b2d14a9a85fc739aa6dee13057c1bdbf1a5c224240925a1f735bf0177d77de","observation_id":"ec060ee3-db7c-4105-93d7-c7f9ee36b0f7","resolution":{"observed_at":"2026-08-01T01:56:06.938469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-07-06T17:25:35.493362Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-01T01:56:07.007784Z","title":"Bge m3- embedding: Multi-lingual, multi-functionality, multi-granularity text embeddings through self-knowledge distillation.arXiv preprint arXiv:2402.03216, 4(5), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:07.007784Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:2ebbf298c53b2787fe604c0fc4a61f09bc2e8ca703525829ab0b354a2f551388","observation_id":"364beb7c-8570-479f-b802-f1931cbbc73c","resolution":{"observed_at":"2026-08-01T01:56:07.007784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:07.115760Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations.Advances in neural information processing systems, 33:12449–12460, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:07.115760Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:0d4cd561245347fe50d1945a807fbdd991bebed0b5d9fd5ad3e1a6d2e924453d","observation_id":"3073e048-4215-46be-b1b6-056a5699e3c5","resolution":{"observed_at":"2026-08-01T01:56:07.115760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-08T15:18:32.322111Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-01T01:56:07.281639Z","title":"Conformer: Convolution-augmented transformer for speech recognition.arXiv preprint arXiv:2005.08100, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:07.281639Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:d1889a1d7a1d8d3dd74d85dcfe5c5c4db6daa236088ea0806ac62f312226659e","observation_id":"220642f7-2824-4552-9b04-84d259af93af","resolution":{"observed_at":"2026-08-01T01:56:07.281639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:07.416386Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:07.416386Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:4512991430c10dfedef3d629c964b08fc2674168cdb000937b11eef0bc587dfd","observation_id":"7d5d12c2-58f8-455f-80a6-fa7f43704f9a","resolution":{"observed_at":"2026-08-01T01:56:07.416386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:07.564953Z","title":"Chineseeeg: A chinese linguistic corpora eeg dataset for semantic alignment and neural decoding.Scientific Data, 11(1):550, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:07.564953Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:50cc1f6cad9d8d5be5b6d2a14064f181ca87c73927bd9d76edb5e494aa6f67c2","observation_id":"416279af-44a9-4b50-bc36-4849b2d54b1a","resolution":{"observed_at":"2026-08-01T01:56:07.564953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:56:07.727769Z","title":"Similarity of neural network representations revisited","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:07.727769Z"},"links":{"citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:819dc506bcac2a5ae1be9114a96b882afe4c343daea7ef53d0941eba02b66996","observation_id":"1aa1c0de-b214-42f5-bb18-809d72c7f7fc","resolution":{"observed_at":"2026-08-01T01:56:07.727769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00854","last_updated":"2025-07-08T17:34:10Z","snapshot_observed_at":"2026-08-07T11:54:18.332824Z","submitted_at":"2025-06-01T06:26:32Z","title":"EEG2TEXT-CN: An Exploratory Study of Open-Vocabulary Chinese Text-EEG Alignment via Large Language Model and Contrastive Learning on ChineseEEG","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00854","snapshot_observed_at":"2026-08-01T01:56:07.868870Z","title":"RA encoder vs. PL encoder","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T01:56:07.868870Z"},"links":{"cited_paper":"/paper/2506.00854","citing_paper":"/paper/2607.25626"},"observation_digest":"sha256:c68d76425f7de69968b737193ac368f090bf872574d6e291287735829531bdef","observation_id":"a425bea4-4308-41f9-a262-8dd0a7a81b6b","resolution":{"observed_at":"2026-08-01T01:56:07.868870Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25626","last_updated":"2026-07-28T12:06:56Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T19:18:51.414764Z","submitted_at":"2026-07-28T12:06:56Z","title":"Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2607.25626."}