{"as_of":"2026-08-09T11:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:290c53106969de1cf13f9563ecea2209d6a1dcfe3f43d9a27cf5b8257f3c062b","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:55:02.132530Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17326/citation-record","integrity":"/paper/2505.17326/integrity","json":"/paper/2505.17326/citation-record.json","paper":"/paper/2505.17326"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:00.252021Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:00.252021Z"},"links":{"citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:d892fc1b4ba1b8231c5d8e2d2ac40be696ee02c13fadfc96235c53b34fc83b34","observation_id":"da51988e-5391-43f3-ba43-5ff7fda1d676","resolution":{"observed_at":"2026-08-07T14:55:00.252021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:00.355762Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:00.355762Z"},"links":{"citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:f2e7c1c2f30e32dce0814fe546a618a5aad714fd3faa74ee06b0a688606bbc39","observation_id":"63c0c083-93ae-4283-813f-eeb38c65b93f","resolution":{"observed_at":"2026-08-07T14:55:00.355762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11477","last_updated":"2020-10-22T06:09:10Z","snapshot_observed_at":"2026-08-07T05:13:16.889179Z","submitted_at":"2020-06-20T02:35:02Z","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11477","snapshot_observed_at":"2026-08-07T14:55:00.482138Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:00.482138Z"},"links":{"cited_paper":"/paper/2006.11477","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:e335e1ab745001b7a52b616b218240d26f57278ecc4cbd77f4441e85a5f4b449","observation_id":"3e1cca06-2741-46ad-beab-56116adfe6e9","resolution":{"observed_at":"2026-08-07T14:55:00.482138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:03.805884Z","title":null,"venue":null,"work_id":"ac962e6e-e8b7-476f-9b30-d3e480ec0dc3","year":2020},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:00.588205Z"},"links":{"citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:f71304e5ce024ae7992c1569b9e3207b933edd816d751e1a6c613721f369320b","observation_id":"584d6fac-b87f-455d-897f-0954ff648668","resolution":{"observed_at":"2026-08-07T14:55:03.848993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08281","last_updated":"2025-10-23T09:36:08Z","snapshot_observed_at":"2026-07-31T05:45:37.385210Z","submitted_at":"2024-01-16T11:12:36Z","title":"The Faiss library","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08281","snapshot_observed_at":"2026-08-07T14:55:00.682486Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:00.682486Z"},"links":{"cited_paper":"/paper/2401.08281","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:8cfe3997ab97130391a8597761afed83300d52af1d9127e0004eb59699dea477","observation_id":"4cd7e828-3c02-4cb4-9a6d-3cf738854be0","resolution":{"observed_at":"2026-08-07T14:55:00.682486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04769","last_updated":"2022-06-09T21:16:10Z","snapshot_observed_at":"2026-08-04T21:36:01.107247Z","submitted_at":"2022-06-09T21:16:10Z","title":"CLAP: Learning Audio Concepts From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04769","snapshot_observed_at":"2026-08-07T14:55:00.771662Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:00.771662Z"},"links":{"cited_paper":"/paper/2206.04769","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:719549403bfc6a8e573bc43298fb294d3349e3015b2651be29146f663b0836a6","observation_id":"f99fc070-5593-45b0-be1f-a5422ddb5699","resolution":{"observed_at":"2026-08-07T14:55:00.771662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09227","last_updated":"2021-06-17T03:33:10Z","snapshot_observed_at":"2026-07-06T11:20:09.361726Z","submitted_at":"2021-06-17T03:33:10Z","title":"Current Challenges and Future Directions in Podcast Information Access","version":1},"cited_work":{"arxiv_id":"2106.09227","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.09227","snapshot_observed_at":"2026-08-07T14:55:03.037805Z","title":"Current Challenges and Future Directions in Podcast Information Access","venue":"cs.IR","work_id":"c460a7c3-9065-4b73-bc60-87b1203d364c","year":2021},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:00.873800Z"},"links":{"cited_paper":"/paper/2106.09227","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:913f2863a9d36120c0b33c647b099841e0b78505202553fb4686877863dbb7f5","observation_id":"01cbfa11-d870-43e2-882e-674f0ca83d7a","resolution":{"observed_at":"2026-08-07T14:55:03.131941Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.09577","last_updated":"2019-09-14T03:51:46Z","snapshot_observed_at":"2026-08-03T18:17:55.398298Z","submitted_at":"2019-09-14T03:51:46Z","title":"NeMo: a toolkit for building AI applications using Neural Modules","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.09577","snapshot_observed_at":"2026-08-07T14:55:00.940362Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:00.940362Z"},"links":{"cited_paper":"/paper/1909.09577","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:d2c1408f03ad743df34e1d45b86f226ab1a425ed9052486cebdef828f4eb3684","observation_id":"8140ff5c-c7d7-4a40-bfa1-fb404426bae6","resolution":{"observed_at":"2026-08-07T14:55:00.940362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-07T14:55:01.013875Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.013875Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:8e6fe8e5218a444e32eef46be8827b2404f068869774d45115fd05829fd16412","observation_id":"dc4ca069-1237-45dd-8212-fd49013996bd","resolution":{"observed_at":"2026-08-07T14:55:01.013875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13463","last_updated":"2024-08-24T20:28:38Z","snapshot_observed_at":"2026-07-06T17:19:56.099931Z","submitted_at":"2024-01-24T14:08:38Z","title":"SpeechDPR: End-to-End Spoken Passage Retrieval for Open-Domain Spoken Question Answering","version":3},"cited_work":{"arxiv_id":"2401.13463","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.13463","snapshot_observed_at":"2026-08-07T14:55:02.863020Z","title":"SpeechDPR: End-to-End Spoken Passage Retrieval for Open-Domain Spoken Question Answering","venue":"cs.CL","work_id":"dd6a9f62-1bc7-421b-a0cb-784769e88300","year":2024},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.118191Z"},"links":{"cited_paper":"/paper/2401.13463","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:9b83e4dd61c4cf4ab7f2bb4a58f6f004ba3e76f89cd3d0af5952319a175105ba","observation_id":"8574557c-5b13-4304-b64c-10f671b9b2a9","resolution":{"observed_at":"2026-08-07T14:55:02.915495Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04911","last_updated":"2022-06-21T15:59:47Z","snapshot_observed_at":"2026-07-06T12:46:05.124615Z","submitted_at":"2022-03-09T17:46:22Z","title":"DUAL: Discrete Spoken Unit Adaptive Learning for Textless Spoken Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.04911","snapshot_observed_at":"2026-08-07T14:55:01.204149Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.204149Z"},"links":{"cited_paper":"/paper/2203.04911","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:a403490cff3ef81731b9ab6f6a159952ea35c28e39e508d993c87deb73372498","observation_id":"cc1b1c14-4d5c-4091-bf7a-18de1d033a18","resolution":{"observed_at":"2026-08-07T14:55:01.204149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T14:55:01.264765Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.264765Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:73392d75d8252e75870205cfefbe6591eeb9a1b54d6e192ad18c2a3f17dde6e0","observation_id":"f37611ec-9426-4db9-8d18-2006492f66d2","resolution":{"observed_at":"2026-08-07T14:55:01.264765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16500","last_updated":"2025-01-03T07:18:30Z","snapshot_observed_at":"2026-08-03T19:20:51.697231Z","submitted_at":"2024-12-21T06:16:04Z","title":"Speech Retrieval-Augmented Generation without Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":"2412.16500","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.16500","snapshot_observed_at":"2026-08-07T14:55:02.618954Z","title":"Speech Retrieval-Augmented Generation without Automatic Speech Recognition","venue":"eess.AS","work_id":"a425db0d-5793-4db7-832b-e7a7470e6957","year":2024},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.375758Z"},"links":{"cited_paper":"/paper/2412.16500","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:7450fde753622a892d05237b974cf886b09cc42f2fb391b243e924d77e6c246f","observation_id":"b97890f7-17c2-4981-acd4-fe1cc4b5d397","resolution":{"observed_at":"2026-08-07T14:55:02.723063Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-07T14:55:01.447743Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.447743Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:788caec393e917f9b4e8ecd8d2ba8dc5202305f7b7f19a57387b4c792f7d8063","observation_id":"a9c77d13-2b1c-4e61-8113-7d64e9720542","resolution":{"observed_at":"2026-08-07T14:55:01.447743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:01.515929Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.515929Z"},"links":{"citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:f4749189d4da8d3b86e8e62db344f25c10e6b3e3ab2d2c2ce67d16e325ba8a8f","observation_id":"31d5b514-caec-4867-9967-5b46411a5d05","resolution":{"observed_at":"2026-08-07T14:55:01.515929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14783","last_updated":"2024-10-08T15:10:42Z","snapshot_observed_at":"2026-07-06T18:34:37.884969Z","submitted_at":"2024-06-20T23:20:34Z","title":"Evaluating RAG-Fusion with RAGElo: an Automated Elo-based Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14783","snapshot_observed_at":"2026-08-07T14:55:01.602256Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.602256Z"},"links":{"cited_paper":"/paper/2406.14783","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:b401c766804712a4ca28a72172396056b4d4df5e362be208a580e9490162dca8","observation_id":"445cd7a7-92ba-4b5a-85c3-1bdf9517d196","resolution":{"observed_at":"2026-08-07T14:55:01.602256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-07T14:55:01.681010Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.681010Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:0820928727943245a8c50c0974948d1ea26e90bb4d9661a8b35a5d7319979102","observation_id":"362e459a-056b-41d1-892a-a9e44a7ccfaa","resolution":{"observed_at":"2026-08-07T14:55:01.681010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.10915","last_updated":"2020-10-21T11:56:22Z","snapshot_observed_at":"2026-08-04T10:39:23.328703Z","submitted_at":"2020-10-21T11:56:22Z","title":"Contrastive Learning of General-Purpose Audio Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.10915","snapshot_observed_at":"2026-08-07T14:55:01.759249Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.759249Z"},"links":{"cited_paper":"/paper/2010.10915","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:0ff24b796ad864bbc99028c160451be125e25b8d4ee2d9fc1f602d8cbf633d72","observation_id":"fe35c705-afe1-4e98-a718-455646a6a9e7","resolution":{"observed_at":"2026-08-07T14:55:01.759249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:03.578490Z","title":null,"venue":null,"work_id":"60019e4b-2937-420d-931d-ae1ab22ea02d","year":2022},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.874732Z"},"links":{"citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:a0d34c0ca50bb5a78ef144a5002d6d3167b3b2dc8682c56c20c9864ce4c97e18","observation_id":"760c18e8-c9fb-4767-b05d-01bdfd057181","resolution":{"observed_at":"2026-08-07T14:55:03.717012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:03.378086Z","title":null,"venue":null,"work_id":"6bf70c6d-8d70-46ba-aff9-417b5f776e3d","year":2024},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.968691Z"},"links":{"citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:13122db136860c6f6062627a7929024b95a1a300a92b4c4b26943ed989e8b4a0","observation_id":"4889059e-12a1-4166-96ef-f8ba649d4646","resolution":{"observed_at":"2026-08-07T14:55:03.475209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:02.048897Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:02.048897Z"},"links":{"citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:ff1ae00843a3bff9b5de19baf24f3e16defbbae480fb8690871a6dd744a82d66","observation_id":"ce33d872-fee5-43e0-84a7-52e79eefa564","resolution":{"observed_at":"2026-08-07T14:55:02.048897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:03.248831Z","title":"Faster whisper","venue":null,"work_id":"67bd0a61-6c5d-4909-8ee0-cea6fe282b78","year":null},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:02.132530Z"},"links":{"citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:13e7cc788eba8102ac37c9813836ed8a6fcaf420549d4c88676ebb745fabac06","observation_id":"938fb258-8af9-49d5-b37e-4141754901b3","resolution":{"observed_at":"2026-08-07T14:55:03.315506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2505.17326."}