{"as_of":"2026-08-14T14:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c35195e414b8f06d1eb003d3e9e38cbc2bbff62f71d850c7cfb591a2134a36c3","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:42:17.253526Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T23:40:07.144158Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:30:00.280829Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.15090","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15090","snapshot_observed_at":"2026-07-04T17:30:00.280829Z","title":null,"venue":null,"work_id":"95200d81-67e4-4447-88f5-4ec4e22cc5c8","year":2025},"citing_paper":{"arxiv_id":"2606.24644","last_updated":"2026-06-23T14:40:36Z","snapshot_observed_at":"2026-08-12T12:18:14.674965Z","submitted_at":"2026-06-23T14:40:36Z","title":"Measuring User's Mental Models of Speech Translation in Human-AI Collaboration","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-25T23:40:07.144158Z"},"links":{"cited_paper":"/paper/2501.15090","citing_paper":"/paper/2606.24644"},"observation_digest":"sha256:13e7e5f085a2184693487e0836651188689b8d71c2abbfa671df84d36c0621f9","observation_id":"f3fecb70-d488-42b5-982a-a2b057862167","resolution":{"observed_at":"2026-07-04T17:30:00.282188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15090/citation-record","integrity":"/paper/2501.15090/integrity","json":"/paper/2501.15090/citation-record.json","paper":"/paper/2501.15090"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:18.026500Z","title":"Lattice trans- former for speech translation,","venue":null,"work_id":"962f9650-5b5c-4a7e-b6f4-ebc97d729483","year":2019},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.019711Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:ab3a35a1e40268109e44dcf30f118a4f0a3a5eed2a48719b509294178a1325d2","observation_id":"fff1dfd5-12c6-41ea-bc87-0ef66c96f859","resolution":{"observed_at":"2026-08-10T14:42:18.030421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:18.014162Z","title":"Speech translation and the end-to-end promise: Taking stock of where we are,","venue":null,"work_id":"f87a47ad-99b2-4942-a8d3-800ab286c2a8","year":2020},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.024359Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:2c4624e992341515bf0f8c7b129f825aebfc5ce26e0869d8042f369a5465e0c9","observation_id":"f32e5f64-016f-4c15-abdb-c159c585d331","resolution":{"observed_at":"2026-08-10T14:42:18.018483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:18.000722Z","title":"Cascaded mod- els with cyclic feedback for direct speech translation,","venue":null,"work_id":"a454afcf-45e0-456a-827f-427b49d79dd8","year":2021},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.028614Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:2b7b18317e95ac5b4c519952625da5cea727026bd467cecd162ad7a273d0d243","observation_id":"db07f715-becf-4cd6-aedb-0c572ed27d33","resolution":{"observed_at":"2026-08-10T14:42:18.005681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.985502Z","title":"End-to-end speech trans- lation via cross-modal progressive training,","venue":null,"work_id":"fd67dda4-3b6b-497a-a8c0-fc3cfc41ec47","year":2021},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.032962Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:a02eb58c6038e7f7714baa5f3998ecc74ab75e61fa7cb3243ac43a79487cc585","observation_id":"b45f0ba3-c378-468d-b513-499cf3accbb8","resolution":{"observed_at":"2026-08-10T14:42:17.992177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.973709Z","title":"STEMM: Self-learning with speech-text manifold mixup for speech translation,","venue":null,"work_id":"584eac78-c12b-46a2-8c05-f73685b838e4","year":2022},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.036934Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:c514b2c3dd3b88c44d14956570c6bf71c368234c008e2650c5cc6715ec1de1dd","observation_id":"9de96314-71a4-414f-a62c-cb67d0d78892","resolution":{"observed_at":"2026-08-10T14:42:17.977764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.961997Z","title":"CKDST: Comprehensively and effectively distill knowledge from machine translation to end-to-end speech translation,","venue":null,"work_id":"5bddfd23-8d24-4ff4-a01e-8815ee86d3f6","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.040656Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:3af919cadb68086448720adc48301f3d11ec141d1036b7536015c1a88b865052","observation_id":"07715ab7-0b12-4e27-ba7a-0054827e6942","resolution":{"observed_at":"2026-08-10T14:42:17.966124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.949604Z","title":"Iterative translation refinement with large language models,","venue":null,"work_id":"91020b4d-603d-4f82-a8ee-658acfafb302","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.045024Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:6bf2a68795c4d3ab80190bbc6988c9a61a7ee7c2dbee0ea846411712563bf7af","observation_id":"f0f8ab60-333d-410e-86bf-f239a08aadc6","resolution":{"observed_at":"2026-08-10T14:42:17.954061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.933976Z","title":"Leveraging gpt-4 for automatic translation post-editing,","venue":null,"work_id":"8eeb78ee-c252-42f7-9a11-dbe79bdec6f9","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.048813Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:ebb538ee080d01fd89b3c104a0f2816bbcd80785661ea932787b7dd7f054edbf","observation_id":"f1b6abd4-9b6d-4cc9-98ef-4f9607529ea2","resolution":{"observed_at":"2026-08-10T14:42:17.938177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.921563Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":"9701d71e-5152-414d-81ca-5e9311179800","year":2022},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.052212Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:984a1a077969a6cf9ae0ec4fe78eb0343d78c2829d20cde0d579e4ffb80f5bf4","observation_id":"0791eefc-8eb5-4d62-82fc-370aa6759b9a","resolution":{"observed_at":"2026-08-10T14:42:17.925554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.909934Z","title":"Language models are few-shot learners,","venue":null,"work_id":"78bbaf57-f02a-4425-bc75-1802d5b63d2a","year":2020},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.055898Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:6a3d7e139649e8165341277317a1513cbe82eb94ae7ceee04756f7c116875456","observation_id":"7e4b5ce9-95e6-4a43-a482-d27ec105c6d9","resolution":{"observed_at":"2026-08-10T14:42:17.914018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.897745Z","title":"The llama 3 herd of models,","venue":null,"work_id":"3b6717a9-257e-41e0-b15a-ddd80906db6b","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.059516Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:02fc4a4b369c5a0b0ff6e38ec64e76c4ff7258443e61f7aacb57cf7fd3bd043e","observation_id":"02dca7a2-abaa-4323-9387-6bbfa53b1464","resolution":{"observed_at":"2026-08-10T14:42:17.902302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.884629Z","title":"Mistral nemo,","venue":null,"work_id":"5cc2d804-cbbf-4d42-af71-64d61586d840","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.063177Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:b7236cb224a00f563cf58972d840b1bc48ecda9872ddab6520be512a83fdd8d6","observation_id":"67231b00-f780-4e08-9aa5-f81c889bf8dc","resolution":{"observed_at":"2026-08-10T14:42:17.889248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.872545Z","title":"Blending LLMs into cas- caded speech translation: KIT‘s offline speech translation system for IWSLT 2024,","venue":null,"work_id":"cf505d5b-af37-4da4-9caf-f0c259c80fb6","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.066693Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:a95995df954b69426f0a2e87aa3efcb07c0dcee385e64432d904e859339cb504","observation_id":"6177d0f5-cc85-4e29-b3c0-852ebf347bb3","resolution":{"observed_at":"2026-08-10T14:42:17.877209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.861054Z","title":"Cur- riculum pre-training for end-to-end speech translation,","venue":null,"work_id":"41cc3091-360b-4831-a2d1-5622e3eea658","year":2020},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.070362Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:4c33cfec2aa612892af7feb24a9adbd0a468379c82b586c132fddf252326c4d3","observation_id":"78a47f9d-c5e4-444f-a236-856a3e2bcceb","resolution":{"observed_at":"2026-08-10T14:42:17.865146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.849074Z","title":"Effectively pretraining a speech translation decoder with machine translation data,","venue":null,"work_id":"c2d51b45-0353-4a12-9b95-273b14e3e006","year":2020},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.074112Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:5438780169823f294f4f8f8a0efe83229f7f354a1a169e462551abbd354e6456","observation_id":"57b54374-1e27-4150-a74a-a3524fabf452","resolution":{"observed_at":"2026-08-10T14:42:17.853211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.837813Z","title":"Unified speech-text pre-training for speech translation and recognition,","venue":null,"work_id":"550a6af3-6bb6-4810-a5a3-f1ccdfe134ad","year":2022},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.077847Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:9a3398eabef4185711529bf1bdf9b5daaac9d0007e7ab84ef1defb4ff8f3b0d1","observation_id":"50340621-c345-44c3-b3fc-72329841c36a","resolution":{"observed_at":"2026-08-10T14:42:17.841592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.826343Z","title":"SpeechUT: Bridging speech and text with hidden-unit for encoder-decoder based speech-text pre-training,","venue":null,"work_id":"66934a5b-3381-4a63-ba12-db42278910e3","year":2022},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.081425Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:c9382c0f87d2cb80fc9c1a25a62a787cc883beca274dfa0cd0975228b1ee93b9","observation_id":"e4f7b749-5c9f-4184-a4b7-7b7c18b20516","resolution":{"observed_at":"2026-08-10T14:42:17.830354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.814942Z","title":"Harnessing indirect training data for end- to-end automatic speech translation: Tricks of the trade,","venue":null,"work_id":"b3f90691-1c06-4148-b8d3-e2b49042bbc5","year":2019},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.085295Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:67c477365b0f3787abc8d3259ff8bc8a6c29de38ba636f67973b726702af25bd","observation_id":"d52f5c10-5b6e-48e5-a86e-4cf5f2cfec44","resolution":{"observed_at":"2026-08-10T14:42:17.819041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.802658Z","title":"Self-Training for End-to-End Speech Translation,","venue":null,"work_id":"09057c4c-b177-4bba-9158-fb09debdedea","year":2020},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.089003Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:293c734068abe29e2afb3433101edbfd748ed2641f5dacd6ba2da555421f9b92","observation_id":"c7ea2c1f-bb6b-48a0-80cc-0dc7abf95cdd","resolution":{"observed_at":"2026-08-10T14:42:17.806868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.789357Z","title":"Sample, translate, recombine: Leveraging audio alignments for data augmentation in end-to-end speech translation,","venue":null,"work_id":"92282825-547d-45a7-9240-f1deb4bbbc7c","year":2022},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.092670Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:c56b4e2b5dcd293e970a16fde56ece1d7869a33ec9dea109f43f705fe9b15a80","observation_id":"6096388f-f92e-46eb-a233-5de7c21f880c","resolution":{"observed_at":"2026-08-10T14:42:17.793722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.777225Z","title":"Cross-modal contrastive learning for speech translation,","venue":null,"work_id":"f8582034-491c-4e01-a119-d77f43fa802f","year":2022},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.096299Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:94ccfc99941f34a4bbd3f09268234bd544c60635e025339ddf1643d0625d2c20","observation_id":"e1e666ea-9cca-4375-b9f3-37d6e26b8942","resolution":{"observed_at":"2026-08-10T14:42:17.781408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.765372Z","title":"FCGCL: Fine- and coarse-granularity contrastive learning for speech translation,","venue":null,"work_id":"73fc8945-32bd-4329-8a8e-10d503297498","year":2022},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.100046Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:c9b3ba858f82fa26230ae6673ed05f7d728692402b2a6bdd4281e1c7f8a9aa95","observation_id":"d4853550-b03e-45d9-ba66-439778a35c3f","resolution":{"observed_at":"2026-08-10T14:42:17.769313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.753233Z","title":"W ACO: Word-aligned con- trastive learning for speech translation,","venue":null,"work_id":"969f0cb3-48c6-46d3-b344-d76ed6de6616","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.103972Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:d076d47d6fa0aad97da4863f77425afe97cb6fc7f8c4ceee85939dac12a8244b","observation_id":"a7a27a6d-b291-4d04-b8eb-f823e3431d6b","resolution":{"observed_at":"2026-08-10T14:42:17.757217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.741485Z","title":"Improving speech translation by fusing speech and text,","venue":null,"work_id":"f1b32fcd-e908-4d66-ad54-ee174543aecf","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.107826Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:5caebd2b9e17381a08fe38fd31e035fbe8c4b656a10cffd04b11d06a98af5bd0","observation_id":"0209708c-5202-4317-8da6-32e7d2093182","resolution":{"observed_at":"2026-08-10T14:42:17.745547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.726559Z","title":"A simple con- catenation can effectively improve speech translation,","venue":null,"work_id":"351c4836-9262-4287-a782-b253413c95e3","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.111419Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:4548f6bc962f4e80861c96aaac0747bac3862b903565e2bc2cbeded50c3f5a0d","observation_id":"5c1c279d-dd04-438c-b32c-f0e1334cd2b0","resolution":{"observed_at":"2026-08-10T14:42:17.731505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.714936Z","title":"CMOT: Cross-modal mixup via optimal transport for speech translation,","venue":null,"work_id":"8438ac2f-47cd-412c-814e-937b1dad5cd8","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.115262Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:b5355ac510b26147eb7c8ca19d0a0a5c2de5fa0e10c0d4b2e0dd1f3797dce7d5","observation_id":"2ddb9577-31cd-4603-8a33-e380fa7e3926","resolution":{"observed_at":"2026-08-10T14:42:17.719162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.699621Z","title":"Im- proving speech translation by understanding and learning from the auxiliary text translation task,","venue":null,"work_id":"7937749a-2a57-4409-ba06-d25b51038261","year":2021},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.119126Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:e8e265c7744eed189e553d5981491dc585506a9811b41eb7dddc2d974311be95","observation_id":"522d255c-7037-402e-99f9-c757f0ba2d00","resolution":{"observed_at":"2026-08-10T14:42:17.704741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.687094Z","title":"Modality adaption or regularization? a case study on end-to-end speech translation,","venue":null,"work_id":"0e81d4de-f5d7-4af4-a5d3-f8ef20451d74","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.122920Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:8296ee0288c7ddf3b88aa9f5f64085ecfe56a7958669a698c8a6fb7e390280a2","observation_id":"6da65ddc-9dde-403e-b045-de2a3543b1e4","resolution":{"observed_at":"2026-08-10T14:42:17.691246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.675581Z","title":"An empirical study of consistency regularization for end-to- end speech-to-text translation,","venue":null,"work_id":"4f1cf8cb-e49c-4fa1-8aba-a692d3d203b4","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.126467Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:e4ed32f3441b4e498ab742724bf402bc1603a780de39885419a17d87edbce869","observation_id":"6cff7d87-ef61-427a-bd91-bacd1b8a804d","resolution":{"observed_at":"2026-08-10T14:42:17.679381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.663989Z","title":"On decoder-only architecture for speech-to-text and large language model integration,","venue":null,"work_id":"1e98fb1d-0d01-491a-bfd1-cd22fdbf2af2","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.130084Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:9716bf4abf7510cf2918251b4c79d9812ae46d6ab5ed6213cb08b0708b76f613","observation_id":"71da6c52-1c1b-42cf-aed3-4ed4d1fad841","resolution":{"observed_at":"2026-08-10T14:42:17.668087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.651951Z","title":"Salm: Speech-augmented language model with in- context learning for speech recognition and translation,","venue":null,"work_id":"0ac0e8f1-a4f6-4fe7-8193-4f1bde758a68","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.133739Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:21bbbee70a996429fadf1c5575977bf384a892864bb072542995ad8ad4ee482f","observation_id":"fa07cc28-eb38-447d-a484-a05a5780c4ad","resolution":{"observed_at":"2026-08-10T14:42:17.656069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.641017Z","title":"SALMONN: towards generic hearing abilities for large language models,","venue":null,"work_id":"0770bd40-6f20-4657-8614-e7de7b1daeb5","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.137463Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:f5e9c0c2ddee77c9a2116b73467010205c3c88942f37db760d0ea34deae1bf1e","observation_id":"2b2abc2a-b583-4b19-a8f5-e1becae33d66","resolution":{"observed_at":"2026-08-10T14:42:17.644918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-10T14:42:17.140840Z","title":"Qwen-audio: Advancing univer- sal audio understanding via unified large-scale audio- language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.140840Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:086821ee15f34965d36832720f1d73ce592051bfb31f5fa21aed3bf4f8673ef8","observation_id":"b2956e84-e4c5-417f-bf86-8ebf6a65e62a","resolution":{"observed_at":"2026-08-10T14:42:17.140840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-10T14:42:17.144957Z","title":"Qwen2- audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.144957Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:bd28080f088222c0bcd5d502609bef1ffc3321fc61b36f73454e39a20c214584","observation_id":"85f2ecc3-a4b9-4793-b159-375c76349f9e","resolution":{"observed_at":"2026-08-10T14:42:17.144957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.629429Z","title":"AudioChatLlama: Towards general-purpose speech abilities for LLMs,","venue":null,"work_id":"bec2bcda-2034-4611-a0aa-178fd2ef1fed","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.148812Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:505432a73c9fff7ddb47e0c6722387fca3525c2637ec19554287f1b2f95d8949","observation_id":"dc42bebc-a420-4f26-bfef-1418baf0788e","resolution":{"observed_at":"2026-08-10T14:42:17.633451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.617396Z","title":"Speech translation with speech foundation models and large language models: What is there and what is missing?","venue":null,"work_id":"4aa95c15-a695-498e-bb27-ff4f3d2d3b0f","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.152572Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:49c27f554174029e5fd3329ef936556778089ac9cc8434847d87384399ddaa34","observation_id":"1758239e-f19a-423f-821c-7c1764f5bf56","resolution":{"observed_at":"2026-08-10T14:42:17.621566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.604960Z","title":"GenTranslate: Large language models are generative multilingual speech and machine translators,","venue":null,"work_id":"93bac9f3-95de-4a84-b908-e8be629409d8","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.156168Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:ec6c856cc4c22b25f358321816a6e60f5276158b32a9bb60c7c6b43319945ae5","observation_id":"fa08d383-055c-48e8-9619-bd512a135ab4","resolution":{"observed_at":"2026-08-10T14:42:17.609845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.593746Z","title":"Findings of the WMT 2018 shared task on automatic post-editing,","venue":null,"work_id":"f322b53a-c430-42bf-8bb1-b5bb425fc68a","year":2018},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.159668Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:7802fa9d4713b95f5373f52f68f4793f0771425d3692c32a7e8b398b38c60bd1","observation_id":"7ee4e9e0-efa2-48ea-8792-4dfd6fa718a0","resolution":{"observed_at":"2026-08-10T14:42:17.597671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.582102Z","title":"Lexical translation inconsistency-aware document-level translation repair,","venue":null,"work_id":"d403c714-6f79-47bc-9172-fdd65f100836","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.163254Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:bec9e73eb9530fc8b7e2afab9af4ab3235a9c788b3f8b534e183755741b46b02","observation_id":"eefa0888-5c7f-4d27-839a-36ac565ff310","resolution":{"observed_at":"2026-08-10T14:42:17.586027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16379","last_updated":"2024-06-21T07:35:53Z","snapshot_observed_at":"2026-08-14T11:45:52.367644Z","submitted_at":"2024-02-26T07:58:12Z","title":"TEaR: Improving LLM-based Machine Translation with Systematic Self-Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16379","snapshot_observed_at":"2026-08-10T14:42:17.166902Z","title":"Improving llm-based machine translation with systematic self-correction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.166902Z"},"links":{"cited_paper":"/paper/2402.16379","citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:898b9e1feac4b7436e4f029f981bdf64da3d9f635ac533cd390bf03fc37f45f5","observation_id":"8b1036b3-5ecb-405b-8161-bef433103d4a","resolution":{"observed_at":"2026-08-10T14:42:17.166902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.570992Z","title":"Guiding large language models to post-edit machine translation with error annotations,","venue":null,"work_id":"7626c8a9-7e2e-4acf-acb6-7073b3eb07f6","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.170723Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:ecaec1ceb8fc4a0ca557a232388fbefb49a07a7e0d1b12e95716fa771fd36c06","observation_id":"1e4393e7-5ad4-46b9-9971-de5ea8f8d0ac","resolution":{"observed_at":"2026-08-10T14:42:17.574799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.560176Z","title":"Contex- tual refinement of translations: Large language models for sentence and document-level post-editing,","venue":null,"work_id":"a2107387-f321-4fdb-b1d1-9069ea2e1330","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.174195Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:87d9d60c5baf370fde1bbf2281da82426eb69b5f6f2e3c871fb301e8e5c83d2a","observation_id":"9a535983-a811-4b94-bbd0-de5d6ed0761e","resolution":{"observed_at":"2026-08-10T14:42:17.564109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.549174Z","title":"Hubert: Self- supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":"5369579e-1680-4856-9726-55bfbeb928c8","year":2021},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.177705Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:57c8d0e7ecdebaf316ff98ac8bb73fb2b1954f46d5a08228f82400d0031780af","observation_id":"62295bcc-f7b5-45a9-96a6-6fb3bd7de7d6","resolution":{"observed_at":"2026-08-10T14:42:17.553094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.538138Z","title":"Robust speech recog- nition via large-scale weak supervision,","venue":null,"work_id":"81cbfd8d-c866-46b4-a733-46c7e9ca45de","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.181609Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:d5fabdc6e141fe9c2fa8cb6af137e65bccf98d3edf8e48e7d699b4f77851c6bd","observation_id":"e6e14604-4845-486a-b4ab-39ed8bca64c6","resolution":{"observed_at":"2026-08-10T14:42:17.542141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.527254Z","title":"Don’t stop pretraining: Adapt language models to domains and tasks,","venue":null,"work_id":"0e748a64-56e6-497f-b85f-ba9c9e8ad78e","year":2020},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.185210Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:0174dccedf6fad71852de2f9ab8a6584827b68e9bd28b1baa06fed3bfdaaf602","observation_id":"3a8f6cb7-5cb4-40b4-b0ca-d63ca6e66c0e","resolution":{"observed_at":"2026-08-10T14:42:17.531051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.516090Z","title":"Neural machine transla- tion with extended context,","venue":null,"work_id":"2fb8e776-80c5-45b7-a469-0ec6563d7537","year":2017},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.189246Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:7e68461e64e845be0af74470101bc526a2401048bd350b338698ca5ef33689cb","observation_id":"81f18431-b0e3-4c8a-87fb-fcbd0cdaa5c7","resolution":{"observed_at":"2026-08-10T14:42:17.520092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.504670Z","title":"P-Transformer: Towards Better Document-to-Document Neural Machine Translation,","venue":null,"work_id":"5029f56b-005a-4981-af28-8f91ac505db0","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.193063Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:198111526dac0c1a2426c38905cb78dec7c5c184d4ebf9d5edc51e6d65cbe6d7","observation_id":"590819f7-a102-437d-b910-208b6af4259d","resolution":{"observed_at":"2026-08-10T14:42:17.508706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.493220Z","title":"Beyond sentence-level end-to-end speech translation: Context helps,","venue":null,"work_id":"66853424-a976-4537-914c-207fd60b127e","year":2021},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.196546Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:6a78b80e61c20bbdc77c833ed0a43434c8ac14fdb7de8bf665d4bb0b5e640e99","observation_id":"8540ea81-023d-47ee-9bb9-24c43fc61fa0","resolution":{"observed_at":"2026-08-10T14:42:17.497344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.481315Z","title":"MuST-C: a Multilingual Speech Translation Corpus,","venue":null,"work_id":"bfbb0f2f-89a4-400b-b758-4c67196b83cb","year":2019},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.200377Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:c2c3e044a5ad2436c23ded4539f0e6ca63740e39d2762f1bfd3b30f16e70ece2","observation_id":"74c94ba9-8185-480b-8872-23f921ecb650","resolution":{"observed_at":"2026-08-10T14:42:17.485240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.10310","last_updated":"2020-10-24T06:07:01Z","snapshot_observed_at":"2026-08-09T21:19:30.065131Z","submitted_at":"2020-07-20T17:53:35Z","title":"CoVoST 2 and Massively Multilingual Speech-to-Text Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.10310","snapshot_observed_at":"2026-08-10T14:42:17.203997Z","title":"Covost 2: A massively multilingual speech-to-text translation corpus,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.203997Z"},"links":{"cited_paper":"/paper/2007.10310","citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:96ceeb331293ddd1e428648714ca1a605d339b28f3f11434025e68b38af56390","observation_id":"ebc0e240-ef6c-4878-9eab-d199efc693ab","resolution":{"observed_at":"2026-08-10T14:42:17.203997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.470595Z","title":"Understanding and bridging the modality gap for speech translation,","venue":null,"work_id":"7af4c97c-bdce-4ac2-81d6-2e3cd88d79de","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.208126Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:72a1aa12a380ba56abc497329b33de295fb832ea6b41bd1f39de85514ea24bc1","observation_id":"223dffcb-8aa9-4122-bc2c-a3a8df70334a","resolution":{"observed_at":"2026-08-10T14:42:17.474368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.459481Z","title":"Speechlm: Enhanced speech pre-training with unpaired textual data,","venue":null,"work_id":"1e210b3b-8cf9-4823-9e7d-9f8c79122cb6","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.212398Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:6b85681630f9b651e78340f7dde65af49d0c050f0042c1ad21593fb6e5e7b991","observation_id":"c3197707-a5bf-4818-b761-5d86d35dc996","resolution":{"observed_at":"2026-08-10T14:42:17.463332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.447558Z","title":"LlamaFactory: Unified efficient fine-tuning of 100+ lan- guage models,","venue":null,"work_id":"37f4c613-6cdf-4e60-96de-d0e8b48c4475","year":2024},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.216353Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:3250a34e2dd4758e2bb326560dce96d90365b69713cd8649a101a272e5950578","observation_id":"205e4de9-3450-47b1-b348-af54037745ce","resolution":{"observed_at":"2026-08-10T14:42:17.451393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.436501Z","title":"A call for clarity in reporting BLEU scores,","venue":null,"work_id":"8fdc36f2-defd-4bb6-863f-5e2b5abd1fea","year":2018},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.220074Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:61c30b32a6293e64d5d5de2f05106c3bf8deb3694b6b7087f52c193fd2a9d964","observation_id":"97e84c99-d058-4847-93f4-2af72677c76a","resolution":{"observed_at":"2026-08-10T14:42:17.440398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.424617Z","title":"COMET: Commonsense trans- formers for automatic knowledge graph construction,","venue":null,"work_id":"d47bf9bc-bd41-4acb-a3f1-8518f145b142","year":2019},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.223666Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:6c3f3bbda9edbcce73e18fee324ca1598c461ea80ba037f9e421a7f27c464e32","observation_id":"6db5a894-56dd-4f80-9af7-0459ce76b0e2","resolution":{"observed_at":"2026-08-10T14:42:17.429039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.412102Z","title":"Statistical significance tests for machine trans- lation evaluation,","venue":null,"work_id":"05b0eb67-035d-44ff-ae03-2dd335bde9b6","year":2004},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.227188Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:5bf657778e257c09b50423ead77b44ec00ad28f1d0591aa76921b873a6802048","observation_id":"0beb234c-fb1c-4011-9ded-ae39038abc48","resolution":{"observed_at":"2026-08-10T14:42:17.416771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.399962Z","title":"Bertscore: Evaluating text generation with bert,","venue":null,"work_id":"75a0087a-435c-4039-8700-259bf2727926","year":2020},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.231207Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:0e5e66b85d7c97ac8253c859a21545d4a6dac6f71dc1cef31b6f5463cbc54284","observation_id":"2e07c23b-6409-4f6d-9336-c98db2ae735b","resolution":{"observed_at":"2026-08-10T14:42:17.404141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.387193Z","title":"Con- trastive decoding: Open-ended text generation as opti- mization,","venue":null,"work_id":"5a318160-9d2c-4084-a958-f126b1e4de92","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.235011Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:ca9bb959bcde6996609d89857c0075b118b3837688727aaff36c1e38be9d2679","observation_id":"b405241a-5c06-4786-a5c4-5aeb1edfdcae","resolution":{"observed_at":"2026-08-10T14:42:17.391916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.375178Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":"298f5a70-1dbd-4fd3-bb8b-a7ae0fd69ecc","year":2019},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.238699Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:dc03dac159e2ab4e01f77721bd86ab197e292fa9cae34befc148bb2c255c11f5","observation_id":"c6ace663-75fe-4862-83d7-1828369a7d54","resolution":{"observed_at":"2026-08-10T14:42:17.379064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.363044Z","title":"SimCSE: Simple con- trastive learning of sentence embeddings,","venue":null,"work_id":"5b765a1b-4fc4-41f5-b17a-068ce7c864a9","year":2021},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.242482Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:3f2c8fb9206eb2191e4228918d7f4cd0a5e4e052d483105cc15a4e452b26b5d6","observation_id":"ca0f027b-6207-4f1a-a794-9cc9ebcabd6e","resolution":{"observed_at":"2026-08-10T14:42:17.367160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.351238Z","title":"Rethinking document-level neural machine translation,","venue":null,"work_id":"324e4236-8d14-4415-83cc-cb8527d1bcf4","year":2022},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.246185Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:d2cbeef6d943bf8d9e8618994dc52ba9847feb458c7d36535f831ea942008bc7","observation_id":"184ae547-277f-4e79-b1aa-eb46e1489fa8","resolution":{"observed_at":"2026-08-10T14:42:17.355016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.339477Z","title":"Validation of an automatic metric for the accuracy of pronoun translation (APT),","venue":null,"work_id":"3bf2e183-ec5f-477a-8346-0834c43156ec","year":2017},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.249654Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:8c79c716d1b61c84d0a6ae0217e8ed8c91505e6cefc839accd11eccb89c71300","observation_id":"840f6936-4b02-411c-bb66-33b0d7392685","resolution":{"observed_at":"2026-08-10T14:42:17.343510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:42:17.325729Z","title":"Large language models are state-of-the-art evaluators of translation quality,","venue":null,"work_id":"9d5a09f6-b231-45cd-b2e3-2d730fdbdbc7","year":2023},"citing_paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T14:42:17.253526Z"},"links":{"citing_paper":"/paper/2501.15090"},"observation_digest":"sha256:360d5834a825d3a4ca9f0e54947d06c8cd6fdc22b0d2cb8df8e9fed198a295e5","observation_id":"db95e896-cf57-4751-88a0-23335bdf379b","resolution":{"observed_at":"2026-08-10T14:42:17.331141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.15090","last_updated":"2025-01-25T05:32:42Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T20:42:14.334754Z","submitted_at":"2025-01-25T05:32:42Z","title":"Speech Translation Refinement using Large Language Models"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":59},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2501.15090."}