{"as_of":"2026-08-06T17:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60fb5bb0a079c7a64fdf9037831f30df5bb7c7c2222c9cf961df97ded6b048e1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:30:09.973558Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-07-06T06:03:37.247241Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-12T10:47:18.426912Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/1710.03740"},"observation_digest":"sha256:cbebbad8d7105e68408db3628d88994a78f24340589232ef36960a7162c7d5cc","observation_id":"446fe6cf-28f0-4211-887b-4ee6cdc0b47e","resolution":{"observed_at":"2026-05-12T10:47:18.502759Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"1712.00409","last_updated":"2017-12-01T17:13:14Z","snapshot_observed_at":"2026-07-06T06:12:18.811024Z","submitted_at":"2017-12-01T17:13:14Z","title":"Deep Learning Scaling is Predictable, Empirically","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T04:01:58.384077Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/1712.00409"},"observation_digest":"sha256:a1a3b55cf0cd3fe3bb8cf1debeaf60650f2bfefb7cf0330d356702207e90386a","observation_id":"d98064fe-8d22-4197-85d0-03e411a22c8b","resolution":{"observed_at":"2026-05-12T04:01:58.419869Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"1906.11604","last_updated":"2019-06-27T13:10:37Z","snapshot_observed_at":"2026-07-06T08:03:14.995336Z","submitted_at":"2019-06-27T13:10:37Z","title":"Gated Embeddings in End-to-End Speech Recognition for Conversational-Context Fusion","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-25T15:04:37.455896Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/1906.11604"},"observation_digest":"sha256:c52d50697cda54a333c2502817ae48a65bdafb341b05cfe251e4a90b2e65910b","observation_id":"2d7b3c58-e652-4406-889c-3900656cca5b","resolution":{"observed_at":"2026-05-25T15:05:57.754837Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"1907.02479","last_updated":"2019-07-04T16:20:42Z","snapshot_observed_at":"2026-08-02T21:43:57.499724Z","submitted_at":"2019-07-04T16:20:42Z","title":"Fine-grained robust prosody transfer for single-speaker neural text-to-speech","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T08:27:16.910352Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/1907.02479"},"observation_digest":"sha256:06cb29eba5556bf207af15a95b637e751da8daaf4be2f463fb9407e735d3b5cc","observation_id":"51ff81b0-f8f9-42b3-8f3c-dd60da89375a","resolution":{"observed_at":"2026-05-25T08:30:32.083727Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2309.12802","last_updated":"2023-09-22T11:33:03Z","snapshot_observed_at":"2026-07-06T16:22:21.746857Z","submitted_at":"2023-09-22T11:33:03Z","title":"Deepfake audio as a data augmentation technique for training automatic speech to text transcription models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T07:01:04.631071Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2309.12802"},"observation_digest":"sha256:b39d3e9d62f918b50ceeb92d1d379cb4799d23baa58a57d5de45a7857904240a","observation_id":"82ec4563-a7b2-428f-8d6f-ab4c8f21d13c","resolution":{"observed_at":"2026-05-24T07:04:03.119378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2402.13228","last_updated":"2024-07-03T13:46:33Z","snapshot_observed_at":"2026-07-31T05:05:41.080329Z","submitted_at":"2024-02-20T18:42:34Z","title":"Smaug: Fixing Failure Modes of Preference Optimisation with DPO-Positive","version":2},"reference_index":239,"source":"arxiv_source","source_observed_at":"2026-05-17T23:04:44.287660Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2402.13228"},"observation_digest":"sha256:e531d8feeaa3d619d2dd35ea67e70cd4dc138f1394b3fd9155a9b85ae9f803d3","observation_id":"2271d272-fc1d-4434-95cb-db8f2ab6596e","resolution":{"observed_at":"2026-05-17T23:04:44.622504Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-06T16:30:09.973558Z","title":"Deep speech: Scaling up end-to-end speech recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.13563","last_updated":"2026-06-23T14:05:34Z","snapshot_observed_at":"2026-08-06T16:19:41.670843Z","submitted_at":"2025-07-17T22:41:40Z","title":"Balalaika: Data-Centric, Prosody-Aware Annotation Pipeline for Russian Speech","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:30:09.973558Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2507.13563"},"observation_digest":"sha256:b4a970c9ca48f22d5f07972a01825b3bc2804b2c7e8141ebec80ee9bf0d544bc","observation_id":"1ff236bf-b2b1-43e6-90ee-428bbecd26d3","resolution":{"observed_at":"2026-08-06T16:30:09.973558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-05T22:04:11.978406Z","title":"arXiv preprint arXiv:1412.5567 (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.07608","last_updated":"2025-08-11T04:23:08Z","snapshot_observed_at":"2026-08-06T10:43:44.106644Z","submitted_at":"2025-08-11T04:23:08Z","title":"AD-AVSR: Asymmetric Dual-stream Enhancement for Robust Audio-Visual Speech Recognition","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-05T22:04:11.978406Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2508.07608"},"observation_digest":"sha256:d2c98236c3e8be8bfc67213769e865ed0a0a3b388e16d93bf1efce64c7fc5661","observation_id":"468f7e96-22df-46a9-b9b1-43c97c53aeec","resolution":{"observed_at":"2026-08-05T22:04:11.978406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-05T20:23:51.658851Z","title":"Deep speech: Scaling up end-to-end speech recognition.arXiv preprint arXiv:1412.5567, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.658851Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:98f8518381a66b5e08954e5c2a42a7fa55f0067f8d9efac8fd7a5f2db4f9bbb9","observation_id":"f4b98128-934c-44e5-b2b2-5a6d7dd6dc0c","resolution":{"observed_at":"2026-08-05T20:23:51.658851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-05T18:37:00.706707Z","title":"Hannun, C","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.14449","last_updated":"2025-08-20T06:12:33Z","snapshot_observed_at":"2026-08-05T18:36:58.630200Z","submitted_at":"2025-08-20T06:12:33Z","title":"D^3-Talker: Dual-Branch Decoupled Deformation Fields for Few-Shot 3D Talking Head Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T18:37:00.706707Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2508.14449"},"observation_digest":"sha256:01e3aec19ba128cd38ad90a86c0997b7a04631660570984757001d2072f858d2","observation_id":"1708bf61-afa7-4ad7-bacb-9eb6202d5a89","resolution":{"observed_at":"2026-08-05T18:37:00.706707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2508.18948","last_updated":"2026-04-22T09:07:09Z","snapshot_observed_at":"2026-07-06T22:18:49.969283Z","submitted_at":"2025-08-26T11:41:11Z","title":"Gauge-covariant stochastic neural fields: Stability and finite-width effects","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T21:45:08.119232Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2508.18948"},"observation_digest":"sha256:0e01a8a6526101d4fdcf7cebc9f85feb87e31e0292da2da814828de7c616d93b","observation_id":"319bc9a0-f60c-46cb-bc65-4564129e8a14","resolution":{"observed_at":"2026-05-18T21:46:51.886918Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2510.03093","last_updated":"2026-01-23T10:54:04Z","snapshot_observed_at":"2026-07-06T22:31:40.462674Z","submitted_at":"2025-10-03T15:23:32Z","title":"Revisiting Direct Speech-to-Text Translation with Speech LLMs: Better Scaling than CoT Prompting?","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T10:28:16.040337Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2510.03093"},"observation_digest":"sha256:4fe28ec3e4de93387815b81013d40ca00a7889ecdd22430885433c53724bdbe7","observation_id":"409dd226-30de-4ad4-9fab-f88e40ba717c","resolution":{"observed_at":"2026-05-18T10:31:14.892893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2601.17097","last_updated":"2026-01-22T15:00:47Z","snapshot_observed_at":"2026-07-06T22:42:52.947644Z","submitted_at":"2026-01-22T15:00:47Z","title":"Sink or SWIM: Tackling Real-Time ASR at Scale","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T12:09:17.087477Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2601.17097"},"observation_digest":"sha256:3c5dbbda80baba466e58ed599cda999b19f946ef1b3446b996bd4d0985844643","observation_id":"98865472-96d1-4f83-9c81-e9aaf9c35a3d","resolution":{"observed_at":"2026-05-16T12:10:53.557431Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-03T01:34:12.626353Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T17:30:36.462567Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:cd17aef3fcf57b3ba888a8c1dbce58e259086f1560a4c013a340e25ff0b2af28","observation_id":"5834117f-1eac-402b-9d87-ed9af41d2a03","resolution":{"observed_at":"2026-05-11T06:41:26.316355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-02T16:38:16.145548Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-03T01:34:12.626353Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T16:38:16.145548Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:c492db8421fcff4b5148d843bae821301e7edefcb7ae5ea70b1427e751a7e286","observation_id":"1c93f416-1030-47c2-80c0-27d8280e0d47","resolution":{"observed_at":"2026-08-02T16:38:16.145548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2604.11283","last_updated":"2026-06-01T08:50:38Z","snapshot_observed_at":"2026-08-02T05:26:21.584719Z","submitted_at":"2026-04-13T10:42:31Z","title":"Multimodal Large Language Model-Enabled Video Translation: A Role-Oriented Survey","version":1},"reference_index":152,"source":"pdf_text","source_observed_at":"2026-05-10T16:36:33.264166Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2604.11283"},"observation_digest":"sha256:931c2fb8f0a1dcd8fea0e8ae93117e8ac5160ce0983ba2db4d6af3d62c686143","observation_id":"3de0fc65-9b4e-4993-8c10-bf722f69e27a","resolution":{"observed_at":"2026-05-11T08:30:56.910165Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-12T22:04:31.302192Z","title":"Deep speech: Scaling up end-to-end speech recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2604.11283","last_updated":"2026-06-01T08:50:38Z","snapshot_observed_at":"2026-08-02T05:26:21.584719Z","submitted_at":"2026-04-13T10:42:31Z","title":"Multimodal Large Language Model-Enabled Video Translation: A Role-Oriented Survey","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T22:04:31.302192Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2604.11283"},"observation_digest":"sha256:e2aaf59faac6eee4dfa811f859418d7858f6593f452583753d57f2ec236dd355","observation_id":"80b95312-4df9-4ba7-af79-1b6243102680","resolution":{"observed_at":"2026-07-12T22:04:31.302192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2604.20842","last_updated":"2026-04-22T17:59:58Z","snapshot_observed_at":"2026-08-04T16:34:40.989674Z","submitted_at":"2026-04-22T17:59:58Z","title":"SpeechParaling-Bench: A Comprehensive Benchmark for Paralinguistic-Aware Speech Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T00:39:04.303837Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2604.20842"},"observation_digest":"sha256:a8fe523fe802ece8860426a32f8cf3ffb06486a7d845470c40e3161a5d1f5d2b","observation_id":"684a4787-3093-4075-aba3-ac871ed0b664","resolution":{"observed_at":"2026-05-10T00:39:48.467145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2605.24313","last_updated":"2026-05-23T00:39:59Z","snapshot_observed_at":"2026-08-05T03:29:01.672887Z","submitted_at":"2026-05-23T00:39:59Z","title":"End-to-End Intracortical Speech Decoding from Neural Activity","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T13:58:02.170701Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2605.24313"},"observation_digest":"sha256:37c7d66cfcb3543027d8e7e31c2813ef6c54412aa12e55ee1fb78c033a69e374","observation_id":"46bcce13-80b7-437c-9177-c3ad1d7c7184","resolution":{"observed_at":"2026-06-30T14:04:44.710471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2605.28139","last_updated":"2026-05-27T08:22:47Z","snapshot_observed_at":"2026-08-05T12:11:37.559145Z","submitted_at":"2026-05-27T08:22:47Z","title":"Data-Efficient On-Policy Distillation for Automatic Speech Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T12:02:35.332633Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2605.28139"},"observation_digest":"sha256:90516b7911767ebec68623589d277b4d945289d7f6db0c9230cd5bde44689d2a","observation_id":"1b17bb28-12cc-4f6a-ad52-05a35e2b0321","resolution":{"observed_at":"2026-06-29T12:03:23.194853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2606.05678","last_updated":"2026-06-04T04:00:48Z","snapshot_observed_at":"2026-08-06T15:39:31.090436Z","submitted_at":"2026-06-04T04:00:48Z","title":"Beyond Waveform Robustness: Robust Feature-Vocoder Adversarial Attacks on Automatic Speech Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T00:09:19.291564Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2606.05678"},"observation_digest":"sha256:2ee18e0b24a811631e9103ff8241d14d95ba17e71ea5eba4161afe7a6d96e5e5","observation_id":"b91ef777-9229-463f-887b-e11c6daed347","resolution":{"observed_at":"2026-07-02T14:47:04.341763Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2606.21340","last_updated":"2026-06-19T11:37:06Z","snapshot_observed_at":"2026-08-05T14:47:11.390438Z","submitted_at":"2026-06-19T11:37:06Z","title":"Synthetic Audio Generation Framework for Air Traffic Control Speech Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T14:34:38.316387Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2606.21340"},"observation_digest":"sha256:9becb0790797991aa15e721750e498285a00d3b5226624754af26282df8f66b8","observation_id":"521abf9f-fdb3-4f0c-a2f5-ebdef0e21926","resolution":{"observed_at":"2026-07-04T06:19:38.617334Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":"1412.5567","doi":"10.48550/arxiv.1412.5567","metadata_source":"pith","pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Deep Speech: Scaling up end-to-end speech recognition","venue":"cs.CL","work_id":"eb57b6c8-18a7-4e51-b90a-2add68d4ee9e","year":2014},"citing_paper":{"arxiv_id":"2607.02296","last_updated":"2026-07-02T15:13:32Z","snapshot_observed_at":"2026-08-02T07:05:47.023745Z","submitted_at":"2026-07-02T15:13:32Z","title":"Spatial Speech Perception Systems: A Survey of Sound Source Localization, Directional Enhancement, and Speech Recognition","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-03T04:52:36.712797Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2607.02296"},"observation_digest":"sha256:a64b620978955722092ede425899d7228210f9b79093f267f292accd52618ac9","observation_id":"ce450b9b-0032-46fa-9cc6-042fa3747e6e","resolution":{"observed_at":"2026-07-03T04:57:37.928585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-01T15:08:19.307496Z","title":"Hannun, Carl Case, Jared Casper, Bryan Catanzaro, Greg Diamos, Erich Elsen, Ryan Prenger, Sanjeev Satheesh, Shubho Sengupta, Adam Coates, and Andrew Y","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18582","last_updated":"2026-07-20T23:41:24Z","snapshot_observed_at":"2026-08-01T15:08:16.865398Z","submitted_at":"2026-07-20T23:41:24Z","title":"Provably Lossless Acceleration of DNN Mutation Testing via Memoization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T15:08:19.307496Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2607.18582"},"observation_digest":"sha256:c9e0cd3dfe216c72d9a6a7238408e4005385c1b6db4536bca1aa10596dd605b6","observation_id":"35ffceb3-8834-404f-9733-71d2c5ca0930","resolution":{"observed_at":"2026-08-01T15:08:19.307496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-31T23:37:11.363931Z","title":"Hannun and Carl Case and Jared Casper and Bryan Catanzaro and Greg Diamos and Erich Elsen and Ryan Prenger and Sanjeev Satheesh and Shubho Sengupta and Adam Coates and Andrew Y","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23925","last_updated":"2026-07-27T01:36:40Z","snapshot_observed_at":"2026-08-05T00:36:35.788925Z","submitted_at":"2026-07-27T01:36:40Z","title":"Greedy dynamical meta-learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T23:37:11.363931Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2607.23925"},"observation_digest":"sha256:9fa265bb96da452a7ed43800964f8d1e1fb9dd68f273c45dcb30ff853c69c61d","observation_id":"d5e2d7ca-a4b1-4c47-8366-e319a60e3036","resolution":{"observed_at":"2026-07-31T23:37:11.363931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-07-31T23:06:30.462774Z","title":"Deep speech: Scaling up end-to-end speech recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.24082","last_updated":"2026-07-27T07:23:22Z","snapshot_observed_at":"2026-08-06T03:54:26.893671Z","submitted_at":"2026-07-27T07:23:22Z","title":"Towards High-Level Semantic Intelligence","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T23:06:30.462774Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2607.24082"},"observation_digest":"sha256:a39f71b77bbf6334be685cb75d3c3d33dd031aa5a40d2d5996115e7f72a1fec1","observation_id":"3104b090-de81-49f1-8ca1-699f4617a492","resolution":{"observed_at":"2026-07-31T23:06:30.462774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-01T02:20:39.882725Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.25494","last_updated":"2026-07-28T09:31:17Z","snapshot_observed_at":"2026-08-06T15:06:20.222746Z","submitted_at":"2026-07-28T09:31:17Z","title":"Automated Numerical Stability Analysis of Deep Learning Operators","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T02:20:39.882725Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2607.25494"},"observation_digest":"sha256:7dc1e821fc036c00eb804a57489ffc3fcf3425f9f4b6a1ec850d8f9d8f031dbd","observation_id":"6a842f46-9408-43b3-b110-82b136ebbb8b","resolution":{"observed_at":"2026-08-01T02:20:39.882725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1412.5567/citation-record","integrity":"/paper/1412.5567/integrity","json":"/paper/1412.5567/citation-record.json","paper":"/paper/1412.5567"},"outbound":[],"paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:1412.5567."}