{"as_of":"2026-08-14T18:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3f8957d009e1318b26f593729002ae9c3f87cfa597f3795d2e65a022ef787157","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T10:34:37.884102Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T13:29:51.152577Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"1906.09890","last_updated":"2019-07-01T22:02:09Z","snapshot_observed_at":"2026-07-06T08:02:22.250283Z","submitted_at":"2019-06-24T12:44:09Z","title":"Self Multi-Head Attention for Speaker Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-25T17:14:01.218607Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/1906.09890"},"observation_digest":"sha256:dc0c8bdcefe7ca8ef39e8348bde7e94b59639f360c646a7a5d2b24c6ef2c6767","observation_id":"2aaef789-604b-41d6-9fca-64ddabb807fe","resolution":{"observed_at":"2026-05-25T17:16:04.540716Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"1907.03233","last_updated":"2019-07-07T07:03:09Z","snapshot_observed_at":"2026-08-02T15:00:43.955201Z","submitted_at":"2019-07-07T07:03:09Z","title":"NIESR: Nuisance Invariant End-to-end Speech Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T01:46:36.471156Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/1907.03233"},"observation_digest":"sha256:b5a0a4a117e40cbc66afd00b855b88253d7a5c72e85600a53a9ddd2e77525ab5","observation_id":"ac6ba8a7-c512-4ddd-ba61-07ec11a13021","resolution":{"observed_at":"2026-05-25T01:50:11.188236Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"1907.07769","last_updated":"2019-07-15T07:54:46Z","snapshot_observed_at":"2026-08-02T01:49:57.493719Z","submitted_at":"2019-07-15T07:54:46Z","title":"Hierarchical Sequence to Sequence Voice Conversion with Limited Data","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T21:30:16.923017Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/1907.07769"},"observation_digest":"sha256:ecaa6598b972a4e32b9bed881fc30d377f3f7709a4025e49c32011953b72dee2","observation_id":"0e9a48a5-485f-41b5-82bc-a8ccb9f8ace4","resolution":{"observed_at":"2026-05-24T21:34:58.941375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"1907.10726","last_updated":"2019-07-24T21:18:39Z","snapshot_observed_at":"2026-08-14T07:21:35.829460Z","submitted_at":"2019-07-24T21:18:39Z","title":"Cross-Attention End-to-End ASR for Two-Party Conversations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T16:26:01.154655Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/1907.10726"},"observation_digest":"sha256:b1b74b66548a06197aec698cdcb0ad76c22f0b985ff76f694f2ce61af0d3bc40","observation_id":"71f04163-c72a-4ec0-bb69-a9fb53957058","resolution":{"observed_at":"2026-05-24T16:26:15.890289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-14T10:34:37.884102Z","title":"Listen, attend and spell,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.10992","last_updated":"2019-08-29T00:18:05Z","snapshot_observed_at":"2026-08-14T10:25:36.852344Z","submitted_at":"2019-08-29T00:18:05Z","title":"Two-Pass End-to-End Speech Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T10:34:37.884102Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/1908.10992"},"observation_digest":"sha256:7a26062be757dbce3536a33e3418088fbaa34d70779151cba062aba2fb12c304","observation_id":"bd56e8e4-e5b7-4071-ba58-22ffc2120c10","resolution":{"observed_at":"2026-08-14T10:34:37.884102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T03:49:09.374351Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2209.11895"},"observation_digest":"sha256:dad3a26e22fb26b81249ba742d3084f82e87a0ab18f02e1739127f80c5a0edc5","observation_id":"511c37b9-a53a-49c5-b473-8ffcfcebd524","resolution":{"observed_at":"2026-05-11T03:49:09.898808Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-10T22:18:01.505886Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.02370","last_updated":"2025-02-07T20:12:12Z","snapshot_observed_at":"2026-08-14T10:31:21.474745Z","submitted_at":"2025-01-04T20:14:16Z","title":"Prepending or Cross-Attention for Speech-to-Text? An Empirical Comparison","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T22:18:01.505886Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2501.02370"},"observation_digest":"sha256:9bd2ef4605978435fe5e1138b95657839a475a0f6ea5037ee8c25449a1f39d20","observation_id":"c57b96bd-cf23-4998-bd38-e087f706bb27","resolution":{"observed_at":"2026-08-10T22:18:01.505886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-10T20:35:12.962138Z","title":"Listen, attend and spell,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.08057","last_updated":"2025-01-14T12:12:06Z","snapshot_observed_at":"2026-08-14T18:27:08.066186Z","submitted_at":"2025-01-14T12:12:06Z","title":"Optimizing Speech Multi-View Feature Fusion through Conditional Computation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:12.962138Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2501.08057"},"observation_digest":"sha256:fd046f3ea057b93966320131b1dbfba39931d3f992642bbb4366e4e499f93afd","observation_id":"de5af010-494a-43ef-a812-c3d97c274977","resolution":{"observed_at":"2026-08-10T20:35:12.962138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-09T11:31:04.655943Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02683","last_updated":"2025-02-04T19:50:15Z","snapshot_observed_at":"2026-08-14T11:20:12.475237Z","submitted_at":"2025-02-04T19:50:15Z","title":"Streaming Speaker Change Detection and Gender Classification for Transducer-Based Multi-Talker Speech Translation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T11:31:04.655943Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2502.02683"},"observation_digest":"sha256:31657f1408b051afa12064c416a4139a425938bcb3f408b952d4ac71184c7418","observation_id":"8e632cc7-4c56-4e4a-a7aa-50db407fd231","resolution":{"observed_at":"2026-08-09T11:31:04.655943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-08T22:31:38.698823Z","title":"Listen, attend and spell","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.05232","last_updated":"2025-02-06T22:09:52Z","snapshot_observed_at":"2026-08-14T02:34:41.901675Z","submitted_at":"2025-02-06T22:09:52Z","title":"Aligner-Encoders: Self-Attention Transformers Can Be Self-Transducers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T22:31:38.698823Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2502.05232"},"observation_digest":"sha256:ad4c38f9b350973044c7ffd701758f94442296e65a3a4bcd2a5a56e1f208de87","observation_id":"19e81f0b-d8f4-4201-ad39-e6447b7be2ea","resolution":{"observed_at":"2026-08-08T22:31:38.698823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-07T15:23:34.281997Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:34.281997Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:2105932a9bdc4ecf6e4bf10877154689ff7933985d7ebbe03546781f41cba017","observation_id":"b7dc1772-fa5f-4ae5-8a4c-75c29f254617","resolution":{"observed_at":"2026-08-07T15:23:34.281997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-07T13:24:28.216789Z","title":"Listen, attend and spell,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.22069","last_updated":"2025-05-28T07:51:21Z","snapshot_observed_at":"2026-08-14T18:27:10.731993Z","submitted_at":"2025-05-28T07:51:21Z","title":"Delayed-KD: Delayed Knowledge Distillation based CTC for Low-Latency Streaming ASR","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:24:28.216789Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2505.22069"},"observation_digest":"sha256:804aebdc71530e3d494c5fbb25148352f691406e1c06c5f7b1e9fc1663df8eb4","observation_id":"80548279-b02e-4b6a-bfcc-ff886bf7da1c","resolution":{"observed_at":"2026-08-07T13:24:28.216789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"2506.10779","last_updated":"2026-04-19T21:22:32Z","snapshot_observed_at":"2026-08-13T11:00:35.110135Z","submitted_at":"2025-06-12T14:53:48Z","title":"Improving Speech Recognition of Named Entities in Classroom Speech with LLM Revision and Phonetic-Semantic Context","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T09:16:48.512860Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2506.10779"},"observation_digest":"sha256:2a7847926a8ce84dd8a347bc3562d9bc963ebce0e640df5c3eeba90313ba2b6e","observation_id":"5b655266-39e7-4ef1-8c54-145239a38cc2","resolution":{"observed_at":"2026-05-19T09:17:13.864764Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-06T13:22:32.429081Z","title":"Listen, attend and spell","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20757","last_updated":"2025-07-28T12:11:12Z","snapshot_observed_at":"2026-08-09T18:34:37.006269Z","submitted_at":"2025-07-28T12:11:12Z","title":"Learning to See Inside Opaque Liquid Containers using Speckle Vibrometry","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:22:32.429081Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2507.20757"},"observation_digest":"sha256:ea02a73600db2f32a124e51ca4d0c1d4b28d7a8614a34c49495933aed4ced56b","observation_id":"0cb7a811-d6ee-4412-a40a-921c664d0241","resolution":{"observed_at":"2026-08-06T13:22:32.429081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"2605.06582","last_updated":"2026-06-21T09:09:33Z","snapshot_observed_at":"2026-08-12T17:40:19.172480Z","submitted_at":"2026-05-07T17:11:22Z","title":"PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T12:25:52.847432Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2605.06582"},"observation_digest":"sha256:9de270f95e35806fd143d7377d42b4e31c08bc346282ea45f10d06abd6123a5d","observation_id":"1847bb47-c10b-4e4a-89d5-e65b12cd1fc9","resolution":{"observed_at":"2026-05-11T19:16:08.806418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"2605.06582","last_updated":"2026-06-21T09:09:33Z","snapshot_observed_at":"2026-08-12T17:40:19.172480Z","submitted_at":"2026-05-07T17:11:22Z","title":"PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T23:14:32.494076Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2605.06582"},"observation_digest":"sha256:d96d255d5574af4e81ffe61630489d32e598e731dcb0f31d2c6d3fed6638ddb0","observation_id":"a676cc31-cd1e-4fa4-8156-c44e4ffadf32","resolution":{"observed_at":"2026-06-30T23:15:07.882041Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"2605.16555","last_updated":"2026-05-15T18:57:48Z","snapshot_observed_at":"2026-08-02T22:36:41.510450Z","submitted_at":"2026-05-15T18:57:48Z","title":"MedASR: An Open-Source Model for High-Accuracy Medical Dictation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T21:18:56.084055Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2605.16555"},"observation_digest":"sha256:a4976c22c903d7480c7db10cb51a810b4daa75759aab6e6862d50a9859c12ff0","observation_id":"5f871b2b-3415-4625-96eb-6522fa53b207","resolution":{"observed_at":"2026-05-19T21:22:48.086856Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"2605.23463","last_updated":"2026-05-22T10:24:50Z","snapshot_observed_at":"2026-08-12T19:51:32.587082Z","submitted_at":"2026-05-22T10:24:50Z","title":"StepAudio 2.5 Technical Report","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-25T02:52:22.610397Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2605.23463"},"observation_digest":"sha256:457d06c83ee856e85cfef2695cef9e463ee3367eee6eefd1a14562f94347ec71","observation_id":"6eab5b32-aab8-4e2a-a3fe-7d9fdbfc6b2a","resolution":{"observed_at":"2026-05-25T02:55:16.509973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":"1508.01211","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-04T13:29:51.152577Z","title":"Listen, Attend and Spell","venue":"cs.CL","work_id":"bb2589f9-8410-4374-a31f-7e5031750959","year":2015},"citing_paper":{"arxiv_id":"2606.26749","last_updated":"2026-06-25T08:33:34Z","snapshot_observed_at":"2026-08-01T16:00:20.311664Z","submitted_at":"2026-06-25T08:33:34Z","title":"Structure Before Collapse: Transient semantic geometry in next-token prediction","version":1},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-06-26T05:14:07.208255Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2606.26749"},"observation_digest":"sha256:9e7469e40638a68928ddc764fd91a14fab85f062d2cdd04c36d15e34fdf473f9","observation_id":"ac47e242-1940-42d7-9f82-5bf8a7f5de21","resolution":{"observed_at":"2026-07-04T13:29:51.153703Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-07-14T15:12:47.255094Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.09833","last_updated":"2026-07-10T14:04:28Z","snapshot_observed_at":"2026-08-09T00:38:18.505995Z","submitted_at":"2026-07-10T14:04:28Z","title":"Generative Testing of Automated Speech Recognition Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T15:12:47.255094Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2607.09833"},"observation_digest":"sha256:20ec17127d1c9a96b0434423e457514edfe9d8c47682c1c21fe4078098dc5aaf","observation_id":"c521aeb4-ade8-4f27-87a8-e077145e6a75","resolution":{"observed_at":"2026-07-14T15:12:47.255094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-03T10:13:54.677464Z","title":"arXiv preprint arXiv:1508.01211 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.29279","last_updated":"2026-07-31T10:50:14Z","snapshot_observed_at":"2026-08-06T04:02:53.771607Z","submitted_at":"2026-07-31T10:50:14Z","title":"ParaASR: Multi-Token Prediction for Fast and Long-Context LLM-Based Speech Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T10:13:54.677464Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2607.29279"},"observation_digest":"sha256:102de1c45f3ee85fd3a21d0314ffec47701dc91904a73660ef2752dbcacf210d","observation_id":"c4d5d563-3613-49ad-aad0-996cf83555a0","resolution":{"observed_at":"2026-08-03T10:13:54.677464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1508.01211/citation-record","integrity":"/paper/1508.01211/integrity","json":"/paper/1508.01211/citation-record.json","paper":"/paper/1508.01211"},"outbound":[],"paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T18:26:22.198814Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:1508.01211."}