{"as_of":"2026-08-06T21:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64c30c08db582cbc910382662a431f371faa8d8b599db248a3af28b9869eaba9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T16:29:22.077126Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-07T14:53:55.835313Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15646","last_updated":"2025-05-21T15:24:29Z","snapshot_observed_at":"2026-07-06T21:27:51.964897Z","submitted_at":"2025-05-21T15:24:29Z","title":"Word Level Timestamp Generation for Automatic Speech Recognition and Translation","version":1},"cited_work":{"arxiv_id":"2505.15646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15646","snapshot_observed_at":"2026-07-07T14:53:55.835313Z","title":"Word level timestamp generation for automatic speech recognition and translation","venue":"cs.CL","work_id":"d35dd65d-2126-4d90-8652-eeae77f75dc6","year":2025},"citing_paper":{"arxiv_id":"2604.22817","last_updated":"2026-04-14T20:56:24Z","snapshot_observed_at":"2026-07-06T23:09:10.050398Z","submitted_at":"2026-04-14T20:56:24Z","title":"In-Sync: Adaptation of Speech Aware Large Language Models for ASR with Word Level Timestamp Predictions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T13:25:50.524448Z"},"links":{"cited_paper":"/paper/2505.15646","citing_paper":"/paper/2604.22817"},"observation_digest":"sha256:bb91120bc9ad239a9831d1f30b9428bd8c9d9a54cda9359c88297a2acb5877c7","observation_id":"c7367329-b074-4690-8396-c8d89d527ccf","resolution":{"observed_at":"2026-05-10T13:35:26.723435Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15646","last_updated":"2025-05-21T15:24:29Z","snapshot_observed_at":"2026-07-06T21:27:51.964897Z","submitted_at":"2025-05-21T15:24:29Z","title":"Word Level Timestamp Generation for Automatic Speech Recognition and Translation","version":1},"cited_work":{"arxiv_id":"2505.15646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15646","snapshot_observed_at":"2026-07-07T14:53:55.835313Z","title":"Word level timestamp generation for automatic speech recognition and translation","venue":"cs.CL","work_id":"d35dd65d-2126-4d90-8652-eeae77f75dc6","year":2025},"citing_paper":{"arxiv_id":"2605.30993","last_updated":"2026-05-29T08:27:57Z","snapshot_observed_at":"2026-08-02T00:55:15.607531Z","submitted_at":"2026-05-29T08:27:57Z","title":"SwanVoice: Expressive Long-Form Zero-Shot Speech Synthesis for Both Monologue and Dialogue","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T21:05:54.061395Z"},"links":{"cited_paper":"/paper/2505.15646","citing_paper":"/paper/2605.30993"},"observation_digest":"sha256:f71446120892501d6d4c471b8a54dbb274711be4eb854c5eb89ed0f8037143cb","observation_id":"47effc7e-584b-43b7-bf48-3762a318aa6a","resolution":{"observed_at":"2026-07-01T20:26:13.101650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15646","last_updated":"2025-05-21T15:24:29Z","snapshot_observed_at":"2026-07-06T21:27:51.964897Z","submitted_at":"2025-05-21T15:24:29Z","title":"Word Level Timestamp Generation for Automatic Speech Recognition and Translation","version":1},"cited_work":{"arxiv_id":"2505.15646","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15646","snapshot_observed_at":"2026-07-07T14:53:55.835313Z","title":"Word level timestamp generation for automatic speech recognition and translation","venue":"cs.CL","work_id":"d35dd65d-2126-4d90-8652-eeae77f75dc6","year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-03T03:09:40.573819Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-07T14:52:35.127533Z"},"links":{"cited_paper":"/paper/2505.15646","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:4f73ca1a735315f50ab85482bb6e95ff01b3fef71c9c26a606f41669a4497ef0","observation_id":"e2cad170-3d16-4002-9f89-620863b6aef0","resolution":{"observed_at":"2026-07-07T14:53:55.837853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15646","last_updated":"2025-05-21T15:24:29Z","snapshot_observed_at":"2026-07-06T21:27:51.964897Z","submitted_at":"2025-05-21T15:24:29Z","title":"Word Level Timestamp Generation for Automatic Speech Recognition and Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15646","snapshot_observed_at":"2026-08-02T08:34:02.696146Z","title":"Word level timestamp generation for automatic speech recognition and translation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05364","last_updated":"2026-07-15T17:16:51Z","snapshot_observed_at":"2026-08-03T03:09:40.573819Z","submitted_at":"2026-07-06T17:40:54Z","title":"REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T08:34:02.696146Z"},"links":{"cited_paper":"/paper/2505.15646","citing_paper":"/paper/2607.05364"},"observation_digest":"sha256:398a69e54325ef977d96593e2158d6bd050a546c835463ffb903d681af94c484","observation_id":"f45fb52e-531b-4ab7-bdae-ec25e6d94d36","resolution":{"observed_at":"2026-08-02T08:34:02.696146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15646","last_updated":"2025-05-21T15:24:29Z","snapshot_observed_at":"2026-07-06T21:27:51.964897Z","submitted_at":"2025-05-21T15:24:29Z","title":"Word Level Timestamp Generation for Automatic Speech Recognition and Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15646","snapshot_observed_at":"2026-08-04T16:29:22.077126Z","title":"Word level timestamp generation for automatic speech recognition and translation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02023","last_updated":"2026-08-04T08:54:48Z","snapshot_observed_at":"2026-08-06T21:45:01.689347Z","submitted_at":"2026-08-03T10:20:52Z","title":"SwanTale: Unified Multi-Speaker Speech and Audio Generation for Instruct and Zero-Shot Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T16:29:22.077126Z"},"links":{"cited_paper":"/paper/2505.15646","citing_paper":"/paper/2608.02023"},"observation_digest":"sha256:b3934836758fcd783af19c98350a3e2d714b1a659fc41dcd1196e05a71b7367c","observation_id":"0f40e806-b1e9-419f-b475-bf27c4ce6c10","resolution":{"observed_at":"2026-08-04T16:29:22.077126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15646/citation-record","integrity":"/paper/2505.15646/integrity","json":"/paper/2505.15646/citation-record.json","paper":"/paper/2505.15646"},"outbound":[],"paper":{"arxiv_id":"2505.15646","last_updated":"2025-05-21T15:24:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T21:27:51.964897Z","submitted_at":"2025-05-21T15:24:29Z","title":"Word Level Timestamp Generation for Automatic Speech Recognition and Translation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2505.15646."}