{"as_of":"2026-08-21T03:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d3b587c570b081890686302ccfb26ead2e2ea6d7a81e35bbad875644317bedc0","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:22:41.151996Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.04885/citation-record","integrity":"/paper/2505.04885/integrity","json":"/paper/2505.04885/citation-record.json","paper":"/paper/2505.04885"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.632155Z","title":"Hybrid Human-AI Workflows for Audiobook Production,","venue":null,"work_id":"abd8b481-69c4-48e2-babf-24e3102d9e01","year":2022},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:40.989687Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:7dd88e1817e7da0253784da66bc3597561aa607a635c05a51d6ffdb1dddddb74","observation_id":"791f78bf-5634-4597-a75f-ef04737941f6","resolution":{"observed_at":"2026-08-15T23:22:41.636566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.618724Z","title":"AI Audiobook Narration: Transforming Education,","venue":null,"work_id":"3a433c27-c9a8-4267-ad87-99a8a7349bed","year":null},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:40.994617Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:dd002dcb37baba6cc031ff44992fa8b2bceed7e433b4804c21c72cf13f9369de","observation_id":"37ae6859-cd40-4078-a51c-21938a94050d","resolution":{"observed_at":"2026-08-15T23:22:41.623163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.594654Z","title":"The Technology of Binaural Understanding,","venue":null,"work_id":"57a3c3ba-bfbe-4a9f-bb06-8ff1e52c54e9","year":2013},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.003695Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:1ebdb9669c69505c0911e4dac924364e77e94f471565c3fcd63395ee649bac57","observation_id":"d9d5ad9c-75e9-412b-91a0-596382347643","resolution":{"observed_at":"2026-08-15T23:22:41.599295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.580293Z","title":"Evaluating Spatial Audio – Part 1 – Criteria & Chal- lenges,","venue":null,"work_id":"9710056b-2123-4562-8911-b788b5dc35c8","year":2024},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.014584Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:278b65206674913498f68b3360bec7a4f568022bb87f8876e9da142acfaa1aab","observation_id":"423a7dd9-f16f-4d3a-96e9-b0f9f90c3e2b","resolution":{"observed_at":"2026-08-15T23:22:41.584084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.568516Z","title":"From Human-Made to AI-Generated Products: An Empirical Study of Audiobook Consumption,","venue":null,"work_id":"2e5316d0-42ed-4727-8d88-70b75bb7f8d1","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.018594Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:6196054227b8c78df67f0700b998c92eee4804388de091edd1ea3215a8285fbe","observation_id":"b5d46ce8-9fcb-4a6e-b899-2d0b9b286b0a","resolution":{"observed_at":"2026-08-15T23:22:41.572923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.554302Z","title":"Evaluating Spatial Audio - Criteria & Challenges,","venue":null,"work_id":"6219940e-aa04-4803-8daf-edb9f84d870e","year":2024},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.028078Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:977a5b1b762c1ac9eabecc986d13da52ad53f8723d50248b34bea2b7c6e3beff","observation_id":"eaef61ee-66e3-4139-a1cb-5ca19b41e938","resolution":{"observed_at":"2026-08-15T23:22:41.558594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-15T23:22:41.032301Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.032301Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:b79383c267005cc7d2b81dbc539036f26e014cae873da72effa9ceb6b6f22f46","observation_id":"63c26353-ceaa-414f-bb0b-1e06bc1c232b","resolution":{"observed_at":"2026-08-15T23:22:41.032301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03926","last_updated":"2023-09-07T11:41:23Z","snapshot_observed_at":"2026-08-20T09:21:11.693473Z","submitted_at":"2023-09-07T11:41:23Z","title":"Large-Scale Automatic Audiobook Creation","version":1},"cited_work":{"arxiv_id":"2309.03926","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.03926","snapshot_observed_at":"2026-08-15T23:22:41.252461Z","title":"Large-Scale Automatic Audiobook Creation","venue":"cs.SD","work_id":"be3679b2-de25-442a-99de-ea9062471b72","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.036913Z"},"links":{"cited_paper":"/paper/2309.03926","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:80c803bb9e547932773f40ec032433a6b90f1e092b7d8de1f616f675c30d6d09","observation_id":"77d1330e-9361-41c0-8c97-0d79e8fd35da","resolution":{"observed_at":"2026-08-15T23:22:41.259690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.542592Z","title":"AI Speech Tools Revolutionizing Audiobook Production,","venue":null,"work_id":"521323f3-12b0-44ab-a540-c0d5f784bfb7","year":2025},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.041568Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:bc1f95e017a92c71abb9d1c3249f909f3c5511e2c27212b41b6fa4a1aa6bee2a","observation_id":"39535000-85ef-46e5-9f9a-38c4422b2607","resolution":{"observed_at":"2026-08-15T23:22:41.546691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.07875","last_updated":"2019-12-17T08:47:30Z","snapshot_observed_at":"2026-08-18T04:48:16.394194Z","submitted_at":"2019-12-17T08:47:30Z","title":"Libri-Light: A Benchmark for ASR with Limited or No Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.07875","snapshot_observed_at":"2026-08-15T23:22:41.051010Z","title":"Libri-Light: A Benchmark for ASR with Limited or No Supervision,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.051010Z"},"links":{"cited_paper":"/paper/1912.07875","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:554f99553d5fbef5305e64041c8d7ecab3bf8cfc149f5e130aca941eab3b39dc","observation_id":"783d15e7-1f52-4750-8b55-fcf1a7494cc3","resolution":{"observed_at":"2026-08-15T23:22:41.051010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.529585Z","title":"Emotion-Aware Neural Text-to-Speech with Multi-Agent Reinforcement Learning,","venue":null,"work_id":"2ed1b796-25e6-4259-91c9-b3bb6aff398f","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.054959Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:2abd770692b36925c3bb9494b9be84e817de9f75fbbb6429b04f1accb68ac2ab","observation_id":"7ed79b37-4bff-466b-89b3-90177a40e333","resolution":{"observed_at":"2026-08-15T23:22:41.534072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.517625Z","title":"Robust Audio Watermarking for AI-Generated Content Attribution,","venue":null,"work_id":"e87505bf-7fc7-4bc5-ae09-1753119f6a1e","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.058724Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:c0567f98954f9a20d3347aad9e4165d02e13a1ec01f89907dd49467ce1d216a1","observation_id":"81ee94af-ce1f-4bd2-bebe-6426dfeeafae","resolution":{"observed_at":"2026-08-15T23:22:41.521824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.504183Z","title":"What are the Main Challenges and Opportunities of Working with Spatial Audio?,","venue":null,"work_id":"f57e0c7a-5500-4ff8-8067-f17247f4ffac","year":2024},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.062493Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:853b1fd1fd019ce1e1d65124fd18117bbdff7e13239e964f137057eaad6256fd","observation_id":"dac16799-8b63-46d3-86a2-1e9db7734259","resolution":{"observed_at":"2026-08-15T23:22:41.508639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18474","last_updated":"2023-05-29T10:41:28Z","snapshot_observed_at":"2026-08-16T15:28:43.775568Z","submitted_at":"2023-05-29T10:41:28Z","title":"Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18474","snapshot_observed_at":"2026-08-15T23:22:41.066407Z","title":"Temporal-Enhanced Text-to-Audio Generation for Complex Scene Synchro- nization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.066407Z"},"links":{"cited_paper":"/paper/2305.18474","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:5863a36a422d7b8a8f59a214bb245eedc6a7fe6c15fe35cc4f1b83f5d03e7bc4","observation_id":"45ca8e8b-37ee-406f-aebf-38fe42eca573","resolution":{"observed_at":"2026-08-15T23:22:41.066407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.491112Z","title":"The Art and Science of Audio Book Production,","venue":null,"work_id":"ef24d1f4-2b5f-4709-837d-0a4903560bde","year":2025},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.070148Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:fc1aec3435e50a551f976e98b1a7f084a9146fd6a6e6dad0d706a8a37786cc9c","observation_id":"1ff32b45-c503-4089-b9d7-207ddccbcdfe","resolution":{"observed_at":"2026-08-15T23:22:41.495607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.478288Z","title":"Neural Acoustic Field Processing by Learning the Gradient of Sound Field,","venue":null,"work_id":"1ee0a64a-beae-461e-98d4-1bc373d65f73","year":2022},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.074154Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:088d4413132103278056a737c5810b8fe16cfe50bb33b4856eb08af4b7ee91d8","observation_id":"7b38e265-b1a8-48c6-86bb-54f48c6e8798","resolution":{"observed_at":"2026-08-15T23:22:41.482249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.465516Z","title":"How is AI Revolutionizing Audiobook Production? Creating Thousands of High-Quality Audiobooks from E-books with Neural Text-to-Speech Tech- nology,","venue":null,"work_id":"7a343e9a-07e1-46f1-9fad-eabe172fbd81","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.078269Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:153374473bca697a9e2d60d4af6c0d292d45dc6c37a7cef39bb7f3e076ac8595","observation_id":"985d6bd2-b335-4850-a4b1-d1a6d6bb492a","resolution":{"observed_at":"2026-08-15T23:22:41.470193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.453406Z","title":"Spatial Audio - Microsoft Research Overview,","venue":null,"work_id":"d1b92bd0-dbbe-4f6e-90ef-f963a1ea2088","year":2025},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.082113Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:1f73e61969387e4245c1923340c76e63f14fec17b79278f04c9338e4cf856445","observation_id":"905f0757-9f22-492f-a0bf-3aa0838ea44e","resolution":{"observed_at":"2026-08-15T23:22:41.457444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.441580Z","title":"Ray: A Distributed Framework for Emerging AI Applications,","venue":null,"work_id":"88f1b2bd-c372-4e13-b413-d39756611cd4","year":2018},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.085866Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:7aaa11e89797699898d79d025693b8a348200b68005774464e6b750cc7f1f6b3","observation_id":"449f20d3-4c3a-43fc-922d-aa0affe5918a","resolution":{"observed_at":"2026-08-15T23:22:41.445408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.428938Z","title":"The Best Text To Speech For Audiobooks In 2025: A De- tailed Comparison,","venue":null,"work_id":"419ed4fd-8c9a-4fc6-b413-9fa42872215e","year":2025},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.089691Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:8b164b010abf7b497420290d6ccdf524e58ec900e4cf4010cb10dbe4fee44b43","observation_id":"85b88189-87c6-4772-a837-abf8c020398b","resolution":{"observed_at":"2026-08-15T23:22:41.433452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.093344Z","title":"GPT-4 Technical Report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.093344Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:3618655118590eebe4129711187098f6e8fa09b200ef453ddc21749e3ce41567","observation_id":"b45bc3c7-7c25-4db2-b100-5c4a20292114","resolution":{"observed_at":"2026-08-15T23:22:41.093344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.408440Z","title":"Key Concepts in Spatial Audio,","venue":null,"work_id":"c86fcd0f-c905-4527-a40e-146583a5b3c9","year":null},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.097041Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:ac352c8ae70a3c698ddbc1a2542809ae5107cb588873f503ad77507e68ee524e","observation_id":"d4671044-c8ad-4e4d-b856-7b02a4f132af","resolution":{"observed_at":"2026-08-15T23:22:41.412899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04558","last_updated":"2022-08-08T01:53:05Z","snapshot_observed_at":"2026-08-20T03:31:53.345681Z","submitted_at":"2020-06-08T13:05:40Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04558","snapshot_observed_at":"2026-08-15T23:22:41.105359Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.105359Z"},"links":{"cited_paper":"/paper/2006.04558","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:52dff6a7ab83d07dd0980025d48868cd10af47ee84e0581b60d01e959df2b8e1","observation_id":"ea6bd5fc-2563-43c4-949b-1e27e10d4eeb","resolution":{"observed_at":"2026-08-15T23:22:41.105359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.383582Z","title":"Spatial Audio: Overcoming Its Unique Challenges to Provide A Complete Solution,","venue":null,"work_id":"a0132081-0b76-4591-ab04-0afa253f0db8","year":2024},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.109870Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:cc8dd41e7e2ecf5ab75f7403eb4b5debf7b1330f7bb32775645bd370a6f8c16e","observation_id":"22879027-a647-4c37-afee-a41e4f986fcf","resolution":{"observed_at":"2026-08-15T23:22:41.387790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.371643Z","title":"Ethical Implications of AI Voice Cloning in Creative Industries,","venue":null,"work_id":"bafc4e37-49af-40d2-af95-952dc03f6fa9","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.114897Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:5e766ea8570bd9a990d081517af67736f2333d7f1f44d912f3b6d8cfacf131dd","observation_id":"d0ec39ff-8ff3-4608-99f1-f4fa57524b94","resolution":{"observed_at":"2026-08-15T23:22:41.375571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.358332Z","title":"SpaCy: Industrial-Strength Natural Language Processing,","venue":null,"work_id":"9a0be41b-7bf9-45e5-b4d4-0c4dcc3b38e3","year":2020},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.118676Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:9f6ee6db576ea970a770ec6dfbe795b79df4fae4a3f00ab6ddaf3d1cb0a5c975","observation_id":"f6382e08-1239-4c6e-ad88-8f726458aace","resolution":{"observed_at":"2026-08-15T23:22:41.362679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.122666Z","title":"Current Use and Future Perspectives of Spatial Audio Technologies in Electronic Travel Aids,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.122666Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:526f38da26c3d497429b0c9fab1f4e74476f4f4ec5514bca190081d18eb11619","observation_id":"9376d115-8fb8-4550-9503-6ab8b271df89","resolution":{"observed_at":"2026-08-15T23:22:41.122666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.344923Z","title":"Multi-Agent Systems for Audio Content Creation,","venue":null,"work_id":"ba7d534f-4fd1-40a5-aeb5-c87149aca563","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.126694Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:4b94ebabb5c9ed1801af836d7d4bda4e460ac8c12fbe5d55b12f56495e51937a","observation_id":"b38ff787-c1fe-415c-b51d-3738c15b84a4","resolution":{"observed_at":"2026-08-15T23:22:41.348781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-15T23:22:41.130517Z","title":"VALL-E: Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.130517Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:3f75225544d2ec7443440ab98f7ec5c5c062f14f07d1a34f4240b11e3a19811d","observation_id":"35e17589-c0b8-4a99-96f8-3c6707924564","resolution":{"observed_at":"2026-08-15T23:22:41.130517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.332909Z","title":"Hierarchical Auditory Computation Across Timescales in the Human Brain,","venue":null,"work_id":"07825cdb-68bd-4956-90d8-77c0b7fd464e","year":2022},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.134880Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:539bfc189158699d1a9657e596986b0f3c0d95297b4348c5d3b5c4dc71b9abc0","observation_id":"f430cf42-d29f-4a14-8d78-e17245d4bf38","resolution":{"observed_at":"2026-08-15T23:22:41.336890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.318713Z","title":"Human-in-the-Loop Deep Learning for Audio Narration Review,","venue":null,"work_id":"cb96bb8d-eca8-4070-89dd-b5981bfd6fb0","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.139352Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:1e825527615624c19f575fb792734afbd1e61f71d05211bb45ad5c04a660a913","observation_id":"58b91471-cca2-4e03-811f-92b43a608b10","resolution":{"observed_at":"2026-08-15T23:22:41.322927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.306045Z","title":"Whisper: Scalable Multilingual Speech Recogni- tion with Human Feedback,","venue":null,"work_id":"89454ebb-8954-4db8-be29-25abddecc18d","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.143769Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:8d446e2b14d7d8a761b75082819c6867b1e0c072a2a291bf16651adf6bf217dc","observation_id":"64e8b208-df18-447d-97d5-2792f721bf51","resolution":{"observed_at":"2026-08-15T23:22:41.310248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.293413Z","title":"Hybrid AI + Human Editing in Voice Cloning Workflows,","venue":null,"work_id":"000c5b00-6e89-40fc-892e-83199c279ebb","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.147899Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:e62b77f2d82b40b737a6e4c0095b07f358fefb686a989a6221e0fbd88c406f78","observation_id":"525f5c6f-098c-40c9-8ed6-1eab0028c328","resolution":{"observed_at":"2026-08-15T23:22:41.298000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-17T15:45:31.564132Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-15T23:22:41.151996Z","title":"Learning to summarize with human feed- back,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.151996Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:c4d2cfdccd37230f04160a2af359633132ea33c86018dd19932375a194f194c2","observation_id":"5f39adc0-62b7-4ed5-b663-dc38a20db9a9","resolution":{"observed_at":"2026-08-15T23:22:41.151996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.396478Z","title":null,"venue":null,"work_id":"ca8e4fb5-06f4-4205-b95f-a1e178e91d50","year":null},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.101346Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:d96582a69b032f94bf4a326602e2f635470792719071585629223fa7bd2b5ff9","observation_id":"cc75a388-cdb2-45b9-8aa0-133cb224feaa","resolution":{"observed_at":"2026-08-15T23:22:41.400470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.607319Z","title":null,"venue":null,"work_id":"941fb031-2f54-4220-b577-3dc489824772","year":null},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:40.999158Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:8e5933fa5a4c2ef88b7b916fd3eb38141130db1d921a5a260195ba081ceb5c6b","observation_id":"c0a210e7-01c7-40bc-b322-eb6333db2745","resolution":{"observed_at":"2026-08-15T23:22:41.611080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2505.04885."}