{"as_of":"2026-08-23T09:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3701cf2824a68f6242ffb7ed8dad90641d0b80a342fcb1f914190753d50af731","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:22:41.151996Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.04885/citation-record","integrity":"/paper/2505.04885/integrity","json":"/paper/2505.04885/citation-record.json","paper":"/paper/2505.04885"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.632155Z","title":"Hybrid Human-AI Workflows for Audiobook Production,","venue":null,"work_id":"abd8b481-69c4-48e2-babf-24e3102d9e01","year":2022},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:40.989687Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:3fcdfeeca07fbe1febed877ab1ec85f607148d2ab7343f0b07ff4bf2e35a25d2","observation_id":"791f78bf-5634-4597-a75f-ef04737941f6","resolution":{"observed_at":"2026-08-15T23:22:41.636566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.618724Z","title":"AI Audiobook Narration: Transforming Education,","venue":null,"work_id":"3a433c27-c9a8-4267-ad87-99a8a7349bed","year":null},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:40.994617Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:d12d2bd2df94cb7fbe134a5a57dd2a40e4ffd807d62569d935727a28230d9579","observation_id":"37ae6859-cd40-4078-a51c-21938a94050d","resolution":{"observed_at":"2026-08-15T23:22:41.623163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.594654Z","title":"The Technology of Binaural Understanding,","venue":null,"work_id":"57a3c3ba-bfbe-4a9f-bb06-8ff1e52c54e9","year":2013},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.003695Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:888a3ebac5ca5893c4852a2f1fdcae3539ac4bc359eb5af1024fc0d341e34317","observation_id":"d9d5ad9c-75e9-412b-91a0-596382347643","resolution":{"observed_at":"2026-08-15T23:22:41.599295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.580293Z","title":"Evaluating Spatial Audio – Part 1 – Criteria & Chal- lenges,","venue":null,"work_id":"9710056b-2123-4562-8911-b788b5dc35c8","year":2024},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.014584Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:81aa193e5c03ace1052a464746c918d0f21a92b951ed9872629225bde8628eda","observation_id":"423a7dd9-f16f-4d3a-96e9-b0f9f90c3e2b","resolution":{"observed_at":"2026-08-15T23:22:41.584084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.568516Z","title":"From Human-Made to AI-Generated Products: An Empirical Study of Audiobook Consumption,","venue":null,"work_id":"2e5316d0-42ed-4727-8d88-70b75bb7f8d1","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.018594Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:7feaa73179489fdeed70f7dc48fa7ba511a85bdead1552c2109af2c3e7df2e9a","observation_id":"b5d46ce8-9fcb-4a6e-b899-2d0b9b286b0a","resolution":{"observed_at":"2026-08-15T23:22:41.572923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.554302Z","title":"Evaluating Spatial Audio - Criteria & Challenges,","venue":null,"work_id":"6219940e-aa04-4803-8daf-edb9f84d870e","year":2024},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.028078Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:99819b955d2ba39ca6e2452199bd74b5a6f05353b4d6ddefc10a31103c88e2f6","observation_id":"eaef61ee-66e3-4139-a1cb-5ca19b41e938","resolution":{"observed_at":"2026-08-15T23:22:41.558594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-15T23:22:41.032301Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.032301Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:b79383c267005cc7d2b81dbc539036f26e014cae873da72effa9ceb6b6f22f46","observation_id":"63c26353-ceaa-414f-bb0b-1e06bc1c232b","resolution":{"observed_at":"2026-08-15T23:22:41.032301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03926","last_updated":"2023-09-07T11:41:23Z","snapshot_observed_at":"2026-08-20T09:21:11.693473Z","submitted_at":"2023-09-07T11:41:23Z","title":"Large-Scale Automatic Audiobook Creation","version":1},"cited_work":{"arxiv_id":"2309.03926","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.03926","snapshot_observed_at":"2026-08-15T23:22:41.252461Z","title":"Large-Scale Automatic Audiobook Creation","venue":"cs.SD","work_id":"be3679b2-de25-442a-99de-ea9062471b72","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.036913Z"},"links":{"cited_paper":"/paper/2309.03926","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:221fb2dd804287a38746728708fba9a697ac1d91be2a4aa10cc3f926783a5d9b","observation_id":"77d1330e-9361-41c0-8c97-0d79e8fd35da","resolution":{"observed_at":"2026-08-15T23:22:41.259690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.542592Z","title":"AI Speech Tools Revolutionizing Audiobook Production,","venue":null,"work_id":"521323f3-12b0-44ab-a540-c0d5f784bfb7","year":2025},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.041568Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:1292a7c11e51cb627796c0bdbb2e91c08c93c097d4cc31a8b505c4cc7af91c6a","observation_id":"39535000-85ef-46e5-9f9a-38c4422b2607","resolution":{"observed_at":"2026-08-15T23:22:41.546691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.07875","last_updated":"2019-12-17T08:47:30Z","snapshot_observed_at":"2026-08-18T04:48:16.394194Z","submitted_at":"2019-12-17T08:47:30Z","title":"Libri-Light: A Benchmark for ASR with Limited or No Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.07875","snapshot_observed_at":"2026-08-15T23:22:41.051010Z","title":"Libri-Light: A Benchmark for ASR with Limited or No Supervision,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.051010Z"},"links":{"cited_paper":"/paper/1912.07875","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:554f99553d5fbef5305e64041c8d7ecab3bf8cfc149f5e130aca941eab3b39dc","observation_id":"783d15e7-1f52-4750-8b55-fcf1a7494cc3","resolution":{"observed_at":"2026-08-15T23:22:41.051010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.529585Z","title":"Emotion-Aware Neural Text-to-Speech with Multi-Agent Reinforcement Learning,","venue":null,"work_id":"2ed1b796-25e6-4259-91c9-b3bb6aff398f","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.054959Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:d37fdf4712b3b6db7eb42f43653b19c1714b9a7072f11d35c7172b741295d0a3","observation_id":"7ed79b37-4bff-466b-89b3-90177a40e333","resolution":{"observed_at":"2026-08-15T23:22:41.534072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.517625Z","title":"Robust Audio Watermarking for AI-Generated Content Attribution,","venue":null,"work_id":"e87505bf-7fc7-4bc5-ae09-1753119f6a1e","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.058724Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:709b5f4f82f06508a3ddc7064adfe234ba422d6b4cb0677ed4b22b86db301580","observation_id":"81ee94af-ce1f-4bd2-bebe-6426dfeeafae","resolution":{"observed_at":"2026-08-15T23:22:41.521824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.504183Z","title":"What are the Main Challenges and Opportunities of Working with Spatial Audio?,","venue":null,"work_id":"f57e0c7a-5500-4ff8-8067-f17247f4ffac","year":2024},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.062493Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:8499ab30b9878663c114c6e6d6150cff62891d2c12993cf86f131fd99109ce34","observation_id":"dac16799-8b63-46d3-86a2-1e9db7734259","resolution":{"observed_at":"2026-08-15T23:22:41.508639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18474","last_updated":"2023-05-29T10:41:28Z","snapshot_observed_at":"2026-08-16T15:28:43.775568Z","submitted_at":"2023-05-29T10:41:28Z","title":"Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18474","snapshot_observed_at":"2026-08-15T23:22:41.066407Z","title":"Temporal-Enhanced Text-to-Audio Generation for Complex Scene Synchro- nization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.066407Z"},"links":{"cited_paper":"/paper/2305.18474","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:5863a36a422d7b8a8f59a214bb245eedc6a7fe6c15fe35cc4f1b83f5d03e7bc4","observation_id":"45ca8e8b-37ee-406f-aebf-38fe42eca573","resolution":{"observed_at":"2026-08-15T23:22:41.066407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.491112Z","title":"The Art and Science of Audio Book Production,","venue":null,"work_id":"ef24d1f4-2b5f-4709-837d-0a4903560bde","year":2025},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.070148Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:cf2f9b2bdc0a240a99af6f8f6bb24c4d706e3f408344df78ea0bc6dc07be2029","observation_id":"1ff32b45-c503-4089-b9d7-207ddccbcdfe","resolution":{"observed_at":"2026-08-15T23:22:41.495607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.478288Z","title":"Neural Acoustic Field Processing by Learning the Gradient of Sound Field,","venue":null,"work_id":"1ee0a64a-beae-461e-98d4-1bc373d65f73","year":2022},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.074154Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:af46cdca22c0278ae1c82e0e899fe954bfa7dfaa07fd5b4890717b5511b7f0ea","observation_id":"7b38e265-b1a8-48c6-86bb-54f48c6e8798","resolution":{"observed_at":"2026-08-15T23:22:41.482249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.465516Z","title":"How is AI Revolutionizing Audiobook Production? Creating Thousands of High-Quality Audiobooks from E-books with Neural Text-to-Speech Tech- nology,","venue":null,"work_id":"7a343e9a-07e1-46f1-9fad-eabe172fbd81","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.078269Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:5f9945e2f284f93103a75e346d9e41e2625ea1fd8fd036bfb14ef01fb4854bb8","observation_id":"985d6bd2-b335-4850-a4b1-d1a6d6bb492a","resolution":{"observed_at":"2026-08-15T23:22:41.470193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.453406Z","title":"Spatial Audio - Microsoft Research Overview,","venue":null,"work_id":"d1b92bd0-dbbe-4f6e-90ef-f963a1ea2088","year":2025},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.082113Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:4a4d703b66a27f84c45b5c2668f01fa50b283be5757d3d1ab1add56d5f1e985a","observation_id":"905f0757-9f22-492f-a0bf-3aa0838ea44e","resolution":{"observed_at":"2026-08-15T23:22:41.457444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.441580Z","title":"Ray: A Distributed Framework for Emerging AI Applications,","venue":null,"work_id":"88f1b2bd-c372-4e13-b413-d39756611cd4","year":2018},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.085866Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:5196cb4f64516e333ccb99b0948b3cc72b74d406e288d5918981405e4329384e","observation_id":"449f20d3-4c3a-43fc-922d-aa0affe5918a","resolution":{"observed_at":"2026-08-15T23:22:41.445408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.428938Z","title":"The Best Text To Speech For Audiobooks In 2025: A De- tailed Comparison,","venue":null,"work_id":"419ed4fd-8c9a-4fc6-b413-9fa42872215e","year":2025},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.089691Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:7f47621c680bdd4f134eb1141e4bbb39bda033e71e412908347a11a905ecf21d","observation_id":"85b88189-87c6-4772-a837-abf8c020398b","resolution":{"observed_at":"2026-08-15T23:22:41.433452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.093344Z","title":"GPT-4 Technical Report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.093344Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:3618655118590eebe4129711187098f6e8fa09b200ef453ddc21749e3ce41567","observation_id":"b45bc3c7-7c25-4db2-b100-5c4a20292114","resolution":{"observed_at":"2026-08-15T23:22:41.093344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.408440Z","title":"Key Concepts in Spatial Audio,","venue":null,"work_id":"c86fcd0f-c905-4527-a40e-146583a5b3c9","year":null},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.097041Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:ef9032c113a4d929f39bb967fbf264758979d38b2b5ebb6a8997addc491bd815","observation_id":"d4671044-c8ad-4e4d-b856-7b02a4f132af","resolution":{"observed_at":"2026-08-15T23:22:41.412899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04558","last_updated":"2022-08-08T01:53:05Z","snapshot_observed_at":"2026-08-20T03:31:53.345681Z","submitted_at":"2020-06-08T13:05:40Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04558","snapshot_observed_at":"2026-08-15T23:22:41.105359Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.105359Z"},"links":{"cited_paper":"/paper/2006.04558","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:52dff6a7ab83d07dd0980025d48868cd10af47ee84e0581b60d01e959df2b8e1","observation_id":"ea6bd5fc-2563-43c4-949b-1e27e10d4eeb","resolution":{"observed_at":"2026-08-15T23:22:41.105359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.383582Z","title":"Spatial Audio: Overcoming Its Unique Challenges to Provide A Complete Solution,","venue":null,"work_id":"a0132081-0b76-4591-ab04-0afa253f0db8","year":2024},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.109870Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:0e08222ac2a8f24c568f18fa166290fe151972b1a77ae21e52bde2583c20d6c0","observation_id":"22879027-a647-4c37-afee-a41e4f986fcf","resolution":{"observed_at":"2026-08-15T23:22:41.387790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.371643Z","title":"Ethical Implications of AI Voice Cloning in Creative Industries,","venue":null,"work_id":"bafc4e37-49af-40d2-af95-952dc03f6fa9","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.114897Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:a3050c0e1dc7354817781e7af614c43d88d9f53db19904757be9f1b512a7e8b6","observation_id":"d0ec39ff-8ff3-4608-99f1-f4fa57524b94","resolution":{"observed_at":"2026-08-15T23:22:41.375571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.358332Z","title":"SpaCy: Industrial-Strength Natural Language Processing,","venue":null,"work_id":"9a0be41b-7bf9-45e5-b4d4-0c4dcc3b38e3","year":2020},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.118676Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:7b77d3b1dcad9f1fe81869ca84edc00ea382b80a1498bb95eb4030fd48031beb","observation_id":"f6382e08-1239-4c6e-ad88-8f726458aace","resolution":{"observed_at":"2026-08-15T23:22:41.362679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.122666Z","title":"Current Use and Future Perspectives of Spatial Audio Technologies in Electronic Travel Aids,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.122666Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:526f38da26c3d497429b0c9fab1f4e74476f4f4ec5514bca190081d18eb11619","observation_id":"9376d115-8fb8-4550-9503-6ab8b271df89","resolution":{"observed_at":"2026-08-15T23:22:41.122666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.344923Z","title":"Multi-Agent Systems for Audio Content Creation,","venue":null,"work_id":"ba7d534f-4fd1-40a5-aeb5-c87149aca563","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.126694Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:643321e9785e2476dbd893e7ba55fbec54764c2e6ee707735f79be6dbe48fb22","observation_id":"b38ff787-c1fe-415c-b51d-3738c15b84a4","resolution":{"observed_at":"2026-08-15T23:22:41.348781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-15T23:22:41.130517Z","title":"VALL-E: Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.130517Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:3f75225544d2ec7443440ab98f7ec5c5c062f14f07d1a34f4240b11e3a19811d","observation_id":"35e17589-c0b8-4a99-96f8-3c6707924564","resolution":{"observed_at":"2026-08-15T23:22:41.130517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.332909Z","title":"Hierarchical Auditory Computation Across Timescales in the Human Brain,","venue":null,"work_id":"07825cdb-68bd-4956-90d8-77c0b7fd464e","year":2022},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.134880Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:f4951ae6553e30b9f6d509ceaa6af55bb4de4e53df084b54295e0186e4c3de38","observation_id":"f430cf42-d29f-4a14-8d78-e17245d4bf38","resolution":{"observed_at":"2026-08-15T23:22:41.336890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.318713Z","title":"Human-in-the-Loop Deep Learning for Audio Narration Review,","venue":null,"work_id":"cb96bb8d-eca8-4070-89dd-b5981bfd6fb0","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.139352Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:1d065ed7d567a1ffc0043631055e0c5f27916e743014f8fc37ff67cc9a130bf8","observation_id":"58b91471-cca2-4e03-811f-92b43a608b10","resolution":{"observed_at":"2026-08-15T23:22:41.322927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.306045Z","title":"Whisper: Scalable Multilingual Speech Recogni- tion with Human Feedback,","venue":null,"work_id":"89454ebb-8954-4db8-be29-25abddecc18d","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.143769Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:ac63fab0b41b7eb49b74a49d7fdf3e08242e37849bd35aab2cfd01982bd4fd86","observation_id":"64e8b208-df18-447d-97d5-2792f721bf51","resolution":{"observed_at":"2026-08-15T23:22:41.310248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.293413Z","title":"Hybrid AI + Human Editing in Voice Cloning Workflows,","venue":null,"work_id":"000c5b00-6e89-40fc-892e-83199c279ebb","year":2023},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.147899Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:fcfebded17028012f3ce09e699c4cf98ced0a48a362593073a2b85ea1f671485","observation_id":"525f5c6f-098c-40c9-8ed6-1eab0028c328","resolution":{"observed_at":"2026-08-15T23:22:41.298000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-21T14:30:27.126880Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-15T23:22:41.151996Z","title":"Learning to summarize with human feed- back,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.151996Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:aa0fea78984657eb75360b62ed48f0b381a2d45bb07a91cac9bb8744997dbac1","observation_id":"5f39adc0-62b7-4ed5-b663-dc38a20db9a9","resolution":{"observed_at":"2026-08-15T23:22:41.151996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.396478Z","title":null,"venue":null,"work_id":"ca8e4fb5-06f4-4205-b95f-a1e178e91d50","year":null},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:41.101346Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:4bc8bda62e31b7331a29a89950691e73b1b585cd2a2121820f6851ca13d116bc","observation_id":"cc75a388-cdb2-45b9-8aa0-133cb224feaa","resolution":{"observed_at":"2026-08-15T23:22:41.400470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:22:41.607319Z","title":null,"venue":null,"work_id":"941fb031-2f54-4220-b577-3dc489824772","year":null},"citing_paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T23:22:40.999158Z"},"links":{"citing_paper":"/paper/2505.04885"},"observation_digest":"sha256:02fdff8a85df78168a67216af1783dfb66dcb68626ef1560d148ee8737a45d12","observation_id":"c0a210e7-01c7-40bc-b322-eb6333db2745","resolution":{"observed_at":"2026-08-15T23:22:41.611080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.04885","last_updated":"2025-05-08T01:48:06Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-19T15:04:41.579527Z","submitted_at":"2025-05-08T01:48:06Z","title":"A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2505.04885."}