{"as_of":"2026-08-18T01:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d8849ec7dae636ca6f85f41946eb981f71963c2ad5c9b2117d2d71ed55b75e6","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:40:29.266371Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.12005/citation-record","integrity":"/paper/2504.12005/integrity","json":"/paper/2504.12005/citation-record.json","paper":"/paper/2504.12005"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.531234Z","title":"Naturally, there has been many studies on building a voice conversion machine that converts the source speakers voice into that of a target speakers automatically","venue":null,"work_id":"387e9d19-82fe-4df0-860d-60ef50b3fa4b","year":null},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.184066Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:93e4402b63371006feb1f8d433700c027bdf6d3c8a6e4626ad1458bc7a2cd303","observation_id":"b9dec44b-7064-4cd4-b6df-5e5cb55f003c","resolution":{"observed_at":"2026-08-16T12:40:29.538216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.510023Z","title":null,"venue":null,"work_id":"338a1253-23ea-4778-9cfb-0388d02ddcd0","year":null},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.190446Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:0c3f3f4c0ae2056da70e70bbe46c4c186ac70a667a38992b35d4ca856ee02272","observation_id":"037ca2cf-a552-4627-9f51-c8f2649878a4","resolution":{"observed_at":"2026-08-16T12:40:29.515334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.489940Z","title":null,"venue":null,"work_id":"add936d1-e3ac-4465-b6ed-7b0ccefe04f1","year":null},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.197482Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:576ba270464795ef9ed3904135652f1471a18f17744fa8d8178e6e00aecc35b8","observation_id":"1526280f-d8dc-4b77-8ba2-aaccc62523bc","resolution":{"observed_at":"2026-08-16T12:40:29.496490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.470576Z","title":null,"venue":null,"work_id":"ea6bb0f5-1da2-4baa-b23d-f3313e52c6e3","year":null},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.203745Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:eabe6197329757f8f3d1e7d2b81472d214343ac385ffa2496312e38f9a9d2fe3","observation_id":"b2c46edf-180d-4f09-97b6-fe8c1fe051a1","resolution":{"observed_at":"2026-08-16T12:40:29.477298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.452697Z","title":"V oice conversion from non-parallel corpora using variational auto-encoder,","venue":null,"work_id":"284955e3-8be7-4a21-9bdf-0b95c2da537a","year":2016},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.210461Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:eee7d0fe6b33bd5f5bb2a901c686a04192d6f638968779390fceb1571021e98b","observation_id":"5e342da4-e8af-43a6-b66a-93e1f611da3c","resolution":{"observed_at":"2026-08-16T12:40:29.458681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00849","last_updated":"2017-06-08T01:08:38Z","snapshot_observed_at":"2026-08-14T21:08:28.165840Z","submitted_at":"2017-04-04T01:47:14Z","title":"Voice Conversion from Unaligned Corpora using Variational Autoencoding Wasserstein Generative Adversarial Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00849","snapshot_observed_at":"2026-08-16T12:40:29.216406Z","title":"V oice conversion from unaligned corpora using variational au- toencoding wasserstein generative adversarial networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.216406Z"},"links":{"cited_paper":"/paper/1704.00849","citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:19098d67821a9417a383d0f3f0005740d18d161cdc3f1884b78fd2c64fcfb246","observation_id":"38ce2a26-b8de-4295-b3e2-35ea92b86d95","resolution":{"observed_at":"2026-08-16T12:40:29.216406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.433368Z","title":"Phonetic poste- riorgrams for many-to-one voice conversion without parallel data training,","venue":null,"work_id":"ecdc0efe-7987-4b90-b406-978cb51a54f8","year":2016},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.222371Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:10859aafe39f962f90cc9b3f5f96171306854ebf756b2a7e1aa512f97fa8bc82","observation_id":"8443cfde-2d5f-4314-b19d-1a7060252da5","resolution":{"observed_at":"2026-08-16T12:40:29.440414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10135","last_updated":"2017-04-06T21:20:34Z","snapshot_observed_at":"2026-08-17T12:01:30.659594Z","submitted_at":"2017-03-29T16:55:13Z","title":"Tacotron: Towards End-to-End Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10135","snapshot_observed_at":"2026-08-16T12:40:29.228884Z","title":"Tacotron: A fully end-to-end text-to-speech synthesis model,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.228884Z"},"links":{"cited_paper":"/paper/1703.10135","citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:b299af16feca47d83d59cd3024294a9ef2ac3eaa95de4e8282f0cc7ff815cf42","observation_id":"3483ca78-e787-41f4-890f-15c65b463293","resolution":{"observed_at":"2026-08-16T12:40:29.228884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05908","last_updated":"2021-01-03T16:56:46Z","snapshot_observed_at":"2026-08-14T21:52:07.048587Z","submitted_at":"2016-06-19T21:02:30Z","title":"Tutorial on Variational Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05908","snapshot_observed_at":"2026-08-16T12:40:29.234689Z","title":"Tutorial on variational autoencoders,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.234689Z"},"links":{"cited_paper":"/paper/1606.05908","citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:373776c0b843ee78e318d9df1f85f0a974040378e554c8549fb990b5d3f48501","observation_id":"72dcbb02-34d1-4080-9345-4e1a0f6e143b","resolution":{"observed_at":"2026-08-16T12:40:29.234689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.241983Z","title":"Signal estimation from modiﬁed short- time fourier transform,","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.241983Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:85f03c653e5870257e1af106ff34879d4d42d7c5c2426d3f3a46050ed8d4bb17","observation_id":"2c977a2c-430a-4345-adb7-38b3bc54b5b5","resolution":{"observed_at":"2026-08-16T12:40:29.241983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.404156Z","title":"Improved variational inference with inverse au- toregressive ﬂow,","venue":null,"work_id":"01423033-3b46-45c8-9aee-1358ddf984a6","year":2016},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.248008Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:28e48da3ec639e3cfae96a87c66a82677e7ddf29946644101b4477502004a944","observation_id":"f6084efb-394d-4c8c-ae1d-a051de006562","resolution":{"observed_at":"2026-08-16T12:40:29.409557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.05770","last_updated":"2016-06-14T09:01:36Z","snapshot_observed_at":"2026-08-14T22:47:38.400768Z","submitted_at":"2015-05-21T15:36:37Z","title":"Variational Inference with Normalizing Flows","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.05770","snapshot_observed_at":"2026-08-16T12:40:29.253927Z","title":"Variational inference with nor- malizing ﬂows,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.253927Z"},"links":{"cited_paper":"/paper/1505.05770","citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:a08a3a0c35d8d949bc475964de2fb727449bce04e495b70bf25adef2223405c0","observation_id":"fab2d56d-784d-4f2c-bce7-5b5497f3c5eb","resolution":{"observed_at":"2026-08-16T12:40:29.253927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.382431Z","title":"Darpa timit acoustic-phonetic continous speech corpus cd-rom. nist speech disc 1-1.1,","venue":null,"work_id":"7cde0f1b-3e5d-430c-94d4-ef33a8eb2d69","year":1993},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.260203Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:34cb982c071f16165959fc65491f383a49d24d1df1bf8be3ebeec4bb22b8d3d1","observation_id":"ad87974f-8ea1-47eb-93c0-22afd3c7e340","resolution":{"observed_at":"2026-08-16T12:40:29.392684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:29.266371Z","title":"Lib- rispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:29.266371Z"},"links":{"citing_paper":"/paper/2504.12005"},"observation_digest":"sha256:e7a00ef90a644a88a32e7db1a1b9489ede66d6fe649efdce5c4a1638e549ebf9","observation_id":"7251410a-a916-44e9-95c3-0450ba1ee8c3","resolution":{"observed_at":"2026-08-16T12:40:29.266371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.12005","last_updated":"2025-04-16T11:59:56Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T12:38:28.776886Z","submitted_at":"2025-04-16T11:59:56Z","title":"Voice Conversion with Diverse Intonation using Conditional Variational Auto-Encoder"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2504.12005."}