{"as_of":"2026-08-20T18:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c4b87eedf6f2ab8707da33726337324e4d378bf46b074fdb1dcff89babc9c3a","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:04:32.900274Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:04:32.627267Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-14T15:04:33.320936Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"cited_work":{"arxiv_id":"1908.01919","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.01919","snapshot_observed_at":"2026-08-14T15:04:33.320936Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","venue":"cs.SD","work_id":"2e93f71a-90cd-47bd-96ad-b44e0f4af608","year":2019},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.627267Z"},"links":{"cited_paper":"/paper/1908.01919","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:2dd239008ce1e6439842d1d2d076e7fd85eda758c3ae0338b89b68d9c79d1df8","observation_id":"92949faf-371f-4e48-bda3-c872d050e3eb","resolution":{"observed_at":"2026-08-14T15:04:33.336154Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.01919/citation-record","integrity":"/paper/1908.01919/integrity","json":"/paper/1908.01919/citation-record.json","paper":"/paper/1908.01919"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.958380Z","title":"For example, three SVS sys- tems based on DNN, LSTM, and Wavenet architecture were proposed, respectively [4, 5, 6]","venue":null,"work_id":"012af2c9-eb48-4b7d-8703-558f43da587e","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.611254Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:50cd95f28e1b6bafe534ebaa2e11a0a42d4068681a10ecd1e1b539442e59e57e","observation_id":"934fab5a-717e-438b-b020-d4f6cfbebe3d","resolution":{"observed_at":"2026-08-14T15:04:33.967134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.933518Z","title":"Recently, the end-to-end TTS system, which is trained as an autoregressive manner, such as Tacotron[8], Deep voice[9], is showing better performance than the conventional method","venue":null,"work_id":"1b62dfab-e9e1-4f01-9df6-948075332c3a","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.620446Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:426fc606eec7c578a04ba994fe37da4032ccfda0d2a632fd365373935fc7e675","observation_id":"3fb0fad9-ed63-4060-9cb4-6805beee4ee6","resolution":{"observed_at":"2026-08-14T15:04:33.941450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"cited_work":{"arxiv_id":"1908.01919","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.01919","snapshot_observed_at":"2026-08-14T15:04:33.320936Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","venue":"cs.SD","work_id":"2e93f71a-90cd-47bd-96ad-b44e0f4af608","year":2019},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.627267Z"},"links":{"cited_paper":"/paper/1908.01919","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:2dd239008ce1e6439842d1d2d076e7fd85eda758c3ae0338b89b68d9c79d1df8","observation_id":"92949faf-371f-4e48-bda3-c872d050e3eb","resolution":{"observed_at":"2026-08-14T15:04:33.336154Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.877778Z","title":"Dataset Since there is no publicly available Korean singing voice dataset, we created the dataset as follows","venue":null,"work_id":"0c8b8823-65eb-4289-a480-6a7c38bca7c4","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.644526Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:ab35a6ef3c47dcc54c355397f43a8443a6e9e09ed9a1bcc11ee907245dd70b9a","observation_id":"741b659e-30c1-4e2f-868a-8b3053bf6ae3","resolution":{"observed_at":"2026-08-14T15:04:33.884267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.824581Z","title":"We showed that using text information to model the phonetic enhancement mask actually worked, and produced more accurate pronunciation","venue":null,"work_id":"a44a4195-9ac4-42e5-bb7c-4cfb080262f2","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.666130Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:19dc8c078a1ac5f6446ecd0b3ecff82efad82b96324009b4dd36571935c739a7","observation_id":"7aeed66b-7dba-4fe9-bc1c-61062e500dc4","resolution":{"observed_at":"2026-08-14T15:04:33.831986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.852894Z","title":"In the case of sound quality, methods 1 and 2 did not sig- niﬁcantly affect the improvement, but the applying method 3 Figure 3: Generated spectrograms","venue":null,"work_id":"628526c2-c9e5-4327-89a7-3327caec4ddb","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.651856Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:2d9953773b29cd5864792a7fda4ffb9ee813a555649c288658c7aece1492a7e3","observation_id":"7531fb99-55f1-4da9-9a43-104570be3dd2","resolution":{"observed_at":"2026-08-14T15:04:33.861589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.902128Z","title":"First, in order to enter pitch information, we added pitch encoders with the same structure as text encoders","venue":null,"work_id":"94a17248-7898-4662-87ba-aaa79ab6e368","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.633847Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:e05b4e18f7ba0c519da3171ccd2cd83c43e1e7566ca3899bcc7875fe4b135ad4","observation_id":"a1c2393c-8eda-45d1-a8fb-e5f515805a8f","resolution":{"observed_at":"2026-08-14T15:04:33.910285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.802406Z","title":null,"venue":null,"work_id":"8a7da32e-27cb-4cf2-a750-04f2c3763ef8","year":2019},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.676867Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:14fb5f012b2843dc8f029bb15f40b4898953c655a6d7a651e153cdff5d92adcb","observation_id":"f23577e3-7b8d-47f7-9906-f76174edb6b3","resolution":{"observed_at":"2026-08-14T15:04:33.809414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.777751Z","title":"Concatenation-based midi-to-singing voice syn- thesis,","venue":null,"work_id":"f7b4f01a-8568-4e1e-ab20-d4e578a89844","year":1997},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.688904Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:77ddd8a244868a5d42dbe553f6eddeb44160ef3f43acb203b2e1ba7106712552","observation_id":"a24a3a0f-946f-4805-8aae-db02de1e9633","resolution":{"observed_at":"2026-08-14T15:04:33.785392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.740040Z","title":"Sample- based singing voice synthesizer using spectral models and source- ﬁlter decomposition,","venue":null,"work_id":"16414932-3193-4bf5-82dc-1d00ab54b6b5","year":2003},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.697292Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:45ec960e5f7041dcfc5a88f541555db54f6e1c4b095b0e0733e5d65be485ef3f","observation_id":"dcc44047-ebb8-4631-b94d-415def622cb0","resolution":{"observed_at":"2026-08-14T15:04:33.748347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.709132Z","title":"V ocaloid-commercial singing syn- thesizer based on sample concatenation,","venue":null,"work_id":"137bb1c7-8063-4f0e-96b9-39991feaeaba","year":2007},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.707465Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:b4796dd78d661a4825bc95501ddd9a4fea548e6d5f1f54c6ef19e837a124abd2","observation_id":"3c900d7c-25d3-4f04-b803-982c108a5b2a","resolution":{"observed_at":"2026-08-14T15:04:33.717634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.675813Z","title":"Singing voice synthesis based on deep neural net- works","venue":null,"work_id":"9d23e098-0a0f-4cc2-b7ae-20529c14c9f0","year":2016},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.718522Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:b3ea30cf6694381c0c2a68d7e20cf87b1bf216e10a416aea00661dc0ca3e8f14","observation_id":"69fa44f2-3c68-4a85-afbc-9284035ec4c4","resolution":{"observed_at":"2026-08-14T15:04:33.685795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.650487Z","title":"Korean singing voice synthesis system based on an lstm recurrent neural network,","venue":null,"work_id":"924720a2-77fa-4381-ae4b-84d480931b9c","year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.733260Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:40221655d5bdf27d9e6578ce147ca30cab99b5b7c445c8fb7b4a73fb73a30587","observation_id":"5cb98ab3-756f-4131-9ce7-4f0ee8ea61ae","resolution":{"observed_at":"2026-08-14T15:04:33.656525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.627497Z","title":"A neural parametric singing synthe- sizer modeling timbre and expression from natural songs,","venue":null,"work_id":"0a54eb71-de9e-487e-97ca-94417d5ad29b","year":2017},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.744963Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:4b7357b41d42e2cf3d7efd8fab320abb89c647acea050cc59b4dedec0ff8d88d","observation_id":"54a0a82a-e11c-41a9-967b-08686ecc9f4e","resolution":{"observed_at":"2026-08-14T15:04:33.634598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.595781Z","title":"Efﬁciently train- able text-to-speech system based on deep convolutional networks with guided attention,","venue":null,"work_id":"d639249c-91e9-4949-b881-6f10084c2de3","year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.751267Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:267d34131a2dcf534f373376ac668866fdbfb28c27ee3cb3799ea670cc526a90","observation_id":"8acdb953-2939-4c27-ba9b-86d6717b1f96","resolution":{"observed_at":"2026-08-14T15:04:33.604675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10135","last_updated":"2017-04-06T21:20:34Z","snapshot_observed_at":"2026-08-17T12:01:30.659594Z","submitted_at":"2017-03-29T16:55:13Z","title":"Tacotron: Towards End-to-End Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10135","snapshot_observed_at":"2026-08-14T15:04:32.758890Z","title":"Tacotron: Towards end-to-end speech synthesis,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.758890Z"},"links":{"cited_paper":"/paper/1703.10135","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:af48dde4187e5a379d5901cd7f9fc945236b18a9ffad5cccde84c40ef6893c45","observation_id":"1faef748-c156-4efb-89a4-05875a5c9a7e","resolution":{"observed_at":"2026-08-14T15:04:32.758890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.568577Z","title":"Deep voice 2: Multi-speaker neural text- to-speech,","venue":null,"work_id":"f4b98940-48fc-402a-8bea-d288e2285ff8","year":2017},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.765387Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:3d31dad9381e0e0bdceb09783ecbd75459750c28a49590d3f3056c566ff7bb13","observation_id":"6a2e93d7-0729-4df0-ae17-de1b5bb3d99c","resolution":{"observed_at":"2026-08-14T15:04:33.577183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09047","last_updated":"2018-03-24T02:52:58Z","snapshot_observed_at":"2026-08-16T07:49:39.892869Z","submitted_at":"2018-03-24T02:52:58Z","title":"Towards End-to-End Prosody Transfer for Expressive Speech Synthesis with Tacotron","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.09047","snapshot_observed_at":"2026-08-14T15:04:32.775499Z","title":"Towards end-to-end prosody transfer for expressive speech synthesis with tacotron,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.775499Z"},"links":{"cited_paper":"/paper/1803.09047","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:01e3c20f0d3cec31221a3af70fe53474de972d2fc9d1ae0b159ae1f5a5a3fe5b","observation_id":"67ee3b95-5455-4daa-933c-9b9c381ee10e","resolution":{"observed_at":"2026-08-14T15:04:32.775499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09017","last_updated":"2018-03-23T23:56:49Z","snapshot_observed_at":"2026-08-14T19:32:58.812371Z","submitted_at":"2018-03-23T23:56:49Z","title":"Style Tokens: Unsupervised Style Modeling, Control and Transfer in End-to-End Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.09017","snapshot_observed_at":"2026-08-14T15:04:32.790427Z","title":"Style tokens: Unsupervised style modeling, control and transfer in end-to-end speech synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.790427Z"},"links":{"cited_paper":"/paper/1803.09017","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:300a52792708f695b7b5798cbeba3ef5e00a0d56909b416f1ccdefcc69eecb17","observation_id":"b152ab93-0151-4dc2-a6bd-3f3f2728a6cb","resolution":{"observed_at":"2026-08-14T15:04:32.790427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.10128","last_updated":"2018-08-30T05:51:30Z","snapshot_observed_at":"2026-08-18T00:26:32.771187Z","submitted_at":"2018-08-30T05:51:30Z","title":"Semi-Supervised Training for Improving Data Efficiency in End-to-End Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.10128","snapshot_observed_at":"2026-08-14T15:04:32.798183Z","title":"Semi-supervised training for improving data efﬁciency in end-to- end speech synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.798183Z"},"links":{"cited_paper":"/paper/1808.10128","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:a2ed268ad7107f650abdf18085f2b0f0b7339e4bddb9806d123b3fc9d3f1a246","observation_id":"234074e7-8471-4005-86aa-21266d27950c","resolution":{"observed_at":"2026-08-14T15:04:32.798183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:32.807982Z","title":"Speech band- width extension using generative adversarial networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.807982Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:1016e4616c7986adfc0f90534f48fc65bf568f57925dd3410569c2be8e66450f","observation_id":"6a427ff8-e219-4f41-8973-21b2d699c21e","resolution":{"observed_at":"2026-08-14T15:04:32.807982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05637","last_updated":"2018-08-15T00:02:46Z","snapshot_observed_at":"2026-08-18T07:18:52.679033Z","submitted_at":"2018-02-15T16:19:21Z","title":"cGANs with Projection Discriminator","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05637","snapshot_observed_at":"2026-08-14T15:04:32.815332Z","title":"cgans with projection discriminator,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.815332Z"},"links":{"cited_paper":"/paper/1802.05637","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:3dbbe9966734460db92e10d69897eb03601c07eb18e14f9bb0a8fa8d8f3efe05","observation_id":"41e18110-478a-4b03-a7a7-974243325b8a","resolution":{"observed_at":"2026-08-14T15:04:32.815332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-14T15:04:32.822440Z","title":"Large scale gan train- ing for high ﬁdelity natural image synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.822440Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:9cfeb3ee4e3ba071850641955635eb8f3e04ccc7fe8f9563ab8475ed4ebf52da","observation_id":"2bcf71f6-6ed7-4dd2-8aea-986e76cf7b17","resolution":{"observed_at":"2026-08-14T15:04:32.822440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.521243Z","title":"Signal estimation from modiﬁed short- time fourier transform,","venue":null,"work_id":"f53872fb-5acb-43af-a111-932cd98b10ab","year":1984},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.827979Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:e587f85acf03ab2870d35dfb0d7496f06b3f977a5076ad52b81905dc01524f2a","observation_id":"d2a14b5d-d811-4154-ae17-c8a4e63fc977","resolution":{"observed_at":"2026-08-14T15:04:33.530052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-08-16T05:39:41.727705Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-14T15:04:32.834775Z","title":"Wavenet: A generative model for raw audio,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.834775Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:1d438223072074422fd8f843bf3b8d597f54ee879fca68752f0100647c9cc7c2","observation_id":"be5dc81e-362c-44c9-946a-0119c5b36307","resolution":{"observed_at":"2026-08-14T15:04:32.834775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.488163Z","title":"Dropout: a simple way to prevent neural net- works from overﬁtting,","venue":null,"work_id":"43a739b3-f6f8-4793-94bd-bac94c439400","year":1929},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.841481Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:563081f0a82d24737f825bb93c8194f047b94594eed21745c86b5c625245a523","observation_id":"ef683e37-81fe-411d-9374-eb236f08c699","resolution":{"observed_at":"2026-08-14T15:04:33.501667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.461738Z","title":"Improved training of wasserstein gans,","venue":null,"work_id":"562e705c-50e4-4cc9-b78f-ea88300a1344","year":2017},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.846895Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:e6a524456978b4a2bf983e1b5c12fb906aba83e3077e6a16f5181a1a4cb9fe35","observation_id":"c8b0ea22-3e8a-450b-ad4b-b4a82ea1975f","resolution":{"observed_at":"2026-08-14T15:04:33.470197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05957","last_updated":"2018-02-16T14:41:39Z","snapshot_observed_at":"2026-08-15T15:47:46.409113Z","submitted_at":"2018-02-16T14:41:39Z","title":"Spectral Normalization for Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05957","snapshot_observed_at":"2026-08-14T15:04:32.854952Z","title":"Spectral normalization for generative adversarial networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.854952Z"},"links":{"cited_paper":"/paper/1802.05957","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:7499aabe7466050a4a6474f10ca550696018a766d49d2b7289dff517f217317c","observation_id":"b7d3dad6-f809-4d86-8709-8728d30bd4d5","resolution":{"observed_at":"2026-08-14T15:04:32.854952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.04406","last_updated":"2018-07-31T16:28:15Z","snapshot_observed_at":"2026-08-20T04:10:01.336083Z","submitted_at":"2018-01-13T09:42:26Z","title":"Which Training Methods for GANs do actually Converge?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.04406","snapshot_observed_at":"2026-08-14T15:04:32.867284Z","title":"Which train- ing methods for gans do actually converge?","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.867284Z"},"links":{"cited_paper":"/paper/1801.04406","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:e0fe84f6a57141f56c679fdc492fbdf9a9e65d628951616fa619792c5c37c4a1","observation_id":"b670dd15-f368-41f3-afe7-c523ff48dde9","resolution":{"observed_at":"2026-08-14T15:04:32.867284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.428825Z","title":"Generative adver- sarial nets,","venue":null,"work_id":"2f4c49a9-18d2-4941-bd4b-a5d9a77d7d07","year":2014},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.876401Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:118e0bba7f6bbeefc0103f8b7e1d8b91bd4d4c2f1bdea6347161b3646e479a6e","observation_id":"e4eb64ee-8e14-48fe-b9c1-9f8bb0350c66","resolution":{"observed_at":"2026-08-14T15:04:33.439146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-14T15:04:32.883317Z","title":"Adam: A method for stochastic opti- mization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.883317Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:12da9fce1c26206bd84c29f3f9cc244d0761cf945a190c03c954892a62a37815","observation_id":"86253747-3d7a-4b5a-9239-49c409716da6","resolution":{"observed_at":"2026-08-14T15:04:32.883317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:32.890770Z","title":"Understanding the difﬁculty of train- ing deep feedforward neural networks,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.890770Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:c097d50fa5aa6874f133dfa380d7a8fe06a5cc6b1ef95174a4238da494ac258a","observation_id":"4972dbcd-278c-4656-a3bc-3f6b8164bb5a","resolution":{"observed_at":"2026-08-14T15:04:32.890770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.354163Z","title":"World: a vocoder-based high-quality speech synthesis system for real-time applications,","venue":null,"work_id":"700ccf04-7eb4-4205-b081-45b441f6dba9","year":2016},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.900274Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:49897469d3a3e5e30c001b44b53fcdcf13c1e0228f2ad5cd2e7ebb4a1ed208da","observation_id":"72259870-852f-4d7e-b8dc-92deaf44c5f9","resolution":{"observed_at":"2026-08-14T15:04:33.372021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-20T06:03:36.478251Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:1908.01919."}