{"as_of":"2026-08-15T04:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:440320f86d186a0bd51e18849257684f73df1874abd7857dc37b7340cc7aece1","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:34:03.270755Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10289/citation-record","integrity":"/paper/2506.10289/integrity","json":"/paper/2506.10289/citation-record.json","paper":"/paper/2506.10289"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.608164Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:56.608164Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:39bb3d2320b430232556fcba028a85d207cb6546fc46603f18228d83ff99396d","observation_id":"f69987ce-6521-4ba5-b474-e3f233dc0fd7","resolution":{"observed_at":"2026-08-07T04:33:56.608164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:56.757231Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:56.757231Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:8acc630c6b9c84793ea4b4b68bd83392dfad1d0847df29494bfeee212b53daf1","observation_id":"3633db4d-b517-4807-a4e8-7ed29046b9db","resolution":{"observed_at":"2026-08-07T04:33:56.757231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:09.858406Z","title":null,"venue":null,"work_id":"a49f2344-5750-49c4-9c97-bc4435e843f8","year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:56.899404Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:9271c42a84ba3d11662bf623f4b61ad01aea5af2b71a082c95c66529f6342179","observation_id":"dbd2371a-71c4-4f12-9655-2768f6c71fd0","resolution":{"observed_at":"2026-08-07T04:34:09.965360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.060937Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:57.060937Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:5b2a01f1e438d0932fe01edec91ec89d609aaec62a555d159da9ac3ee7d22d17","observation_id":"38c8e64a-b983-45aa-9a26-067e12155423","resolution":{"observed_at":"2026-08-07T04:33:57.060937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.211292Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:57.211292Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:5e1acfacdd9d8e0bf54ced8d9b9a80b5013f339f925cfd83cc1421487f9fe3ac","observation_id":"38a49bc0-ab82-4f67-9af1-12fd09a31e42","resolution":{"observed_at":"2026-08-07T04:33:57.211292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:09.520448Z","title":null,"venue":null,"work_id":"21dcaefe-00a4-45e3-8a34-b939f31fc12f","year":2021},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:57.349889Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:abb781290802d676b108314e9e3a81ed55ae49236b19437ae85b5c6a93e4cc5c","observation_id":"99142e36-da35-4e70-9938-e7814a80f840","resolution":{"observed_at":"2026-08-07T04:34:09.703168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:09.201296Z","title":null,"venue":null,"work_id":"dc6ea9b8-ecca-4b7e-9fd4-d4dca2113001","year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:57.515935Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:c80e0fc9777f98137e8f6755e9de335b536eb0af3844056a0caea2926ed9e7cd","observation_id":"04a264fc-b4e3-4be7-b9cc-ffdf157f7156","resolution":{"observed_at":"2026-08-07T04:34:09.373554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:57.700741Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:57.700741Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:defe804f90b1ee7d2591390cc47c34da3ddd6beafc6112389addcc31d16ebfd3","observation_id":"84150a00-57ab-4c62-a2ab-2a2f8086ca21","resolution":{"observed_at":"2026-08-07T04:33:57.700741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:08.888081Z","title":"Prabhune, Dhruv Agarwal, and Gopala K","venue":null,"work_id":"ab376959-e169-4f7f-ac1a-804da99e2552","year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:57.851547Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:cfdfce3c79849b5c280478b500b2e3709661d025c3a4efd4fa0f301d68213710","observation_id":"bd19b2cf-3c9b-4e32-95c2-9f6321143dc7","resolution":{"observed_at":"2026-08-07T04:34:09.020926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:08.651297Z","title":null,"venue":null,"work_id":"98e47f9f-2c40-42dd-b5e7-568878f33971","year":2021},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:57.983077Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:eb6d537c896049514eb9b0314f74413a1f92e65a6eb93fdcd9a3349b459ba404","observation_id":"5ea36c94-4f7e-4b53-9187-436139c3f570","resolution":{"observed_at":"2026-08-07T04:34:08.754781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05742","last_updated":"2019-08-22T17:18:16Z","snapshot_observed_at":"2026-08-14T16:48:34.482292Z","submitted_at":"2019-04-10T16:22:18Z","title":"One-shot Voice Conversion by Separating Speaker and Content Representations with Instance Normalization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05742","snapshot_observed_at":"2026-08-07T04:33:58.142988Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:58.142988Z"},"links":{"cited_paper":"/paper/1904.05742","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:a9bd34f2d1d1f469006b0822eafdb644ce6da2ccdf8fd9971d3312f09c53b877","observation_id":"5ed31ba1-ea94-4904-9e9d-2c67b1f701e5","resolution":{"observed_at":"2026-08-07T04:33:58.142988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05407","last_updated":"2024-07-09T07:42:51Z","snapshot_observed_at":"2026-08-10T17:49:50.848957Z","submitted_at":"2024-07-07T15:16:19Z","title":"CosyVoice: A Scalable Multilingual Zero-shot Text-to-speech Synthesizer based on Supervised Semantic Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05407","snapshot_observed_at":"2026-08-07T04:33:58.292521Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:58.292521Z"},"links":{"cited_paper":"/paper/2407.05407","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:5564103e2ee5785a0b78344c5947bb88092ff8c8ac3f2fedafb158fb072304f5","observation_id":"c5aff160-ddf5-406a-8254-54a3feff346a","resolution":{"observed_at":"2026-08-07T04:33:58.292521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10117","last_updated":"2024-12-25T11:54:03Z","snapshot_observed_at":"2026-08-09T04:36:59.879757Z","submitted_at":"2024-12-13T12:59:39Z","title":"CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10117","snapshot_observed_at":"2026-08-07T04:33:58.459319Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:58.459319Z"},"links":{"cited_paper":"/paper/2412.10117","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:6bf175726f757fee591c04a37a209832f2a7ea40f06add5f331e0695393ed234","observation_id":"dd09f493-43c4-4136-baff-508a18977187","resolution":{"observed_at":"2026-08-07T04:33:58.459319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:08.325558Z","title":null,"venue":null,"work_id":"92399a37-3915-4145-8b0c-6e4061714833","year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:58.613092Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:3cb5c895dff3f96623eddf197c503437e7ec9fe0643e302b1809f41cd847606c","observation_id":"c90fdc5b-c7d0-4eaa-a818-49e4503637c7","resolution":{"observed_at":"2026-08-07T04:34:08.477107Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:58.795966Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:58.795966Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:eab0982825fb7a3d977cc06ae7d740369283c5e2367f0b9fe0f8c8ab55801993","observation_id":"95d779a5-c7ce-4ef2-bffb-85210049bf0f","resolution":{"observed_at":"2026-08-07T04:33:58.795966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03100","last_updated":"2024-04-23T08:38:03Z","snapshot_observed_at":"2026-08-13T04:02:54.961180Z","submitted_at":"2024-03-05T16:35:25Z","title":"NaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03100","snapshot_observed_at":"2026-08-07T04:33:58.917561Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:58.917561Z"},"links":{"cited_paper":"/paper/2403.03100","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:b6573fa5d7eda91406883a1d280e9d8ab3b31f7c0cb58c2807e8b2ad078043b7","observation_id":"73c0b75f-257e-4ba2-bba9-6d630887dd27","resolution":{"observed_at":"2026-08-07T04:33:58.917561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:08.009442Z","title":null,"venue":null,"work_id":"e2731e04-1859-4fee-981e-efb0535df333","year":2018},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:59.103647Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:a254246af5426bd3cbdb964cad67d823b13803fb843e3586826e95a957d91ba1","observation_id":"42a24785-adc4-4082-92ca-988f2f41f6d7","resolution":{"observed_at":"2026-08-07T04:34:08.123653Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:33:59.282696Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:59.282696Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:904fb3aac81105f97aff51742c4bd665dc34ffecb90cc38cc499ffe098cc154a","observation_id":"5f1201ca-579d-4104-b268-8aa326e82fe5","resolution":{"observed_at":"2026-08-07T04:33:59.282696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:07.681599Z","title":null,"venue":null,"work_id":"bf2c587f-92fc-451c-8da7-927cc9f019a5","year":2019},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:59.371521Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:34603ff61eb3c7f9f7984dce244bce645b427cfb8d065ab9d41ebea729c1bc8e","observation_id":"85dbed56-2a91-4bc2-917c-89b22a0b676c","resolution":{"observed_at":"2026-08-07T04:34:07.870210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.12279","last_updated":"2019-08-07T10:21:30Z","snapshot_observed_at":"2026-08-14T16:01:14.192318Z","submitted_at":"2019-07-29T08:51:52Z","title":"StarGAN-VC2: Rethinking Conditional Methods for StarGAN-Based Voice Conversion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.12279","snapshot_observed_at":"2026-08-07T04:33:59.522916Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:59.522916Z"},"links":{"cited_paper":"/paper/1907.12279","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:10160e4e64f3b5de905d58c35e2ecd276a52535790d2cf5de316e1e8c1f0d354","observation_id":"b9499f04-5991-43bd-b030-f1a394ccc3d1","resolution":{"observed_at":"2026-08-07T04:33:59.522916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16937","last_updated":"2022-03-31T10:45:32Z","snapshot_observed_at":"2026-08-14T02:13:32.247769Z","submitted_at":"2022-03-31T10:45:32Z","title":"HiFi-VC: High Quality ASR-Based Voice Conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16937","snapshot_observed_at":"2026-08-07T04:33:59.674989Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:59.674989Z"},"links":{"cited_paper":"/paper/2203.16937","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:001430a1b5673aaa97c6be7ce20f006168cadf4a88585a1415e50c2d7b7127e7","observation_id":"49307dae-5448-4945-8514-28d84813e4e0","resolution":{"observed_at":"2026-08-07T04:33:59.674989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:07.384432Z","title":null,"venue":null,"work_id":"154281bb-6a1a-4b0b-b3a4-1244d2a64616","year":2018},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:59.808052Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:452a945e1ae7a931c21f54c8917a1b68ef0a6bef63e6dbaa34971808c1176e9a","observation_id":"c3ece916-0dd3-4d6c-b8b4-93fdfff2763b","resolution":{"observed_at":"2026-08-07T04:34:07.536495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:07.123073Z","title":null,"venue":null,"work_id":"d71806a7-d2b4-46c7-9c0f-0f4a8f94302c","year":2023},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:33:59.959136Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:4406f2a1a2938e13b49d2a2b4c99202c2650122773af9e590350db5dde7dd0f6","observation_id":"566b6b14-b408-4ebd-941a-c62eb15c8ba2","resolution":{"observed_at":"2026-08-07T04:34:07.235890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18802","last_updated":"2023-05-30T07:30:21Z","snapshot_observed_at":"2026-08-13T11:29:44.547086Z","submitted_at":"2023-05-30T07:30:21Z","title":"LibriTTS-R: A Restored Multi-Speaker Text-to-Speech Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18802","snapshot_observed_at":"2026-08-07T04:34:00.100529Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:00.100529Z"},"links":{"cited_paper":"/paper/2305.18802","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:4b0b4ebac0d6107d6177e1eea8f59e91e6d6706105e9fcd6b080bdc4b3b5b081","observation_id":"2f354450-2ce2-4a03-a7c7-d894c42cfc0d","resolution":{"observed_at":"2026-08-07T04:34:00.100529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:00.261153Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:00.261153Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:e42f8ba4ad2b55c8b1b1de0b2193a7344fb92db9129d561aca734d1e481b4a7e","observation_id":"c05fae2b-5766-46c9-8838-a1d6aa701d53","resolution":{"observed_at":"2026-08-07T04:34:00.261153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:06.794684Z","title":null,"venue":null,"work_id":"425febef-583b-4d81-9c3b-0c357cd35206","year":2023},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:00.397361Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:94d56a7b1e1a4d4b29b22368ea113388b465a225c292a42e73ea4488301d0e5c","observation_id":"d1f7543d-b13f-457e-87ce-bc9c895b0d35","resolution":{"observed_at":"2026-08-07T04:34:06.956021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:06.506410Z","title":null,"venue":null,"work_id":"b1ed7d91-d05d-4de7-93cc-cc25a65f798f","year":2022},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:00.570417Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:1a05c55eb5830ada3304ae0172709a5c3e6b1702e36ec0502fb196526293c360","observation_id":"4a95845f-d5bd-4df2-9bb5-53a92e0cadcc","resolution":{"observed_at":"2026-08-07T04:34:06.623419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:06.229614Z","title":null,"venue":null,"work_id":"bdedb0fc-07e2-4a6d-b822-9bb6d62af7cb","year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:00.722994Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:21d3c75e9d4376de6fd1c6ec19a756bb8eb950f9a06aef0c1b428eb568474417","observation_id":"3de0b55f-f1b8-401f-956e-c60d19a85f0b","resolution":{"observed_at":"2026-08-07T04:34:06.370485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.03295","last_updated":"2020-08-14T06:01:38Z","snapshot_observed_at":"2026-07-06T09:18:21.199815Z","submitted_at":"2020-05-07T07:37:31Z","title":"Cotatron: Transcription-Guided Speech Encoder for Any-to-Many Voice Conversion without Parallel Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.03295","snapshot_observed_at":"2026-08-07T04:34:00.880857Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:00.880857Z"},"links":{"cited_paper":"/paper/2005.03295","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:fd40055423fac61343fdeea9f44acdbea7349c0d9fec7b8e8e412c0530004ef4","observation_id":"a7dd153c-1dc1-4fc7-b957-cd9c7b527159","resolution":{"observed_at":"2026-08-07T04:34:00.880857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:05.940542Z","title":null,"venue":null,"work_id":"51459d06-4ce1-491b-b1eb-d7afa634b559","year":2018},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:01.015482Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:13542c7d5468f9c794f811288532d965e8df2193dca485587c30b18d301983f6","observation_id":"cf475e3a-7880-4631-8215-70bde16c651a","resolution":{"observed_at":"2026-08-07T04:34:06.067101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:05.642740Z","title":null,"venue":null,"work_id":"ec140867-2867-48c7-944b-ca50a4084c28","year":2020},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:01.151516Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:86f49fe814b7395b53d5bf6da135bcac635f6faacece0dff5766214920624b8a","observation_id":"5910ae05-af2e-4c31-91c1-d038b042b504","resolution":{"observed_at":"2026-08-07T04:34:05.793981Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:01.331192Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:01.331192Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:f7448d53400d26dfd7ce0b6cc6193da6dfa4c4ed661438eefcb2f76f307248a0","observation_id":"bb3f761a-b8b4-4d9d-a20b-a6f913ed6267","resolution":{"observed_at":"2026-08-07T04:34:01.331192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:05.318798Z","title":null,"venue":null,"work_id":"a6356ae4-0dc2-43b2-a4f9-0f177283a3fe","year":2022},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:01.510193Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:a500f8c6a708c4f137f3b687e7668b418e49f288a40898986360b0d4212adea9","observation_id":"4863fe3f-5789-4bf8-a99d-2b0e6c365233","resolution":{"observed_at":"2026-08-07T04:34:05.472666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:05.047850Z","title":null,"venue":null,"work_id":"1c6b46ef-b29d-460d-8723-932c98f65631","year":2023},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:01.708583Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:4278c23380740e724cd9deddbc9d09a30bc174b4d8c725b72958fd931fbc2a7f","observation_id":"8bb1fde0-b616-48ae-ba80-38900f107b0e","resolution":{"observed_at":"2026-08-07T04:34:05.175861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:04.751436Z","title":null,"venue":null,"work_id":"292331ac-c880-4e38-bfe0-6cb11b57449c","year":2016},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:01.900091Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:023ccc2119be8d09e99db7f08e803cb12c37aca0c11c3fd3615af73b0da1cad2","observation_id":"0d970309-0bf5-4be2-b58f-1acfb5ec4d0e","resolution":{"observed_at":"2026-08-07T04:34:04.933550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:04.449911Z","title":null,"venue":null,"work_id":"dbb2b2b6-a09c-49c7-9c59-9f8c755db558","year":2022},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:02.059219Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:1afc100a83b4a43bcaecad4637bbf0ef6248eda09dcc22439caad9bd7601fa29","observation_id":"172e7166-ff4c-4fc7-aa73-83e056f0da92","resolution":{"observed_at":"2026-08-07T04:34:04.567104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15412","last_updated":"2023-06-28T01:53:37Z","snapshot_observed_at":"2026-08-13T11:08:28.119782Z","submitted_at":"2023-06-27T12:11:55Z","title":"RMVPE: A Robust Model for Vocal Pitch Estimation in Polyphonic Music","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15412","snapshot_observed_at":"2026-08-07T04:34:02.224982Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:02.224982Z"},"links":{"cited_paper":"/paper/2306.15412","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:0ad4dd2c609f09c7c96c96476a5422eaf59671bd697086058a8f24f9ea827bfb","observation_id":"d61da44b-2357-4b41-900d-e2c8078867aa","resolution":{"observed_at":"2026-08-07T04:34:02.224982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:04.094411Z","title":"Anumanchipalli","venue":null,"work_id":"922dd5b3-21cb-4804-bd7c-5c08336abcd7","year":2023},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:02.358688Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:82567099b1d4cc45326055d1ada09a206ab15379e4b3edd966793242d57c77eb","observation_id":"d2e55697-349c-4153-802a-376af08cdd18","resolution":{"observed_at":"2026-08-07T04:34:04.316022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:03.802465Z","title":null,"venue":null,"work_id":"c49f9929-132f-46b1-a03c-3ebed96bd679","year":2021},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:02.472554Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:412cb21ef76e34b6f837ac6ef5f80f7098e461b925517102625525c9e34eb165","observation_id":"cd56585f-d7bc-43c8-ab86-d03b3b40fe2f","resolution":{"observed_at":"2026-08-07T04:34:03.966548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:03.536672Z","title":null,"venue":null,"work_id":"128e1b63-df09-4d84-8cdc-822f6c27838e","year":2022},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:02.644859Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:9c13f1e4afc5e830075bb4e3c162d9f75432d2cb1d0e79f419bf0efe0ab9f0f2","observation_id":"f75ba2da-20f1-4b8e-adab-087264502ee7","resolution":{"observed_at":"2026-08-07T04:34:03.677262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:02.826117Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:02.826117Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:aae6ad37d3a443943bf06a9b111931d8b289a4fdc63858bb57e55336218a7a01","observation_id":"2d738fb7-b680-4b83-9a15-5cc765921fb3","resolution":{"observed_at":"2026-08-07T04:34:02.826117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03078","last_updated":"2024-01-05T22:37:26Z","snapshot_observed_at":"2026-08-13T04:48:13.476468Z","submitted_at":"2024-01-05T22:37:26Z","title":"StreamVC: Real-Time Low-Latency Voice Conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03078","snapshot_observed_at":"2026-08-07T04:34:03.011417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:03.011417Z"},"links":{"cited_paper":"/paper/2401.03078","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:772db52f73f5a7da561ead73340d82278f1b754b9bc5fe23bd1c0a14f1139b5e","observation_id":"77105597-4fc4-4e3a-84f9-65c5fe85532d","resolution":{"observed_at":"2026-08-07T04:34:03.011417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:34:03.138006Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:03.138006Z"},"links":{"citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:e164341bd9469e0d2c4993be68ba00109ac697df91b07679d82db972cec066dd","observation_id":"811efc34-9781-41a3-bfb7-5715adac1d44","resolution":{"observed_at":"2026-08-07T04:34:03.138006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-14T16:51:22.656133Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-07T04:34:03.270755Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:34:03.270755Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2506.10289"},"observation_digest":"sha256:2d584ecac1d49f0b46f69bf811591ae8cef4e1d6ab16daf4d9dce443c79453f3","observation_id":"8aeaf1bc-ded5-45d9-9c23-78e8ce87597d","resolution":{"observed_at":"2026-08-07T04:34:03.270755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10289","last_updated":"2025-06-12T02:02:38Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T04:50:04.093165Z","submitted_at":"2025-06-12T02:02:38Z","title":"RT-VC: Real-Time Zero-Shot Voice Conversion with Speech Articulatory Coding"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2506.10289."}