{"as_of":"2026-08-14T08:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ee4e75a83116c5b0b96bd5bf7ab17eac8be903873f9b81fe345d4a755772e10","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:12:09.662888Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T12:26:37.498741Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":"2109.13821","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion-based voice conversion with fast maximum likelihood sampling scheme","venue":null,"work_id":"b98a9957-671e-40c3-b314-a143f34ed660","year":2021},"citing_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T12:26:37.300599Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2406.02430"},"observation_digest":"sha256:4041930ee8d8f907741a600e36408b0452e0ff5f062990cd47667ea92901f47a","observation_id":"c7ee5465-f4e3-43ff-a7f0-10f80a53ac2a","resolution":{"observed_at":"2026-05-15T12:26:37.501347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-12T20:12:09.662888Z","title":"Diffusion-based voice conversion with fast maximum likelihood sampling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09943","last_updated":"2024-11-15T04:43:44Z","snapshot_observed_at":"2026-08-13T06:34:37.505459Z","submitted_at":"2024-11-15T04:43:44Z","title":"Zero-shot Voice Conversion with Diffusion Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:09.662888Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2411.09943"},"observation_digest":"sha256:e9a5e9d2b41223bb017d7ca2e170a1a63c7fa4b0f4ccda359d3a2fc43c80593b","observation_id":"abe0a4ea-5cc0-4129-a4a5-d4c0a310b386","resolution":{"observed_at":"2026-08-12T20:12:09.662888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-10T23:28:04.210795Z","title":"In Interspeech, volume 2016, 2453–2457","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.20359","last_updated":"2024-12-29T05:30:06Z","snapshot_observed_at":"2026-08-10T23:21:31.444039Z","submitted_at":"2024-12-29T05:30:06Z","title":"EmoReg: Directional Latent Vector Modeling for Emotional Intensity Regularization in Diffusion-based Voice Conversion","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T23:28:04.210795Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2412.20359"},"observation_digest":"sha256:ab75508db250c57057daca8e14ebc6357533950a83798e9c0c040b63ed43f977","observation_id":"dbdcfbb5-1d16-4517-8d61-f925e6c12d26","resolution":{"observed_at":"2026-08-10T23:28:04.210795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-10T21:21:12.112357Z","title":"Diffusion-based voice conversion with fast maximum likelihood sam- pling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-13T16:06:22.690792Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.112357Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:eed7b7c1adab62da1a1345a5addf8e016b88ad38d696854922a5ea9619bce604","observation_id":"57383cb9-df52-4d0a-abda-828db85abc72","resolution":{"observed_at":"2026-08-10T21:21:12.112357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-10T14:09:29.209538Z","title":"Diffusion-based voice conversion with fast maximum likelihood sampling scheme,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.15613","last_updated":"2025-01-26T17:43:32Z","snapshot_observed_at":"2026-08-12T19:50:04.751968Z","submitted_at":"2025-01-26T17:43:32Z","title":"Stepback: Enhanced Disentanglement for Voice Conversion via Multi-Task Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:09:29.209538Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2501.15613"},"observation_digest":"sha256:d36e9fb0b6fa449fea73e3dffe3c9779cfec7ed082a07e9599caeadfc9b2a150","observation_id":"a7708550-21c0-46a7-999f-be4b9a4bb678","resolution":{"observed_at":"2026-08-10T14:09:29.209538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-07T14:58:57.976936Z","title":"Preprint, arXiv:2109.13821","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16691","last_updated":"2025-05-23T05:07:17Z","snapshot_observed_at":"2026-08-13T05:00:06.234822Z","submitted_at":"2025-05-22T13:57:02Z","title":"EZ-VC: Easy Zero-shot Any-to-Any Voice Conversion","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:57.976936Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2505.16691"},"observation_digest":"sha256:8b7d0676b2c84f2e0b8867142173ff692b46851065de7ee049c0a37d5fe196fb","observation_id":"47aa4c1a-aabe-44ef-9e16-7d104fc9573b","resolution":{"observed_at":"2026-08-07T14:58:57.976936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-07T11:57:56.791796Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01014","last_updated":"2025-06-01T13:53:28Z","snapshot_observed_at":"2026-08-07T23:06:59.165463Z","submitted_at":"2025-06-01T13:53:28Z","title":"Rhythm Controllable and Efficient Zero-Shot Voice Conversion via Shortcut Flow Matching","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:57:56.791796Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2506.01014"},"observation_digest":"sha256:a34829ebf345c01a76bc4e9013b19240ba0d1a714ae9a8dc7540a65e085a46cd","observation_id":"0e065f7e-7662-4794-9666-584dcf6a3aff","resolution":{"observed_at":"2026-08-07T11:57:56.791796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-07T11:56:25.936184Z","title":"Diffusion-based voice conversion with fast maximum likelihood sampling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01032","last_updated":"2025-06-01T14:21:07Z","snapshot_observed_at":"2026-08-11T06:35:39.286516Z","submitted_at":"2025-06-01T14:21:07Z","title":"ReFlow-VC: Zero-shot Voice Conversion Based on Rectified Flow and Speaker Feature Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:25.936184Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2506.01032"},"observation_digest":"sha256:dc34e3a5af03f6e3d7d7df6adba4746c4e976bb1c0576502099966fa213dfd0a","observation_id":"e638bdbd-8655-4859-a950-a8396c317d62","resolution":{"observed_at":"2026-08-07T11:56:25.936184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-07T11:30:34.794851Z","title":"Diffusion-based voice conversion with fast maximum likelihood sam- pling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02366","last_updated":"2025-06-03T02:04:27Z","snapshot_observed_at":"2026-08-08T04:54:26.507468Z","submitted_at":"2025-06-03T02:04:27Z","title":"Approximate Borderline Sampling using Granular-Ball for Classification Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:30:34.794851Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2506.02366"},"observation_digest":"sha256:34d5f2161dca3cb4690554114540780c4547e37bb305557551b1a4ed8754ca36","observation_id":"bf6a37d3-8d93-4b24-8718-48335111518a","resolution":{"observed_at":"2026-08-07T11:30:34.794851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-07T11:28:39.352136Z","title":"Diffusion-based voice conversion with fast maximum likelihood sampling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02414","last_updated":"2025-06-03T04:00:53Z","snapshot_observed_at":"2026-08-13T16:01:19.704930Z","submitted_at":"2025-06-03T04:00:53Z","title":"StarVC: A Unified Auto-Regressive Framework for Joint Text and Speech Generation in Voice Conversion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:39.352136Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2506.02414"},"observation_digest":"sha256:d973cde9268d968ea0d36cd8593d7a424b1a96bbe503c878afcdaa1dc743d1c7","observation_id":"b8bb26c0-d798-4ad7-830a-f0d1443dacdc","resolution":{"observed_at":"2026-08-07T11:28:39.352136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-04T19:37:28.960970Z","title":"Diffusion-based voice conversion with fast maximum likelihood sam- pling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-13T08:04:46.636042Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:28.960970Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:e8de61f39d253ddf4d1fd753ea17de87588bb77c6449e2fb51f6e17f39edb170","observation_id":"53fff485-e278-4622-b773-7695c7021ff4","resolution":{"observed_at":"2026-08-04T19:37:28.960970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":"2109.13821","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion-based voice conversion with fast maximum likelihood sampling scheme","venue":null,"work_id":"b98a9957-671e-40c3-b314-a143f34ed660","year":2021},"citing_paper":{"arxiv_id":"2604.13229","last_updated":"2026-04-14T18:56:13Z","snapshot_observed_at":"2026-08-02T00:07:11.058562Z","submitted_at":"2026-04-14T18:56:13Z","title":"ProSDD: Learning Prosodic Representations for Speech Deepfake Detection against Expressive and Emotional Attacks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T13:31:12.802897Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2604.13229"},"observation_digest":"sha256:ff59c514736bea21df41c58b8317717723b6ad270af8ed0d8a3c127423a1d309","observation_id":"34b47704-6210-4aa4-804a-daf81940ccf7","resolution":{"observed_at":"2026-05-10T13:35:26.586414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":"2109.13821","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion-based voice conversion with fast maximum likelihood sampling scheme","venue":null,"work_id":"b98a9957-671e-40c3-b314-a143f34ed660","year":2021},"citing_paper":{"arxiv_id":"2605.09259","last_updated":"2026-05-10T02:08:07Z","snapshot_observed_at":"2026-08-11T13:05:15.374903Z","submitted_at":"2026-05-10T02:08:07Z","title":"Remix the Timbre: Diffusion-Based Style Transfer Across Polyphonic Stems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T04:58:26.634355Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2605.09259"},"observation_digest":"sha256:a5d3a6d587dc0e1cc9e6d64eb1e92758afd3f8c978682694c6adfd95ed6df765","observation_id":"96c9e229-312f-48f2-9802-64bb7c550a23","resolution":{"observed_at":"2026-05-12T05:46:27.986754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-07-14T14:47:58.592181Z","title":"Diffusion-based voice conversion with fast maximum likelihood sam- pling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09891","last_updated":"2026-07-10T18:29:24Z","snapshot_observed_at":"2026-08-07T18:22:58.421177Z","submitted_at":"2026-07-10T18:29:24Z","title":"What You Train Is What You Get: Gender Bias, Training Composition, and Post-Hoc Mitigation in Audio Deepfake Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-14T14:47:58.592181Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2607.09891"},"observation_digest":"sha256:fb774f75ef9ccab4666d078905d9b17037c5f463e45480d53d81c362de725fb3","observation_id":"e7b1ade3-0c46-4c20-95d6-f9752b32c64f","resolution":{"observed_at":"2026-07-14T14:47:58.592181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-08T11:50:21.166263Z","title":"arXiv preprint arXiv:2109.13821 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05507","last_updated":"2026-08-06T01:19:35Z","snapshot_observed_at":"2026-08-12T15:35:38.693448Z","submitted_at":"2026-08-06T01:19:35Z","title":"AffectDF: The Most Comprehensive Benchmark for Speech Deepfake Detection against Emotionally Expressive Attacks","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-08T11:50:21.166263Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2608.05507"},"observation_digest":"sha256:9dcfdc937621d354391140b26288ccbf0af965bab9f72ea8b705eb970d21b740","observation_id":"07650bfa-c611-42d6-88ef-957cae3bd642","resolution":{"observed_at":"2026-08-08T11:50:21.166263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2109.13821/citation-record","integrity":"/paper/2109.13821/integrity","json":"/paper/2109.13821/citation-record.json","paper":"/paper/2109.13821"},"outbound":[],"paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2109.13821."}