{"as_of":"2026-08-09T11:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f08fa9a6aecacf32837aa181f030c4ea6c04f28343ae0e4b2544857ac74721fd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":42,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:37:03.726917Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":19,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2406.14294","last_updated":"2026-04-21T15:27:17Z","snapshot_observed_at":"2026-07-30T17:14:02.349402Z","submitted_at":"2024-06-20T13:23:27Z","title":"DASB - Discrete Audio and Speech Benchmark","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-24T00:26:57.419537Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2406.14294"},"observation_digest":"sha256:af82e8b5dbaa29e41d87db3362b6dfe6e9f161c10a275296dea8902d1fc9decd","observation_id":"2db04592-9e87-449a-86a0-452f6c8ee9a9","resolution":{"observed_at":"2026-05-24T00:28:39.528794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-01T23:52:25.071174Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"reference_index":151,"source":"arxiv_source","source_observed_at":"2026-05-16T06:06:41.348728Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2410.06885"},"observation_digest":"sha256:7b1757dd0c375779badfc9928d991fa90fcee23ed1204933474f0ea570b4249f","observation_id":"e7ecd608-8cac-4b36-a2c6-bce8f1986ff7","resolution":{"observed_at":"2026-05-16T06:06:41.558268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-09T10:37:03.726917Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02942","last_updated":"2025-02-05T07:14:39Z","snapshot_observed_at":"2026-08-09T10:28:59.080733Z","submitted_at":"2025-02-05T07:14:39Z","title":"GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T10:37:03.726917Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2502.02942"},"observation_digest":"sha256:b69931db966b87d8a688fabafff38bfb0bb9dd0bbdf8dbcda910313d7859b24b","observation_id":"1322981d-a653-44ed-a58f-ded95262096f","resolution":{"observed_at":"2026-08-09T10:37:03.726917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-08T15:04:29.618212Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06604","last_updated":"2025-05-16T03:43:21Z","snapshot_observed_at":"2026-08-08T23:02:01.951277Z","submitted_at":"2025-02-10T16:01:55Z","title":"Do we really have to filter out random noise in pre-training data for language models?","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T15:04:29.618212Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2502.06604"},"observation_digest":"sha256:1791a3beb8126d023be70d941c915ec3372f44fa2a8d3f6f96296f3bb4e4b1af","observation_id":"8d564f31-603c-406e-b171-5f5efd47bbc6","resolution":{"observed_at":"2026-08-08T15:04:29.618212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T15:36:44.119792Z","title":"Hifi- codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14470","last_updated":"2025-06-04T08:23:18Z","snapshot_observed_at":"2026-08-07T18:35:24.185731Z","submitted_at":"2025-05-20T15:05:14Z","title":"PAST: Phonetic-Acoustic Speech Tokenizer","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:36:44.119792Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.14470"},"observation_digest":"sha256:e4aab43ff2b3855d8e4ded538dc2fe5b79350e647a1751de6863f63bfdb4c38b","observation_id":"ae2a569d-ba4b-42a9-a956-bcf254094187","resolution":{"observed_at":"2026-08-07T15:36:44.119792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T15:30:36.404353Z","title":"Hifi- codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-09T11:37:19.523370Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.404353Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:d721c01c8a8f8781de8e05178151fb7393de53a20b8830277ccc1f7f163a1fd1","observation_id":"253a6c96-6aff-4fbb-b24d-1f91f865a911","resolution":{"observed_at":"2026-08-07T15:30:36.404353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T14:53:17.856062Z","title":"Hiﬁ-codec: Group-residual vector quantization for high ﬁd elity audio codec","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17426","last_updated":"2025-05-23T03:13:46Z","snapshot_observed_at":"2026-08-08T01:56:34.167573Z","submitted_at":"2025-05-23T03:13:46Z","title":"UniTTS: An end-to-end TTS system without decoupling of acoustic and semantic information","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.856062Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.17426"},"observation_digest":"sha256:16fb5aea940144715649c6e6acd41ce652c9581e2cfa268543696a928cc5dad2","observation_id":"c17515ea-574e-4cd3-9cdd-f3aa64e2267c","resolution":{"observed_at":"2026-08-07T14:53:17.856062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T12:50:34.712516Z","title":"HiFi- Codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23379","last_updated":"2025-05-29T12:00:00Z","snapshot_observed_at":"2026-08-07T12:44:34.894201Z","submitted_at":"2025-05-29T12:00:00Z","title":"Vision-Integrated High-Quality Neural Speech Coding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:34.712516Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.23379"},"observation_digest":"sha256:89e6da3107d64c6de92e5fae54f5d6aa2bc6f4ffc5b15bc4131d0aa3bc8541a7","observation_id":"cb3a9791-83df-42c5-b990-e4fc8f7d12cd","resolution":{"observed_at":"2026-08-07T12:50:34.712516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T12:31:36.315885Z","title":"Hifi- codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24248","last_updated":"2025-05-30T06:12:52Z","snapshot_observed_at":"2026-08-08T04:48:33.525066Z","submitted_at":"2025-05-30T06:12:52Z","title":"Probing the Robustness Properties of Neural Speech Codecs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:31:36.315885Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.24248"},"observation_digest":"sha256:820898d3ebd1ee3e2835aa732455858572de32e40a88c683c409e429f43abd46","observation_id":"314333f8-cf24-4d99-ab6f-6c3aa6839524","resolution":{"observed_at":"2026-08-07T12:31:36.315885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T12:29:40.551229Z","title":"Hifi- codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24314","last_updated":"2025-05-30T07:53:01Z","snapshot_observed_at":"2026-08-07T16:55:51.904027Z","submitted_at":"2025-05-30T07:53:01Z","title":"DS-Codec: Dual-Stage Training with Mirror-to-NonMirror Architecture Switching for Speech Codec","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:29:40.551229Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.24314"},"observation_digest":"sha256:5197cee34a047e83a7419c47afb6568dc1301bc6ffcb57f683d21832f53a65cf","observation_id":"25530ef0-39a0-44ea-99d3-c96a65232ecd","resolution":{"observed_at":"2026-08-07T12:29:40.551229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2505.24437","last_updated":"2026-05-07T16:01:45Z","snapshot_observed_at":"2026-08-01T04:07:46.006657Z","submitted_at":"2025-05-30T10:20:04Z","title":"SwitchCodec: A High-Fidelity Nerual Audio Codec With Sparse Quantization","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T13:10:14.839742Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.24437"},"observation_digest":"sha256:8c44cf378da76672161fe0fcb71e5e04e70617dd8aaddd0c0110bd2bc98ee43e","observation_id":"7f80eabb-77c8-4a24-900b-cfcde254fa56","resolution":{"observed_at":"2026-05-19T13:12:18.263887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T12:27:30.136628Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24496","last_updated":"2025-05-30T11:47:29Z","snapshot_observed_at":"2026-08-07T23:08:47.920163Z","submitted_at":"2025-05-30T11:47:29Z","title":"Speech Token Prediction via Compressed-to-fine Language Modeling for Speech Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:27:30.136628Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.24496"},"observation_digest":"sha256:fe5d552421856c338b17ac9472fd2a54d146342bf263a175005415e38a8905e6","observation_id":"05bcfd94-028f-404c-86a9-ce88db9cb736","resolution":{"observed_at":"2026-08-07T12:27:30.136628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-06T21:23:52.752336Z","title":"Hifi- codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00324","last_updated":"2025-06-30T23:41:04Z","snapshot_observed_at":"2026-08-08T08:56:54.182248Z","submitted_at":"2025-06-30T23:41:04Z","title":"Collecting, Curating, and Annotating Good Quality Speech deepfake dataset for Famous Figures: Process and Challenges","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:23:52.752336Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2507.00324"},"observation_digest":"sha256:d9c5b748ac5d2c63b515df64f0c9c59034a087bfa56158a5315c81d07dbaae1c","observation_id":"416732da-24e4-4e09-9e70-d2114e6776df","resolution":{"observed_at":"2026-08-06T21:23:52.752336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-06T16:41:22.610257Z","title":"HiFi-Codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12825","last_updated":"2025-07-17T06:32:22Z","snapshot_observed_at":"2026-08-08T08:29:15.041400Z","submitted_at":"2025-07-17T06:32:22Z","title":"Autoregressive Speech Enhancement via Acoustic Tokens","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:41:22.610257Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2507.12825"},"observation_digest":"sha256:e08f18c32c360e923aab9ea4630bc859acc7f964ee903aa99c2917fd5e76be26","observation_id":"c46c1d72-99e2-425d-b195-235d3ac823e7","resolution":{"observed_at":"2026-08-06T16:41:22.610257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-06T15:33:40.225699Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec.arXiv preprint arXiv:2305.02765, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15597","last_updated":"2025-07-21T13:19:09Z","snapshot_observed_at":"2026-08-06T15:25:42.125132Z","submitted_at":"2025-07-21T13:19:09Z","title":"Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:33:40.225699Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2507.15597"},"observation_digest":"sha256:a028f756633c34ca49e84c1aebec91e6f58b798958f5c9f041fe15fbe8eb16ba","observation_id":"acbb01f9-ab9e-405a-9aaf-dc55f47d8d26","resolution":{"observed_at":"2026-08-06T15:33:40.225699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T19:54:58.565677Z","title":"Hifi- codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.11598","last_updated":"2025-08-15T17:06:04Z","snapshot_observed_at":"2026-08-07T23:10:02.754274Z","submitted_at":"2025-08-15T17:06:04Z","title":"Representing Speech Through Autoregressive Prediction of Cochlear Tokens","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T19:54:58.565677Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2508.11598"},"observation_digest":"sha256:9c5fdd0ecbde68e70ee1a3899819a48a9b0d5263adf5f68944bd68d72917173d","observation_id":"f225f353-cfd7-4e63-b6bc-70213e002bb5","resolution":{"observed_at":"2026-08-05T19:54:58.565677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T15:58:54.074017Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19180","last_updated":"2025-08-26T16:33:54Z","snapshot_observed_at":"2026-08-09T05:42:23.207555Z","submitted_at":"2025-08-26T16:33:54Z","title":"MDD: a Mask Diffusion Detector to Protect Speaker Verification Systems from Adversarial Perturbations","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T15:58:54.074017Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2508.19180"},"observation_digest":"sha256:21c635f94e0a78da81079576fae1f125c718c1815d48757dfdc669cab53fe52b","observation_id":"06b61e99-6fde-4deb-a33f-daeb94aad832","resolution":{"observed_at":"2026-08-05T15:58:54.074017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T12:38:50.189716Z","title":"HiFi-Codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01390","last_updated":"2025-09-01T11:36:33Z","snapshot_observed_at":"2026-08-09T07:26:19.244733Z","submitted_at":"2025-09-01T11:36:33Z","title":"Analysing the Language of Neural Audio Codecs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T12:38:50.189716Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2509.01390"},"observation_digest":"sha256:d935ea7de6ad856e67a636d14d9f645fb23b2fee7df7b6448615bd2f9a80303b","observation_id":"83bbd839-6360-4737-9f50-a666710a8e05","resolution":{"observed_at":"2026-08-05T12:38:50.189716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T11:41:03.195908Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.195908Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:31260a275961dd627d1bd8e3d13e08b99720e7c25f3af5cc9e1bf8709261c08f","observation_id":"9e4cf411-10da-45fd-ad7f-82ba079270fc","resolution":{"observed_at":"2026-08-05T11:41:03.195908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-04T19:37:52.501429Z","title":"Hifi- codec: Group-residual vector quantization for high fi- delity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09201","last_updated":"2025-09-11T07:14:18Z","snapshot_observed_at":"2026-08-08T05:22:34.464459Z","submitted_at":"2025-09-11T07:14:18Z","title":"DeCodec: Rethinking Audio Codecs as Universal Disentangled Representation Learners","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:52.501429Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2509.09201"},"observation_digest":"sha256:dbf7a63b4b74f855c2ef1457ae66acb1c1b00e658d4c7a7a3a32d997a1f8afb4","observation_id":"eccc40f4-61df-481b-af0b-307de4dfe04a","resolution":{"observed_at":"2026-08-04T19:37:52.501429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2512.01537","last_updated":"2026-05-18T17:15:31Z","snapshot_observed_at":"2026-07-06T22:37:26.652349Z","submitted_at":"2025-12-01T11:06:38Z","title":"Two-Dimensional Quantization for Geometry-Aware Audio Coding","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-21T18:16:51.486807Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2512.01537"},"observation_digest":"sha256:c2c70e2e32c015e97d9b912ea9dd186da46624b4287fcd860a7d697ca0cd49ca","observation_id":"81a5ce7d-c10b-49f3-9b0e-09a86d317a0e","resolution":{"observed_at":"2026-05-21T18:20:29.324852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-02T22:52:22.957365Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.15491","last_updated":"2026-07-27T12:16:11Z","snapshot_observed_at":"2026-08-06T19:31:08.163240Z","submitted_at":"2026-02-17T10:59:33Z","title":"The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T22:52:22.957365Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2602.15491"},"observation_digest":"sha256:29e4d6ddc615ef9b9343c29a6981a4a2e4f4d542980b823cf0351e8610fdc27a","observation_id":"8765431d-586e-40ac-ba53-632d9fa2ae65","resolution":{"observed_at":"2026-08-02T22:52:22.957365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2604.12383","last_updated":"2026-05-25T07:44:26Z","snapshot_observed_at":"2026-08-02T09:36:59.041269Z","submitted_at":"2026-04-14T07:17:55Z","title":"On the Distillation Loss Functions of Speech VAE for Unified Reconstruction, Understanding, and Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T15:30:58.664375Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2604.12383"},"observation_digest":"sha256:d78901ae811f1be018f5daadc92fb8bf3686443aeb5f6272260431edea0b5a86","observation_id":"13722c82-0799-4806-a3a0-cbcc3866a4ab","resolution":{"observed_at":"2026-05-11T10:25:59.517768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2604.23522","last_updated":"2026-04-26T03:59:35Z","snapshot_observed_at":"2026-07-06T23:09:43.659053Z","submitted_at":"2026-04-26T03:59:35Z","title":"Beyond Static Collision Handling: Adaptive Semantic ID Learning for Multimodal Recommendation at Industrial Scale","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T05:41:17.427618Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2604.23522"},"observation_digest":"sha256:3fd941f7c459316208ed4f7fd17488b37a25b77eaa84e42cef9d2045a51e547a","observation_id":"306e6cdf-ba9c-42ec-bb99-acc2fcc58841","resolution":{"observed_at":"2026-05-08T23:39:24.351337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2604.26296","last_updated":"2026-04-29T04:51:14Z","snapshot_observed_at":"2026-07-06T23:11:57.238808Z","submitted_at":"2026-04-29T04:51:14Z","title":"SPG-Codec: Exploring the Role and Boundaries of Semantic Priors in Ultra-Low-Bitrate Neural Speech Coding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T12:44:08.364835Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2604.26296"},"observation_digest":"sha256:c667a3dbd9863f29e7c8432401dee3bf8fc2dec41627365769d3b547677705a4","observation_id":"7662c559-d436-46f3-9ae2-6c42e0f6c8c7","resolution":{"observed_at":"2026-05-12T09:11:25.429100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2605.06582","last_updated":"2026-06-21T09:09:33Z","snapshot_observed_at":"2026-07-06T23:19:00.794334Z","submitted_at":"2026-05-07T17:11:22Z","title":"PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-08T12:25:52.847432Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2605.06582"},"observation_digest":"sha256:b3d2cb350244038c70211adeec6399b79e54f792fbf944356b2ee91e5a1c2233","observation_id":"548a9c9b-923b-4f31-83a7-bbd54a3fb979","resolution":{"observed_at":"2026-05-11T19:16:08.827723Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2605.06582","last_updated":"2026-06-21T09:09:33Z","snapshot_observed_at":"2026-07-06T23:19:00.794334Z","submitted_at":"2026-05-07T17:11:22Z","title":"PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-30T23:14:32.494076Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2605.06582"},"observation_digest":"sha256:a7b934f9915d43dfa769f9a4f9b7314a5cc9d58309df891a7c5e5d9493b82c68","observation_id":"55b89657-e9ed-471e-98c0-a7d228024d93","resolution":{"observed_at":"2026-06-30T23:15:07.755327Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2605.11098","last_updated":"2026-05-11T18:04:33Z","snapshot_observed_at":"2026-07-06T23:22:57.012338Z","submitted_at":"2026-05-11T18:04:33Z","title":"AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-13T01:04:54.506749Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2605.11098"},"observation_digest":"sha256:74c56cf13865e929c384946406606bc54427865db9c2eb3e101c0e98fa399464","observation_id":"07ed2eae-dc0b-438d-af05-df6a276367da","resolution":{"observed_at":"2026-05-13T01:07:00.268282Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2605.19541","last_updated":"2026-07-24T12:58:15Z","snapshot_observed_at":"2026-08-02T13:42:34.100602Z","submitted_at":"2026-05-19T08:40:12Z","title":"Optimising Neural Speech Codecs for 300bps Communication using Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T02:07:50.016394Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2605.19541"},"observation_digest":"sha256:616bf76e55a0c66725aa3423506456a12ed86959873f60bf91be67679b647aed","observation_id":"e00e85cb-1fc9-47d9-9ffb-178713e42b61","resolution":{"observed_at":"2026-05-20T02:07:58.601955Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-02T13:42:35.682547Z","title":"HiFi- Codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.19541","last_updated":"2026-07-24T12:58:15Z","snapshot_observed_at":"2026-08-02T13:42:34.100602Z","submitted_at":"2026-05-19T08:40:12Z","title":"Optimising Neural Speech Codecs for 300bps Communication using Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T13:42:35.682547Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2605.19541"},"observation_digest":"sha256:f5b0075ab98925d681738fceb471217b7fdee1c3a7f181b7a766d6bd692f5c03","observation_id":"32f8e5fd-7e83-4c60-a83b-fcd812423b6d","resolution":{"observed_at":"2026-08-02T13:42:35.682547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2605.23373","last_updated":"2026-05-22T08:37:38Z","snapshot_observed_at":"2026-08-07T23:46:27.207050Z","submitted_at":"2026-05-22T08:37:38Z","title":"AffectCodec: Emotion-Preserving Neural Speech Codec with Block-Diagonal Residual FSQ","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-25T03:04:01.544231Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2605.23373"},"observation_digest":"sha256:8bcc07face538a43d6a4e63bd0ec3897d151551f39ebf8a8454fa7def8e5ecbc","observation_id":"66bb1792-8c77-4365-bc42-ac9dbf53472a","resolution":{"observed_at":"2026-05-25T03:05:16.739256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2605.31521","last_updated":"2026-05-29T16:36:21Z","snapshot_observed_at":"2026-08-07T15:12:30.458872Z","submitted_at":"2026-05-29T16:36:21Z","title":"UniAudio-Token: Empowering Semantic Speech Tokenizers with General Audio Perception","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T22:26:20.100595Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2605.31521"},"observation_digest":"sha256:3fdc94287b3c1f70684af3c75cb19fd659e3d0f9a8a4c26a1f1157580842e9b7","observation_id":"cb4ffe68-c56e-4813-9e8f-8f240219b418","resolution":{"observed_at":"2026-06-28T22:32:44.571649Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2606.10591","last_updated":"2026-06-09T08:55:47Z","snapshot_observed_at":"2026-08-06T05:44:02.287372Z","submitted_at":"2026-06-09T08:55:47Z","title":"ContextCodec: Content-Focused Context Guidance for Ultra-Low Bitrate Speech Coding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T11:51:25.305324Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2606.10591"},"observation_digest":"sha256:3ca2fd6e4058bfe9a72d86bf373d9babdba6647befbbfe94265bc881a45ac32e","observation_id":"547f23bc-24b8-4173-acaf-1a4af0ad7839","resolution":{"observed_at":"2026-07-03T07:47:44.553305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2606.11631","last_updated":"2026-06-10T03:49:54Z","snapshot_observed_at":"2026-08-02T17:57:49.398213Z","submitted_at":"2026-06-10T03:49:54Z","title":"Benchmarking Neural Speech Compression from a Rate-Distortion Perspective","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T08:43:35.279033Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2606.11631"},"observation_digest":"sha256:9b3f320080aa9d7165bbdc29249936054ff91b58f9268428706ef6ff0aa7ffb0","observation_id":"ca0eba20-563a-4f04-a5ee-e13b8ed8c59f","resolution":{"observed_at":"2026-07-03T12:48:12.256905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2606.12940","last_updated":"2026-06-11T06:06:02Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T06:06:02Z","title":"Self-Guidance: Enhancing Neural Codecs via Decoder Manifold Alignment","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-27T06:05:26.735340Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2606.12940"},"observation_digest":"sha256:904fe9c28a73fa9eac28ebea634d7a4ba7bff4e15b1d168ef2f8c75ccba64bcb","observation_id":"2f821992-797c-421f-825a-db2758e53f04","resolution":{"observed_at":"2026-07-03T16:08:37.514482Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2606.12940","last_updated":"2026-06-11T06:06:02Z","snapshot_observed_at":"2026-07-06T23:51:45.306189Z","submitted_at":"2026-06-11T06:06:02Z","title":"Self-Guidance: Enhancing Neural Codecs via Decoder Manifold Alignment","version":1},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-06-27T06:05:26.735340Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2606.12940"},"observation_digest":"sha256:145ffa65c78baa69af6722ee052deeee58226f34e318c2208c58008401d5b341","observation_id":"a64f6781-5bea-4433-95d9-0482ae2e5f24","resolution":{"observed_at":"2026-06-28T16:02:22.518914Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2606.31247","last_updated":"2026-06-30T07:24:10Z","snapshot_observed_at":"2026-07-07T00:04:58.486133Z","submitted_at":"2026-06-30T07:24:10Z","title":"FlexiSLM: A Dynamic and Controllable Frame Rate Spoken Language Model","version":1},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-07-01T03:50:26.873406Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2606.31247"},"observation_digest":"sha256:2c0339ee68903841cb21b007a0ead58bd38c0c0ab91dbc15bef51833aeaf82c1","observation_id":"781fbedf-bd44-4908-bfd8-3ad9a33c9f75","resolution":{"observed_at":"2026-07-01T11:55:42.208918Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2607.00899","last_updated":"2026-07-01T13:02:29Z","snapshot_observed_at":"2026-08-08T06:51:12.366279Z","submitted_at":"2026-07-01T13:02:29Z","title":"Positive-Incentive Noise Predictor for Adversarial Purification in Speaker Verification","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-02T05:12:44.574336Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2607.00899"},"observation_digest":"sha256:efe25d57503e2aa4df597e1f27b5bf37e933597ca675ea7edbec4ea7c284a241","observation_id":"bef5c968-b30d-4668-9998-c1451e4820ea","resolution":{"observed_at":"2026-07-02T05:16:38.675904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":"2305.02765","doi":"10.48550/arxiv.2305.02765","metadata_source":"pith","pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hifi-codec: Group-residual vector quantization for high fidelity audio codec","venue":"cs.SD","work_id":"b1993988-663c-4e53-a60e-4a29006bc48a","year":2023},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-08-08T14:15:13.834590Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":1},"reference_index":245,"source":"arxiv_source","source_observed_at":"2026-07-07T23:59:38.702609Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:d0a30993c895aabd765d8a2605d56069a264bf37b55bb385276b7b76e1229556","observation_id":"c29c4570-5299-4921-8488-10667aa4eef9","resolution":{"observed_at":"2026-07-08T00:04:22.350821Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-07-11T07:46:49.059192Z","title":"arXiv preprint arXiv:2305.02765 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-08-08T14:15:13.834590Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":2},"reference_index":245,"source":"arxiv_source","source_observed_at":"2026-07-11T07:46:49.059192Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:1b142f73ccd0156fbb6bb933609c0599a90d658e5be2b5c8de6dbe5dd802da6a","observation_id":"9b6c5251-c268-46da-86cc-432ca6c6da52","resolution":{"observed_at":"2026-07-11T07:46:49.059192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-07-13T05:10:26.667731Z","title":"arXiv preprint arXiv:2305.02765 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09134","last_updated":"2026-07-10T06:44:04Z","snapshot_observed_at":"2026-08-07T15:40:45.553118Z","submitted_at":"2026-07-10T06:44:04Z","title":"ReGen: Hierarchical Multi-Prompt Representation Generation for Efficient Waveform Diffusion Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-13T05:10:26.667731Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2607.09134"},"observation_digest":"sha256:122f47e924a627ec8e0263a0a2f21f96e32c0b5a8aa164d8a439d24e57a03af2","observation_id":"f7debbb3-ad19-48b2-9569-06106a7b6899","resolution":{"observed_at":"2026-07-13T05:10:26.667731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-01T08:25:27.374503Z","title":"HiFi-Codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21132","last_updated":"2026-07-23T10:12:36Z","snapshot_observed_at":"2026-08-06T20:43:47.837332Z","submitted_at":"2026-07-23T10:12:36Z","title":"Investigating Codec-Internal Latent Audio Watermarking for Neural Codec Robustness","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T08:25:27.374503Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2607.21132"},"observation_digest":"sha256:20c8d872b33ee9209b016000cd7f056c5331858557bc6c0666728dc07fe623f2","observation_id":"ab5e6bd2-fdfb-4d2d-8562-9a301254364b","resolution":{"observed_at":"2026-08-01T08:25:27.374503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.02765/citation-record","integrity":"/paper/2305.02765/integrity","json":"/paper/2305.02765/citation-record.json","paper":"/paper/2305.02765"},"outbound":[],"paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 42 inbound Pith citation observations for arXiv:2305.02765."}