{"as_of":"2026-08-09T15:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:906696b5c023ca6332c21b8a67e31ac3e4de14875ccc6c7d73ee7dec274d1c02","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:45.767421Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":24,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-06T23:21:30.071947Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18488","last_updated":"2025-06-28T05:44:41Z","snapshot_observed_at":"2026-08-09T14:28:00.448846Z","submitted_at":"2025-06-23T10:42:50Z","title":"AI-Generated Song Detection via Lyrics Transcripts","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:30.071947Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2506.18488"},"observation_digest":"sha256:ec7856f90e6b29f746f253ad700a7257f87227107e014c331de0116d75ad4706","observation_id":"3e270137-8315-4fb3-9ec5-c3805b530c73","resolution":{"observed_at":"2026-08-06T23:21:30.071947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-06T16:47:34.455589Z","title":"High- fidelity audio compression with improved RVQGAN,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12701","last_updated":"2025-07-17T00:32:07Z","snapshot_observed_at":"2026-08-08T13:02:50.918593Z","submitted_at":"2025-07-17T00:32:07Z","title":"Task-Specific Audio Coding for Machines: Machine-Learned Latent Features Are Codes for That Machine","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:47:34.455589Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2507.12701"},"observation_digest":"sha256:af6b61e25641c63acb0e898b0336dcacd1267c50fb011c81c2517426bb839b59","observation_id":"72e08b84-24df-4c1c-8c9d-fa09d208c4c9","resolution":{"observed_at":"2026-08-06T16:47:34.455589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-06T11:14:46.240127Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22995","last_updated":"2025-07-30T18:00:09Z","snapshot_observed_at":"2026-08-07T05:00:27.384082Z","submitted_at":"2025-07-30T18:00:09Z","title":"Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:14:46.240127Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2507.22995"},"observation_digest":"sha256:512e90c2ffbc1a29add7b5694015b06fb1f1a6add28d065e717745a50ff9d8b2","observation_id":"2798e571-ad33-4e5a-ada7-a1d5ba7f446d","resolution":{"observed_at":"2026-08-06T11:14:46.240127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T11:29:01.971972Z","title":"Kumar, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02771","last_updated":"2025-09-02T19:20:06Z","snapshot_observed_at":"2026-08-09T07:32:23.956379Z","submitted_at":"2025-09-02T19:20:06Z","title":"Analysis of Speaker Verification Performance Trade-offs with Neural Audio Codec Transmission","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:29:01.971972Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2509.02771"},"observation_digest":"sha256:f26fcc4c5c08f42eb526279550e6f9df63ca012803e97caa09f416f8ec595e44","observation_id":"0ea89150-798c-40b1-9ff6-63b4d87fc4ef","resolution":{"observed_at":"2026-08-05T11:29:01.971972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2512.01537","last_updated":"2026-05-18T17:15:31Z","snapshot_observed_at":"2026-07-06T22:37:26.652349Z","submitted_at":"2025-12-01T11:06:38Z","title":"Two-Dimensional Quantization for Geometry-Aware Audio Coding","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-21T18:16:51.486807Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2512.01537"},"observation_digest":"sha256:be71d3022f5049b56e5d5a12ac9a21a7f7d38a0306a3decdcb3b8c076321b472","observation_id":"bc504376-b5c5-4872-aca3-1de37ec2c946","resolution":{"observed_at":"2026-05-21T18:20:29.163714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-07-14T22:43:13.611383Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.11669","last_updated":"2026-06-08T07:16:00Z","snapshot_observed_at":"2026-08-02T13:38:52.812816Z","submitted_at":"2026-03-12T08:37:28Z","title":"SEMamba++: A General Speech Restoration Framework Leveraging Global, Local, and Periodic Spectral Patterns","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-14T22:43:13.611383Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2603.11669"},"observation_digest":"sha256:0302b10653c44ffc164ac578ff31419a42f4fec1844b75ee57c0dd05eb972fa8","observation_id":"c97c7d44-f0d5-45ca-8fd4-c117f5a372e6","resolution":{"observed_at":"2026-07-14T22:43:13.611383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2604.01929","last_updated":"2026-04-29T10:54:09Z","snapshot_observed_at":"2026-07-06T22:51:40.181565Z","submitted_at":"2026-04-02T11:49:00Z","title":"Woosh: A Sound Effects Foundation Model","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T20:51:08.144573Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2604.01929"},"observation_digest":"sha256:494fe13707e36cc5fd3b763905e9dd8447533cdeba10063756e437a481ae658e","observation_id":"8da1a194-4f45-40a8-91f2-6cc16c018a92","resolution":{"observed_at":"2026-05-13T20:53:15.792883Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2605.10281","last_updated":"2026-05-11T09:40:14Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T09:40:14Z","title":"Drum Synthesis from Expressive Drum Grids via Neural Audio Codecs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T03:13:47.971429Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2605.10281"},"observation_digest":"sha256:3e7d8fd0680e8fb60f191b29dd4b59ae20b9e279d76fd36fb3c37f53ceddb0a0","observation_id":"2e20c943-ac0c-42ee-bc6b-e527083ac1ff","resolution":{"observed_at":"2026-05-12T03:16:18.398296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2605.20519","last_updated":"2026-05-21T17:49:53Z","snapshot_observed_at":"2026-07-06T23:31:03.878152Z","submitted_at":"2026-05-19T21:39:52Z","title":"Codec-Robust Attacks on Audio LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T06:43:52.735211Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2605.20519"},"observation_digest":"sha256:fdab1b63bed24b4f954c68351de40cff6c888ab3edf3accfb0b7572dcbe61378","observation_id":"d476b8f2-8481-4bbe-8e4b-97e984948d92","resolution":{"observed_at":"2026-05-21T06:44:00.668460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2605.20519","last_updated":"2026-05-21T17:49:53Z","snapshot_observed_at":"2026-07-06T23:31:03.878152Z","submitted_at":"2026-05-19T21:39:52Z","title":"Codec-Robust Attacks on Audio LLMs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-25T05:44:46.831360Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2605.20519"},"observation_digest":"sha256:ba7e6dd42978834254f8c4fea1e40f1a73dcecf09022acf5e5f54f26c8be4d03","observation_id":"5f42bc6e-c314-4a57-9a10-33625285b2f3","resolution":{"observed_at":"2026-05-25T05:45:23.802002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2606.10046","last_updated":"2026-06-10T16:28:45Z","snapshot_observed_at":"2026-08-05T07:13:46.298081Z","submitted_at":"2026-06-08T18:18:28Z","title":"Inside the Latent Flow: Causal Deciphering of Attention Dynamics in Audio Separation Foundation Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T14:58:27.176375Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2606.10046"},"observation_digest":"sha256:fe1fb05d832b35620c808dbec6639703c58d41d576abc83ec9f63a421dbdcd91","observation_id":"672edff9-c431-48c5-a3ec-704f628101a4","resolution":{"observed_at":"2026-07-03T03:37:36.067248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:ea7b00940b64a17dbd756bc3f9ff03e96eb44722eaa38d34040aab62265db972","observation_id":"ad2efb5b-5feb-4db4-b3bc-8923f82e9f78","resolution":{"observed_at":"2026-06-30T22:15:05.521886Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2606.21372","last_updated":"2026-06-19T12:24:49Z","snapshot_observed_at":"2026-08-01T15:59:11.712537Z","submitted_at":"2026-06-19T12:24:49Z","title":"NAC: Neural Action Codec for Vision-Language-Action Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T13:59:53.484305Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2606.21372"},"observation_digest":"sha256:0d5245dd5a90cede3758c0c06371153447ff913de12204aac4e421d4a8c56244","observation_id":"c0923909-5374-4f44-94ef-df9eedf159f7","resolution":{"observed_at":"2026-07-04T06:59:37.904034Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":"2306.06546","doi":"10.48550/arxiv.2306.06546","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-fidelity audio compression with improved rvqgan","venue":"arXiv (Cornell University)","work_id":"377fbd72-7799-4b45-a519-e458481dbd13","year":2023},"citing_paper":{"arxiv_id":"2606.27627","last_updated":"2026-06-26T00:53:49Z","snapshot_observed_at":"2026-08-01T15:25:39.721188Z","submitted_at":"2026-06-26T00:53:49Z","title":"HybridCodec: Modeling Discrete and Continuous Representations for Efficient Speech Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T00:56:43.991936Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2606.27627"},"observation_digest":"sha256:666e1e1f272b52e73c4753bdb234e58159c08ab3c89f6109cf4d3510ad18db4d","observation_id":"5d2969a1-f330-4ccb-8171-eb5121f4d6cd","resolution":{"observed_at":"2026-06-29T01:02:56.247716Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-02T06:23:30.515762Z","title":"06546 [cs.SD].url: https://arxiv.org/abs/2306.06546","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14148","last_updated":"2026-07-14T13:05:53Z","snapshot_observed_at":"2026-08-07T05:42:24.503168Z","submitted_at":"2026-07-14T13:05:53Z","title":"ITGPT: A Transformer Based Architecture for the Generation of Dance Dance Revolution and In the Groove Charts","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T06:23:30.515762Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2607.14148"},"observation_digest":"sha256:bae096dcaf47c17794a2ebca0f44f1453fcba351bfe7a65fb311a5dadb834d93","observation_id":"b520bed0-bfc9-4c40-a6f7-2a2ee91cd0bf","resolution":{"observed_at":"2026-08-02T06:23:30.515762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-01T08:25:28.089701Z","title":"High- fidelity audio compression with improved RVQGAN,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21132","last_updated":"2026-07-23T10:12:36Z","snapshot_observed_at":"2026-08-06T20:43:47.837332Z","submitted_at":"2026-07-23T10:12:36Z","title":"Investigating Codec-Internal Latent Audio Watermarking for Neural Codec Robustness","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T08:25:28.089701Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2607.21132"},"observation_digest":"sha256:ca16bdd8372f7f8de57d750065282d115b4bb05fcda430eb15d7b6a17a308528","observation_id":"753f55db-093b-4210-a661-34c9eb1e7920","resolution":{"observed_at":"2026-08-01T08:25:28.089701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-07-30T10:35:00.630413Z","title":"High-fidelity audio compression with improved RVQGAN","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23855","last_updated":"2026-07-31T15:34:14Z","snapshot_observed_at":"2026-08-08T08:33:39.848789Z","submitted_at":"2026-07-26T21:51:28Z","title":"OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T10:35:00.630413Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2607.23855"},"observation_digest":"sha256:f98c4aef74c20595f5e358110bec0bd1b873a1337e2b113260771993e49e62a0","observation_id":"ffac6167-9e67-498e-ba85-c20864d82cf3","resolution":{"observed_at":"2026-07-30T10:35:00.630413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-03T01:50:59.050808Z","title":"High-fidelity audio compression with improved RVQGAN","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23855","last_updated":"2026-07-31T15:34:14Z","snapshot_observed_at":"2026-08-08T08:33:39.848789Z","submitted_at":"2026-07-26T21:51:28Z","title":"OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T01:50:59.050808Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2607.23855"},"observation_digest":"sha256:478e178975c967a09e64f55382019a404e348a0e39e09c352afc4a93637e445a","observation_id":"b693b372-f65d-4222-9903-f5161639ba97","resolution":{"observed_at":"2026-08-03T01:50:59.050808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-04T16:29:24.694740Z","title":"High-fidelity audio compression with improved rvqgan.arXiv preprint arXiv:2306.06546, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02023","last_updated":"2026-08-04T08:54:48Z","snapshot_observed_at":"2026-08-09T11:38:54.510697Z","submitted_at":"2026-08-03T10:20:52Z","title":"SwanTale: Unified Multi-Speaker Speech and Audio Generation for Instruct and Zero-Shot Tasks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T16:29:24.694740Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2608.02023"},"observation_digest":"sha256:6eafda0b9748b664915f56f6784da4242641f2d44172530f491150b4c525aace","observation_id":"6998a798-10b3-4f4b-b2bb-868dab788b76","resolution":{"observed_at":"2026-08-04T16:29:24.694740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-07T00:14:45.767421Z","title":"High-fidelity audio compression with improved rvqgan.arXiv preprint arXiv:2306.06546, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02023","last_updated":"2026-08-04T08:54:48Z","snapshot_observed_at":"2026-08-09T11:38:54.510697Z","submitted_at":"2026-08-03T10:20:52Z","title":"SwanTale: Unified Multi-Speaker Speech and Audio Generation for Instruct and Zero-Shot Tasks","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:14:45.767421Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2608.02023"},"observation_digest":"sha256:a38facc72bd2cd044332b4d286b8b781ad8107e01534cb65f2fe863237ac1450","observation_id":"59066311-494b-4bd7-b822-fd5f4f5b1025","resolution":{"observed_at":"2026-08-07T00:14:45.767421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-05T14:08:33.591322Z","title":"High-Fidelity Audio Compression with Improved RVQGAN,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03721","last_updated":"2026-08-04T14:19:59Z","snapshot_observed_at":"2026-08-08T11:14:07.482553Z","submitted_at":"2026-08-04T14:19:59Z","title":"On the Geometry of Music Bandwidth Extension in Latent Spaces of Audio Codecs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T14:08:33.591322Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2608.03721"},"observation_digest":"sha256:6946c8a4ad1112217322c27f74a68ae926849bfcc5405f2940d081b3754d54e8","observation_id":"613f7c29-7e12-4080-b576-24f4866498b2","resolution":{"observed_at":"2026-08-05T14:08:33.591322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.06546/citation-record","integrity":"/paper/2306.06546/integrity","json":"/paper/2306.06546/citation-record.json","paper":"/paper/2306.06546"},"outbound":[],"paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2306.06546."}