{"as_of":"2026-08-10T19:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0aebc827c617f80d2826e60484dbe53cec98d21e6d3987e668151975a5b42275","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:12:30.315990Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T08:18:42.002083Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T05:16:39.815988Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"cited_work":{"arxiv_id":"2506.00385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00385","snapshot_observed_at":"2026-07-02T05:16:39.815988Z","title":"Magicodec: Simple masked gaussian- injected codec for high-fidelity reconstruction and genera- tion","venue":null,"work_id":"7df8946f-a15e-4e65-8ea9-714ad2c0b1f9","year":2025},"citing_paper":{"arxiv_id":"2604.10927","last_updated":"2026-04-13T02:54:07Z","snapshot_observed_at":"2026-07-06T22:59:27.499664Z","submitted_at":"2026-04-13T02:54:07Z","title":"LiveGesture Streamable Co-Speech Gesture Generation Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T16:46:58.944000Z"},"links":{"cited_paper":"/paper/2506.00385","citing_paper":"/paper/2604.10927"},"observation_digest":"sha256:80c51033d79863ff42a12898d71cf22fe911b4f3b594bf04807daf11f1f7c167","observation_id":"bf779313-c62f-41c8-bb1b-57726e12cd4a","resolution":{"observed_at":"2026-05-11T08:11:03.425181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"cited_work":{"arxiv_id":"2506.00385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00385","snapshot_observed_at":"2026-07-02T05:16:39.815988Z","title":"Magicodec: Simple masked gaussian- injected codec for high-fidelity reconstruction and genera- tion","venue":null,"work_id":"7df8946f-a15e-4e65-8ea9-714ad2c0b1f9","year":2025},"citing_paper":{"arxiv_id":"2606.03455","last_updated":"2026-06-02T10:33:20Z","snapshot_observed_at":"2026-08-05T18:48:21.902772Z","submitted_at":"2026-06-02T10:33:20Z","title":"WavTTS: Towards High-Quality Zero-Shot TTS via Direct Raw Waveform Modeling","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T08:18:42.002083Z"},"links":{"cited_paper":"/paper/2506.00385","citing_paper":"/paper/2606.03455"},"observation_digest":"sha256:40957110580b82e2b6869ffccc4de2a21d49e42600b6a4da30ecaf04f8245423","observation_id":"ee1ef2a2-d58c-46b0-a5ef-149e2bfa0a28","resolution":{"observed_at":"2026-07-02T05:16:39.817490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00385/citation-record","integrity":"/paper/2506.00385/integrity","json":"/paper/2506.00385/citation-record.json","paper":"/paper/2506.00385"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:12:27.781053Z","title":"GPT-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:27.781053Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:8dfa4a6a8657c21a0cae5739e0db2fd936e6d9896e481d40f8a1f894fbfba328","observation_id":"527b27d6-9413-4c9b-8fb7-05bf9c1d6b8b","resolution":{"observed_at":"2026-08-07T12:12:27.781053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-07T12:12:27.993064Z","title":"Estimating or propagating gradients through stochastic neurons for conditional computation.arXiv preprint arXiv:1308.3432,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:27.993064Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:9306cbfc0e6d20d4a9eb65d9b76b8ba2790cd4d108b93964cc01b9c587f2a34a","observation_id":"977f1e1f-74e7-4d3f-96b2-f5b9ae50ee2d","resolution":{"observed_at":"2026-08-07T12:12:27.993064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-09T07:12:13.721596Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-07T12:12:28.248636Z","title":"High fidelity neural audio compression.arXiv preprint arXiv:2210.13438,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:28.248636Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:bc818b7d5849d4ee0fe23c4171d5e6f176624768c9ae0c668da6637b1af04541","observation_id":"ce6e7cfd-e0c8-47c8-a9a4-4bf8ee8b58d2","resolution":{"observed_at":"2026-08-07T12:12:28.248636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-07T12:12:28.369650Z","title":"Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:28.369650Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:47e553ae755a3362877ab45cff09b04e8b65418f239dd56e73d6f43a5daee7b7","observation_id":"60e77fdc-8b22-4d5f-a6bb-3e047cdc3897","resolution":{"observed_at":"2026-08-07T12:12:28.369650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-10T17:02:50.054809Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T12:12:28.853649Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:28.853649Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:b737f75369cd5a6e767af656f3dda3220985ab5f7f5e9df045d3b2a9ec919b01","observation_id":"f635e158-363b-40b7-ba74-a3dd0bfadb2e","resolution":{"observed_at":"2026-08-07T12:12:28.853649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-07T12:12:29.194153Z","title":"Nasim Rahaman, Aristide Baratin, Devansh Arpit, Felix Draxler, Min Lin, Fred Hamprecht, Yoshua Bengio, and Aaron Courville","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.194153Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:582251de80e8bd6806e170b566c9504b96bda0249b53f4102b0e1cdac058bf2e","observation_id":"0e18c3fc-2abf-449a-b237-3e7684be45e7","resolution":{"observed_at":"2026-08-07T12:12:29.194153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00814","last_updated":"2024-05-29T14:21:47Z","snapshot_observed_at":"2026-08-08T02:04:12.090464Z","submitted_at":"2023-06-01T15:40:32Z","title":"Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00814","snapshot_observed_at":"2026-08-07T12:12:29.406719Z","title":"V ocos: Closing the gap between time-domain and fourier-based neural vocoders for high-quality audio synthesis.arXiv preprint arXiv:2306.00814,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.406719Z"},"links":{"cited_paper":"/paper/2306.00814","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:8527ace41e4919c77c8f9e8955ae536c5c0a6a475edf7a9a9afb8e6b4335a1ef","observation_id":"eeacbfb5-38ea-4628-8ef8-d397f3701c09","resolution":{"observed_at":"2026-08-07T12:12:29.406719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14411","last_updated":"2024-10-18T12:24:05Z","snapshot_observed_at":"2026-08-10T14:03:18.097569Z","submitted_at":"2024-10-18T12:24:05Z","title":"SNAC: Multi-Scale Neural Audio Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14411","snapshot_observed_at":"2026-08-07T12:12:29.506757Z","title":"SNAC: Multi-scale neural audio codec","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.506757Z"},"links":{"cited_paper":"/paper/2410.14411","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:e1ba7d5031ce152a4add1753d5da5806d2ab2d133f4b82f574e32dc7c0dc2716","observation_id":"0a7f13f1-42ee-49db-9ea2-d1c9513ca34d","resolution":{"observed_at":"2026-08-07T12:12:29.506757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14831","last_updated":"2025-06-06T23:43:53Z","snapshot_observed_at":"2026-08-07T18:01:04.557872Z","submitted_at":"2025-02-20T18:45:44Z","title":"Improving the Diffusability of Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14831","snapshot_observed_at":"2026-08-07T12:12:29.605020Z","title":"Improving the diffusability of autoencoders.arXiv preprint arXiv:2502.14831,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.605020Z"},"links":{"cited_paper":"/paper/2502.14831","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:eb716a006c271f8d259e0c0a6fa92881a9b7ba6f4425e4417ba5a75abc5a27a6","observation_id":"3bf83466-eda5-45b0-abdb-d01e1f6712ec","resolution":{"observed_at":"2026-08-07T12:12:29.605020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05377","last_updated":"2024-09-09T07:18:07Z","snapshot_observed_at":"2026-08-03T20:35:31.539481Z","submitted_at":"2024-09-09T07:18:07Z","title":"BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05377","snapshot_observed_at":"2026-08-07T12:12:29.869064Z","title":"BigCodec: Pushing the limits of low-bitrate neural speech codec.arXiv preprint arXiv:2409.05377,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.869064Z"},"links":{"cited_paper":"/paper/2409.05377","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:ea432caa917cc5fa71346f653a77917214e7a85a0e4fb95b070ab059f8e7b828","observation_id":"4cce3fd7-c466-4712-b8bc-90ae4aafcd0b","resolution":{"observed_at":"2026-08-07T12:12:29.869064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T12:12:29.931794Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.931794Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:9fa288f041c5b3bcadb088e8c20e7ad55b2895ebf0d115d1b9c68f385e77e231","observation_id":"4471a5d9-0b71-4dc4-98b2-e25c2919e356","resolution":{"observed_at":"2026-08-07T12:12:29.931794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01423","last_updated":"2025-03-10T11:43:42Z","snapshot_observed_at":"2026-08-06T01:13:01.484290Z","submitted_at":"2025-01-02T18:59:40Z","title":"Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01423","snapshot_observed_at":"2026-08-07T12:12:30.011254Z","title":"Reconstruction vs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.011254Z"},"links":{"cited_paper":"/paper/2501.01423","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:8685058f4150ce9aaf4111134c9b63cf97a4b6a2e7c45ef9db886ba1cbe31947","observation_id":"5053abe2-6e75-491c-bbf8-404f1115cdb3","resolution":{"observed_at":"2026-08-07T12:12:30.011254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16550","last_updated":"2024-11-25T16:32:29Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T16:32:29Z","title":"Representation Collapsing Problems in Vector Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16550","snapshot_observed_at":"2026-08-07T12:12:30.147379Z","title":"Representation collapsing problems in vector quantization.arXiv preprint arXiv:2411.16550,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.147379Z"},"links":{"cited_paper":"/paper/2411.16550","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:306123efb290ea1be40efe5caa9a51528c649bb2ea6f5f2d2284fe26d862526d","observation_id":"345a4d98-4de2-4d79-ac08-b07d372408b1","resolution":{"observed_at":"2026-08-07T12:12:30.147379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01053","last_updated":"2025-06-28T09:45:02Z","snapshot_observed_at":"2026-08-07T22:54:36.991382Z","submitted_at":"2024-12-02T02:29:22Z","title":"FreeCodec: A disentangled neural speech codec with fewer tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01053","snapshot_observed_at":"2026-08-07T12:12:30.227476Z","title":"FreeCodec: A disentangled neural speech codec with fewer tokens.arXiv preprint arXiv:2412.01053,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.227476Z"},"links":{"cited_paper":"/paper/2412.01053","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:187402122aaa4da476e1cb9734391024a1e576a6a2b13e266b6899b07c00737c","observation_id":"fa5ec1c0-3294-481e-b74c-f744b30da92d","resolution":{"observed_at":"2026-08-07T12:12:30.227476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11837","last_updated":"2024-06-17T17:59:57Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:57Z","title":"Scaling the Codebook Size of VQGAN to 100,000 with a Utilization Rate of 99%","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11837","snapshot_observed_at":"2026-08-07T12:12:30.315990Z","title":"Scaling the codebook size of vqgan to 100,000 with a utilization rate of 99%.arXiv preprint arXiv:2406.11837, 2024a","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.315990Z"},"links":{"cited_paper":"/paper/2406.11837","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:b101dca0de92e65a0709b8b09ef05bd006f6abbb57da4c0b5c0a649beefd8806","observation_id":"b0468529-a537-472a-aa38-067c6e842efa","resolution":{"observed_at":"2026-08-07T12:12:30.315990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:28.063751Z","title":"Zalán Borsos, Raphaël Marinier, Damien Vincent, Eugene Kharitonov, Olivier Pietquin, Matt Sharifi, Dominik Roblek, Olivier Teboul, David Grangier, Marco Tagliasacchi, et al","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:28.063751Z"},"links":{"citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:a677881fdc86f040c76d085b2de7e9bab27364e912714b5c62bb8b8472b09c12","observation_id":"b20acf97-4996-4bda-9aae-a3d8dc0be81a","resolution":{"observed_at":"2026-08-07T12:12:28.063751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:29.335785Z","title":"Takaaki Saeki, Detai Xin, Wataru Nakata, Tomoki Koriyama, Shinnosuke Takamichi, and Hiroshi Saruwatari","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.335785Z"},"links":{"citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:2104da0afd75ebfcac84420127e2f894f6dd4558df1dea4c79169298c963e675","observation_id":"e5c099ae-6734-497c-bc46-4be1eef8a3d8","resolution":{"observed_at":"2026-08-07T12:12:29.335785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2010.54957","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:30.779495Z","title":"Aaron Van Den Oord, Oriol Vinyals, et al","venue":null,"work_id":"ce1ebc9a-7524-4fd5-9afb-82eee55f89ec","year":2010},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.714900Z"},"links":{"citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:621006922f8c2879e338589bfd0d429f3d63ece0dfbccaf1cfef643386c63219","observation_id":"9bb77452-8687-49f8-93f6-60222ea50bc3","resolution":{"observed_at":"2026-08-07T12:12:30.942168Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:29.027797Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.027797Z"},"links":{"citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:e0ab738a0df309497b96468bc45fffeac82c9597e786d416d18ea3ec0e403f02","observation_id":"02a2eb66-78fa-481f-9b65-6ffb26efad7c","resolution":{"observed_at":"2026-08-07T12:12:29.027797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18803","last_updated":"2025-04-27T16:37:28Z","snapshot_observed_at":"2026-08-06T16:58:49.935180Z","submitted_at":"2024-11-27T23:07:52Z","title":"TS3-Codec: Transformer-Based Simple Streaming Single Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18803","snapshot_observed_at":"2026-08-07T12:12:29.788907Z","title":"Ts3-codec: Transformer-based simple streaming single codec.arXiv preprint arXiv:2411.18803,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.788907Z"},"links":{"cited_paper":"/paper/2411.18803","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:b13a06a0c511295a47a57a5fbd57680c31579bd005a90b6e1daf6da030f4bb4c","observation_id":"44e9ba0b-86d4-498a-9499-c63d4984ea96","resolution":{"observed_at":"2026-08-07T12:12:29.788907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05001","last_updated":"2024-11-07T18:59:28Z","snapshot_observed_at":"2026-08-01T08:55:09.990991Z","submitted_at":"2024-11-07T18:59:28Z","title":"Analyzing The Language of Visual Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05001","snapshot_observed_at":"2026-08-07T12:12:28.158067Z","title":"Analyzing the language of visual tokens.arXiv preprint arXiv:2411.05001,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:28.158067Z"},"links":{"cited_paper":"/paper/2411.05001","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:afd46410635e5863ba26add0e9e29ec68668f258d63f295d382e6ac92a52c8ce","observation_id":"4025257f-398f-44d3-8fa3-bdfe1f51560f","resolution":{"observed_at":"2026-08-07T12:12:28.158067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16692","last_updated":"2024-01-23T01:56:57Z","snapshot_observed_at":"2026-08-07T03:22:13.424379Z","submitted_at":"2023-08-31T12:53:09Z","title":"SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16692","snapshot_observed_at":"2026-08-07T12:12:30.076359Z","title":"SpeechTokenizer: Unified speech tokenizer for speech large language models.arXiv preprint arXiv:2308.16692,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.076359Z"},"links":{"cited_paper":"/paper/2308.16692","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:08c0df9abaf364f4a8b2dd06b9a8ca6d0b5e83ee7186a26d3f8189d869d1be19","observation_id":"b9af8d2d-0b5c-4755-8fa1-0bca759ca4af","resolution":{"observed_at":"2026-08-07T12:12:30.076359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00169","last_updated":"2024-07-22T09:53:44Z","snapshot_observed_at":"2026-08-02T05:10:10.209271Z","submitted_at":"2023-08-31T23:26:10Z","title":"RepCodec: A Speech Representation Codec for Speech Tokenization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00169","snapshot_observed_at":"2026-08-07T12:12:28.525519Z","title":"Repcodec: A speech representation codec for speech tokenization.arXiv preprint arXiv:2309.00169,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:28.525519Z"},"links":{"cited_paper":"/paper/2309.00169","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:1c0916b758de6c8d04006118d26a8edbe49c9508d6929d69c68f242de9cb4e28","observation_id":"efa103e0-2f88-40e2-accc-4581962c6242","resolution":{"observed_at":"2026-08-07T12:12:28.525519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16532","last_updated":"2025-02-25T11:45:12Z","snapshot_observed_at":"2026-08-07T23:06:05.723893Z","submitted_at":"2024-08-29T13:43:36Z","title":"WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16532","snapshot_observed_at":"2026-08-07T12:12:28.698164Z","title":"WavTokenizer: an efficient acoustic discrete codec tokenizer for audio language modeling.arXiv preprint arXiv:2408.16532,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:28.698164Z"},"links":{"cited_paper":"/paper/2408.16532","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:93b4bdd0c0fcc8b6f12f5461e01f8395e0c74916748614d5862f1253f25ba5ec","observation_id":"4b36495d-0831-43f3-8312-a16cc4fbba50","resolution":{"observed_at":"2026-08-07T12:12:28.698164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02430","snapshot_observed_at":"2026-08-07T12:12:27.861952Z","title":"Seed-TTS: A family of high-quality versatile speech generation models.arXiv preprint arXiv:2406.02430,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:27.861952Z"},"links":{"cited_paper":"/paper/2406.02430","citing_paper":"/paper/2506.00385"},"observation_digest":"sha256:918ed4b9e75e4f50b42372a1e2cf6bce1210f9b2550f69ba48abc2323d04dbc3","observation_id":"914a2250-af2d-4a02-841e-30a570b8fdb0","resolution":{"observed_at":"2026-08-07T12:12:27.861952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00385","last_updated":"2025-05-31T04:31:02Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T12:04:30.289730Z","submitted_at":"2025-05-31T04:31:02Z","title":"MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 2 inbound Pith citation observations for arXiv:2506.00385."}