Pith. sign in

Paper Citation Record · LEDGER

TS3-Codec: Transformer-Based Simple Streaming Single Codec

As of 19 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 14 inbound Pith citation observations for arXiv:2411.18803.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2411.18803 v2

Coverage vector

measured 46 of 46 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-12T10:57:08.585678Z

measured 60 of 60 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-12T10:57:08.411772Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

46 of 46 outbound references displayed

  • verified exact1
  • verified fuzzy10
  • unresolved35
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

0
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

Observation 5858faed-d0f9-4fd3-a147-a2e5965c08f6 · outbound

This paper cites More recently, NAC has also gained significant attention as a key technology for speech lan- guage modeling (SLM) [6–8].

TS3-Codec: Transformer-Based Simple Streaming Single Codec More recently, NAC has also gained significant attention as a key technology for speech lan- guage modeling (SLM) [6–8]

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:09.053466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.407044Z digest=sha256:be3eb673cebc07b636e2166c6b60fa5ba248b0351a49bd1271ed4525e62c5eb4

Observation ce9606ef-0009-47e3-aa96-11b9790848c7 · outbound

This paper cites TS3-Codec: Transformer-Based Simple Streaming Single Codec.

TS3-Codec: Transformer-Based Simple Streaming Single Codec TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.411772Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.411772Z digest=sha256:03782d200705069cbd53b489d61d470da0b438942cd35ee7c3f0270c7c0d5056

Observation 34c2eb9b-37db-4ab5-8eab-056bfcb5245d · outbound

This paper cites ×$ ℝ%×$ Reshape Linear wo bias Linear… Transformer×𝑁ℝ%×$LinearVQLinear Transformer×𝑁 Linear Linear wo bias … ℝ!ℝ.

TS3-Codec: Transformer-Based Simple Streaming Single Codec ×$ ℝ%×$ Reshape Linear wo bias Linear… Transformer×𝑁ℝ%×$LinearVQLinear Transformer×𝑁 Linear Linear wo bias … ℝ!ℝ

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:09.030059Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.420274Z digest=sha256:c68155d6d429ccddc06e543755a5d8baf5ac446870b2099b1ba9a352443ee4b6

Observation 288e723a-bb46-42ff-9548-14925d1e624b · outbound

This paper cites Data We used Libri-light [31], which contains 60K hours of speech, to train the codec models.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Data We used Libri-light [31], which contains 60K hours of speech, to train the codec models

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:09.017614Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.425422Z digest=sha256:60436f54f93a95c62f1d60fee3989dc23da3f0062c260abdca7ad4c8baf02c21

Observation 2fb71e1d-77ab-4972-bff4-07635046be0d · outbound

This paper cites Results at approximately 1000 bps In Table 3, four non-streaming baselines, (A)–(D1), are evalu- ated using results derived from their official checkpoints.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Results at approximately 1000 bps In Table 3, four non-streaming baselines, (A)–(D1), are evalu- ated using results derived from their official checkpoints

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:09.005848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.429872Z digest=sha256:4e768d8ab540bae851aa932597cb99a62fa9e2445e7f569ea6552ee51b9664a7

Observation 24eb8eea-149c-4150-941d-9315dbb79bc5 · outbound

This paper cites an unresolved cited work.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-12T10:57:08.994282Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.433935Z digest=sha256:6ad9462470e1795c516f9538df857518e666b9590333335b46cc2711dc718393

Observation 9b85f422-0d74-4b25-baab-62c3835eaba7 · outbound

This paper cites Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.465887Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.465887Z digest=sha256:4df80aced5da1ab1f375e2a90ef316d1bce531f3e5d8ca5ceb08891728b1de88

Observation 349ebc89-39fe-43ad-aeb6-04bb32fa01c9 · outbound

This paper cites Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-12T10:57:08.790349Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.438249Z digest=sha256:f79ab762ac522f6c4080d0f1e48b782a71e4196e00e14502d4311bc80aba4984

Observation 85ca8b2f-ac7d-4155-aa80-3bc03484ee65 · outbound

This paper cites Codec-SUPERB: An in- depth analysis of sound codec models,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Codec-SUPERB: An in- depth analysis of sound codec models,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:08.982704Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.442190Z digest=sha256:cc58ee65bde8753342bd57f8fdc077caf844e16e7ac509c94a237faded429d9e

Observation c928f62e-8c07-4576-b5a4-01071c20d108 · outbound

This paper cites an unresolved cited work.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-12T10:57:09.042041Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.416189Z digest=sha256:c2591ade62cac293cff45c73ef21f4856e09ca1af7b515b6d81bf47b71dc1f02

Observation ed60375e-15fe-446a-be80-5f813c7d875b · outbound

This paper cites ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech.

TS3-Codec: Transformer-Based Simple Streaming Single Codec ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.449289Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.449289Z digest=sha256:893bfd86cac3523e224fe5609a09c9202163954c8233e4bc7f62fff11d145907

Observation aef4a325-8c43-4b9d-ab4e-14c701d41429 · outbound

This paper cites Codec-SUPERB @ SLT 2024: A lightweight benchmark for neural audio codec models.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Codec-SUPERB @ SLT 2024: A lightweight benchmark for neural audio codec models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.453711Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.453711Z digest=sha256:b3d52d7f56c38bab34868ab463b2b89b036cedb739ac749a2f2372af8acdb262

Observation fb057fa8-24be-4d34-bfd2-6d0ca68d5d12 · outbound

This paper cites DASB - Discrete Audio and Speech Benchmark.

TS3-Codec: Transformer-Based Simple Streaming Single Codec DASB - Discrete Audio and Speech Benchmark

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.458050Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.458050Z digest=sha256:a60408231dc142d53aa7cd7ca117e8f794acbdee763981ce7020eea0b3ccaba9

Observation 0a6fa24d-2e3b-4778-bbeb-8d48f7b34477 · outbound

This paper cites Audiolm: a language modeling approach to audio gener- ation,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Audiolm: a language modeling approach to audio gener- ation,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.462411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.462411Z digest=sha256:46089f021fecb5300ab177c6c40b3ddd2ac7556c24d398d4aba9a54d0f94d1ca

Observation 1656a58b-11b7-484f-ae08-684dcdd68016 · outbound

This paper cites High Fidelity Neural Audio Compression.

TS3-Codec: Transformer-Based Simple Streaming Single Codec High Fidelity Neural Audio Compression

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.495784Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.495784Z digest=sha256:3a333658a7ed75a7d97aac2f7afeb70e71b0d24a12490f0f74d5ba387be2ebe8

Observation 5dc18737-b3e1-4455-9e1a-ba231dbbe099 · outbound

This paper cites Speechx: Neural codec language model as a versatile speech transformer,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Speechx: Neural codec language model as a versatile speech transformer,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.469717Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.469717Z digest=sha256:5a17550368de80b82ac57302d695e002095d69a5f5ebe01207bb2283abff284f

Observation 8de55c88-5d75-4d67-91d6-d5eb02a00c56 · outbound

This paper cites Towards audio language modeling -- an overview.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Towards audio language modeling -- an overview

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.473295Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.473295Z digest=sha256:92f4e1b351184a971fdd1c02aad45f25f15e885ae03f6c1211019289ebf5452f

Observation 14334fd2-b27d-4b1c-b5b2-eb537ce818ef · outbound

This paper cites WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling.

TS3-Codec: Transformer-Based Simple Streaming Single Codec WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.477120Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.477120Z digest=sha256:777eb77b12179bd78a5a64d847154111f4ee2a76f078cf111ca41bfc6ef32d4a

Observation 0f72f1b6-81aa-4f58-b6e5-885382d838eb · outbound

This paper cites Moshi: a speech-text foundation model for real-time dialogue.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Moshi: a speech-text foundation model for real-time dialogue

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.480919Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.480919Z digest=sha256:0913440a28fa5ce13734ef6b4d9140e08e8f1771fe90900862e97b183c24638f

Observation 886a9bf3-e4b2-49d4-8e99-759df1288a38 · outbound

This paper cites Attention is all you need,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Attention is all you need,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.484715Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.484715Z digest=sha256:e7e8e12f681435d8538102b36e16da8137ccdab668001ba78ab29bf68cfba3cc

Observation 5f92d1e9-d342-47f9-ab00-a82735606edd · outbound

This paper cites Generative spoken dialogue language model- ing,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Generative spoken dialogue language model- ing,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:08.938658Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.488547Z digest=sha256:fde435a73ff286633abd1efe6486b6726c576d14868822a6b57c49f7273704a6

Observation ec55d800-033f-4148-9ac1-3eedf702ae83 · outbound

This paper cites Soundstream: An end-to-end neural audio codec,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Soundstream: An end-to-end neural audio codec,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.492227Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.492227Z digest=sha256:38e841f85eacd7050b5e9f03392fd2b6794b94ef8182780fa4d680fdb6a7d874

Observation 82e50c85-551c-4381-b35f-509eeb55e5c5 · outbound

This paper cites Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.526943Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.526943Z digest=sha256:b226ad984c7bddc81c0488fe5f993caf6fbca52fbf0e8a40d260bf834d09533f

Observation e0334ebb-d1cb-44c9-9e57-6426f51b4923 · outbound

This paper cites Megabyte: Predicting million-byte sequences with multiscale transformers,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Megabyte: Predicting million-byte sequences with multiscale transformers,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:08.918930Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.500219Z digest=sha256:7ac833199b4be3bf9757d51512129a625bf963ed1e51ab6b500a853b39e78615

Observation 7cc2410c-b149-4fa1-80df-2c899d75e363 · outbound

This paper cites UniAudio: An Audio Foundation Model Toward Universal Audio Generation.

TS3-Codec: Transformer-Based Simple Streaming Single Codec UniAudio: An Audio Foundation Model Toward Universal Audio Generation

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.503701Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.503701Z digest=sha256:0f42a5b7276335c378c08cf0b70d7c8a0ff7d314a0068b207fae4c232551bbdd

Observation 6b571bb1-3d94-4493-b85e-8db59f2cee88 · outbound

This paper cites Neural discrete represen- tation learning,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Neural discrete represen- tation learning,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.507412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.507412Z digest=sha256:883aebdf7d393e9b49aabdab704e5158ea4a13c6ad53d7f46f7f4d4b0621be0e

Observation 0a98529b-4178-4e69-8da9-5e43266d3af6 · outbound

This paper cites Finite Scalar Quantization: VQ-VAE Made Simple.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Finite Scalar Quantization: VQ-VAE Made Simple

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.511006Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.511006Z digest=sha256:70e6e5a0ff749fabf527b09ade0c617ffb747d0fdcf13bb67a1af36e01cabd92

Observation 9dbba404-9a39-439e-bb70-e91b0ac0aa4c · outbound

This paper cites Simple and controllable music gen- eration,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Simple and controllable music gen- eration,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.515013Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.515013Z digest=sha256:7f2e087e6f976de55c8e1a1b41e0064cfa079877f63aa0d4a7a0a623d6d86215

Observation 23e996a2-d719-408c-8203-d67e5d551bc3 · outbound

This paper cites Fewer-token neural speech codec with time-invariant codes,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Fewer-token neural speech codec with time-invariant codes,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.518825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.518825Z digest=sha256:1bcfa223a80984f3d0a001a1b0bafc79783b3e096e5d7db60c3887544495464a

Observation 964049ae-5ea3-443f-ba70-c597ba79495e · outbound

This paper cites Single-Codec: Single-Codebook Speech Codec towards High-Performance Speech Generation.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Single-Codec: Single-Codebook Speech Codec towards High-Performance Speech Generation

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.522475Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.522475Z digest=sha256:ec8e86a326d6ac0c559f1ded31a6b50862271b7bc01444ac9814f10e56d95bea

Observation 9a4cb872-e2b1-4db7-9d44-2f0e713834cb · outbound

This paper cites Libri-light: A benchmark for asr with limited or no su- pervision,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Libri-light: A benchmark for asr with limited or no su- pervision,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.558540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.558540Z digest=sha256:7a04e09c1b41ccc573f7860f7371ae217d6e4453baca5446f92e43abf4263246

Observation 4f77f30a-3f52-42c9-844a-8bcc67f0ff31 · outbound

This paper cites BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec.

TS3-Codec: Transformer-Based Simple Streaming Single Codec BigCodec: Pushing the Limits of Low-Bitrate Neural Speech Codec

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.531814Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.531814Z digest=sha256:b3c98836bd64c1c1e1d99d7bd3ee18719f7b10fd874e06ab72b793d8ef8b5591

Observation 058056cb-64e6-4fd9-95ac-33f00792eb7e · outbound

This paper cites Audiodec: An open-source streaming high-fidelity neural audio codec,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Audiodec: An open-source streaming high-fidelity neural audio codec,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.535829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.535829Z digest=sha256:d7c0dca717d67649d2bfe636dba8680a0125879283fd861d1a57036c789051ac

Observation 7777f2a1-0827-4311-b178-b999106dafc8 · outbound

This paper cites Generative adver- sarial networks,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Generative adver- sarial networks,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.539429Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.539429Z digest=sha256:029234bf1105dad47dcae7191889d50788da421885ee9916714a5183b0aee97c

Observation c51ef002-fbe8-4b5e-b0ad-c34f8701198b · outbound

This paper cites Wavenext: Convnext-based fast neural vocoder without istft layer,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Wavenext: Convnext-based fast neural vocoder without istft layer,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:08.872782Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.543236Z digest=sha256:378ce5aa6b735cc16ad8a8afb01d0ad71d50b127e1d76cc1585a32e182b59f57

Observation 4dcbd1b9-616b-45c4-82ca-24a2c7936b0c · outbound

This paper cites Hearing the agi from gmm hmm to gpt 4o,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Hearing the agi from gmm hmm to gpt 4o,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:08.861778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.547214Z digest=sha256:977f460375fd788e7669ecd5015f20f9a05b62e62fde5c52544e26e0ce101230

Observation 86d2ad6d-d0f3-4d3f-b6ff-d6c7fd564f78 · outbound

This paper cites Least squares generative adversarial networks,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Least squares generative adversarial networks,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.551074Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.551074Z digest=sha256:8c1df74e1b7e07d86a61d84d5f8a2950c791fba058c44ab65e513bfb7f04f3b2

Observation 3a538afc-1f5c-4e75-9212-3ea4ae59a956 · outbound

This paper cites Hifi-gan: Generative adversarial net- works for efficient and high fidelity speech synthesis,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Hifi-gan: Generative adversarial net- works for efficient and high fidelity speech synthesis,

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.554994Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.554994Z digest=sha256:4d4c5d89d27dfe7909e99daf9a9969c2b6d4c9709aaa8dd9d39cbfe706ede72d

Observation 960b2538-641b-44bf-b026-17260c3c3c7a · outbound

This paper cites Lib- rispeech: an asr corpus based on public domain audio books,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Lib- rispeech: an asr corpus based on public domain audio books,

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.562296Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.562296Z digest=sha256:530fe02f4c092ab801ec18049e5075362748af7d9c747da9fbcaa2ac801a8b3e

Observation 93a798c7-0f5a-4b44-a044-883a621d5303 · outbound

This paper cites Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.566645Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.566645Z digest=sha256:5fb0cde0d40b23a1f7e9ed341b13b5538ee0a1ad755dcb99169b3fe175cb6f24

Observation 3dd273e6-f780-4311-8eca-3f0316993b0a · outbound

This paper cites Wavlm: Large-scale self- supervised pre-training for full stack speech processing,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Wavlm: Large-scale self- supervised pre-training for full stack speech processing,

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.570227Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.570227Z digest=sha256:31b72286bf1a8026f8cf7000e7c5803c012b6733de35e7f8c01a2a7271b6fdfb

Observation fdc4aa58-a145-4680-adda-f2862d74942d · outbound

This paper cites UTMOS: UTokyo-SaruLab System for VoiceMOS Challenge 2022.

TS3-Codec: Transformer-Based Simple Streaming Single Codec UTMOS: UTokyo-SaruLab System for VoiceMOS Challenge 2022

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.573932Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.573932Z digest=sha256:386308bc0ad82ee22ccd52463845080d2c7bb104c4b2e15efd948523eab8ecab

Observation 8c1a0ad4-17ad-47b0-b029-4e1ffea2865a · outbound

This paper cites High-fidelity audio compression with improved rvqgan,.

TS3-Codec: Transformer-Based Simple Streaming Single Codec High-fidelity audio compression with improved rvqgan,

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.577980Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.577980Z digest=sha256:766bb47075c3b6957db7e899afaa5c3d77daae40ee7bf8f566535ba13fe5b5da

Observation 897055d0-ae01-412e-bf1c-55cb48a63822 · outbound

This paper cites SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models.

TS3-Codec: Transformer-Based Simple Streaming Single Codec SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.581775Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.581775Z digest=sha256:8d6df108bc915d64089218650c763513b75086f54dde9335eacaab1df7b275a2

Observation ca6ec73c-5731-4232-84d1-cda269f1e99f · outbound

This paper cites Decoupled Weight Decay Regularization.

TS3-Codec: Transformer-Based Simple Streaming Single Codec Decoupled Weight Decay Regularization

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.585678Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.585678Z digest=sha256:beed293c949e958e74528714e70970f96505afa7bcd83b724ed8ba9c750a4ddc

Observation 3254b6cc-fd1e-4cd1-b69d-b1dddc3c1574 · outbound

This paper cites 2024, pp.

TS3-Codec: Transformer-Based Simple Streaming Single Codec 2024, pp

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-12T10:57:08.970140Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-12T10:57:08.445729Z digest=sha256:4430e228e47a231c1f5c6d625f446cf3e23cb8e44574ba6028dac34d8a383df2

Pith citing papers

Observation ce9606ef-0009-47e3-aa96-11b9790848c7 · inbound

TS3-Codec: Transformer-Based Simple Streaming Single Codec cites this paper.

TS3-Codec: Transformer-Based Simple Streaming Single Codec TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T10:57:08.411772Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:57:08.411772Z digest=sha256:03782d200705069cbd53b489d61d470da0b438942cd35ee7c3f0270c7c0d5056

Observation 7e92ff0b-20a8-4813-adf0-9b726946a129 · inbound

VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music cites this paper.

VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 1978

Resolution
unresolved
no resolver link, observed 2026-08-11T05:20:45.109103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T05:20:45.109103Z digest=sha256:502c0971d97050328184674837083e2c971d487c71b534ff34b6ca89c8a41d2d

Observation 4c2ab74e-6c20-497b-b9d0-8e18c6213b42 · inbound

CodecFake+: Codec-Based Resynthesized Data as a Proxy for Detecting CodecFake Speech cites this paper.

CodecFake+: Codec-Based Resynthesized Data as a Proxy for Detecting CodecFake Speech TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-10T20:34:37.557233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T20:34:37.557233Z digest=sha256:035e2cc47fa91006d930e51174539973a59b295d9632e56f938abfcd2569b19d

Observation 2a9b763d-c4eb-4e23-a9db-7766fc53a498 · inbound

Unlocking Temporal Flexibility: Neural Speech Codec with Variable Frame Rate cites this paper.

Unlocking Temporal Flexibility: Neural Speech Codec with Variable Frame Rate TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T14:58:42.579162Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:58:42.579162Z digest=sha256:ed4bc2c79032af4203bce96f1c1dd8ba02a2ea3a4f4259a53b7e306543eaefc1

Observation 44e9ba0b-86d4-498a-9499-c63d4984ea96 · inbound

MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation cites this paper.

MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-07T12:12:29.788907Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:12:29.788907Z digest=sha256:ff91017d6b89b0a0093b192bf729a291d6feef23988f9ae4f6b2e71e211492b1

Observation 57bf441b-e926-4c19-b4de-a6a7246a0672 · inbound

NanoCodec: Towards High-Quality Ultra Fast Speech LLM Inference cites this paper.

NanoCodec: Towards High-Quality Ultra Fast Speech LLM Inference TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-05T23:10:56.245021Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T23:10:56.245021Z digest=sha256:f1950477b007db3e0104e8e8d23642ae519de7ad4f6c0c7d816e617033c808bd

Observation 7286be21-0ff9-4929-aafc-2ba2bfab38dd · inbound

The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs cites this paper.

The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T22:52:22.632593Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T22:52:22.632593Z digest=sha256:d509973297b7711c764c9afdfd709cfe6573c479b14915f26ae5a5f52b175042

Observation 6d73520c-6fd6-4b72-bfb5-016879fd6d54 · inbound

Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents cites this paper.

Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 51

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T22:15:05.294432Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-06-30T22:11:44.891731Z digest=sha256:611cedbab4b863fe805314dd61c1ba8de6ea68302dedef91a412354e3af5ee9e

Observation ce90ef58-d24e-45bc-bf3c-dba558993043 · inbound

Self-Guidance: Enhancing Neural Codecs via Decoder Manifold Alignment cites this paper.

Self-Guidance: Enhancing Neural Codecs via Decoder Manifold Alignment TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 131

Resolution
verified exact
arxiv_id, observed 2026-07-03T16:08:37.466186Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-06-27T06:05:26.735340Z digest=sha256:c35b7906f6d5ced577129136990ff421c4e6a924ae82a95b9d7339fd08f0506e

Observation d8a3fcd6-77c0-4e52-836e-e3bd0298c8c2 · inbound

FlexiSLM: A Dynamic and Controllable Frame Rate Spoken Language Model cites this paper.

FlexiSLM: A Dynamic and Controllable Frame Rate Spoken Language Model TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 108

Resolution
metadata mismatch
arxiv_id, observed 2026-07-01T11:45:47.220487Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-07-01T03:50:26.873406Z digest=sha256:1336c6ccf4d1a35a7b8bafb61bbc6b18b56cab98b91463baceff1088dbe1be97

Observation 9bf6d11c-0b5f-4a07-9949-777d777b2bfd · inbound

From Objectives to Applications: Aligning Architectural Biases in Audio Self-Supervised Learning cites this paper.

From Objectives to Applications: Aligning Architectural Biases in Audio Self-Supervised Learning TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 85

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T05:56:39.854827Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-07-02T05:52:55.818877Z digest=sha256:e1de9757ad4dfd558b6e37e5caeb9cf5296eb52ffe8f804bb14f3684e3ca028e

Observation 37063fa0-30e7-4ff4-85bb-44f8139bce9e · inbound

ReGen: Hierarchical Multi-Prompt Representation Generation for Efficient Waveform Diffusion Models cites this paper.

ReGen: Hierarchical Multi-Prompt Representation Generation for Efficient Waveform Diffusion Models TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 84

Resolution
unresolved
no resolver link, observed 2026-07-13T05:10:26.667731Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-13T05:10:26.667731Z digest=sha256:31c29dc4b6c1214cb14457ee5af25c5edcd51574484e27079abf803836e83321

Observation e039e130-9fc9-4b33-afdd-ef05a5bfedf3 · inbound

Memory Efficient Audio Synthesis with Decoupled Temporal Depth Diffusion Transformers cites this paper.

Memory Efficient Audio Synthesis with Decoupled Temporal Depth Diffusion Transformers TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-30T11:48:49.526693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T11:48:49.526693Z digest=sha256:061649a9ce806d28ba192c066da01be7940cb5e4de25bd04ff07eae6b82167bb

Observation a2864ae6-a1c0-4587-8414-6d830c794d93 · inbound

SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation cites this paper.

SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation TS3-Codec: Transformer-Based Simple Streaming Single Codec

Reference 147

Resolution
unresolved
no resolver link, observed 2026-08-10T04:20:42.277492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T04:20:42.277492Z digest=sha256:6d261a92ccc92e0a083c8f29792724df5a1cf6781d5d8870ac337ec9615eed7e