Pith. sign in

Paper Citation Record · LEDGER

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation

As of 14 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2608.09571.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.09571 v1

Coverage vector

measured 58 of 58 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T14:54:55.275856Z

measured 58 of 58 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

58 of 58 outbound references displayed

  • verified exact3
  • verified fuzzy30
  • unresolved24
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation afd02cc8-07cd-496d-a50f-5e442ff4c8c2 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:56.272037Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.028632Z digest=sha256:8dff46e462e875eec996e7d786e0bc9eafef87fbbda44d3bc995d692ec43048c

Observation 4eed1274-ef77-48e1-b345-c3ae0df48eb6 · outbound

This paper cites V oicebox: Text-guided multilingual universal speech generation at 8 scale.Advances in neural information processing systems, 36:14005–14034, 2023.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation V oicebox: Text-guided multilingual universal speech generation at 8 scale.Advances in neural information processing systems, 36:14005–14034, 2023

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.257290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.033145Z digest=sha256:51ba9afb3b733a042602fca65844ea765f67f19efa4d6960daade4b2e34781f3

Observation fb1a21ac-4182-42ba-84e7-1f03920daa17 · outbound

This paper cites F5- TTS: A fairytaler that fakes fluent and faithful speech with flow matching.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation F5- TTS: A fairytaler that fakes fluent and faithful speech with flow matching

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.242505Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.038148Z digest=sha256:229c0a8be2a50d5d151c7a43f0e2b6908264268285154ba682796b50f8595066

Observation c3e5f785-c4a8-424a-8b6e-b1cbf54b13c0 · outbound

This paper cites Tangoflux: Super fast and faithful text to audio generation with flow matching and clap-ranked preference optimization.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Tangoflux: Super fast and faithful text to audio generation with flow matching and clap-ranked preference optimization

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.228130Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.042819Z digest=sha256:21c28b2bac6f39259a9f9783b09839f9b65bb769fe9ec07f521ca1927e1629f1

Observation 4fa110ad-eb7a-4c90-9dca-66fc47c1d481 · outbound

This paper cites Plumbley.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Plumbley

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.212486Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.047662Z digest=sha256:afe5a3341789f56edb0e0787cd6bade1f93002358abcc74e6f20ad0d134daeca

Observation c268a083-01d3-4d96-ae51-f753edf7da14 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:56.196252Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.052640Z digest=sha256:dc152e1a02057e2db2cb0b1f2a9f7bb3ef609deb642587994d08c9ad89aa001c

Observation cdbad638-fd23-48e1-bf05-11a5343a5750 · outbound

This paper cites Audiobox: Unified Audio Generation with Natural Language Prompts.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Audiobox: Unified Audio Generation with Natural Language Prompts

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.057843Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.057843Z digest=sha256:14a28de23743b6b329a9694ec42f8d1e2477cbae98203dc81ab9c53f63b60297

Observation a466b657-6ca1-489c-921d-c11eb11d7be7 · outbound

This paper cites Dasheng AudioGen: A Unified Model for Generating Coherent Audio Scenes from Text.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Dasheng AudioGen: A Unified Model for Generating Coherent Audio Scenes from Text

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-11T14:54:55.619644Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.067522Z digest=sha256:31b2b90821ad90d6de953501b60ef2fab13e6e28fce23599eca7ba728579e417

Observation f59e3dc8-afac-4863-b9ef-1593a0f9b875 · outbound

This paper cites UniMoE-Audio: Unified speech and music generation with dynamic- capacity mixture-of-experts.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation UniMoE-Audio: Unified speech and music generation with dynamic- capacity mixture-of-experts

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.178829Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.072212Z digest=sha256:e69f803df2aa0eec439180330fddb7872925a13d0c4b7dc8c5b8d1e32eddfc40

Observation 8e6278e1-319a-45e0-9363-943639f4f052 · outbound

This paper cites Mandic, Wenwu Wang, and Mark D.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Mandic, Wenwu Wang, and Mark D

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.163243Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.076050Z digest=sha256:8d46333eb7af642e76b4546ee180248238d12e7f044e6a09bc47c032535f38fc

Observation a826b188-4b5a-4d18-bb33-6e4b0ca9c963 · outbound

This paper cites UniSonate: A unified model for speech, music, and sound effect generation with text instructions.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation UniSonate: A unified model for speech, music, and sound effect generation with text instructions

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.148464Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.079733Z digest=sha256:004494589be90b6071851b77bc242fcd438a9194f2c03e47ee3e5bc25f4227d9

Observation 79092f9d-7ac3-4d2d-b7e0-8a2dbf9f2cda · outbound

This paper cites Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.083682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.083682Z digest=sha256:cf71af9ee597513c28eb9d45c3c53e73e40be31daaa7cdb9bd0d62e7fe001b60

Observation d82903fd-9735-4cd8-81ec-05f31fbda54c · outbound

This paper cites Text-to-audio generation using in- struction guided latent diffusion model.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Text-to-audio generation using in- struction guided latent diffusion model

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.133911Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.087986Z digest=sha256:251886ac1f8d0a9d0e8aabe0b6caa6d7898e82ecb212d348af695dfa6ef9b3d5

Observation 54b05279-be64-43e9-8226-51d3f4c08fac · outbound

This paper cites Freeaudio: Training-free timing plan- ning for controllable long-form text-to-audio generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Freeaudio: Training-free timing plan- ning for controllable long-form text-to-audio generation

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.119443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.091787Z digest=sha256:9718fe770f5c7f9d8541754ea389540bdf33c3acf408469ecc603855f04e4ba8

Observation e04a2ccd-3fd9-4258-a87f-8fe0dd487153 · outbound

This paper cites Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learn- ing Research, 23(120):1–39, 2022.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learn- ing Research, 23(120):1–39, 2022

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.095477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.095477Z digest=sha256:43af279c46bc57a0be1d62ecde5923865312a43e1d9eec9feaa3b8ab17a6dc56

Observation 62964b0e-7417-4d5b-9b98-07b190c2032c · outbound

This paper cites Scaling Diffusion Transformers to 16 Billion Parameters.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Scaling Diffusion Transformers to 16 Billion Parameters

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.099279Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.099279Z digest=sha256:98aae82bb33ae4596868e58e8990155693f458019f1ba464e570ff8ef1efea60

Observation 1ea80760-c232-497a-bed6-eb0602fcff01 · outbound

This paper cites Switch diffu- sion transformer: Synergizing denoising tasks with sparse mixture-of-experts.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Switch diffu- sion transformer: Synergizing denoising tasks with sparse mixture-of-experts

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.095129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.103831Z digest=sha256:63eae476f12c530d120b4df41b713f782a3250474dfe9e45029f2c4502b93680

Observation f5509802-f7a0-46ce-8b60-2855f3ce56b7 · outbound

This paper cites EC-DIT: Scaling diffusion transformers with adaptive expert-choice routing.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation EC-DIT: Scaling diffusion transformers with adaptive expert-choice routing

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.079884Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.108164Z digest=sha256:54d2cfc4dfd7c8630cab1cf5eae48236204fc217f625df0f2c1a93e11c6e7db9

Observation 91b25063-e225-4f9a-92d6-762f8998988d · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.113059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.113059Z digest=sha256:a52d271d198482c7ebf015aa00ad801f0dba4cc120c5b9959422c40cf62ebcb1

Observation 7c0ebbd6-d290-41f6-9327-a19b0d50143d · outbound

This paper cites Scalable diffusion mod- els with transformers.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Scalable diffusion mod- els with transformers

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.065225Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.117751Z digest=sha256:7ddbb563cafd80c3d002e450661c023abd3b0df48954a13b4f4251f20f74b128

Observation ec6c0a83-9fa1-445a-aa46-3864d9e1d3cb · outbound

This paper cites Learning transferable visual models from natural language supervision.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Learning transferable visual models from natural language supervision

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.052100Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.122187Z digest=sha256:72014e3bd9deee04153c62fb99a57afeef0f00e90ba22c3336764af3dd8665a6

Observation 8a2bcaef-be1c-44b5-9a36-b84fec2768e0 · outbound

This paper cites CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.126911Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.126911Z digest=sha256:922f1312ac27f6bdd16749bc875f30edd807164f75977cd5a4861a684bb43bfa

Observation 0e10443b-a2af-4cb4-9da5-27e2fbf33a07 · outbound

This paper cites Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.131781Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.131781Z digest=sha256:dbe67b57a7d13eda8fcfa920f60fdba73ca59d278fb25533c6cd30b593588a01

Observation 0669497a-4ea5-47c6-8599-cf94c0d5df74 · outbound

This paper cites Simple and controllable music generation.Advances in neural information processing systems, 36:47704–47720, 2023.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Simple and controllable music generation.Advances in neural information processing systems, 36:47704–47720, 2023

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.038847Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.136657Z digest=sha256:8b30f3728fd78e621c978bde82b469675a4da5dc410a55cae83a0f5e2c231c35

Observation ef7088ac-e0e6-4331-a5c5-bff7ee09a496 · outbound

This paper cites SegTune: Structured and fine-grained con- trol for song generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation SegTune: Structured and fine-grained con- trol for song generation

Reference 25

Resolution
verified exact
doi, observed 2026-08-11T14:54:55.528507Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.140918Z digest=sha256:8337f37efe0208dca88b2be4ba5c1d8d3caab89a11b9de7d64ad2e603f7b88c3

Observation a41bb708-5063-4773-a12d-b90f59ac082e · outbound

This paper cites Qwen2.5-Omni Technical Report.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Qwen2.5-Omni Technical Report

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.144842Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.144842Z digest=sha256:cb1430878acdb3eb206153958b2890ffd87853ddc31ec9fc1897b7d7972188dc

Observation fda2e9ef-d7ff-4da9-a101-f60dad53afd7 · outbound

This paper cites Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.025058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.153623Z digest=sha256:bd7c7ae285bd7dc7c1bf631ea30c567b68b0f53663bfdb3be57bafd39e25c928

Observation 386c4899-330e-4995-a944-fd706fcd1e3d · outbound

This paper cites Audiox: A unified framework for anything-to-audio generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Audiox: A unified framework for anything-to-audio generation

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:56.010531Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.157870Z digest=sha256:7cc1bf5532e57e433f73fa85455179aa5ec20bf87b2597b08a8ce3042f8d5516

Observation ddc464a5-37d5-489e-bdb3-37f041586904 · outbound

This paper cites Higgs Audio V2: Redefining expressiveness in audio generation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Higgs Audio V2: Redefining expressiveness in audio generation

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.995338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.161824Z digest=sha256:b2491e8ff58cdefc26024c5c4218533271515cb112bce9b14d7215f2952ccc9c

Observation 4ae51aae-4b50-4398-bbf1-ffeb860a1e57 · outbound

This paper cites UniFlow- Audio: Unified flow matching for audio generation from omni-modalities.CoRR, abs/2509.24391, 2025.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation UniFlow- Audio: Unified flow matching for audio generation from omni-modalities.CoRR, abs/2509.24391, 2025

Reference 30

Resolution
verified exact
doi, observed 2026-08-11T14:54:55.499848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.165701Z digest=sha256:73f0458bcc0da2f5dd13af688c4664e78a9c63e284ca84e58de0fd19e4f5500e

Observation 955e52c4-3a3b-455c-8728-ad26f9cbfee5 · outbound

This paper cites Supervised learning of universal sentence representations from natural language inference data.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Supervised learning of universal sentence representations from natural language inference data

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.169530Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.169530Z digest=sha256:cdf8a9b54ff917dcb48c3cd0828480b8c6df0ae4f6fc132500a82ee63e08a3eb

Observation abcac6ea-9023-46a7-83e5-f42822daecd6 · outbound

This paper cites Classifier-Free Diffusion Guidance.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Classifier-Free Diffusion Guidance

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.173499Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.173499Z digest=sha256:b06be3fcedbc1eee277d9fea798edef4f3625637bee4a8539e9af44fc68c68c4

Observation 6004f259-5b16-45c1-a7ea-f7031326e77c · outbound

This paper cites Eliminating oversaturation and artifacts of high guidance scales in diffusion models.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Eliminating oversaturation and artifacts of high guidance scales in diffusion models

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.978801Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.178905Z digest=sha256:389be918aacbcd5ab496792055ad5e48471992dd28d95205207c4a53292ebfa3

Observation ac4144c2-224e-423e-9d08-114090bf528a · outbound

This paper cites Seed-TTS: A Family of High-Quality Versatile Speech Generation Models.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Seed-TTS: A Family of High-Quality Versatile Speech Generation Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.183277Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.183277Z digest=sha256:6785d9c76953d7748fe3fba0194924aed769a0e23527b9b62a60bf5a8bd73898

Observation 371dd502-aa54-4b93-8057-8f167f221832 · outbound

This paper cites Librispeech-pc: Benchmark for evaluation of punc- tuation and capitalization capabilities of end-to-end asr models.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Librispeech-pc: Benchmark for evaluation of punc- tuation and capitalization capabilities of end-to-end asr models

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.963729Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.188042Z digest=sha256:68418a617db9c3a9cd05e5995a434e7297cd93b83cfa8908d022c215d8c7eca8

Observation b2798beb-52d1-42af-ac10-55cdf9072415 · outbound

This paper cites AudioCaps: Generating captions for audios in the wild.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation AudioCaps: Generating captions for audios in the wild

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.948849Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.192582Z digest=sha256:7b9dfc548c3005f35180d7e12eba97831e72b8a57710e930525132ca54625979

Observation 7f6a365e-c732-4d60-b0d2-c35994108945 · outbound

This paper cites MusicLM: Generating Music From Text.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation MusicLM: Generating Music From Text

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.196931Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.196931Z digest=sha256:a004837cbfc97a324fc1f985d89e2c64fd9d5764d4d6e81f35a7c8fc9eb52ba7

Observation b68f9f84-a28b-4284-9d43-227b77b4bca7 · outbound

This paper cites The Song Describer Dataset: a Corpus of Audio Captions for Music-and-Language Evaluation.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation The Song Describer Dataset: a Corpus of Audio Captions for Music-and-Language Evaluation

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.201613Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.201613Z digest=sha256:24d31755ad460ae843eb7c1ac36ae2d2f01aed1c3808e642f2ce49c4785babc3

Observation 9242d031-4e69-4b04-9d86-ddf022d84c86 · outbound

This paper cites Qwen3-VL Technical Report.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Qwen3-VL Technical Report

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.206209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.206209Z digest=sha256:a2d3fa7ddd9cc7bfe07b3e280412fc87b18949988571fa3f4c93ab73c9a628f8

Observation 0cb6a07a-4fb6-4c10-b20e-18cc239d67a0 · outbound

This paper cites Robust speech recognition via large-scale weak supervision.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Robust speech recognition via large-scale weak supervision

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.935113Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.210869Z digest=sha256:e8af68d74b232ad451a7716f4ae99eb1be4586b1876b155f93b61e39679a391d

Observation c7d98b08-56b2-46b5-bba9-9d43b7952fa7 · outbound

This paper cites rain” may be an event in sfx, “an urban street in a downpour.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation rain” may be an event in sfx, “an urban street in a downpour

Reference 41

Resolution
malformed identifier
raw_fallback, observed 2026-08-11T14:54:55.921565Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.215282Z digest=sha256:c7cb9309db8bb97c7a1990ccc99b0b246da8a524700ffda118daed26b5e44db1

Observation f7f18d1f-6b9b-4db2-b40a-3db806700a16 · outbound

This paper cites rule-based templates.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation rule-based templates

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.907528Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.219349Z digest=sha256:1b9a99465f8a2fcb7789e2d9df6726cfc7adf0657f8eb12d36b96f5f640334e9

Observation 1fa24644-4753-455f-b26b-eb41a89cd3be · outbound

This paper cites Do not include markdown, explana- tions, or extra text.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Do not include markdown, explana- tions, or extra text

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.893520Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.223346Z digest=sha256:5664e1db97ec832bc6c0a5bb5e786c94682e8dac6825e65001f551ea5579a42e

Observation 0010179d-e9ce-4f5e-bd02-2954138956d6 · outbound

This paper cites Do not add new keys.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Do not add new keys

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.878723Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.227851Z digest=sha256:be47f2975af023fe9422a9018704ab2a12e14b692384e930f6ff2c2744d3ef14

Observation 364a779a-e06d-4041-af44-06bacacb3304 · outbound

This paper cites - Do not paraphrase, expand, or rewrite it.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation - Do not paraphrase, expand, or rewrite it

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.863503Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.231770Z digest=sha256:0ff9b65f34858f3a95e5268d6a466555182549d2abbe64287de627ec68383410

Observation 28fde77a-e01a-4113-815d-914948893213 · outbound

This paper cites - Otherwise leave it empty.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation - Otherwise leave it empty

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.849051Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.235918Z digest=sha256:c63d3fff1175818060b82235f25ab44728f2013849d2b55ef7fee8945be5e7fd

Observation 750581f5-7a9b-4b7d-be7b-b099686e335e · outbound

This paper cites Other- wise leave it empty.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Other- wise leave it empty

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.834994Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.239775Z digest=sha256:45ac0c63f9d80d5084b5a701dd38b645b304a28cd59ed8c66e5f7823f7c5d901

Observation 465acee9-987c-47c6-bfc0-4dab1cd5d5c7 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 50

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.821099Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.243879Z digest=sha256:7abdd6f954c93888d2fbe642e5f9f272246802f273ddebbaebefc86525f1c1c8

Observation ace219d6-1fef-41df-969f-24e92c3f7d29 · outbound

This paper cites - Otherwise leave it empty.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation - Otherwise leave it empty

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.807877Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.247581Z digest=sha256:bf8a482483b1c35a0b627b6af98ae3c3c2276d3d22a35242320b6e6003569aa0

Observation 353f1487-1fbf-4872-a937-cbd532615bd3 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 52

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.794116Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.251276Z digest=sha256:002644e7ef7f88052f2b43681b86c78e98a2f6a61fbaee1c57ec38085f99904c

Observation 83f9cdc4-50cd-4be2-bf37-b6357e747476 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 53

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.778522Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.254890Z digest=sha256:f8e19a8f76b76ea043c800b6186d7e7448bb027fa8dde108a97f2a157b852c3e

Observation 6330a75d-ffd2-4610-a6f9-473999d3b4e5 · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 54

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.762312Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.258634Z digest=sha256:f0310978c48a3bb715758327fba5f6c3e56ad130e7e7a87e3dfe8c232cf440b1

Observation 889cc983-b815-4dd9-a3e1-56cfdcf16dad · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 55

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.747826Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.262758Z digest=sha256:b67142d6009c1dad776a110d4a97a37ddec945087d973ebdf42dba67adb4799d

Observation 4c9b4f35-0a32-4976-af3c-7a1910d000f2 · outbound

This paper cites 1", "2",.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation 1", "2",

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.733866Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.267346Z digest=sha256:fd51a3f09a89b793fe035fe9baa424250b6d99b22e6740b26bf7930708ee6cf5

Observation 4038b4a8-cdc6-468c-835d-7d4d25138f2f · outbound

This paper cites an unresolved cited work.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Unresolved cited work

Reference 57

Resolution
unresolved
raw_fallback, observed 2026-08-11T14:54:55.720592Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.271550Z digest=sha256:ffca343d71a70fb816cf8b5d83ffdabffbb069af7f5837c7e3db2159fe5e5797

Observation 0d1a757a-e876-4dc8-b70c-6f66be8fce40 · outbound

This paper cites summary":.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation summary":

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T14:54:55.706330Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-11T14:54:55.275856Z digest=sha256:dfd4f4a9019e6f5ca5eabf30dde61858c5d0f182998e3c92b50b47f28c497bd0

Observation 57e5ad33-fe50-4da2-b06f-b3c4ed53a099 · outbound

This paper cites Audiobox: Unified Audio Generation with Natural Language Prompts.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Audiobox: Unified Audio Generation with Natural Language Prompts

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.062732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.062732Z digest=sha256:184e14bf3093fc592accb6b9e00dc183a18788dacdd2656eb9e6b07f5ba7b96d

Observation d2ee54d8-1f0b-469a-98b8-2ae550ef66e5 · outbound

This paper cites Qwen2.5-Omni Technical Report.

SonicWeave: Chunk-Routed Mixture-of-Experts for Unified Audio Scene Generation Qwen2.5-Omni Technical Report

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-11T14:54:55.149373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:54:55.149373Z digest=sha256:97d46adb8135d945cf4ea75024eb5482aa3057b3e0ad38f4349148589b4428ad

Pith citing papers

No inbound Pith citation observations are available.