Pith. sign in

Paper Citation Record · LEDGER

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training

As of 10 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2603.16805.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2603.16805 v2

Coverage vector

measured 32 of 32 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T18:03:42.705090Z

measured 33 of 33 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T18:03:39.804104Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

32 of 32 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved32
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation cf778fc3-f1cb-4b7e-9567-5c68cf177af5 · outbound

This paper cites Audio watermarking has therefore emerged as a key technology for copyright protection and tamper detection [5].

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Audio watermarking has therefore emerged as a key technology for copyright protection and tamper detection [5]

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.754037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.754037Z digest=sha256:c2ce468680110bb38e00dac6a435c219aa339e9de21f668e2aa4fdd8e374e674

Observation d95a5364-4c2f-4396-946b-a1b22a37c019 · outbound

This paper cites Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.804104Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.804104Z digest=sha256:c5cec818896a97c1998846fa0c89c0a7edca1e79628971b1eccd74a92176a3d2

Observation 775dfc10-d2a2-4f79-8f1c-1e30be1da483 · outbound

This paper cites an unresolved cited work.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.883511Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.883511Z digest=sha256:8f176198ba557266e408d0f926223fa6d648c88ea53a0853191cd3bc62ea9d17

Observation 8a9e14cc-64ab-4ed2-97f6-aa9b2557c439 · outbound

This paper cites The LLMs were not used for ideation, methodology, experimental design, data analysis, or result interpretation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training The LLMs were not used for ideation, methodology, experimental design, data analysis, or result interpretation

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.938342Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.938342Z digest=sha256:7794e71314034d0ae8fce288c0f2cfc027cc7bb1d3d6fb452065eb7386bd6f6d

Observation 0cd1e6aa-b77f-48ac-8e1a-832191215d75 · outbound

This paper cites Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.027879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.027879Z digest=sha256:af19e410ba7fe301d2f87ddf8fe9743c123c80c197f150da2ee660ce93035c5d

Observation 6f6fbe12-1056-481f-a394-17d714e80274 · outbound

This paper cites AudioLDM: Text-to-Audio Generation with Latent Diffusion Models.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training AudioLDM: Text-to-Audio Generation with Latent Diffusion Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.092528Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.092528Z digest=sha256:dc589f1f3f6805e9d8e9f76fa7ad33edcbf15cca15a84a6a791e1a884c29acaf

Observation 90acce7b-57d5-49f2-9b22-d93e9238a3c7 · outbound

This paper cites Voicebox: Text-Guided Multilingual Universal Speech Generation at Scale.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Voicebox: Text-Guided Multilingual Universal Speech Generation at Scale

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.202491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.202491Z digest=sha256:6509a03f6c71c390a41a482a4ffcc1773e3bdc1f315124c4d8251511864b674f

Observation 314b1853-2332-4c49-a51b-96a09c774be3 · outbound

This paper cites Better speech synthesis through scaling.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Better speech synthesis through scaling

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.305722Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.305722Z digest=sha256:b9ee087d48847bbc35087c042347ea1211ed7b368ad99196998377d2aec552ac

Observation f02bc71e-5f27-4749-a6bf-d6e64001e1f5 · outbound

This paper cites DeAR: A Deep-learning-based Audio Re-recording Resilient Watermarking.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training DeAR: A Deep-learning-based Audio Re-recording Resilient Watermarking

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.411732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.411732Z digest=sha256:3e83dc615bae3be768fa6f8357a0b9ddde8c016b0603c7f69f3a2080c250bd87

Observation 52adeee5-bc53-4369-843d-160bf6a487e9 · outbound

This paper cites Techniques for data hiding,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Techniques for data hiding,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.546684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.546684Z digest=sha256:b6d48f879f71eff40b0b4636a483188797c2440bbd7473b6b593f6326a338bf7

Observation 107565b5-0ab9-4990-a8eb-433ba4186345 · outbound

This paper cites WavMark: Watermarking for Audio Generation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training WavMark: Watermarking for Audio Generation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.666307Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.666307Z digest=sha256:ea7fc1b790f66073372b67b33589cd5d0995c2cbd0923d4e71ab2365266c9267

Observation 5e7347d4-519b-418d-bf00-40b42663e6df · outbound

This paper cites Maskmark: Robust neu- ralwatermarking for real and synthetic speech,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Maskmark: Robust neu- ralwatermarking for real and synthetic speech,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.841554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.841554Z digest=sha256:d94af5da7079ea6e4e129c8262d6b6e7858e980df14a5a8aaa4ba790bb874908

Observation 63796681-a48e-409e-8fc7-bf12106c1482 · outbound

This paper cites Silentci- pher: Deep audio watermarking,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Silentci- pher: Deep audio watermarking,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.955096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.955096Z digest=sha256:2e6a36ad2c48e071658c054806c3f4049c7bdde53b82e393119fcd2623c5dc17

Observation 53bffafb-423c-45c9-89f0-cc72ef788c8a · outbound

This paper cites Hybrid Transformers for Music Source Separation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Hybrid Transformers for Music Source Separation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.035860Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.035860Z digest=sha256:3c57cc2ba4159e1ccea0f7299d60a7c675f5b8e3503bb7347678e5b05c14cbc7

Observation 038509e1-0816-485e-b164-c5f229689d3c · outbound

This paper cites TF-GridNet: Making Time-Frequency Domain Models Great Again for Monaural Speaker Separation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training TF-GridNet: Making Time-Frequency Domain Models Great Again for Monaural Speaker Separation

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.137465Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.137465Z digest=sha256:fa0e60e082bae6fcc1b5730e5feb9f63b03ea9ef384ebf788d65b33fb03327a3

Observation 99f3b199-2a20-40ff-98a4-73f67df10bad · outbound

This paper cites Open-unmix - a reference imple- mentation for music source separation,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Open-unmix - a reference imple- mentation for music source separation,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.197167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.197167Z digest=sha256:d73e4124cc366d29e7a1af28a9c39cb3061fbb63009571c1cbe6bf6cfc258d90

Observation abc55813-17bc-4066-b1d8-6a1155c8195d · outbound

This paper cites Spleeter: a fast and efficient music source separation tool with pre-trained models,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Spleeter: a fast and efficient music source separation tool with pre-trained models,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.324195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.324195Z digest=sha256:25e6d2acd7db1846628b7164d0beb060010ce5c3601888d91fd2f4ef0f0db0ec

Observation 6b5856eb-1bcf-4fc9-9aa1-c11c7cf43d11 · outbound

This paper cites Hybrid Spectrogram and Waveform Source Separation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Hybrid Spectrogram and Waveform Source Separation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.434039Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.434039Z digest=sha256:1106e3f357395ecf145d0b2457fda724f561074247058b773adc1ebf3bdf9ecc

Observation 0c892742-1fd4-400a-bd8a-c6751a917048 · outbound

This paper cites Conformer: Convolution-augmented Transformer for Speech Recognition.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Conformer: Convolution-augmented Transformer for Speech Recognition

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.525577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.525577Z digest=sha256:d9093af09e6ae486673a655d71fe32d02e20e17a9d60f4bd59218702ae7054ec

Observation 574f46d1-3428-4df6-a6c9-888afe8c17e7 · outbound

This paper cites Aura: A stegaformer-based scalable deep audio wa- termark with extreme robustness,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Aura: A stegaformer-based scalable deep audio wa- termark with extreme robustness,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.597480Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.597480Z digest=sha256:1d3d01a0e3f76e3f2ea05d3fd4b029900f5b174a156ba936a008b061a7b35809

Observation cc2bc651-a8ab-4625-a234-0c758f4dbbcd · outbound

This paper cites FiLM: Visual Reasoning with a General Conditioning Layer.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training FiLM: Visual Reasoning with a General Conditioning Layer

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.661694Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.661694Z digest=sha256:5915c96f454c65d3481a56b2ec270fbb083123a450b69aa41abd3a9601debca7

Observation 5a2c8fa7-cfe5-493e-a49b-63dfaa1f8206 · outbound

This paper cites Robust speech watermarking by a jointly trained embedder and detector using a dnn,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Robust speech watermarking by a jointly trained embedder and detector using a dnn,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.789963Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.789963Z digest=sha256:ac51299735031a4b343f50cd140f998b445ae7fd97968de17c4a90cabbd736e0

Observation 2fa367fd-061b-4282-81cd-f68e58ef216d · outbound

This paper cites Wave-u-net: A multi-scale neural network for end-to-end audio source separation,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Wave-u-net: A multi-scale neural network for end-to-end audio source separation,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.974092Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.974092Z digest=sha256:8966077bfadb069de96b488a3cd25b7b823980ea9cd41f3ad66bf1f113918e52

Observation fe3fc82d-380f-4a08-91e2-8636820a9b4e · outbound

This paper cites Bidirectional recurrent neural networks,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Bidirectional recurrent neural networks,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.085674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.085674Z digest=sha256:3e5f234ebdc45b47fb4ff09a3238299d79599b0db9ae186aea6cb00304a8b3dc

Observation 8e876df4-ebdd-455b-9dcc-c250e554ba5f · outbound

This paper cites Musical source separation: An introduction,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Musical source separation: An introduction,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.166168Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.166168Z digest=sha256:4c034b8e40b127d6e54893a1911df74b79683363f1971f6c02185aa9ea058c2d

Observation dcdd2f65-8a93-4e74-85dd-56cbd601492d · outbound

This paper cites Performance mea- surement in blind audio source separation,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Performance mea- surement in blind audio source separation,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.290913Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.290913Z digest=sha256:cd5caa4394d746004fa1d1121b472e2dfaa19fc21242a314cfa1c25213c52e7e

Observation 3349f34a-a4ba-4c31-b76e-bfc992d08c79 · outbound

This paper cites FMA: A Dataset For Music Analysis.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training FMA: A Dataset For Music Analysis

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.342050Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.342050Z digest=sha256:59b0c21b52df4b7ef5debc2d9e1a6ba032cb0e3af4a253204ef3aecb3cdbe425

Observation 74e8b097-9b56-4718-84c0-761387fba4d7 · outbound

This paper cites Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.435007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.435007Z digest=sha256:e1fdc450bc7d1ec5107f6a142f9647b58f135817af29ea3c6f1427603bf8c04d

Observation 42ca25ff-c58d-4cf9-8c72-b797e366800e · outbound

This paper cites The musdb18 corpus for music separation,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training The musdb18 corpus for music separation,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.511762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.511762Z digest=sha256:34e8177aeefb5ff8dbef9435d8ae1b605312f8b56263c7b5db43d0070985fcef

Observation 226673d6-99e2-4c78-aaa2-02f64a4e0c1d · outbound

This paper cites BigVGAN: A Universal Neural Vocoder with Large-Scale Training.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training BigVGAN: A Universal Neural Vocoder with Large-Scale Training

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.596651Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.596651Z digest=sha256:aa594dd7ebf36b1d2d1eabe8a9ad100a7b0d9f426879fca6b35f1e0da55c726c

Observation 6831850f-cf73-4a3f-ad19-13c231338263 · outbound

This paper cites Noise-to-mask ratio loss for deep neural network based audio watermarking,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Noise-to-mask ratio loss for deep neural network based audio watermarking,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.653314Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.653314Z digest=sha256:4034a269bb9c612c3a188db29d91e4d0dfc3d5ddfaab0cab1d99db40fc5e89d3

Observation 98b2569b-0c78-4d37-a140-1877a79b48be · outbound

This paper cites ViSQOL v3: An Open Source Production Ready Objective Speech and Audio Metric.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training ViSQOL v3: An Open Source Production Ready Objective Speech and Audio Metric

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.705090Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.705090Z digest=sha256:943dec52ff733cf5909367bd1d7c88c450015affb7484dba7afa4400991c8670

Pith citing papers

Observation d95a5364-4c2f-4396-946b-a1b22a37c019 · inbound

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training cites this paper.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.804104Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.804104Z digest=sha256:c5cec818896a97c1998846fa0c89c0a7edca1e79628971b1eccd74a92176a3d2