Pith. sign in

Paper Citation Record · LEDGER

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training

As of 7 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2603.16805.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2603.16805 v2

Coverage vector

measured 32 of 32 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T18:03:42.705090Z

measured 33 of 33 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T18:03:39.804104Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

32 of 32 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved32
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation cf778fc3-f1cb-4b7e-9567-5c68cf177af5 · outbound

This paper cites Audio watermarking has therefore emerged as a key technology for copyright protection and tamper detection [5].

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Audio watermarking has therefore emerged as a key technology for copyright protection and tamper detection [5]

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.754037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.754037Z digest=sha256:0a2d4a841c12d376a1a08099bffe7df6298378e55239d27f74e0b9fbd683bfc4

Observation d95a5364-4c2f-4396-946b-a1b22a37c019 · outbound

This paper cites Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.804104Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.804104Z digest=sha256:fa098ef87fcd445526059a6f5e8331ddf315936f867453b3f8a9159c6af20222

Observation 775dfc10-d2a2-4f79-8f1c-1e30be1da483 · outbound

This paper cites an unresolved cited work.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.883511Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.883511Z digest=sha256:3c93482da29fa7181818eaabd3a32a104db3d078923d5bb80899537d491823f4

Observation 8a9e14cc-64ab-4ed2-97f6-aa9b2557c439 · outbound

This paper cites The LLMs were not used for ideation, methodology, experimental design, data analysis, or result interpretation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training The LLMs were not used for ideation, methodology, experimental design, data analysis, or result interpretation

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.938342Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.938342Z digest=sha256:1e5fe28ce1323b900cd925259d85c5f160c2b8c5c131b9de77d994fa7c24a137

Observation 0cd1e6aa-b77f-48ac-8e1a-832191215d75 · outbound

This paper cites Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.027879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.027879Z digest=sha256:1b14b5d526d5de763ab1a16da0eb0492498a0ca477590ab19e647305e5106ce8

Observation 6f6fbe12-1056-481f-a394-17d714e80274 · outbound

This paper cites AudioLDM: Text-to-Audio Generation with Latent Diffusion Models.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training AudioLDM: Text-to-Audio Generation with Latent Diffusion Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.092528Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.092528Z digest=sha256:ff2e14e147b5fbcbf25f6c5df236b57339595dc7e96ca750e13216f114565831

Observation 90acce7b-57d5-49f2-9b22-d93e9238a3c7 · outbound

This paper cites Voicebox: Text-Guided Multilingual Universal Speech Generation at Scale.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Voicebox: Text-Guided Multilingual Universal Speech Generation at Scale

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.202491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.202491Z digest=sha256:ccba43fb776d12905ece1a50410ca12a9efbe76bbb1bcd74a79bc1721a7c1fa1

Observation 314b1853-2332-4c49-a51b-96a09c774be3 · outbound

This paper cites Better speech synthesis through scaling.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Better speech synthesis through scaling

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.305722Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.305722Z digest=sha256:80511664322883430285cc1dad41fb48d5207dca65d3ebc74a94e9e83076adc5

Observation f02bc71e-5f27-4749-a6bf-d6e64001e1f5 · outbound

This paper cites DeAR: A Deep-learning-based Audio Re-recording Resilient Watermarking.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training DeAR: A Deep-learning-based Audio Re-recording Resilient Watermarking

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.411732Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.411732Z digest=sha256:021b58ae22f36eb8365213bfccccbe57ec7e3a873a7b75e83f4772cdac91d90a

Observation 52adeee5-bc53-4369-843d-160bf6a487e9 · outbound

This paper cites Techniques for data hiding,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Techniques for data hiding,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.546684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.546684Z digest=sha256:19685d3738a8483f6c0bc5235032d86bf4571c83eca1b3a5530f2d538c42d96a

Observation 107565b5-0ab9-4990-a8eb-433ba4186345 · outbound

This paper cites WavMark: Watermarking for Audio Generation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training WavMark: Watermarking for Audio Generation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.666307Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.666307Z digest=sha256:48f5cadfbefcd9023995c2dcd32d0b5c7054979168a6573fb1ca5931e5f9b0ca

Observation 5e7347d4-519b-418d-bf00-40b42663e6df · outbound

This paper cites Maskmark: Robust neu- ralwatermarking for real and synthetic speech,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Maskmark: Robust neu- ralwatermarking for real and synthetic speech,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.841554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.841554Z digest=sha256:552538e4415bf54143e761bdbfc79beecfaf4b7d0ec678610ca8363f0ab2db30

Observation 63796681-a48e-409e-8fc7-bf12106c1482 · outbound

This paper cites Silentci- pher: Deep audio watermarking,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Silentci- pher: Deep audio watermarking,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:40.955096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:40.955096Z digest=sha256:752fe36c5d0d87251f434c0dcf725180a66595e5b6a2ad071d27ae114b1ef09b

Observation 53bffafb-423c-45c9-89f0-cc72ef788c8a · outbound

This paper cites Hybrid Transformers for Music Source Separation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Hybrid Transformers for Music Source Separation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.035860Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.035860Z digest=sha256:95d5a46d0bebfd7183e1d996a96aad83c17e521d9c458ce98afa425252be8023

Observation 038509e1-0816-485e-b164-c5f229689d3c · outbound

This paper cites TF-GridNet: Making Time-Frequency Domain Models Great Again for Monaural Speaker Separation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training TF-GridNet: Making Time-Frequency Domain Models Great Again for Monaural Speaker Separation

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.137465Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.137465Z digest=sha256:9f40f8e04a4e6696f890d5887f5fbc0f326690282fa0e90b4221745d0c21765d

Observation 99f3b199-2a20-40ff-98a4-73f67df10bad · outbound

This paper cites Open-unmix - a reference imple- mentation for music source separation,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Open-unmix - a reference imple- mentation for music source separation,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.197167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.197167Z digest=sha256:767028d86bbb1733495a7acff786918ff3568781ee3c843b00c846e9f75ff67a

Observation abc55813-17bc-4066-b1d8-6a1155c8195d · outbound

This paper cites Spleeter: a fast and efficient music source separation tool with pre-trained models,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Spleeter: a fast and efficient music source separation tool with pre-trained models,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.324195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.324195Z digest=sha256:cda9b0029d4b62f03be58d375b5c4032e528a6db4e0bc382f3e48cf8aa14f98c

Observation 6b5856eb-1bcf-4fc9-9aa1-c11c7cf43d11 · outbound

This paper cites Hybrid Spectrogram and Waveform Source Separation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Hybrid Spectrogram and Waveform Source Separation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.434039Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.434039Z digest=sha256:82d221de2df8c45ab17e7d9da5a4a987553bd24e4fd1721af4be81445e285502

Observation 0c892742-1fd4-400a-bd8a-c6751a917048 · outbound

This paper cites Conformer: Convolution-augmented Transformer for Speech Recognition.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Conformer: Convolution-augmented Transformer for Speech Recognition

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.525577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.525577Z digest=sha256:13d9d8662cef64d97fbe7eab244ee83f969076500badaff2df099c5a99a0ad0f

Observation 574f46d1-3428-4df6-a6c9-888afe8c17e7 · outbound

This paper cites Aura: A stegaformer-based scalable deep audio wa- termark with extreme robustness,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Aura: A stegaformer-based scalable deep audio wa- termark with extreme robustness,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.597480Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.597480Z digest=sha256:b8f94f090f655747f43376b40a3c7207689ee2637688632487145ea435afe7df

Observation cc2bc651-a8ab-4625-a234-0c758f4dbbcd · outbound

This paper cites FiLM: Visual Reasoning with a General Conditioning Layer.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training FiLM: Visual Reasoning with a General Conditioning Layer

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.661694Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.661694Z digest=sha256:0748ea9f3f299923f8ee4eb9f16b2b5fa8081032344242ee34df73b9567b50d7

Observation 5a2c8fa7-cfe5-493e-a49b-63dfaa1f8206 · outbound

This paper cites Robust speech watermarking by a jointly trained embedder and detector using a dnn,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Robust speech watermarking by a jointly trained embedder and detector using a dnn,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.789963Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.789963Z digest=sha256:de4f69a39360c680aaded638f5796588f94577b3b2326c888ac76d835d4c68cf

Observation 2fa367fd-061b-4282-81cd-f68e58ef216d · outbound

This paper cites Wave-u-net: A multi-scale neural network for end-to-end audio source separation,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Wave-u-net: A multi-scale neural network for end-to-end audio source separation,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:41.974092Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:41.974092Z digest=sha256:0df5682de0b189330c1f80ab936dd762e96ef027b7b0ce0675e16235566bd386

Observation fe3fc82d-380f-4a08-91e2-8636820a9b4e · outbound

This paper cites Bidirectional recurrent neural networks,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Bidirectional recurrent neural networks,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.085674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.085674Z digest=sha256:473e5919a239ab8d248733cea227e1095f440174fd8706b5489824f10f9bface

Observation 8e876df4-ebdd-455b-9dcc-c250e554ba5f · outbound

This paper cites Musical source separation: An introduction,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Musical source separation: An introduction,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.166168Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.166168Z digest=sha256:78f661a92621283c15260399c754df2dafcaa49c9213500f90ef3f8ddb6ddbb2

Observation dcdd2f65-8a93-4e74-85dd-56cbd601492d · outbound

This paper cites Performance mea- surement in blind audio source separation,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Performance mea- surement in blind audio source separation,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.290913Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.290913Z digest=sha256:a4654de66158966c6d03633ecc4be925ef5fcb738eec88a8787fbeae6f6116c4

Observation 3349f34a-a4ba-4c31-b76e-bfc992d08c79 · outbound

This paper cites FMA: A Dataset For Music Analysis.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training FMA: A Dataset For Music Analysis

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.342050Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.342050Z digest=sha256:b8a1fcdefd39c4da7291f4290d243eb3f57a7972c66c10b710043c3225c68875

Observation 74e8b097-9b56-4718-84c0-761387fba4d7 · outbound

This paper cites Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.435007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.435007Z digest=sha256:862ba8b7e95cf63f2b54da0a888c3578a9b54c20094b4e9957bfbacd8eae3511

Observation 42ca25ff-c58d-4cf9-8c72-b797e366800e · outbound

This paper cites The musdb18 corpus for music separation,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training The musdb18 corpus for music separation,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.511762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.511762Z digest=sha256:e6141311595b86f02869b4f6d6a8f4602fee483d37ad9c1b7e2aef4f80fc11e1

Observation 226673d6-99e2-4c78-aaa2-02f64a4e0c1d · outbound

This paper cites BigVGAN: A Universal Neural Vocoder with Large-Scale Training.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training BigVGAN: A Universal Neural Vocoder with Large-Scale Training

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.596651Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.596651Z digest=sha256:924f105f650767f59a15a7fd716d0947eeababcb0200496c4493ce2c39bed048

Observation 6831850f-cf73-4a3f-ad19-13c231338263 · outbound

This paper cites Noise-to-mask ratio loss for deep neural network based audio watermarking,.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Noise-to-mask ratio loss for deep neural network based audio watermarking,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.653314Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.653314Z digest=sha256:876ab5261041ce09fe7c7e2b877e4c544fd1bc4f84b1cf185d89c45eda0f1a95

Observation 98b2569b-0c78-4d37-a140-1877a79b48be · outbound

This paper cites ViSQOL v3: An Open Source Production Ready Objective Speech and Audio Metric.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training ViSQOL v3: An Open Source Production Ready Objective Speech and Audio Metric

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:42.705090Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:42.705090Z digest=sha256:252bdf3b87ad17869c32b6d1c2ba24368efa919023cd2bc4172a3f5fe7d3c0ed

Pith citing papers

Observation d95a5364-4c2f-4396-946b-a1b22a37c019 · inbound

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training cites this paper.

Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T18:03:39.804104Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T18:03:39.804104Z digest=sha256:fa098ef87fcd445526059a6f5e8331ddf315936f867453b3f8a9159c6af20222