Pith. sign in

Paper Citation Record · LEDGER

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds

As of 9 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 2 inbound Pith citation observations for arXiv:2506.02499.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.02499 v2

Coverage vector

measured 31 of 31 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T11:26:10.917974Z

measured 33 of 33 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T11:26:08.307554Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-12T10:01:29.067292Z

Reference resolution

31 of 31 outbound references displayed

  • verified exact1
  • verified fuzzy24
  • unresolved6
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 4bc3b4e2-93ef-4f46-ba8b-e6b2a40ac92e · outbound

This paper cites DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T11:26:08.307554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:26:08.307554Z digest=sha256:1f60a613d821c619e3c25881df59ee964d7f19b0e2bd5da109a1ac2e285daa2b

Observation 477113ed-8c3a-4570-9f59-53ac54726830 · outbound

This paper cites an unresolved cited work.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T11:26:13.691594Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:08.397233Z digest=sha256:194099e20bd23f2f1ff5a53f536a2fd473291cd4c654f6ae3c2db17fe39af66b

Observation 240f02a4-00a8-467e-85ed-205cb400a7a6 · outbound

This paper cites Motivation In the actual movie audio, we can decomposex s as follows: xs =x v +x n,(2) wherex v andx n correspond to the waveforms of verbal and non-verbal sounds, respectively.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Motivation In the actual movie audio, we can decomposex s as follows: xs =x v +x n,(2) wherex v andx n correspond to the waveforms of verbal and non-verbal sounds, respectively

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.633367Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:08.494147Z digest=sha256:5c7fd07bd739706af34d7abd604b9ab60cb95aa1a85bd950f5c8e56b5fb607e3

Observation 863e12a4-1327-4f5c-9934-ab957207a5b1 · outbound

This paper cites Settings To evaluate the effectiveness of the proposed dataset, we con- ducted CASS experiments.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Settings To evaluate the effectiveness of the proposed dataset, we con- ducted CASS experiments

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.612512Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:08.559016Z digest=sha256:347d552ee6aed54e871d48f7179f0144961a980f1140ebeb81bc8a6705cd92de

Observation 3b355aea-c3fd-4d79-9704-b58a086f8e51 · outbound

This paper cites To address this issue, we built a new dataset containing non-verbal sounds namedDnR- nonverbal.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds To address this issue, we built a new dataset containing non-verbal sounds namedDnR- nonverbal

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.596545Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:08.675340Z digest=sha256:c4f017d76f439074952c4b8a7adb451c7564ede1bfcefb845e01378968a8b52c

Observation 5260f1eb-e6ad-44bd-9c9d-4ddd636f6c02 · outbound

This paper cites The sound demixing challenge 2023-cinematic demixing track,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds The sound demixing challenge 2023-cinematic demixing track,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.579211Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:08.754633Z digest=sha256:9a65c024a46919bf8debdb0bbe4e980131fa2f498210a3a090a908295f5ec027

Observation 853dc9ba-605b-4674-a8fc-b52f466a530d · outbound

This paper cites Supervised speech separation based on deep learning: An overview,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Supervised speech separation based on deep learning: An overview,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.561698Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:08.834619Z digest=sha256:ee48f76aad242f2d29d992df57e843cc56b58b7a61191c0cc8272a52ab6a0cee

Observation a6eadb68-fd61-42e2-9745-bdf983223694 · outbound

This paper cites Conv-TasNet: Surpassing ideal time– frequency magnitude masking for speech separation,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Conv-TasNet: Surpassing ideal time– frequency magnitude masking for speech separation,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.542876Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:08.966726Z digest=sha256:71b4c5883e4b41f3375b03f1e4b6a34bab2340bd7a860b2bf52ef01ba2e2d980

Observation bbb4d0b9-de4e-40fc-88e8-c020c634f3c7 · outbound

This paper cites TF-GridNet: Integrating full- and sub-band modeling for speech separation,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds TF-GridNet: Integrating full- and sub-band modeling for speech separation,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T11:26:09.054261Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:26:09.054261Z digest=sha256:5900d11ff6523fa8a6d004f74beca58f1cbc591a348f86869e1f97d064a4da06

Observation c314b9b3-8fe4-4a57-b994-a22666d5099c · outbound

This paper cites The 2018 signal separation eval- uation campaign,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds The 2018 signal separation eval- uation campaign,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.513919Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.130709Z digest=sha256:fda477cc6d0e155b920dc820418022f63e92a977abf6ddbbd487f5d512df3b29

Observation 08e9fa2b-41cb-4588-8611-2d27d872c9a3 · outbound

This paper cites Open- Unmix - a reference implementation for music source separation,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Open- Unmix - a reference implementation for music source separation,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.492320Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.206282Z digest=sha256:2b15a58c2d8710f3f4ae645b2a99c735aa6b9a709bd109e042ac3387d0a371bc

Observation 94ae7cea-4d47-4906-bd38-e3e254de2160 · outbound

This paper cites Hybrid transformers for music source separation,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Hybrid transformers for music source separation,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.470963Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.309694Z digest=sha256:0ed2a2a48fb8a7922c2a2f5fb4b6e5e22761e96c1da50581f30b67b894262472

Observation 452d209e-b91f-4382-aa50-02423d4e3b70 · outbound

This paper cites Universal sound separation,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Universal sound separation,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.451787Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.391215Z digest=sha256:2f8b4238c9f4cf103ebbb4115c198704339fad7a17a44a310e3ecb0302b60ec2

Observation 8841dde0-c76c-43ad-a949-2bfb315154a6 · outbound

This paper cites The cocktail fork problem: Three-stem audio separation for real- world soundtracks,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds The cocktail fork problem: Three-stem audio separation for real- world soundtracks,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.432325Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.462321Z digest=sha256:fa73bba25ea32013018bfff775ab90fc179752b43f2e362da2693e386530134e

Observation 21b927c6-b541-4d7e-a111-79d74a476add · outbound

This paper cites A general- ized bandsplit neural network for cinematic audio source separa- tion,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds A general- ized bandsplit neural network for cinematic audio source separa- tion,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.413048Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.546046Z digest=sha256:6b67acea17c35bccaf319ea2e9d24080bab6fda9b5a8faec1cb96800fd66c70d

Observation b136c3a8-04ec-4a30-ac97-fbd73ea42424 · outbound

This paper cites Music source separation with band-split RNN,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Music source separation with band-split RNN,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.392521Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.655749Z digest=sha256:d399c2e750c2ee77672d1c4036f128b3c153a8438f470a9273ecddbcc2a4b601

Observation ec275346-37c0-4174-9872-8a9592af11af · outbound

This paper cites Lib- riSpeech: an ASR corpus based on public domain audio books,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Lib- riSpeech: an ASR corpus based on public domain audio books,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.369763Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.733574Z digest=sha256:ebc6a1d2d5ba837c8bcd421a11b43fbcc18334d1d84d13ae34e6cd319ed01f7b

Observation 9b6ec578-7f61-4172-9148-91bed59b0c0b · outbound

This paper cites FMA: A dataset for music analysis,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds FMA: A dataset for music analysis,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.322807Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:09.819652Z digest=sha256:d458094a0f1043c76420ea0092744e3e749fc12060b5790b65901f46c048a4e7

Observation 67de3525-a519-43b2-88af-a073a98efd70 · outbound

This paper cites FSD50K: An Open Dataset of Human-Labeled Sound Events.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds FSD50K: An Open Dataset of Human-Labeled Sound Events

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T11:26:09.913604Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:26:09.913604Z digest=sha256:612d9628cef8fd875b8120b8fb8622e20c8c47950bd43a43a1e285b6a1688c3d

Observation 188cfe9e-2344-4090-b6b5-6b75da1901db · outbound

This paper cites Remastering di- vide and remaster: A cinematic audio source separation dataset with multilingual support,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Remastering di- vide and remaster: A cinematic audio source separation dataset with multilingual support,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:13.168035Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.009245Z digest=sha256:3f9fb6bf20588a1dd6466e2f1fda278fcb8d15cdc265b374ee8158df124f34b8

Observation 7fff145e-f462-4997-a7c8-7e4cb70e19e4 · outbound

This paper cites Hy- perbolic audio source separation,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Hy- perbolic audio source separation,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:12.918502Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.138699Z digest=sha256:785fcb4a811dcc56a32eaacce3f963e1ec04210702aa3d025cedab7437ecec85

Observation e4b34b3d-ccec-44a3-a532-c59dc6312802 · outbound

This paper cites PodcastMix: A dataset for separating music and speech in podcasts,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds PodcastMix: A dataset for separating music and speech in podcasts,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:12.830047Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.209784Z digest=sha256:798db0a0c10cee0ebad609bc7ca7bc5262402e505f29f10334339d90bf58ce4b

Observation bc6ca3bc-edb9-4db9-81d4-183c49c8bdc7 · outbound

This paper cites Jointly Recognizing Speech and Singing Voices Based on Multi-Task Audio Source Separation.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Jointly Recognizing Speech and Singing Voices Based on Multi-Task Audio Source Separation

Reference 23

Resolution
verified exact
local_arxiv, observed 2026-08-07T11:26:11.116952Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.280208Z digest=sha256:3461f665d25fb939b986e830f98bff6b71ac4f36561ae0eff3fba16c7ebe25c1

Observation cfd91ca2-5a4d-4c17-a42d-6061da0cf752 · outbound

This paper cites CSTR VCTK corpus: English multi-speaker corpus for CSTR voice cloning toolkit,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds CSTR VCTK corpus: English multi-speaker corpus for CSTR voice cloning toolkit,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:12.496001Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.372449Z digest=sha256:a74d5db9c9e5d3bc1cf813bd609b1f5b4d46a0dbc1c78bdb42981be377a1f5fe

Observation ba438656-0a9a-4d98-b8b3-3e3e0131593e · outbound

This paper cites AISHELL-1: An open-source Mandarin speech corpus and a speech recognition baseline,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds AISHELL-1: An open-source Mandarin speech corpus and a speech recognition baseline,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:12.158601Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.443563Z digest=sha256:b94acc72b45514ac6538dfa6717f702c0608acfa9ee396b9322f6419d06bc95e

Observation da66c525-b791-4f70-b319-f46780d29c71 · outbound

This paper cites Audio set: An ontology and human-labeled dataset for audio events,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Audio set: An ontology and human-labeled dataset for audio events,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:11.749914Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.537215Z digest=sha256:f6a7bb5fd5649a270053a1820b4543540a517444e5ae813133f80ce3b984742b

Observation 2f38cb89-90c3-4efc-a684-0e9f230f34ef · outbound

This paper cites GPT-4o System Card.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds GPT-4o System Card

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T11:26:10.608433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:26:10.608433Z digest=sha256:7cb646e09f4170688470da8274ecf1af1cd3b4718da20cb36491d89efe97eb0c

Observation 2b12572a-98b7-40e1-982f-7e4a3623e13e · outbound

This paper cites Toward a recommendation for a European standard of peak and LKFS loudness levels,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Toward a recommendation for a European standard of peak and LKFS loudness levels,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:11.515817Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.684202Z digest=sha256:5d6a47599aadd477979faa95fe40b5c458cf3cac1e62989db7f9bc5200cfa120

Observation 59bec6dc-e9bc-4d7a-9212-5e66caa09e6b · outbound

This paper cites Long short-term memory,.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Long short-term memory,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T11:26:10.770747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:26:10.770747Z digest=sha256:5f9a73aea5bfdb65e66c0faabcdce1bd4cc1dd7ad1da546d39e49d3921f6a80d

Observation b1910e17-cd90-41d9-b1cc-604b71c8a438 · outbound

This paper cites Adam: A method for stochastic opti- mization.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Adam: A method for stochastic opti- mization

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:11.421775Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.865536Z digest=sha256:1702f3e26ed0e2c674889b8fcbba0790c87ab7a539ed46bf628dc29e5ae35f61

Observation 29f827db-996a-4237-a769-64a90c6b7694 · outbound

This paper cites Why does music source separation benefit from cacophony?.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds Why does music source separation benefit from cacophony?

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T11:26:11.293933Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-07T11:26:10.917974Z digest=sha256:ac630a0edebb65a064f552d15cfbad78528b6ee918235aeff230846318a6ace3

Pith citing papers

Observation 4bc3b4e2-93ef-4f46-ba8b-e6b2a40ac92e · inbound

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds cites this paper.

DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T11:26:08.307554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:26:08.307554Z digest=sha256:1f60a613d821c619e3c25881df59ee964d7f19b0e2bd5da109a1ac2e285daa2b

Observation caee2fc7-fefb-4d55-bb43-363e3ab0548b · inbound

A Knowledge-Driven Approach to Target Speech Extraction in the Presence of Background Sound Effects for Cinematic Audio Source Separation (CASS) cites this paper.

A Knowledge-Driven Approach to Target Speech Extraction in the Presence of Background Sound Effects for Cinematic Audio Source Separation (CASS) DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds

Reference 7

Resolution
verified exact
arxiv_id, observed 2026-05-12T10:01:29.070570Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-07T08:16:56.671345Z digest=sha256:9bdad7c605cc784a0561f8e9a6028b89a3e641d1e24665a26ff4f9a5689a9272