Pith. sign in

Paper Citation Record · LEDGER

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction

As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2607.27436.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.27436 v1

Coverage vector

measured 42 of 42 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-31T00:58:13.747106Z

measured 43 of 43 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-31T00:58:13.613182Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

42 of 42 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved41
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 7cda655a-b846-4a42-9bc1-9aeb82623079 · outbound

This paper cites Deep learning has significantly improved separation performance un- der controlled conditions.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Deep learning has significantly improved separation performance un- der controlled conditions

Reference 1

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.608691Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.608691Z digest=sha256:749e5d1e30e4728c73b6f7a3f986a9c6988914df15d862632913227a2479c1c2

Observation 633c1e70-c5af-4cb9-9e38-8080bd1f9915 · outbound

This paper cites WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction

Reference 2

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.613182Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.613182Z digest=sha256:1b76533c675e73453f12f542af29f3b92cc07965a7e66abd0d3dd4834063b925

Observation f1e60e79-5593-40ea-b51a-c851149cc943 · outbound

This paper cites It operationalizes the generalized TSE for- mulation in Section 2 and supports systematic exploration of single-, multi-, and heterogeneous-cue settings.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction It operationalizes the generalized TSE for- mulation in Section 2 and supports systematic exploration of single-, multi-, and heterogeneous-cue settings

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.617340Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.617340Z digest=sha256:5586ee5238aa8f681fdbad7cabd99086da2622f749f3e6a202a5964375340f18

Observation 28fde3a6-e52e-4fa8-9510-ea26b94e07e9 · outbound

This paper cites an unresolved cited work.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Unresolved cited work

Reference 4

Resolution
malformed identifier
no resolver link, observed 2026-07-31T00:58:13.621040Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.621040Z digest=sha256:1980ffa46c98eaebf8f39b0c031116ee4cb1b4785719256084757408bbf8d7b7

Observation 58d7f203-7605-45b1-bf82-5ab0f2a839c1 · outbound

This paper cites an unresolved cited work.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Unresolved cited work

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.624975Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.624975Z digest=sha256:db2cf0de9eac1fa3ca680d747429da1e0f8ccfdd084ca5fce6af89108221556c

Observation 7ef3e099-7689-4789-887d-99c2f164d437 · outbound

This paper cites 62401377 and No.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction 62401377 and No

Reference 6

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.628359Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.628359Z digest=sha256:93f3ebc64618ad0f32305ec683ee60c900985624b43082056b7ed0c7d27f6d0b

Observation 9024c6b7-980f-4f95-8e99-7e8b70ad501a · outbound

This paper cites an unresolved cited work.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.631873Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.631873Z digest=sha256:1975a1786c5d66d76e3c1ed42db717c4fd27971642579cde542efc151576c5e1

Observation 5a7ff657-1d6c-4021-9c83-4b159a90bbf3 · outbound

This paper cites Advances in Speech Separation: Techniques, Challenges, and Future Trends.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Advances in Speech Separation: Techniques, Challenges, and Future Trends

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.635128Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.635128Z digest=sha256:c3e574b1eedd8f7cfc77462abd681f9183bedb109ca9fec87b068bc241112239

Observation e559aa31-fce4-4c92-a122-1180779faadd · outbound

This paper cites Supervised speech separation based on deep learning: An overview,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Supervised speech separation based on deep learning: An overview,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.638827Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.638827Z digest=sha256:dbcac1de4a5ef963853f9c8ae95ba248d3945ee679e82d88326d15a437cf38a7

Observation 7aacfac9-9a35-45d0-be5f-249dd05ff061 · outbound

This paper cites Neural target speech extraction: An overview,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Neural target speech extraction: An overview,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.642120Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.642120Z digest=sha256:28ef05fa3901e03c1a88043bcd032ae42705f8b39881dc6c76c004c99bbe9d5e

Observation 07ceedce-ca77-4d6e-8b01-14ca17fd3a6d · outbound

This paper cites Usef-tse: Universal speaker embedding free target speaker extraction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Usef-tse: Universal speaker embedding free target speaker extraction,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.645313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.645313Z digest=sha256:661951483ba3e5d2eef3e24c8caabca00251e8d85edfdf1716e94615cd7bd654

Observation c48121e5-81ea-428b-8b41-789b789c8386 · outbound

This paper cites Multi-level speaker representation for target speaker extraction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Multi-level speaker representation for target speaker extraction,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.648804Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.648804Z digest=sha256:e5a026d0aa4cec84371374a7f30258178c33ae70657bd09f12d889b91b2a7ccc

Observation 7dc5a566-ac56-46ed-acf4-c9825dfe3eee · outbound

This paper cites Listen to extract: Onset-prompted target speaker extraction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Listen to extract: Onset-prompted target speaker extraction,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.652138Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.652138Z digest=sha256:4bd16e1e996f7bf85b38dd43fc48cdb648c5b263eb5cfff6930d19a437a99676

Observation 24d61268-f80a-47e3-acda-7cf5782dc481 · outbound

This paper cites 3d spatial features for multi-channel target speech separation,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction 3d spatial features for multi-channel target speech separation,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.655305Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.655305Z digest=sha256:5d2cc02c299337ddbdbaa22b9fb411be727ae8b2497f5e42ea00482e39fba37d

Observation 707a22bd-fa25-47ea-bd10-8445f75e440f · outbound

This paper cites 3s-tse: Efficient three-stage target speaker extraction for real-time and low-resource applications,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction 3s-tse: Efficient three-stage target speaker extraction for real-time and low-resource applications,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.659084Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.659084Z digest=sha256:c941403cf043c7bf35fb281720c5f7d1cbe45b0c6587c4027f0aa6f79554dd65

Observation cbdf3d8d-d2bd-4ca3-bbca-a8e388f32a33 · outbound

This paper cites Doa or speaker embed- ding: Which is better for multi-microphone target speaker extrac- tion,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Doa or speaker embed- ding: Which is better for multi-microphone target speaker extrac- tion,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.662112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.662112Z digest=sha256:2a9842a5d2ce0fb7afd5b240004253f24a0f9aeeb95860c29df4d09fac1e976b

Observation 59fd683b-8852-4701-a3fa-4c2b42fed570 · outbound

This paper cites Muse: Multi-modal tar- get speaker extraction with visual cues,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Muse: Multi-modal tar- get speaker extraction with visual cues,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.665309Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.665309Z digest=sha256:31dea55230f325fcad886ad1c0bed921a52106ef2052874042ed69eb29370739

Observation 40729d69-5bd8-4a27-926e-ef2bd86dc57a · outbound

This paper cites Usev: Universal speaker extraction with visual cue,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Usev: Universal speaker extraction with visual cue,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.669003Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.669003Z digest=sha256:86d7c76d82d47952d2b747a9a3845b37affdde75c20583fd52ce03a55981f238

Observation 336076a2-4259-4566-b556-eccb34e13a8f · outbound

This paper cites Efficient audio-visual speech separa- tion with discrete lip semantics and multi-scale global-local atten- tion,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Efficient audio-visual speech separa- tion with discrete lip semantics and multi-scale global-local atten- tion,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.671879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.671879Z digest=sha256:75c180532fa99f6dd83e1f52a18d4b3284b688d9b2e0b791d086d48a5f3d279f

Observation e8d614d7-6b92-4100-9602-2d70ff910ecd · outbound

This paper cites Detect, Attend and Extract: Keyword Guided Target Speaker Extraction.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Detect, Attend and Extract: Keyword Guided Target Speaker Extraction

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.674758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.674758Z digest=sha256:66cd81ef6123edb0a205970e940c9e367200612dce7f2c2c1e25bd4f738cfe2a

Observation d6c30afe-afbb-478c-8861-5436b26b1a50 · outbound

This paper cites Contex- tual speech extraction: Leveraging textual history as an implicit cue for target speech extraction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Contex- tual speech extraction: Leveraging textual history as an implicit cue for target speech extraction,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.679032Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.679032Z digest=sha256:9b54a5f82d62c9c3b0604fe70ac0e04cd15265357a2e7699a32d49813c86bf2e

Observation 2aa980d1-0df6-42e8-adc3-c4b20fd89d46 · outbound

This paper cites Speaker Extraction with Detection of Presence and Absence of Target Speakers,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Speaker Extraction with Detection of Presence and Absence of Target Speakers,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.682321Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.682321Z digest=sha256:7ac583e78469e4dd37abc8d4b8375cda8d3e47af63957ff26b9ae8d8e59a672d

Observation 20d1f8be-33fe-4df8-904e-1b232f99af31 · outbound

This paper cites Momuse: Momentum multi-modal target speaker extraction for real-time scenarios with impaired visual cues,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Momuse: Momentum multi-modal target speaker extraction for real-time scenarios with impaired visual cues,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.685605Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.685605Z digest=sha256:f9d899dd458f67ab8ea5c5a9db0d1d362b119e4d009c2bfe8af8cac1d4a584c5

Observation 9c466080-9524-4cd3-9922-414c35719e65 · outbound

This paper cites Multimodal attention fusion for target speaker ex- traction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Multimodal attention fusion for target speaker ex- traction,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.688600Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.688600Z digest=sha256:fd907e934a02d58b93a22fb9cac857bf0b850caa6776b0055e18a0959a376f4a

Observation 14fb368d-02a1-44b9-9cb3-1f622e337a6f · outbound

This paper cites Beyond speaker identity: Text guided target speech ex- traction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Beyond speaker identity: Text guided target speech ex- traction,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.691801Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.691801Z digest=sha256:802ab27fd143ea1ce19cde5146026e23933e46e171fe4cdeea8304cc94bfc827

Observation 3ca07a5a-07b2-4c86-aa42-41fdf15d23d3 · outbound

This paper cites WeSep: A Scalable and Flexible Toolkit Towards Gen- eralizable Target Speaker Extraction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction WeSep: A Scalable and Flexible Toolkit Towards Gen- eralizable Target Speaker Extraction,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.694838Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.694838Z digest=sha256:47de9aa6b7c126ee89c0503a65b5641e213a109b90df71d4c5e7a33169282a6c

Observation abbf2fb1-b965-45dd-a007-46e3cac6a940 · outbound

This paper cites ClearerV oice-Studio: Bridging Ad- vanced Speech Processing Research and Practical Deployment,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction ClearerV oice-Studio: Bridging Ad- vanced Speech Processing Research and Practical Deployment,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.698107Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.698107Z digest=sha256:f33fe2720fb47ac802bce43ab0ad3a7f8d1fc014815c56ac22ac68b8ddc12d92

Observation 9c06811d-3e5a-45e9-972e-8ff951c6287f · outbound

This paper cites Wespeaker: A research and production oriented speaker embedding learning toolkit,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Wespeaker: A research and production oriented speaker embedding learning toolkit,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.701313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.701313Z digest=sha256:e81d09610000391d1b24650d8e423fde2a7d6a55839dcb932452ed7bfe47982b

Observation 9747c5db-65d9-48be-ae97-fb5c8e10cd64 · outbound

This paper cites ECAPA- TDNN: Emphasized Channel Attention, Propagation and Aggre- gation in TDNN Based Speaker Verification,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction ECAPA- TDNN: Emphasized Channel Attention, Propagation and Aggre- gation in TDNN Based Speaker Verification,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.704803Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.704803Z digest=sha256:cde1189a900d4aea4cc04ecf3e35e6b951f84498cc95d04210e73d2a90eed9dc

Observation bb8f5bd5-5f6c-4fc8-b3dd-d1986ca7fa26 · outbound

This paper cites A study of multichannel spatiotemporal features and knowledge distillation on robust target speaker extraction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction A study of multichannel spatiotemporal features and knowledge distillation on robust target speaker extraction,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.708034Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.708034Z digest=sha256:61fde42cee9200f66eb26ac75795bd178dd0fd153bf282602f9e7ac9cf197160

Observation 83d52725-d8fa-47ae-b9f0-e0dea7aea5d0 · outbound

This paper cites End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios

Reference 31

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.711323Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.711323Z digest=sha256:f0ef9c2576ea38df7af786d2d98ecc871c1db21faa47a72a5256879d22aeec3b

Observation f0fd3e8f-f9dd-41d7-9cbf-9d9de83780d5 · outbound

This paper cites Spatially selective deep non-linear filters for speaker extraction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Spatially selective deep non-linear filters for speaker extraction,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.714925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.714925Z digest=sha256:34674a4483df98849e568c4b6f4a548a90bbf01ea3a77cf72bd31385d1e5f881

Observation 16f331ad-5cbc-45f4-8a1c-f2d7dd787d9f · outbound

This paper cites Dpccn: Densely- connected pyramid complex convolutional network for robust speech separation and extraction,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Dpccn: Densely- connected pyramid complex convolutional network for robust speech separation and extraction,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.718093Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.718093Z digest=sha256:2a372c2e8a541f826487b3cb35511d01910c0343a8e219fa7baa587864a0b873

Observation 033264c1-7d4a-4528-8c77-cef666405b4e · outbound

This paper cites Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.721237Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.721237Z digest=sha256:db31bb32804559e5c717ffe9bb52fb7d2bd78a4a222d21240bbe9f0e1ccf6044

Observation 0f8b26ef-70ac-422d-9bbf-aa206cddb358 · outbound

This paper cites Music source separation with band-split rnn,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Music source separation with band-split rnn,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.724769Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.724769Z digest=sha256:dcae17cbe22a303bcbfd39c59872c07f6afeb833a6c631b292416ad3da5a413b

Observation 2f09ade8-56b6-44f7-a69a-743735eaa37d · outbound

This paper cites Tf-gridnet: Making time-frequency domain models great again for monaural speaker separation,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Tf-gridnet: Making time-frequency domain models great again for monaural speaker separation,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.727742Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.727742Z digest=sha256:01e1507dca700b7271f15881f837eff80749224b551cd7a5461da4a0857a3cec

Observation b30f684a-4dfd-465d-85eb-e87d56c80c27 · outbound

This paper cites NBC2: Multichannel Speech Separation with Revised Narrow-band Conformer.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction NBC2: Multichannel Speech Separation with Revised Narrow-band Conformer

Reference 37

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.730997Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.730997Z digest=sha256:2b764d83b9b096c511ee14da526f0d97a0c98a4b35c3677a6d7203548c4af2a7

Observation 5b483fb0-bb24-4fb0-bd96-b108186eb2ca · outbound

This paper cites Sdr– half-baked or well done?.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Sdr– half-baked or well done?

Reference 38

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.734390Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.734390Z digest=sha256:71926cdf490c3bf8248876975bb195029d158e408551da3edb12d3b748e7eab7

Observation f403b5aa-0aa4-4497-a1ff-d4dadc635cf6 · outbound

This paper cites Librimix: An open-source dataset for generalizable speech separation,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Librimix: An open-source dataset for generalizable speech separation,

Reference 39

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.737494Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.737494Z digest=sha256:d48c9aec6989b58dc383494fc48f51864ba816f8e10920f00f316e4ab0a07464

Observation 31be0857-0807-4b51-8ad7-67fd19b78a66 · outbound

This paper cites Lib- rispeech: an asr corpus based on public domain audio books,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction Lib- rispeech: an asr corpus based on public domain audio books,

Reference 40

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.740888Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.740888Z digest=sha256:1286675d7899c1e9e1451867a48be2d42c1ece1c27ce89c7f43ec93a62d83883

Observation ad710a61-a4c7-4812-8c4f-123b51872e5d · outbound

This paper cites 100 nonspeech environmental sounds,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction 100 nonspeech environmental sounds,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.743928Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.743928Z digest=sha256:a6469ccc275cc7854027d78fef332186e9e6daf9fdac051e813a7daf9a2edfbb

Observation 82e38d44-694d-4754-adea-28b4ce3ab08f · outbound

This paper cites gpurir: A python library for room impulse response simulation with gpu acceler- ation,.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction gpurir: A python library for room impulse response simulation with gpu acceler- ation,

Reference 42

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.747106Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.747106Z digest=sha256:23f8c87c88db471fb48e555e8bcfdec6a8694a117ddd0f541a24f237983409e2

Pith citing papers

Observation 633c1e70-c5af-4cb9-9e38-8080bd1f9915 · inbound

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction cites this paper.

WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction

Reference 2

Resolution
unresolved
no resolver link, observed 2026-07-31T00:58:13.613182Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T00:58:13.613182Z digest=sha256:1b76533c675e73453f12f542af29f3b92cc07965a7e66abd0d3dd4834063b925