{"as_of":"2026-08-18T09:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:91432f42ef6451ea27e10341a3d50d345949a6150b95c055ebc031906257def7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:38:44.171139Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T12:57:07.589361Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-08-14T13:38:44.171139Z","title":"V oice- Filter: Targeted Voice Separation by Speaker-Conditioned Spec- trogram Masking,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.04737","last_updated":"2019-08-13T16:56:41Z","snapshot_observed_at":"2026-08-18T02:59:21.463156Z","submitted_at":"2019-08-13T16:56:41Z","title":"End-to-End Multi-Speaker Speech Recognition using Speaker Embeddings and Transfer Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:38:44.171139Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/1908.04737"},"observation_digest":"sha256:3fcdab7fec9f91ef751be3d607c7eff1aec0a25aba364d766a7e5ed4f0a9fbc0","observation_id":"45f9cf6b-e8a3-4aa0-9f84-112abc83ea01","resolution":{"observed_at":"2026-08-14T13:38:44.171139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-08-12T15:53:11.061029Z","title":"V oicefilter: Targeted voice separation by speaker-conditioned spectrogram masking,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13811","last_updated":"2024-11-25T00:21:53Z","snapshot_observed_at":"2026-08-14T00:03:13.464897Z","submitted_at":"2024-11-21T03:21:42Z","title":"X-CrossNet: A complex spectral mapping approach to target speaker extraction with cross attention speaker embedding fusion","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:53:11.061029Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/2411.13811"},"observation_digest":"sha256:095f0b03ef843b5a18660f4ecbbd50e12b6faf57f59fde79b3f0e88c1f731e88","observation_id":"8841318e-8b8e-458b-876c-4e54099e768f","resolution":{"observed_at":"2026-08-12T15:53:11.061029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-08-11T21:56:42.003212Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03980","last_updated":"2024-12-05T08:56:54Z","snapshot_observed_at":"2026-08-16T03:17:55.914916Z","submitted_at":"2024-12-05T08:56:54Z","title":"Comprehensive Audio Query Handling System with Integrated Expert Models and Contextual Understanding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T21:56:42.003212Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/2412.03980"},"observation_digest":"sha256:6ff082ba1e0b649ee45cda4d65a0150aa8a0a708bf8809e382de889775a67931","observation_id":"faba0c50-5095-49cc-a2c3-325524baf5ec","resolution":{"observed_at":"2026-08-11T21:56:42.003212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-08-09T05:54:18.770915Z","title":"A., Weiss, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03128","last_updated":"2025-02-05T12:36:21Z","snapshot_observed_at":"2026-08-13T03:10:13.532495Z","submitted_at":"2025-02-05T12:36:21Z","title":"Metis: A Foundation Speech Generation Model with Masked Generative Pre-training","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-09T05:54:18.770915Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/2502.03128"},"observation_digest":"sha256:4a5d8eb8673e61a29d638959d58a7f52ae0adfc032721dd3d99e29efa9d7fc6b","observation_id":"387d996f-4d08-4dcf-861a-6178b55bc93d","resolution":{"observed_at":"2026-08-09T05:54:18.770915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-08-08T10:06:35.967023Z","title":"V oicefilter: Targeted voice separation by speaker-conditioned spectro- gram masking,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.08191","last_updated":"2025-02-12T08:03:27Z","snapshot_observed_at":"2026-08-15T21:03:22.262363Z","submitted_at":"2025-02-12T08:03:27Z","title":"DualStream Contextual Fusion Network: Efficient Target Speaker Extraction by Leveraging Mixture and Enrollment Interactions","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T10:06:35.967023Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/2502.08191"},"observation_digest":"sha256:4fa055e4bd84a94d412c39d0f5d6b62fe6b7abfc088397bd28be52e83e2a16d4","observation_id":"2210c1a4-6f72-4a10-a827-355990ffd65a","resolution":{"observed_at":"2026-08-08T10:06:35.967023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-08-07T15:37:09.365680Z","title":"V oice- filter: Targeted voice separation by speaker-conditioned spectro- gram masking,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14465","last_updated":"2025-05-20T15:01:30Z","snapshot_observed_at":"2026-08-17T22:44:16.988063Z","submitted_at":"2025-05-20T15:01:30Z","title":"FlowTSE: Target Speaker Extraction with Flow Matching","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:09.365680Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/2505.14465"},"observation_digest":"sha256:40114642bf64b1f3e8441a443b0e807f03db3d64e42840356bb9d2c7df61483a","observation_id":"25102226-6c02-4c11-ad2a-5d0b34580ed6","resolution":{"observed_at":"2026-08-07T15:37:09.365680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-08-05T22:07:46.317445Z","title":"A.; Weiss, R","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.07558","last_updated":"2025-08-11T02:35:54Z","snapshot_observed_at":"2026-08-08T11:57:57.874638Z","submitted_at":"2025-08-11T02:35:54Z","title":"UniFlow: Unifying Speech Front-End Tasks via Continuous Generative Modeling","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T22:07:46.317445Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/2508.07558"},"observation_digest":"sha256:4895ed00f992b9400a796d224a374b10c40ab059d0e45dfd10c5afe6039ae086","observation_id":"874644e3-00e2-47b6-843e-b763ee0c6c55","resolution":{"observed_at":"2026-08-05T22:07:46.317445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-08-05T14:24:34.109330Z","title":"V oicefilter: Targeted voice separation by speaker-conditioned spectrogram masking,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21470","last_updated":"2025-08-29T09:50:05Z","snapshot_observed_at":"2026-08-15T05:24:25.782456Z","submitted_at":"2025-08-29T09:50:05Z","title":"Fundamentals of Data-Driven Approaches to Acoustic Signal Detection, Filtering, and Transformation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T14:24:34.109330Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/2508.21470"},"observation_digest":"sha256:af64513a9ae248f3df105182f9529e9648ed5a1e796efaecde9375e40641f78c","observation_id":"277a7ae1-61ff-4726-84bc-c37cbb9ff803","resolution":{"observed_at":"2026-08-05T14:24:34.109330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","version":6},"cited_work":{"arxiv_id":"1810.04826","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.04826","snapshot_observed_at":"2026-07-10T12:57:07.589361Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking","venue":"eess.AS","work_id":"41c90163-d0d3-450b-849c-9bc354214ad8","year":2018},"citing_paper":{"arxiv_id":"2607.08111","last_updated":"2026-07-09T04:51:11Z","snapshot_observed_at":"2026-08-02T16:21:04.923669Z","submitted_at":"2026-07-09T04:51:11Z","title":"PS4: Proxy-Supervised Joint Training for Real Target Speaker Extraction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T12:54:17.490105Z"},"links":{"cited_paper":"/paper/1810.04826","citing_paper":"/paper/2607.08111"},"observation_digest":"sha256:18a7c4a573414c5032f1febd08c1297e19400cdb125eaae735e42dd3cf43b841","observation_id":"d2f01861-67ed-4bcc-9e2f-22a0fc83e479","resolution":{"observed_at":"2026-07-10T12:57:07.591118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1810.04826/citation-record","integrity":"/paper/1810.04826/integrity","json":"/paper/1810.04826/citation-record.json","paper":"/paper/1810.04826"},"outbound":[],"paper":{"arxiv_id":"1810.04826","last_updated":"2019-06-19T17:10:51Z","latest_version":6,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T18:16:27.334746Z","submitted_at":"2018-10-11T02:57:14Z","title":"VoiceFilter: Targeted Voice Separation by Speaker-Conditioned Spectrogram Masking"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:1810.04826."}