{"as_of":"2026-08-12T14:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0fb5c8e3e194b38df9e0e3ff2c937db6c647fcff227622db0bd8f3b3c9b8ead","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:41:03.296949Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03829/citation-record","integrity":"/paper/2509.03829/integrity","json":"/paper/2509.03829/citation-record.json","paper":"/paper/2509.03829"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.574769Z","title":"Diffcss: Diverse and expressive conversational speech synthesis with diffusion models,","venue":null,"work_id":"4e147bc8-1407-42f9-bb40-5a4c955fbacb","year":2025},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:02.968318Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:1f6f568ceb6d014fae252630db4193775d8188c4092e4b01550359b59e8f5756","observation_id":"9325b512-63be-4c84-a60d-c861bf65fd0a","resolution":{"observed_at":"2026-08-05T10:41:04.583176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.528850Z","title":"Stable- tts: Stable speaker-adaptive text-to-speech synthesis via prosody prompting,","venue":null,"work_id":"5f8cf15b-322a-4851-bf24-fde85bf47856","year":2025},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:02.989450Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:4039bd12f2118279fd7233dae8d8cd75ed3a95e6a6ab3f41e9ae4f2fbbea3925","observation_id":"6f1c16f4-65e0-4622-89e9-f013c0e76a2d","resolution":{"observed_at":"2026-08-05T10:41:04.544004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.480785Z","title":"Grad-stylespeech: Any-speaker adaptive text-to-speech synthesis with dif- fusion models,","venue":null,"work_id":"d8b69c99-7ea4-4d26-9144-bc56b6cb7376","year":2023},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:02.996926Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:6e142942e042da3942e451048f008feb6cb7c3f7945ffa34eb331987a9efa52c","observation_id":"5d14131c-b90c-4db3-9992-b23f82361d27","resolution":{"observed_at":"2026-08-05T10:41:04.495186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.424090Z","title":"Freevc: Towards high- quality text-free one-shot voice conversion,","venue":null,"work_id":"f6a1efa6-53e8-4c68-82e1-7b2005ed97cb","year":2023},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.007408Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:9181b4dab7d1d5affaf6ec5b0e90818fefd539eb21c50dea3944a9d6cdb06817","observation_id":"dd468327-e3fe-42f6-910e-fab8c23da67f","resolution":{"observed_at":"2026-08-05T10:41:04.439815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.386847Z","title":"Speechsplit2.0: Unsupervised speech disen- tanglement for voice conversion without tuning autoen- coder bottlenecks,","venue":null,"work_id":"1f9a77e4-a066-4f71-bbc5-99ef376a53fc","year":2022},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.022214Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:a5a5f69ea90cb128753551bdd40c9a68d50615035689a6494948c5ad112ad59c","observation_id":"3b84e054-a639-4d02-b893-2189e57617de","resolution":{"observed_at":"2026-08-05T10:41:04.393120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.352328Z","title":"Again-vc: A one-shot voice conversion using activation guidance and adaptive instance normalization,","venue":null,"work_id":"cb374ee7-5b23-4dff-9c6c-d382a05ff4d9","year":2021},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.033304Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:17871368b8ea29e3ce18c1c302c1ec659d4b822aa8db0d16a8b1d86c102c86ef","observation_id":"048f8bc3-8ce8-4313-87d2-511267a37522","resolution":{"observed_at":"2026-08-05T10:41:04.366622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.294827Z","title":"Avqvc: One-shot voice conversion by vector quantiza- tion with applying contrastive learning,","venue":null,"work_id":"929f5013-c6a5-4a62-9fe6-744c3229bddb","year":2022},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.050674Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:c45c602f7c8cc32f33f98fc52c96a65ecb14c609b075b354d16f6d63ed920a2a","observation_id":"3e1804e3-5e81-4e84-a479-6f867bb92055","resolution":{"observed_at":"2026-08-05T10:41:04.318328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.268178Z","title":"Enhancing expressive voice conversion with discrete pitch-conditioned flow matching model,","venue":null,"work_id":"f7a69f88-ae59-46e6-84de-e1a84e8ec791","year":2025},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.068339Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:8597bbc916b60ee90d766f649ac21ba814c7632b78f5bb2441536ad90bd6df4b","observation_id":"54d83513-d58e-4140-affc-ea5af4949d64","resolution":{"observed_at":"2026-08-05T10:41:04.275957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.218990Z","title":"Hifi-gan: Generative ad- versarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"f8ebb5f5-4f6d-4109-9722-32f8cfd8da16","year":2020},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.078415Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:53679888edb7ad2dd77fe651d8ee8accf20a44c89274b46ebdbfb7c727d9d63f","observation_id":"1245e7d6-3528-4e52-93d4-8e8d9498b99e","resolution":{"observed_at":"2026-08-05T10:41:04.245373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-05T10:41:03.093578Z","title":"Wavenet: A generative model for raw audio,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.093578Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:9982ba1fbec3d42f93aaf221003e0fe299d08667ec0a924616fd9a86b1c3bf8a","observation_id":"bd41caa9-3391-42cf-bfb2-53758dab346e","resolution":{"observed_at":"2026-08-05T10:41:03.093578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.108991Z","title":"Natural tts synthesis by conditioning wavenet on mel spectro- gram predictions,","venue":null,"work_id":"d8c11642-9450-4339-ae41-39481b2d70b3","year":2018},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.118778Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:67d082d261de42c39456144d8d2df74b505e5eac5ad2115c7f917f3080299a7d","observation_id":"b03fa801-ba11-45cf-9efd-82159b707d47","resolution":{"observed_at":"2026-08-05T10:41:04.179626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.042337Z","title":"End-to-end anti-spoofing with rawnet2,","venue":null,"work_id":"4efadc40-6d5c-47d8-b5ba-b0607e25d496","year":2021},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.132533Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:78d96a95bb00555227fafdff2decd2d74c1c49373cd50c88d702003665da7bfa","observation_id":"2fda5db6-1b1c-4351-bb0d-30f7b1ef3ac6","resolution":{"observed_at":"2026-08-05T10:41:04.053161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:04.011226Z","title":"Aasist: Audio anti-spoofing using integrated spectro-temporal graph attention networks,","venue":null,"work_id":"1685b00e-f574-4c7d-bf2d-359cd16c1b88","year":2022},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.149016Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:0dfe08d255c237d0533b15c53cb944c7e095e90a01de2d624383ca46b9d1084c","observation_id":"a26bda3c-2bf8-4e07-a647-428a8c5a45c9","resolution":{"observed_at":"2026-08-05T10:41:04.020694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03617","last_updated":"2023-12-16T02:17:19Z","snapshot_observed_at":"2026-08-07T05:26:29.050197Z","submitted_at":"2021-04-08T08:57:13Z","title":"Half-Truth: A Partially Fake Audio Detection Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.03617","snapshot_observed_at":"2026-08-05T10:41:03.157874Z","title":"Half-truth: A par- tially fake audio detection dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.157874Z"},"links":{"cited_paper":"/paper/2104.03617","citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:c9a1ec89f924eafdff624873fb049f24c00f60380e6e9b3988b2550c648a4349","observation_id":"d8b016ef-3e91-4a6a-86f6-4678777ab809","resolution":{"observed_at":"2026-08-05T10:41:03.157874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02518","last_updated":"2021-06-15T15:41:34Z","snapshot_observed_at":"2026-07-06T10:56:54.885179Z","submitted_at":"2021-04-06T13:52:31Z","title":"An Initial Investigation for Detecting Partially Spoofed Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02518","snapshot_observed_at":"2026-08-05T10:41:03.170360Z","title":"An initial investigation for detecting par- tially spoofed audio,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.170360Z"},"links":{"cited_paper":"/paper/2104.02518","citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:d4a97c64f3dd0eb4685883160567db47f99704d7b40b3acd1fafea7a7c12d4f0","observation_id":"37fe71e0-b5d7-454b-bb5b-97e609dd2fad","resolution":{"observed_at":"2026-08-05T10:41:03.170360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14132","last_updated":"2021-08-31T16:02:58Z","snapshot_observed_at":"2026-08-09T07:41:28.960066Z","submitted_at":"2021-07-29T16:04:25Z","title":"Multi-Task Learning in Utterance-Level and Segmental-Level Spoof Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14132","snapshot_observed_at":"2026-08-05T10:41:03.183317Z","title":"Multi-task learning in utterance-level and segmental- level spoof detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.183317Z"},"links":{"cited_paper":"/paper/2107.14132","citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:b2bdc4d9ea37df831936a89f60202eef5e88560c472fd69c692138dcbd009aa1","observation_id":"4f202525-3d7a-4595-98c7-0760ba8a38e7","resolution":{"observed_at":"2026-08-05T10:41:03.183317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:03.959104Z","title":"Wav2vec 2.0: A framework for self-supervised learn- ing of speech representations,","venue":null,"work_id":"1177fc51-cec6-4871-8f70-b05b10d638ab","year":2020},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.196901Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:92c485137ad56d24d8b79e9f973f22c8f8a3276709f366aa29727e4bf7628a55","observation_id":"0664f477-0032-4e5a-a27a-b61aeb9593a8","resolution":{"observed_at":"2026-08-05T10:41:03.971546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:03.923281Z","title":"The partialspoof database and countermeasures for the detection of short fake speech segments embedded in an utterance,","venue":null,"work_id":"dc62a023-4004-47f1-8d6b-af2eed050343","year":2022},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.206457Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:3b6ffd05c4a1c6ecc9acd6e6b46654597835df18b1ebf7bba701e8ea4f1399ad","observation_id":"c3fe74b4-ca6f-4d2d-bfae-9e4482663157","resolution":{"observed_at":"2026-08-05T10:41:03.933340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:03.867111Z","title":"Waveform boundary detection for partially spoofed audio,","venue":null,"work_id":"544ac695-2558-4c4e-bf12-69dc47a4bcdb","year":2023},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.216885Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:9f4bb85b6e0fc0d7f81ce9bbdd3a8d2b3a89ee995acf42f874cacba286c1f17b","observation_id":"e24abe07-14da-4949-9ece-964cf1701831","resolution":{"observed_at":"2026-08-05T10:41:03.891030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11184","last_updated":"2020-05-22T13:39:14Z","snapshot_observed_at":"2026-08-06T08:50:55.637766Z","submitted_at":"2020-05-22T13:39:14Z","title":"End-to-end Named Entity Recognition from English Speech","version":1},"cited_work":{"arxiv_id":"2005.11184","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.11184","snapshot_observed_at":"2026-08-05T10:41:03.493662Z","title":"End-to-end Named Entity Recognition from English Speech","venue":"cs.CL","work_id":"8e9fd58d-9bb9-4f34-8872-f619e85c8698","year":2020},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.231015Z"},"links":{"cited_paper":"/paper/2005.11184","citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:6acba6cd28091f81f28763fff3cd995185985d32564380d29f33afc106f55fa0","observation_id":"f54a4bd4-d724-4682-a227-314575dc2d60","resolution":{"observed_at":"2026-08-05T10:41:03.512053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:03.820408Z","title":"Robust speech recogni- tion via large-scale weak supervision,","venue":null,"work_id":"8362926a-f78b-4da9-95c2-7c0032ab5561","year":2023},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.256068Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:3a1576545df66bdd8bc8852ac19280578648d36cfaad39b1e074aea3a3f88c57","observation_id":"d409d5da-f134-4994-930b-857a7807c864","resolution":{"observed_at":"2026-08-05T10:41:03.839315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:03.777696Z","title":"Attention is all you need,","venue":null,"work_id":"b7cc0b9e-ad47-4b60-901a-a49f611885d8","year":2017},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.272787Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:ce37e92bbfcc5eccd42409110b6b7158da0018ca95aebffbc4c55087d001fc93","observation_id":"0f6a390e-4d4e-49f2-bb48-1329b49ff70f","resolution":{"observed_at":"2026-08-05T10:41:03.786987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21611","last_updated":"2024-08-19T16:09:14Z","snapshot_observed_at":"2026-07-06T18:55:02.790902Z","submitted_at":"2024-07-31T13:49:17Z","title":"Enhancing Partially Spoofed Audio Localization with Boundary-aware Attention Mechanism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21611","snapshot_observed_at":"2026-08-05T10:41:03.284513Z","title":"Enhancing partially spoofed audio localization with boundary-aware attention mech- anism,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.284513Z"},"links":{"cited_paper":"/paper/2407.21611","citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:272cf61ccf0332c89e92e62194c71402555cbd76a374fc29b360469fb5ff8afe","observation_id":"23507646-c23d-4bb6-9dd9-bd773055a4e7","resolution":{"observed_at":"2026-08-05T10:41:03.284513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:41:03.748547Z","title":"An efficient temporary deepfake location approach based embed- dings for partially spoofed audio detection,","venue":null,"work_id":"ee4bb6b7-be2e-4ce7-80ac-16f5ef358b98","year":2024},"citing_paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:41:03.296949Z"},"links":{"citing_paper":"/paper/2509.03829"},"observation_digest":"sha256:61fc0be8d250475427b3fe925cebcc09ecf26f328a5584977bc75e9dc0f87fcf","observation_id":"74e271da-741a-4bb4-85af-cc1efdcc099e","resolution":{"observed_at":"2026-08-05T10:41:03.759275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03829","last_updated":"2025-09-04T02:33:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T11:00:21.611469Z","submitted_at":"2025-09-04T02:33:00Z","title":"NE-PADD: Leveraging Named Entity Knowledge for Robust Partial Audio Deepfake Detection via Attention Aggregation"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2509.03829."}