{"as_of":"2026-08-19T00:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec5a539b41f4b8092800b9cf19bd2ea8b93a2b4e20b21568f51ec3d405dbffc1","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T17:38:41.320522Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:50:20.835476Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T13:35:26.561973Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10781","snapshot_observed_at":"2026-08-04T17:38:38.394463Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.394463Z"},"links":{"cited_paper":"/paper/2509.10781","citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:f9487b8f1207179340532846be2931b57e469b5cc13effd00c80308ea3ccac22","observation_id":"323b8396-c3cb-4dd1-99bf-6773703e734a","resolution":{"observed_at":"2026-08-04T17:38:38.394463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"cited_work":{"arxiv_id":"2509.10781","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.10781","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emoanti: au- dio anti-deepfake with refined emotion-guided representations","venue":null,"work_id":"bd1fabac-98da-4b85-b708-a0866885970b","year":2025},"citing_paper":{"arxiv_id":"2604.13229","last_updated":"2026-04-14T18:56:13Z","snapshot_observed_at":"2026-08-02T00:07:11.058562Z","submitted_at":"2026-04-14T18:56:13Z","title":"ProSDD: Learning Prosodic Representations for Speech Deepfake Detection against Expressive and Emotional Attacks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T13:31:12.802897Z"},"links":{"cited_paper":"/paper/2509.10781","citing_paper":"/paper/2604.13229"},"observation_digest":"sha256:91f278da67a0c350e6f602988446602faa11d62519c945f2b811f8e3843bd854","observation_id":"01ad08ff-6181-4303-a8bd-0189ccb577c5","resolution":{"observed_at":"2026-05-10T13:35:26.563364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10781","snapshot_observed_at":"2026-08-08T11:50:20.835476Z","title":"arXiv preprint arXiv:2509.10781 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05507","last_updated":"2026-08-06T01:19:35Z","snapshot_observed_at":"2026-08-15T10:49:11.108765Z","submitted_at":"2026-08-06T01:19:35Z","title":"AffectDF: The Most Comprehensive Benchmark for Speech Deepfake Detection against Emotionally Expressive Attacks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T11:50:20.835476Z"},"links":{"cited_paper":"/paper/2509.10781","citing_paper":"/paper/2608.05507"},"observation_digest":"sha256:918d10f6d14631c2a711f902aa6376120be33d1b9a7cd0c8d37448ad37b19a26","observation_id":"1930ed66-d594-43e3-9065-54099f5db9e9","resolution":{"observed_at":"2026-08-08T11:50:20.835476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.10781/citation-record","integrity":"/paper/2509.10781/integrity","json":"/paper/2509.10781/citation-record.json","paper":"/paper/2509.10781"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:38.062513Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.062513Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:d6d4c69d0877da2942c0fe37a0b0781ceb6ec1dca44f7d1d290d8ddb04ecf184","observation_id":"f61d427f-5bfb-4a4c-be43-069326c2b1f1","resolution":{"observed_at":"2026-08-04T17:38:38.062513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:38.186478Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.186478Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:f78bd5475df6d7f7d69edbe961ea10bd7a816bf260e135ae46e8f22d7aa75240","observation_id":"2c3a20e2-090d-41f4-9a7a-3aa1407027d0","resolution":{"observed_at":"2026-08-04T17:38:38.186478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:38.290337Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.290337Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:6bcbee299d633d197cdc1dfcb650c492a04340b232527f5a07b4bb2b1f9e3c42","observation_id":"e845efe9-decc-4223-951f-b098363e24d4","resolution":{"observed_at":"2026-08-04T17:38:38.290337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.10781","snapshot_observed_at":"2026-08-04T17:38:38.394463Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.394463Z"},"links":{"cited_paper":"/paper/2509.10781","citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:f9487b8f1207179340532846be2931b57e469b5cc13effd00c80308ea3ccac22","observation_id":"323b8396-c3cb-4dd1-99bf-6773703e734a","resolution":{"observed_at":"2026-08-04T17:38:38.394463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:38.528966Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.528966Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:334ff9b8a19c3fe9f21563495ee30b77e15363b2d10f1f54983569fe22522e06","observation_id":"2b1bd1c8-5dd4-410f-91be-f1e7b74db66b","resolution":{"observed_at":"2026-08-04T17:38:38.528966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:38.680564Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.680564Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:b63c50942de878f7cb2a7e37f771277b9d33ad1504d72c311d7ecaeac4af7495","observation_id":"86c96c5c-1786-45e9-b112-7a717f584193","resolution":{"observed_at":"2026-08-04T17:38:38.680564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:38.752007Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.752007Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:a2320762d511583cf5f72aabbbb6df4fb4de4976afb9227202174ec626422317","observation_id":"94b6087a-eb17-4a50-ba1f-f1dc5b004484","resolution":{"observed_at":"2026-08-04T17:38:38.752007Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:38.894812Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.894812Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:dba117ab9147f39f8cbff0afdfb5e6e915789cbc17be66bd8d3c0172d38c9f86","observation_id":"59f5f604-3aa3-4ca4-abdf-c88f1470a1a9","resolution":{"observed_at":"2026-08-04T17:38:38.894812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:38.949621Z","title":"We thank the reviewers for their contributions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:38.949621Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:d0738c85e297c06fb9612dd004a67de2dac9a9da9c314569f76b8eab39608543","observation_id":"e4afdd62-a6af-4420-abaf-c6f9de9d3326","resolution":{"observed_at":"2026-08-04T17:38:38.949621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14970","last_updated":"2023-08-29T01:50:01Z","snapshot_observed_at":"2026-08-16T15:05:05.542652Z","submitted_at":"2023-08-29T01:50:01Z","title":"Audio Deepfake Detection: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14970","snapshot_observed_at":"2026-08-04T17:38:39.097563Z","title":"Audio deepfake detection: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.097563Z"},"links":{"cited_paper":"/paper/2308.14970","citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:8ccaf16d0621ad9b3f01b7dafb0cfa7621109c5b60432d11071b7a02774e128e","observation_id":"c57c8a68-1741-4317-ba90-597b23216299","resolution":{"observed_at":"2026-08-04T17:38:39.097563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:39.187777Z","title":"Audio deepfake detection based on a combination of f0 information and real plus imag- inary spectrogram features,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.187777Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:4034b8a13c93fea685c3f189d88538544dec59cfaf03ac03f38b6cf66dcba1ba","observation_id":"732de417-0a73-4387-b65b-ac04bd9540cf","resolution":{"observed_at":"2026-08-04T17:38:39.187777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:39.305642Z","title":"V oice spoofing countermeasure for logical access at- tacks detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.305642Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:58836e124a5b5dc1988366d12fa55c09a14ae89f2f7fe4b8a84c80b3f56ea383","observation_id":"79ee1314-0a68-49ab-9283-2d274f79b5b6","resolution":{"observed_at":"2026-08-04T17:38:39.305642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:39.400758Z","title":"Deepfake speech detection through emotion recogni- tion: a semantic approach,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.400758Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:81aa03e89ccd1fe99428cc18d71d96b2d94bce53589c488c6accbd84b876cc92","observation_id":"61aaa7c2-773d-4e4d-b8e9-33271e584559","resolution":{"observed_at":"2026-08-04T17:38:39.400758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:39.482025Z","title":"The vicomtech audio deepfake detection system based on wav2vec2 for the 2022 add challenge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.482025Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:1408d690506bb67f49014f74b6af13d2b75314b45db0c41a0c5542327f3056da","observation_id":"4c0aee63-6fa1-418f-91a5-a515530914d9","resolution":{"observed_at":"2026-08-04T17:38:39.482025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:39.617197Z","title":"Audio anti-spoofing based on audio feature fusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.617197Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:57f401139ec6fd2a3f41b4ca6ceb9e559ae9280f4e655018b300f650e56ed86a","observation_id":"8fb5ad35-d77d-4163-8283-f1d8e4828be1","resolution":{"observed_at":"2026-08-04T17:38:39.617197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:39.773741Z","title":"Audio deepfake detection with self- supervised wavlm and multi-fusion attentive classifier,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.773741Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:de36f1a922d4aac23804733fdf505e53eceaca78831e8d0e2cd971f2386f52fd","observation_id":"6cc0db7d-6125-4f3d-b6ed-54b206ab9b06","resolution":{"observed_at":"2026-08-04T17:38:39.773741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01027","last_updated":"2021-09-08T04:12:36Z","snapshot_observed_at":"2026-08-17T15:33:14.058250Z","submitted_at":"2021-04-02T12:53:15Z","title":"Robust wav2vec 2.0: Analyzing Domain Shift in Self-Supervised Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01027","snapshot_observed_at":"2026-08-04T17:38:39.844023Z","title":"Robust wav2vec 2.0: Analyzing domain shift in self-supervised pre-training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.844023Z"},"links":{"cited_paper":"/paper/2104.01027","citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:4a2e0193fd64b6804bde8a77ded2c41eec06cab765046d1e8d84d1e58742d164","observation_id":"a66cd346-43c9-41c3-b1af-4b75f3e9f28f","resolution":{"observed_at":"2026-08-04T17:38:39.844023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:39.931924Z","title":"Wav2Vec2 - Large - Robust model,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:39.931924Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:ee3579b1e014c19365cac3d3f2e5db6e3246c8d2ccf22e22ab5c1d4b2341c480","observation_id":"6a2f6f97-b345-4719-a3be-4f79e7bca647","resolution":{"observed_at":"2026-08-04T17:38:39.931924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:40.011001Z","title":"Large-scale self-supervised speech representation learning for automatic speaker verification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.011001Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:f5a2fe84c9138e0de6430748fafa7f216c4ca1165b10de672e55a1b58ced1366","observation_id":"9bf1cd22-3d1a-4090-887a-68727bcf51c8","resolution":{"observed_at":"2026-08-04T17:38:40.011001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:40.143622Z","title":"Dawn of the transformer era in speech emotion recog- nition: closing the valence gap,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.143622Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:fc74d89abb40cb0e08c09c5815ad151e2e8e451b5f6ba7e48bb3512f5ef79225","observation_id":"f472ad0d-828b-4725-ae4d-2c658da5eb9b","resolution":{"observed_at":"2026-08-04T17:38:40.143622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:40.222469Z","title":"Iemocap: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.222469Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:e7851af404f586d3c6e364cdf2381e67663995d6e2d170a70fd688f6c35dc68e","observation_id":"4722c047-00ab-472e-9d93-cd18cdaa08e3","resolution":{"observed_at":"2026-08-04T17:38:40.222469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:40.337852Z","title":"Speech emotion recognition using self-supervised features,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.337852Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:005f9e68f3da99278ad7f87b1fba567c7570ca52838832f746ca9a578db864e5","observation_id":"1f38cb61-3478-481f-87d8-518c891f6231","resolution":{"observed_at":"2026-08-04T17:38:40.337852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05441","last_updated":"2019-04-14T11:38:32Z","snapshot_observed_at":"2026-08-15T22:10:10.299222Z","submitted_at":"2019-04-09T15:12:52Z","title":"ASVspoof 2019: Future Horizons in Spoofed and Fake Audio Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05441","snapshot_observed_at":"2026-08-04T17:38:40.411889Z","title":"Asvspoof 2019: Future horizons in spoofed and fake audio detection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.411889Z"},"links":{"cited_paper":"/paper/1904.05441","citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:0ba837b75f0d6af23e0becc057aca3a79f2a1d7160f5dc6723fa9938adeacc07","observation_id":"59307c73-8c8f-4cca-a42e-3a1472143c46","resolution":{"observed_at":"2026-08-04T17:38:40.411889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00537","last_updated":"2021-09-01T16:17:31Z","snapshot_observed_at":"2026-08-16T17:59:28.313760Z","submitted_at":"2021-09-01T16:17:31Z","title":"ASVspoof 2021: accelerating progress in spoofed and deepfake speech detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00537","snapshot_observed_at":"2026-08-04T17:38:40.590625Z","title":"Asvspoof 2021: accelerat- ing progress in spoofed and deepfake speech detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.590625Z"},"links":{"cited_paper":"/paper/2109.00537","citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:d0ed053cebe9a14525edc2b2e7db93337baaaf30d6456ee5c778cafbd409d511","observation_id":"ba4bd914-dd0d-4884-b2c3-2d001bf8ea33","resolution":{"observed_at":"2026-08-04T17:38:40.590625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:40.684405Z","title":"Asvspoof 2021: Towards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.684405Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:b03271b231bc41575d382f11705e63f0636aee0ae0341a69d56dfa2c782167e0","observation_id":"347d8f19-34dc-4854-b8ca-e828f0da274a","resolution":{"observed_at":"2026-08-04T17:38:40.684405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.09618","last_updated":"2019-04-11T16:32:25Z","snapshot_observed_at":"2026-08-16T15:27:32.008753Z","submitted_at":"2018-04-25T15:16:48Z","title":"t-DCF: a Detection Cost Function for the Tandem Assessment of Spoofing Countermeasures and Automatic Speaker Verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.09618","snapshot_observed_at":"2026-08-04T17:38:40.790770Z","title":"t-dcf: a detection cost function for the tandem assessment of spoofing countermeasures and automatic speaker verification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.790770Z"},"links":{"cited_paper":"/paper/1804.09618","citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:4df3ee4972b8a7640e4fc9b09b546e4a79262f645e3a1d3ddd1b9d939b4b35bf","observation_id":"d990f0ca-0df0-43ec-be19-2b1e7314c88a","resolution":{"observed_at":"2026-08-04T17:38:40.790770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:40.895382Z","title":"ASVspoof 2021 Baseline CM & Evaluation Package,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:40.895382Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:c711acf6649193c842904293f3b8bdaf5c0507d968599ad1d4988f77a11ea0b1","observation_id":"af39e010-3485-4943-87cc-de628e84b79a","resolution":{"observed_at":"2026-08-04T17:38:40.895382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:41.020445Z","title":"Known-unknown data augmentation strate- gies for detection of logical access, physical access and speech deepfake attacks: Asvspoof 2021,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:41.020445Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:26c10d76458aa5c4dacdcc83645efd27edd51bce06ab0228bef2d39a627ddb1d","observation_id":"96079eca-72e4-40b4-a621-bac246af4167","resolution":{"observed_at":"2026-08-04T17:38:41.020445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:41.120544Z","title":"End-to-end anti-spoofing with rawnet2,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:41.120544Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:82afcdfdce9086d7c90af7b149bb6744bfc88272f7ce812c7c48ee0a0b684a74","observation_id":"a2c9af23-ff1f-450f-8d6e-40441211268c","resolution":{"observed_at":"2026-08-04T17:38:41.120544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:38:41.229298Z","title":"Ur channel- robust synthetic speech detection system for asvspoof 2021,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:41.229298Z"},"links":{"citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:4f01a1b55f988bf1c9ebb5620fee3558817725c7736f579060a96546532648bc","observation_id":"bcdc2648-6354-4b79-b5d2-a601ad843c65","resolution":{"observed_at":"2026-08-04T17:38:41.229298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07725","last_updated":"2022-02-04T13:25:23Z","snapshot_observed_at":"2026-08-16T17:41:47.981956Z","submitted_at":"2021-11-15T12:52:50Z","title":"Investigating self-supervised front ends for speech spoofing countermeasures","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07725","snapshot_observed_at":"2026-08-04T17:38:41.320522Z","title":"Investigating self- supervised front ends for speech spoofing countermea- sures,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T17:38:41.320522Z"},"links":{"cited_paper":"/paper/2111.07725","citing_paper":"/paper/2509.10781"},"observation_digest":"sha256:fe29b4e9aba05dae340b9b31999fb0385eb4eb4217bae89e570c1b53f52e525a","observation_id":"c502ab3b-0786-416f-a622-41371182ea26","resolution":{"observed_at":"2026-08-04T17:38:41.320522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.10781","last_updated":"2025-09-13T01:58:34Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-15T10:50:29.168235Z","submitted_at":"2025-09-13T01:58:34Z","title":"Emoanti: audio anti-deepfake with refined emotion-guided representations"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 3 inbound Pith citation observations for arXiv:2509.10781."}