{"as_of":"2026-08-13T21:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7bc631cf485380380224b80f9dccceff372e023b0192fa4be7c90e98596d2b0","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:29:41.653077Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.09932/citation-record","integrity":"/paper/2509.09932/integrity","json":"/paper/2509.09932/citation-record.json","paper":"/paper/2509.09932"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.492161Z","title":"Front- end factor analysis for speaker verification,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.492161Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:188c565b3102662d6da4db827c1ffaaaf833760639dd21af8b734a82a5d25fd7","observation_id":"d6d3d452-9bbe-4763-9754-dd92033584b0","resolution":{"observed_at":"2026-08-04T18:29:39.492161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.544721Z","title":"Unsupervised speaker adaptation based on the cosine similarity for text-independent speaker verification","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.544721Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:d7f86b688a937f629b2f313f18e8510deaf069777045eee354b235900c846442","observation_id":"63ba7234-cfeb-47f8-b922-37007cd4b268","resolution":{"observed_at":"2026-08-04T18:29:39.544721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.589579Z","title":"Probabilistic linear discriminant analysis,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.589579Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:4c0a1846f1b20abb755a3ee355e80e89d843beff5997cdb2237ca609a5017b7e","observation_id":"6a6e3dea-1dc9-48d5-b307-44cfaa38912d","resolution":{"observed_at":"2026-08-04T18:29:39.589579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.669890Z","title":"X- vectors: robust DNN embeddings for speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.669890Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:292e1450c9ae09e82bbb22836155076ba12b49c932b0ebc40e906685e2595802","observation_id":"8665c159-c6a6-443b-a2fc-46b411f155b5","resolution":{"observed_at":"2026-08-04T18:29:39.669890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.771133Z","title":"Speaker recognition for multi-speaker conversations using x-vectors,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.771133Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:d7666a4bcc02e5f222497c522deb2a445cef1462ca54b3ea118d687a65bb556d","observation_id":"4b53a3e3-13ec-45c7-8cfa-a8ed9a372233","resolution":{"observed_at":"2026-08-04T18:29:39.771133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.863814Z","title":"A time delay neural net- work architecture for efficient modeling of long temporal contexts,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.863814Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:f7bec31929a00da456ae92820b04648a7b6260716eff8a0145151ccb04b0f0d1","observation_id":"3a77ee79-50cc-4ef3-b5ee-2f33f51f5ef6","resolution":{"observed_at":"2026-08-04T18:29:39.863814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:39.944319Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:39.944319Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:17644138720b161c3c7c059172852316a70e5ee6c3ebac858551d932b62403b1","observation_id":"8901f83c-d7b4-4998-9b71-af33e5dd3dc8","resolution":{"observed_at":"2026-08-04T18:29:39.944319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.026239Z","title":"Deep speaker embedding extraction with channel-wise feature responses and additive supervision softmax loss function,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.026239Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:690d1523751394c96ec7ffbc7bb33795a68ab164ec4a5024fb341c8d64c86393","observation_id":"8f7b6053-79e0-416b-af8e-804604c26770","resolution":{"observed_at":"2026-08-04T18:29:40.026239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.082299Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.082299Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:3f6d92cc638ef2bc794b5e314d7c4c73e2750ba96c8981c5f545e76d56ebd4a9","observation_id":"e5dcc0e0-506b-4610-aa71-3bfedce6a715","resolution":{"observed_at":"2026-08-04T18:29:40.082299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.138295Z","title":"ECAPA-TDNN: emphasized channel attention, propagation and aggregation in TDNN based speaker verification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.138295Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:ea46c39ecc9167a410800ee9cd97067af0ff261bc03a6f4e593c6e7432461a0d","observation_id":"e9703e86-4a2e-4861-bae4-470deb5b6057","resolution":{"observed_at":"2026-08-04T18:29:40.138295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.214762Z","title":"Res2net: a new multi-scale backbone architecture,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.214762Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:503cf7db9cc1f6a17797fb7b75343eefd7a3ee3bd820fd0e06ab4780f5c82fcc","observation_id":"3f1d29ef-ae3c-462c-895c-f1ee65bb0be2","resolution":{"observed_at":"2026-08-04T18:29:40.214762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.272617Z","title":"Branch-ECAPA- TDNN: a parallel branch architecture to capture local and global features for speaker verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.272617Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:55c1c78f3c2d70f98bef05a3bc8892e691b20b2b18784262711a1002a776a1db","observation_id":"a89059b5-12f0-4e45-8565-9789ca8ab6ea","resolution":{"observed_at":"2026-08-04T18:29:40.272617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11020","last_updated":"2023-08-01T07:09:50Z","snapshot_observed_at":"2026-08-13T12:20:51.210648Z","submitted_at":"2023-03-20T10:58:12Z","title":"DS-TDNN: Dual-stream Time-delay Neural Network with Global-aware Filter for Speaker Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11020","snapshot_observed_at":"2026-08-04T18:29:40.350753Z","title":"Dual-stream time-delay neural network with dynamic global filter for speaker verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.350753Z"},"links":{"cited_paper":"/paper/2303.11020","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:37e372c7fc92722ba75cd7592a69185504c4787b656846a5ccc93b49759da5ab","observation_id":"fde410a4-ff5c-4b4a-bb64-defc324417cb","resolution":{"observed_at":"2026-08-04T18:29:40.350753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.433029Z","title":"PCF: ECAPA-TDNN with progressive channel fusion for speaker verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.433029Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:664f39d5518aaf2313faea0ababc38404f3e71d0c0bfc09411f32dc80fee5c8c","observation_id":"4e8a0e25-5511-49a2-94a4-9e60853a4b1a","resolution":{"observed_at":"2026-08-04T18:29:40.433029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.517504Z","title":"ECAPA++: fine-grained deep embedding learning for TDNN based speaker verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.517504Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:94383c3c13afc9ac97942eea26c863893f18f78765ee50f188a3a1fb6d28cf03","observation_id":"7c1a1037-9d1d-45d5-9507-d69975399b0c","resolution":{"observed_at":"2026-08-04T18:29:40.517504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.602482Z","title":"PhaseDCN: a phase-enhanced dual-path dilated convolutional network for single- channel speech enhancement,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.602482Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:cefcf5a70deabf7da3e735c7da4566680ec50c2c12e114a3218946d5725dfb60","observation_id":"f7a29ffb-79c3-46d4-a6d3-0e9e3c1cb8c5","resolution":{"observed_at":"2026-08-04T18:29:40.602482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.653948Z","title":"V oxCeleb: a large-scale speaker identification dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.653948Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:6b6127496213e536899441ffcc0b737a2a1e3848c3880ca4d96fa691fabfb839","observation_id":"db91d461-3330-439a-95ae-ed0c97b9d61b","resolution":{"observed_at":"2026-08-04T18:29:40.653948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.714959Z","title":"V oxCeleb: large- scale speaker verification in the wild,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.714959Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:a94cb14fe7c056bda0c19e54644fd87a66c99bd01a5cdb7d4848d30401817c87","observation_id":"d36ef299-7540-4d61-899a-c59792f4a884","resolution":{"observed_at":"2026-08-04T18:29:40.714959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05622","last_updated":"2018-06-27T01:49:17Z","snapshot_observed_at":"2026-08-08T04:36:13.309903Z","submitted_at":"2018-06-14T15:59:12Z","title":"VoxCeleb2: Deep Speaker Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05622","snapshot_observed_at":"2026-08-04T18:29:40.790511Z","title":"V oxceleb2: deep speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.790511Z"},"links":{"cited_paper":"/paper/1806.05622","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:8f2bf8f85bf81fc1a68d7f677ac1139b76d0ddc640562a0e0c25d783c604982a","observation_id":"bd0ee946-5adc-43d4-ba5b-648309e83642","resolution":{"observed_at":"2026-08-04T18:29:40.790511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.895476Z","title":"CN-Celeb: a challenging chinese speaker recog- nition dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.895476Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:250b37520c0e68fef56724546c8f511ec127e5af4e1e993b272bf740e5538746","observation_id":"ad15ad06-6042-4b90-ba77-417988e0dbb7","resolution":{"observed_at":"2026-08-04T18:29:40.895476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:40.948461Z","title":"CN-Celeb: multi-genre speaker recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:40.948461Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:de4e4ce3f4a1decd895ae95704e16a37db6be0431e494d8670de2f0e7805af89","observation_id":"30f44b7e-eabe-4992-b50c-37da4d4c1a2c","resolution":{"observed_at":"2026-08-04T18:29:40.948461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-07-06T04:34:36.474437Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-04T18:29:41.001035Z","title":"Musan: a music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.001035Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:3a7e15dc0b6c0dfce629986b1e228a15eccc5e22835d60792df1183aea0de544","observation_id":"021b3e74-e6de-4648-8514-55c41cb83777","resolution":{"observed_at":"2026-08-04T18:29:41.001035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.083220Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.083220Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:69c7d5e242a4716160e3f214b714b3b6b0afa1d01e4f1795b6f28412763b53c9","observation_id":"3c3623f2-7185-4714-80a3-83800aaeb397","resolution":{"observed_at":"2026-08-04T18:29:41.083220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-13T21:03:38.210392Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-04T18:29:41.136871Z","title":"Specaugment: a simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.136871Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:55ee9e8dc6517a20beceb3134a5e8315d644a0184317b008d712ded255069f38","observation_id":"50e7e4b4-82cd-4515-bdde-58683159c110","resolution":{"observed_at":"2026-08-04T18:29:41.136871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.248655Z","title":"Arcface: additive angular margin loss for deep face recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.248655Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:c0eaa70c9eda9ff12020654e29054efc39652f21ce970fe448272f1a59becfb3","observation_id":"e9f94205-1f78-4997-9cd2-1700ae3c4922","resolution":{"observed_at":"2026-08-04T18:29:41.248655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.333015Z","title":"Margin matters: to- wards more discriminative deep neural network embeddings for speaker recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.333015Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:58f843229039b30b24e8e0866955f41107881ca5150c1ce6611b65843c9c974f","observation_id":"815fab33-ae83-42f1-9158-f1671ee133be","resolution":{"observed_at":"2026-08-04T18:29:41.333015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-04T18:29:41.404254Z","title":"Adam: a method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.404254Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:4ba69db9410f6d2c3606454a0a37086c62bb84606af848c72c257cc9aa7af160","observation_id":"2a7f8947-b81e-4007-8ac4-a6350212779d","resolution":{"observed_at":"2026-08-04T18:29:41.404254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.489308Z","title":"Cyclical learning rates for training neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.489308Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:f98792597e133965a56462b5e7dbd1703cd661b3dc36fc9824325faf91550418","observation_id":"d879a90a-5f53-43a5-b4fa-0aed6bbe05fe","resolution":{"observed_at":"2026-08-04T18:29:41.489308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:29:41.574801Z","title":"Duality temporal-channel-frequency attention enhanced speaker representation learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.574801Z"},"links":{"citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:9721657193997dc0a3144612c86115ec0c5389eab51b404750ce1a2ef55e49df","observation_id":"f24ddda2-fe02-4540-8d53-bcb704aa0e5b","resolution":{"observed_at":"2026-08-04T18:29:41.574801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00332","last_updated":"2023-06-16T09:07:11Z","snapshot_observed_at":"2026-08-13T12:34:33.611807Z","submitted_at":"2023-03-01T08:50:31Z","title":"CAM++: A Fast and Efficient Network for Speaker Verification Using Context-Aware Masking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00332","snapshot_observed_at":"2026-08-04T18:29:41.653077Z","title":"CAM++: a fast and efficient network for speaker verification using context-aware masking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T18:29:41.653077Z"},"links":{"cited_paper":"/paper/2303.00332","citing_paper":"/paper/2509.09932"},"observation_digest":"sha256:974ac5cb07b580d1d1cb944f68b14a272184693cf5a4febd880346c3b4998daa","observation_id":"81c03d8f-5cba-4908-9af8-282172876454","resolution":{"observed_at":"2026-08-04T18:29:41.653077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09932","last_updated":"2025-09-12T02:34:25Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-12T14:49:29.486008Z","submitted_at":"2025-09-12T02:34:25Z","title":"Effective Modeling of Critical Contextual Information for TDNN-based Speaker Verification"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2509.09932."}