{"as_of":"2026-08-19T11:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1791e260bf6bfd9dab09592facdfc5c549a71485744bcb5aee1159f8b10f1257","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:50:30.381855Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:50:30.262621Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T15:52:34.879934Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"cited_work":{"arxiv_id":"2608.03623","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.03623","snapshot_observed_at":"2026-08-05T15:52:34.879934Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","venue":"eess.AS","work_id":"fd6b3d19-601e-49d1-8a22-0fc696120f8a","year":2026},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:52:34.470408Z"},"links":{"cited_paper":"/paper/2608.03623","citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:a9c8683e9328b4fb663caa7e13dfc6e212fc50e4c14c27a5d64efa69d4340528","observation_id":"f66dd3c3-f774-406c-8475-fc192d9e19af","resolution":{"observed_at":"2026-08-05T15:52:34.884194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2608.03623","snapshot_observed_at":"2026-08-15T14:50:30.262621Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.262621Z"},"links":{"cited_paper":"/paper/2608.03623","citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:3e2466f6b1b20b76fdf1a68714e6f051105f786648c5bd27d34444889a26b6cc","observation_id":"a797a310-711d-4620-85f1-bf7dfd45ddf0","resolution":{"observed_at":"2026-08-15T14:50:30.262621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2608.03623/citation-record","integrity":"/paper/2608.03623/integrity","json":"/paper/2608.03623/citation-record.json","paper":"/paper/2608.03623"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2608.03623","snapshot_observed_at":"2026-08-15T14:50:30.262621Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.262621Z"},"links":{"cited_paper":"/paper/2608.03623","citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:3e2466f6b1b20b76fdf1a68714e6f051105f786648c5bd27d34444889a26b6cc","observation_id":"a797a310-711d-4620-85f1-bf7dfd45ddf0","resolution":{"observed_at":"2026-08-15T14:50:30.262621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.267907Z","title":"Dataset description We used an in-house multi-modal classrooms dataset, referred to as the EDSI dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.267907Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:ec3ef9d3a2ba2a7cd487622fb85a1c761a1a32bcc45df883e8c35884a3ad5095","observation_id":"ea684a76-d0a6-46c4-9c99-55c9d202e821","resolution":{"observed_at":"2026-08-15T14:50:30.267907Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.272036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.272036Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:2d82fe40b4009e733e5794e7c1823d209d7ce705d0daaf9cca1828080950a7cd","observation_id":"1600ed06-116e-44a1-ab3e-d47c9237dd3b","resolution":{"observed_at":"2026-08-15T14:50:30.272036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.276003Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.276003Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:9361f4683705a3daf7d006b03af09748ee96559bb503d78669a65b7d3e0aabce","observation_id":"8cd03c45-7e23-42b5-a89f-4e39c8274b87","resolution":{"observed_at":"2026-08-15T14:50:30.276003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.279838Z","title":"Self-supervised speaker verification with relational mask predic- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.279838Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:b79e3145683da309ce3f3897e6998f32efd2130f7c6f357ebcbab12239cd9d70","observation_id":"710503db-70e7-4084-8017-63b9c78aebd5","resolution":{"observed_at":"2026-08-15T14:50:30.279838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.283949Z","title":"Disentangling speaker and content in pre-trained speech models with latent diffusion for robust speaker verification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.283949Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:f0fc3c67e7bb9ae3bafec50dd516d0752fc497e6e6af2d26ebada90ae99ef27b","observation_id":"1d32ea2e-fba3-46c7-952e-669d9dcf893b","resolution":{"observed_at":"2026-08-15T14:50:30.283949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.287924Z","title":"Idir: Identifying and distilling informative relations for speaker verification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.287924Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:79191b2a0b6b7abcbf9d0dd7165e7efae1785084aecb879f42b922264a991698","observation_id":"d27ba446-a7be-483f-af29-5257adda6090","resolution":{"observed_at":"2026-08-15T14:50:30.287924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.291473Z","title":"Noise-robust speaker verifica- tion with attenuated speech restoration and consistency training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.291473Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:50356cdacd554c3181b55212043c2fcdf713781f58c2366bbbab878552023d9b","observation_id":"df5a9bdf-4ec4-4481-9a28-31182e59b985","resolution":{"observed_at":"2026-08-15T14:50:30.291473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.295236Z","title":"FT-Boosted SV: To- wards Noise Robust Speaker Verification for English Speaking Classroom Environments ,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.295236Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:132dae0c8103580c98140d2bbbd38fd7dc952fff2a1b43795d881502f405c272","observation_id":"49115897-c48a-44db-98e5-ce32c410cd29","resolution":{"observed_at":"2026-08-15T14:50:30.295236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.299077Z","title":"Nresnet: nested residual network based on channel and frequency domain attention mechanism for speaker verification in classroom,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.299077Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:77e52bc7c9b077198618bcdae0e3e26a84bb4b37847b973aba71ff751c4bcca1","observation_id":"4672f162-c96d-4825-ae85-b80fed3ab6a9","resolution":{"observed_at":"2026-08-15T14:50:30.299077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.302616Z","title":"Automatic speaker verification system substantiating children’s dialects in school settings,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.302616Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:7d32609bca261c5234a262e4cd2272f3f3bbea9187e335e9a5a5287402a66361","observation_id":"0dcfb238-6880-485d-9300-bf3737c25893","resolution":{"observed_at":"2026-08-15T14:50:30.302616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.306113Z","title":"Momentum con- trast for unsupervised visual representation learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.306113Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:6a8161656445569e67ed1a5c8db68425e9e86f6841d6882bd41f792a8be4bc9b","observation_id":"fdef0ccc-c7c9-405c-a3d8-b90522e37586","resolution":{"observed_at":"2026-08-15T14:50:30.306113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.315204Z","title":"Emerging properties in self-supervised vision transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.315204Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:f6ccd5e42b3166e9200477784ba2039dae6b277816ab4d5fa1586fdaf13a742b","observation_id":"d59eeb98-08d1-44c0-b426-2b696a9e9313","resolution":{"observed_at":"2026-08-15T14:50:30.315204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.319091Z","title":"Self-supervised learning with cluster-aware-dino for high-performance robust speaker verifica- tion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.319091Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:a512d16f01affe2dff18ece4957ed7db21ebdf5866a53dfeb53a227eaae8b7d4","observation_id":"6d6fdae8-4d9d-4a71-b03a-8bd217f41a35","resolution":{"observed_at":"2026-08-15T14:50:30.319091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.322678Z","title":"Contrastive self-supervised speaker embedding with sequential disentanglement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.322678Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:507e649e6e0c69cd53b2bb6682f7761f0bbfcccbabdd2e201c893818c565c0ca","observation_id":"7b516f36-e589-40b7-bbba-cdedaa975219","resolution":{"observed_at":"2026-08-15T14:50:30.322678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02574","last_updated":"2023-06-26T12:01:56Z","snapshot_observed_at":"2026-08-19T05:53:40.441700Z","submitted_at":"2022-06-03T08:04:12Z","title":"On the duality between contrastive and non-contrastive self-supervised learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02574","snapshot_observed_at":"2026-08-15T14:50:30.326483Z","title":"On the duality between contrastive and non-contrastive self-supervised learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.326483Z"},"links":{"cited_paper":"/paper/2206.02574","citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:a0dbd0448dcbc7e5086619cac876602e9d17cd083177370e886dc41d91c59434","observation_id":"17ccfcdb-2640-40df-843d-5a21d20634e2","resolution":{"observed_at":"2026-08-15T14:50:30.326483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.330330Z","title":"Front-end factor analysis for speaker verification,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.330330Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:d863af88da7ba68aba7adfd007a9a165a149844e35a6576745482a6b48273229","observation_id":"3a27787a-d39a-407e-8cf3-27b842b250ab","resolution":{"observed_at":"2026-08-15T14:50:30.330330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.333707Z","title":"X-vectors: Robust dnn embeddings for speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.333707Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:08f04f757c105b42d43b185fb6c7660e26d2730d174b39dd610454447a333eed","observation_id":"d32cb94a-cc4c-45c7-8974-8fa7b50850d6","resolution":{"observed_at":"2026-08-15T14:50:30.333707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07143","last_updated":"2020-08-10T13:50:24Z","snapshot_observed_at":"2026-08-16T12:49:35.884517Z","submitted_at":"2020-05-14T17:02:15Z","title":"ECAPA-TDNN: Emphasized Channel Attention, Propagation and Aggregation in TDNN Based Speaker Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.07143","snapshot_observed_at":"2026-08-15T14:50:30.337277Z","title":"Ecapa- tdnn: Emphasized channel attention, propagation and ag- gregation in tdnn based speaker verification,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.337277Z"},"links":{"cited_paper":"/paper/2005.07143","citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:82405038e0ba28e6475d0aa29d5d30bd06ae921ecec99628b04df18f89224619","observation_id":"1e2a5a3f-63da-4901-bfa2-fccecd187144","resolution":{"observed_at":"2026-08-15T14:50:30.337277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.341055Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.341055Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:bfad54c832b743af045394eb607437794625a6a179ee85ac138138707da8e6f2","observation_id":"f3854464-78f6-4125-b02c-f33a55be838c","resolution":{"observed_at":"2026-08-15T14:50:30.341055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.344657Z","title":"Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.344657Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:f1ee4c466f6479ca107e72fafbfeab335cea57b48d48238a8d14d4a150c472fd","observation_id":"814e58a7-ccbe-410a-bf0c-cefe02974c47","resolution":{"observed_at":"2026-08-15T14:50:30.344657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.348620Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.348620Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:e9a104eb1d5607fdce921ac5ef1eed26538785c256681ba0a225838f00fa873e","observation_id":"fa20f015-b90f-4642-afd5-dc0b7a6b9981","resolution":{"observed_at":"2026-08-15T14:50:30.348620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.352162Z","title":"Large-scale self-supervised speech representation learning for automatic speaker verification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.352162Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:76b927ccbf65614812e3f7b2b3967a6a577ab9aafcbaf0e5f217fd36d58a2d74","observation_id":"8faa6be9-13af-4991-8d40-24a10ae1ab36","resolution":{"observed_at":"2026-08-15T14:50:30.352162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.355772Z","title":"Multi-feature integration for speaker embed- ding extraction,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.355772Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:c0fba2109ca61edc3c8463d43927d3065b29a6a1f5b1619b590148cc6624f45f","observation_id":"383669c5-ef9f-498a-b315-14e98bc5cb5f","resolution":{"observed_at":"2026-08-15T14:50:30.355772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.01051","last_updated":"2021-10-15T22:04:39Z","snapshot_observed_at":"2026-08-16T18:27:20.253405Z","submitted_at":"2021-05-03T17:51:09Z","title":"SUPERB: Speech processing Universal PERformance Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.01051","snapshot_observed_at":"2026-08-15T14:50:30.359241Z","title":"Superb: Speech processing universal performance benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.359241Z"},"links":{"cited_paper":"/paper/2105.01051","citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:5fc9ec8d67645c63f1b492ae25e3f66579d42c478c6dad08130ee5d7eb680d96","observation_id":"b503bbd8-287a-4316-95cf-01a9b0185bb6","resolution":{"observed_at":"2026-08-15T14:50:30.359241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15095","last_updated":"2022-03-28T20:59:58Z","snapshot_observed_at":"2026-08-16T17:11:09.124935Z","submitted_at":"2022-03-28T20:59:58Z","title":"Robust Speaker Recognition with Transformers Using wav2vec 2.0","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15095","snapshot_observed_at":"2026-08-15T14:50:30.363221Z","title":"Robust speaker recognition with transformers using wav2vec 2.0,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.363221Z"},"links":{"cited_paper":"/paper/2203.15095","citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:41b5eadd81eee2da0946f7aeb1fb9391b20fe28b61b1e6142ea92aaef5823319","observation_id":"92604351-4b49-4889-a39a-dd615036c204","resolution":{"observed_at":"2026-08-15T14:50:30.363221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.367037Z","title":"Layer- aware tdnn: Speaker recognition using multi-layer features from pre-trained models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.367037Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:0e0ac34b33a68629410b2fd1ad37e99c3cbc88cbcb2e4f00d24f485dc4654e7d","observation_id":"02af4112-4fd2-4d66-abdd-ef22373c7f39","resolution":{"observed_at":"2026-08-15T14:50:30.367037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.370438Z","title":"In- terspeech 2021 deep noise suppression challenge,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.370438Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:ab941c665c69d53b8fc5c5512ce1b710139339d4736c94a37cf1dbcb6ac3b60e","observation_id":"8de6937d-2745-43ed-8760-1b1f7746a12d","resolution":{"observed_at":"2026-08-15T14:50:30.370438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.374132Z","title":"My sci- ence tutor (myst)–a large corpus of children’s conver- sational speech,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.374132Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:71b83dbdcc10125f3a47784a7f9ea734c7fddbe5688aeda28fc0799a14174ec5","observation_id":"bfd1f3a5-50c6-4ac2-8132-33adb6722f0c","resolution":{"observed_at":"2026-08-15T14:50:30.374132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-08-18T17:51:41.801692Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-08-15T14:50:30.377897Z","title":"Speechbrain: A general-purpose speech toolkit,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.377897Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:c2233a7b1e473ee5b28b8b2020b19c3f658b3d21b9c44c156488648e6fff266a","observation_id":"89b5a2fb-ebec-4679-9a2e-1f616aeb4b9c","resolution":{"observed_at":"2026-08-15T14:50:30.377897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:50:30.381855Z","title":"V oxceleb: Large-scale speaker verification in the wild,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:50:30.381855Z"},"links":{"citing_paper":"/paper/2608.03623"},"observation_digest":"sha256:8bf39dcfc600521db647cfe0661312d4c700e46c270411b3640db56b91ab8e68","observation_id":"259cf1d1-1576-49ff-bfaa-231fdeef77a8","resolution":{"observed_at":"2026-08-15T14:50:30.381855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03623","last_updated":"2026-08-06T17:30:44Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-16T02:28:51.748797Z","submitted_at":"2026-08-04T13:12:41Z","title":"Speaker Verification Under Real Classroom Conditions for English Speech"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 2 inbound Pith citation observations for arXiv:2608.03623."}