{"as_of":"2026-08-11T01:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d92c06dd4b2438061a707e455defa2aa6648011f1bdecc749d55afbc8bd126c","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T11:14:20.892333Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.22177/citation-record","integrity":"/paper/2606.22177/integrity","json":"/paper/2606.22177/citation-record.json","paper":"/paper/2606.22177"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Automatic speaker, age-group and gender identifi- cation from children’s speech,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:f40f11c68eef12da7e9cac6eb7a085065c24989a214e27a08c62ce68e71688a8","observation_id":"81029262-23c9-47f1-9746-b212520f78ca","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Automated prediction of children’s age from voice acoustics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:5ffa631488fa769689d33a8822b4d12901d50cf69d1fe451ba3252c6a3ab9ecb","observation_id":"e360ff93-f709-4277-b387-a5f96d61a2e9","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Children’s age and gender recognition from raw speech waveform using dnn,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:01e1753c946ad6b8cb40e368d408dc1a0cf1e8d0c47d3cb9984872d46c155499","observation_id":"7cbf27ae-1363-4aba-87cd-383272be70b6","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Automated speech analysis tools for children’s speech production: A systematic literature review,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:b77d1cb55ac33ba8e558b3395dfa6d70785951e28f1251315f123df8b11496b6","observation_id":"4bbb234a-d4d3-494b-851b-1527c0c79371","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Modeling the perception of children’s age from speech acoustics,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:cf8a88994f4f5dc471ae98c41761437b5bb7e1119cc56609e9fc1fa626346da7","observation_id":"e6b56550-54ef-406c-8954-3a351211e33e","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Speech production variability in fricatives of children and adults: Results of functional data analysis,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:fac11b10d64b900475c41fba09a0a6b60d4dac5cf86ef02ac88356df0d28569a","observation_id":"bfefabab-58d4-4294-8378-bf53397deeff","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Analysis of disfluency in children’s speech,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:a86f0e6639be41c41ad88f4c73b0404b483c577bfc81edb794cc694474677be2","observation_id":"475c5d3a-677c-403a-abf8-3fe64d862563","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Vowel acoustic space development in children: a synthesis of acoustic and anatomic data.,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:8dfa0a904c64198ee6dc3208eaaafb4cd7c73aef5d6b9736d46871299261cca6","observation_id":"df2d1e09-bf14-4696-9f19-f0b347376b11","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Acoustics of children’s speech: Developmental changes of temporal and spectral parameters,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:3431614fa320397e4d7252429d700471a9e3a891d4e923f58fb21d824a1dc105","observation_id":"1a4f0e8f-6c9f-4b23-98fd-bc3d760199db","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"On the difficulties of automatic speech recognition for kindergarten- aged children,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:4a454e4b5e67ab9d2f895e6e9c5e095a5bfb5a59b51a0e03ed6f0d0ea21b81a4","observation_id":"56153da2-7a59-480d-b892-a87ebd3dcb69","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"A survey about databases of children’s speech.,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:96870bdb8ccaa89e86874e1fa17cf833ce4310c2d4ebf9340cb8a1986addd495","observation_id":"405dc1ed-f519-44a2-8ef8-ea38eca3f6ef","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Automatic speaker age and gender recognition using acoustic and prosodic level information fusion,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:a21992e3a3686d70f87f3edf1902566ffaf075e6f244f077f69ca026e7878e44","observation_id":"5ad9c506-56b7-493e-98fa-ed572f4c4d12","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Roleofacousticsandprosodicfeatures for children’s age classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:58629b04cbc6257c755a09afc8110e73a0dcc8f85e130ad8860b8354929100d6","observation_id":"0ee049fb-5dfd-4250-a6d9-6860be8b5411","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Age and gender recognition based on multiple systems-early vs. late fusion.,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:351644606322cbef5709db91b16a12fd21a5ed8bc6676e5c49d97dbdc57367da","observation_id":"7d3f06dd-49f5-4e88-bdeb-849368564bea","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Combining short-term cepstral and long-term pitch features for automatic recognition of speaker age.,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:7c1ab10c631736254c7d8b4b548f142ba2b283a72d88be708adcce1172640514","observation_id":"75e1a3b1-0088-40b6-8cd4-751d31e0fb7b","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Age and gender detection in the i-dash project,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:77dc75522cbd59cda6aee60e3a06acdc7d206bfd98df26accd96d01c0ff745a8","observation_id":"c4890bb5-1c87-4d81-8e75-9da8e66ff384","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Identification of age-group from children’s speech by computers and humans.,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:b774ab79fcec5cee1921602482dab4e45c30daf3d5598c7c71611896de4140aa","observation_id":"f1f74e5e-9bfe-4546-99d7-1b23d2781073","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Emotion, age, and gender classification in children’s speech by humans and machines,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:5c19348dfed3d90d4f7e1f44e2e09803b8e1c0293b0f120df29bc8bbd16af923","observation_id":"80958c0c-0c71-4bb1-afc3-3b0f50998e67","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Children age and gender classification based on speech using convnets,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:7745bdcf5bd21d348bfa00bc379ef351fbfe3499c8ba93d8d251852b403233e5","observation_id":"eaaaf56c-5034-4c3b-8b2e-7eb9417d0050","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Analyzing features for automatic age estimation on cross-sectional data.,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:bdd91c8ebc3a9a1571b7a3346e70c63130b290e219d409b9c04e14d64fdbbc67","observation_id":"3b9a800f-affa-4ed2-a8de-e732144cdee4","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Calibration of probabilistic age recognition,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:2ded4161989850270f69e761b6fdf33df6cd5c1de8ca7db6321db10333b06672","observation_id":"468f3279-5a76-4889-8eb4-17f79dff0e4f","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Speaker age estimation using age-dependent insensitive loss,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:2fd140b443bc2e4b8411bbbe2dc90f55827da768701877264ca7998d45bc447d","observation_id":"0b16b553-3208-44f5-ae4d-b8cfccb97032","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Speaker recognition for children’s speech,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:afe1b96665461eac0b7017a82b5bd5969cb155b243753ed69c34fc78801d20dc","observation_id":"7611f3cf-cc61-4d4c-bc96-904ea034baa3","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Gender and age estimation methods based on speech using deep neural networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:f835767dd362e7907d85ab9b5cceb0b846742d24be7286df967d67e574ea0fd5","observation_id":"a0aef69c-55ce-4a2d-9f6f-d8ef42f2bfab","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Age group classification and gender recognition from speech with temporal convolutional neural networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:7579b84f0a1e1a53fd47b775e20d57756ba5ea1f77e18516a10c0cbf38a7aafc","observation_id":"284da73a-2a57-478e-a32a-64867f00e34d","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Automatic speaker and age identification of children from raw speech using sincnet over erb scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:1a8241c26de298ee08a111e9c904a1fd18a650dcc81532ff3fd01bd76fc27f2e","observation_id":"cac95780-e341-47ed-b0a4-fa50628e77af","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"wav2vec2.0: Aframeworkfor self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:c37b91a7c57b34b8827e78342b8d1af22550be2fb6a9cfa546c7465dd59db7ad","observation_id":"c6492aff-64ce-461c-8f9b-db5f445962c7","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:dbf85d014e43f1ed21051b86e8abfe28f5c599e4dc885c1a31b551a9d66914bf","observation_id":"ffd080b6-f120-4efc-b858-0b305d4e595b","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Data2vec: A general framework for self-supervised learning in speech, vision and language,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:ed5c4c38c43853464a997c190bceaa5676a1f0faf07cca2698e651c62d30a63f","observation_id":"2bf5c73e-7538-412d-8152-d62390c1d778","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:0ee11592dfde79de2ef1aaa4500d13c39c0d728fca8ac5ff379969ece329f48f","observation_id":"e4307cf0-02b8-4b9c-b75c-e78916dbbd05","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03502","last_updated":"2021-04-08T04:31:58Z","snapshot_observed_at":"2026-07-06T10:57:30.968546Z","submitted_at":"2021-04-08T04:31:58Z","title":"Emotion Recognition from Speech Using Wav2vec 2.0 Embeddings","version":1},"cited_work":{"arxiv_id":"2104.03502","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.03502","snapshot_observed_at":"2026-07-08T07:34:43.114766Z","title":"Emo- tion recognition from speech using wav2vec 2.0 embeddings","venue":"cs.SD","work_id":"ebe96864-b6a5-48a9-9eee-f0502736a27f","year":2021},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"cited_paper":"/paper/2104.03502","citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:a1f68155ab1c7bff44d4ab35c817775ff6246510c6cfddbd13f94d7d8771dcc7","observation_id":"1f25fb35-91ca-4465-b66b-7067feb29066","resolution":{"observed_at":"2026-07-04T08:39:42.082710Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Effect of speech modification on wav2vec2 models for children speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:d060b0728772107139d82e9a81b5ff9679c2d1cc48646c561f8370d3492da8bb","observation_id":"9794c1a9-7d9e-4864-a6ba-efa0441520a4","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Wav2vec2- based paralinguistic systems to recognise vocalised emotions and stuttering,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:3e7d59a9c0a911da12f854873053a7ae5745faa5519a00f1a5b66d8645bd07d5","observation_id":"76041f47-2a5d-4b28-bd93-656e129ce1ce","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Two-stage finetuning of wav2vec 2.0 for speech emotion recognition with asr and gender pretraining,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:a625d922f0a00944d9479346e142b482452ab10893d3cefbfb30b9de856cd2a6","observation_id":"ada7bd73-82e4-4290-b313-4e3c0a70e7b0","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"A noise-robust self-supervised pre-training model based speech representation learning for automatic speech recogni- tion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:d3ef39a8581d527a66aaf2c84c429504364c0e8f888f2c1a59c21d2ffdf53ca7","observation_id":"3107768f-fd24-47f4-bc2f-5202cc8ccb62","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Exploring wav2vec 2.0 on speaker verification and language identification,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:57e428d7ab95a31a131ad7525a664894e432d08edf2e1561e6e55d506e001584","observation_id":"15d94de9-faf3-49b1-825c-747ea30845ab","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Speech emotion recognition using self-supervised features,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:c49aecf0eda7e9697f9d9752310e0e46bd91ada16597a661a6e4d27ae88c33a3","observation_id":"679f2183-113a-4c9f-a30a-de2e31d63f7a","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Harnessing the power of wav2vec2 and cnns for robust speaker identification on the voxceleb and librispeech datasets,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:dd926dfd0379d9dc33d9df8822353608c7bb812c957cc2d9bea2d636c1a05b24","observation_id":"12966f4e-00df-4f13-b337-a86598d6eab7","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"On the robustness of wav2vec 2.0 based speaker recognition systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:fb2961e8611d9b743deb048e27597c832e87c8bdebed65292f9effd5cfb039fd","observation_id":"45353b00-c9e3-470f-8c96-4a4c92e48b9e","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Uti- lizing wav2vec in database-independent voice disorder detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:6554cfc82bd2a5d0eed4eb43a38e1ff4119e7856b4d43c727c5e3af8ede720fb","observation_id":"22fd659c-5c2d-47fe-9f6b-95571fb8f6bd","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Pre-trained models for detection and severity level classification of dysarthria from speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:61cc8a84dda9e2d005bfd02c881c00db8809b5bd17764e410e6d9141891c3f25","observation_id":"029735e2-2d71-406b-a384-e83afa05e26f","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Exploring the impact of fine-tuning the wav2vec2 model in database-independent detection of dysarthric speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:523658062f43383f3a09bdef89059daf87876548c44f5bacba4758ae7495b98e","observation_id":"9c789694-dcf1-49e3-8db3-b943dabada2b","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Svldl: Improved speaker age estimation using selective variance label distribution learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:765553f159f992c0e8e9b2a4aa7d80b3fe2a6a94cb8d0774376efef5183c3db1","observation_id":"ea03b40a-04cb-420e-a730-4b519e49c6e3","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"What are differ- ences? comparing dnn and human by their performance and characteristics in speaker age estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:f3429d96614f6642055bcad13688cb79ceae71dabc845affc1ff959c8a44e1b7","observation_id":"e2b9d72b-f628-4b0c-b728-c15981c13c08","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"Layer-wise analysis of self-supervised representations for age and gender clas- sification in children’s speech,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:7bc2b7be3915e64a83da2937f38ea79d24cfc21e706016e1e95e05187f1b2864","observation_id":"a70100e7-e047-4d6e-a3f6-8890a8618fa0","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"The pf-star british english childrens speech corpus,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:16aa46ec4c9f96a6a9db77e20ce2d15f2a9d22b9611faedc395a5894456fa8b6","observation_id":"2535d91d-59fe-4b07-85e9-5dec412189ae","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T11:14:20.892333Z","title":"The cmu kids corpus,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-26T11:14:20.892333Z"},"links":{"citing_paper":"/paper/2606.22177"},"observation_digest":"sha256:501b6608058689862e77bfa67421292fea422578aae5b0e6c05c1d32ecb6b9b8","observation_id":"dfd2f443-cdfa-434c-8df1-cc66736b51b2","resolution":{"observed_at":"2026-06-26T11:14:20.892333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.22177","last_updated":"2026-06-20T18:16:37Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T10:10:09.364345Z","submitted_at":"2026-06-20T18:16:37Z","title":"How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2606.22177."}