{"as_of":"2026-08-10T20:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3a7bf3032e4a1cd04710cf5947858756adf236da34d58e203c04a3ad4d4500f","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:03:33.486691Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16490/citation-record","integrity":"/paper/2505.16490/integrity","json":"/paper/2505.16490/citation-record.json","paper":"/paper/2505.16490"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1907.10902","last_updated":"2019-07-25T08:55:22Z","snapshot_observed_at":"2026-08-03T10:00:13.416332Z","submitted_at":"2019-07-25T08:55:22Z","title":"Optuna: A Next-generation Hyperparameter Optimization Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10902","snapshot_observed_at":"2026-08-07T15:03:27.263703Z","title":"Optuna: A Next-generation Hyperparameter Optimization Framework, July 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.263703Z"},"links":{"cited_paper":"/paper/1907.10902","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:851ee93e17b63822051b82ff91c4766b2f401a7cd5a43350c8112fa20bb5edbc","observation_id":"ff06e62c-2d41-4854-af30-fdc95e5b0ed0","resolution":{"observed_at":"2026-08-07T15:03:27.263703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.950312Z","title":"Common V oice: A Massively-Multilingual Speech Corpus","venue":null,"work_id":"be501f73-4354-494b-a8b6-1cbd59a24c40","year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.404870Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:b90544b6e153864bfe8929b4ce657970167ff33c4f9709477a189f10db40c3a2","observation_id":"e36f2734-ddd6-46dc-aae0-f52c8839671b","resolution":{"observed_at":"2026-08-07T15:03:43.000008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:27.536001Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations.Advances in neural information processing systems, 33:12449–12460, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.536001Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:47977c722e7b4aec73bb3780dfb068e9101b3b1899cddaea7e40e832d0b544e9","observation_id":"eedb6521-c831-40ae-a34c-2d47c736e457","resolution":{"observed_at":"2026-08-07T15:03:27.536001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02522","last_updated":"2024-03-04T22:26:25Z","snapshot_observed_at":"2026-08-09T12:47:09.784114Z","submitted_at":"2024-03-04T22:26:25Z","title":"HeAR -- Health Acoustic Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02522","snapshot_observed_at":"2026-08-07T15:03:27.720392Z","title":"Hear– health acoustic representations.arXiv preprint arXiv:2403.02522, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.720392Z"},"links":{"cited_paper":"/paper/2403.02522","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:cc9c97738696a72e8ecc43757372f1043f82c506f1b3fc74991f2880d107c385","observation_id":"cca498df-9210-42f1-98e1-0e094cb27da9","resolution":{"observed_at":"2026-08-07T15:03:27.720392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01255","last_updated":"2019-11-04T14:46:31Z","snapshot_observed_at":"2026-08-08T01:40:47.328408Z","submitted_at":"2019-11-04T14:46:31Z","title":"pyannote.audio: neural building blocks for speaker diarization","version":1},"cited_work":{"arxiv_id":"1911.01255","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.01255","snapshot_observed_at":"2026-08-07T15:03:36.957770Z","title":"pyannote.audio: neural building blocks for speaker diarization","venue":"eess.AS","work_id":"ea2f386e-4c41-4bdb-abb5-c946a63cbd67","year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.798093Z"},"links":{"cited_paper":"/paper/1911.01255","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:73ff8f0a438dd4f0c1924556c638207320e1223a6f462510801e26883b293153","observation_id":"acc8e611-e5ec-468f-9b19-9c33159df94c","resolution":{"observed_at":"2026-08-07T15:03:37.077690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:27.899330Z","title":"Iemocap: Interactive emotional dyadic motion capture database.Language resources and evaluation, 42:335–359, 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:27.899330Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f5dd42c51612b32d90dbe8735428510d36ffadb99077635b99afa38f4ebbe97a","observation_id":"85cdbb6b-455f-4f87-a3fb-3b7a53b94332","resolution":{"observed_at":"2026-08-07T15:03:27.899330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06909","last_updated":"2021-06-13T04:09:16Z","snapshot_observed_at":"2026-08-09T08:32:43.969496Z","submitted_at":"2021-06-13T04:09:16Z","title":"GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06909","snapshot_observed_at":"2026-08-07T15:03:28.008270Z","title":"Gigaspeech: An evolving, multi-domain asr corpus with 10,000 hours of transcribed audio.arXiv preprint arXiv:2106.06909, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.008270Z"},"links":{"cited_paper":"/paper/2106.06909","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:3a44960384cc3a168c07a78dd2a745f38b02cd18c105be333ea48dd98e443b70","observation_id":"ddd816b8-bd3f-4403-b5fd-9e9f06e09840","resolution":{"observed_at":"2026-08-07T15:03:28.008270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:28.125804Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing.IEEE Journal of Selected Topics in Signal Processing, 16(6):1505–1518, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.125804Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:2931545ffd81504c0e1ab96466afafe08468c6a4839494a9279c01fceb13c3cc","observation_id":"ad7a64fc-7092-4154-a0e8-c795546c04fa","resolution":{"observed_at":"2026-08-07T15:03:28.125804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.645929Z","title":"Unsupervised cross-lingual representation learning for speech recognition.Interspeech 2021, 2021","venue":null,"work_id":"4057671c-bc45-49fb-a88d-7fbb7bc892c3","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.218606Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:b702d226a8169a25aad3110051940433af0eb0e81f75224a4a98efc72e7ba40a","observation_id":"1ad40fbc-0e66-46fb-a4bd-565ae42db68d","resolution":{"observed_at":"2026-08-07T15:03:42.734448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.428364Z","title":null,"venue":null,"work_id":"a0cdcba3-1da6-46e2-9173-2f31833c563f","year":1980},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.327393Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:8533d0f33f67d29ec27d6251c8329138f4ab1d34d02bec6847bd1cc529ccec6a","observation_id":"f6229e4e-8e64-4885-8a3b-dac33023672b","resolution":{"observed_at":"2026-08-07T15:03:42.516575Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:42.188633Z","title":"Number 2","venue":null,"work_id":"36f145af-8719-4286-81c4-4ce5ef2f3c34","year":1971},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.429204Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:8be5bd00f21fe95d87fb214f4dea930bd2740369afdf4128c72633064dea4620","observation_id":"84cc7782-4f9c-4c5f-aff7-ab59bbf84f85","resolution":{"observed_at":"2026-08-07T15:03:42.311452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17505","last_updated":"2024-08-08T20:22:10Z","snapshot_observed_at":"2026-08-04T14:41:34.733369Z","submitted_at":"2024-07-07T08:09:28Z","title":"Survey on biomarkers in human vocalizations","version":2},"cited_work":{"arxiv_id":"2407.17505","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.17505","snapshot_observed_at":"2026-08-07T15:03:36.666114Z","title":"Survey on biomarkers in human vocalizations","venue":"q-bio.NC","work_id":"3fca4d74-7c49-43c4-b1d3-ca4fdd2f0c31","year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.506004Z"},"links":{"cited_paper":"/paper/2407.17505","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:11f9064676402a633cbcb46538c0efffe25bd6dd97125c8927f6da2f2543bd1d","observation_id":"9d928774-7e8d-4760-9eb0-c03751c53f34","resolution":{"observed_at":"2026-08-07T15:03:36.762505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5120/18744-9997","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Feature Extraction Techniques in Speech Processing: A Survey.International Journal of Computer Applications, 107(5):1–8, December 2014","venue":"International Journal of Computer Applications","work_id":"bd82f5cd-51f7-49c2-aabb-9e721eb3ff3a","year":2014},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.600956Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:0a72c7729302c5c194513efb6c5796411a5c84f27f4f2ac415dfd0ea61275a5a","observation_id":"13dc959f-5a94-44da-ac89-625e4f1034e5","resolution":{"observed_at":"2026-08-07T15:03:35.118750Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:28.678612Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units.IEEE/ACM transactions on audio, speech, and language processing, 29:3451–3460, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.678612Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:54bd36105517e0554a8a86a44ff73464c84ce4038d725221ec5dbd0543c3bf55","observation_id":"15122494-ad71-4bc1-9667-d21cd6002174","resolution":{"observed_at":"2026-08-07T15:03:28.678612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.995422Z","title":"Copdvd: Automated classification of chronic obstructive pulmonary disease on a new collected and evaluated voice dataset.Artificial Intelligence in Medicine, 156: 102953, 2024","venue":null,"work_id":"e2cfdc0a-8552-40be-b245-3ee95c87d584","year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.787258Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f422ba96f503a2d4a74579bb48959f2fee9d8c6ebfe8bf9493a96417d735c585","observation_id":"4aef01c8-e52d-43b8-9180-8ecf34caac6f","resolution":{"observed_at":"2026-08-07T15:03:42.077006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.667908Z","title":"Speaker identification through artificial intelligence techniques: A comprehensive review and research challenges.Expert Systems with Applications, 171:114591, 2021","venue":null,"work_id":"e29ffdf8-ae8b-4a3d-8eb1-be3c957b66ab","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.869172Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:4e2a9799aaa8a8c7c242ab3914bdf1d07dd89a5f51a2d66e6b0c915c600ef7d8","observation_id":"4de8adca-81d7-4231-915c-3ef0f30dfb22","resolution":{"observed_at":"2026-08-07T15:03:41.865994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.378576Z","title":"Libri-light: A benchmark for asr with limited or no supervision","venue":null,"work_id":"1b6ff2b3-ee10-468a-8890-5366b823f1cb","year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:28.966837Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:31c62ac2892700f1a17bd62407a0dedf2b62f401c5ac64b2031ce7f0bd076371","observation_id":"d6b65295-2015-4b55-b11a-634f327bea28","resolution":{"observed_at":"2026-08-07T15:03:41.500821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:41.052480Z","title":"LightGBM: A Highly Efficient Gradient Boosting Deci- sion Tree","venue":null,"work_id":"07379e1f-0fe8-4bed-9ede-8a923733000a","year":2017},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.068136Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:fff80a034a75685ac78410d96d1ee114547a1496098491c788ea89d25544d8a5","observation_id":"bedf83d8-b333-4295-b0d6-958285224776","resolution":{"observed_at":"2026-08-07T15:03:41.214286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:40.680443Z","title":null,"venue":null,"work_id":"2ce4aabb-9990-49a9-bd34-a301a03e9fa1","year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.137119Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:ec4d09dffd1dd4b12c267a2ede1cbb3236b5eb4db1da18798e2ade2b9ae4255d","observation_id":"3edac2e6-4bbc-4e26-b268-ee284abea056","resolution":{"observed_at":"2026-08-07T15:03:40.904101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41591-024-03481-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Phenome-wide associations of sleep characteristics in the Human Phenotype Project.Nature Medicine, 31(3):1026–1037, March 2025","venue":"Nature Medicine","work_id":"7fd5c02c-1dcb-4105-8876-0bcebb95edfd","year":2025},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.230899Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:9cf2575acc97b5561e33a2f9217a5813e22eebb51c43244fc6df9f2feafeaf1f","observation_id":"e2a360df-2512-4ede-994c-69dd37b7ed05","resolution":{"observed_at":"2026-08-07T15:03:34.826996Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/s21144785","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Gender and Age Estimation Methods Based on Speech Using Deep Neural Networks.Sensors (Basel, Switzerland), 21(14):4785, July 2021","venue":"日本作物学会四国支部会報","work_id":"53763e36-5305-4783-99d8-08be682d51c8","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.379756Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:9d98ffd87439b77fcc7fb154fc471bc8c65738bb38050cf18881a7057f8f145c","observation_id":"a3350918-3795-4a6f-b938-bc174330829b","resolution":{"observed_at":"2026-08-07T15:03:34.624355Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:29.438754Z","title":"Covid-19 artificial intelligence diagnosis using only cough recordings.IEEE Open Journal of Engineering in Medicine and Biology, 1: 275–281, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.438754Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:266bae02cac1ce1ec2beaea229fb9a68e5cbf196bba851e5a51f37906eff9aab","observation_id":"10b29842-00e5-46b6-a90a-0aef7bbb76c9","resolution":{"observed_at":"2026-08-07T15:03:29.438754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:40.302935Z","title":"Survey of deep representation learning for speech emotion recognition.IEEE Transactions on Affective Computing, 14(2):1634–1654, 2021","venue":null,"work_id":"077014af-8f2b-4459-bd9b-a06398099e62","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.527326Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f62fbbbb1a929ad72e3e178d25bbf06569866aef611492ffccfdef976403bf1c","observation_id":"a2af128e-e813-45b5-a583-1d35bfb1b175","resolution":{"observed_at":"2026-08-07T15:03:40.427037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:29.655615Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.655615Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:6eff676950e3d5cbecbfbd5c7bfb4315ad89844ee6d1287d556bef4490327373","observation_id":"1317ee78-1777-461d-898e-bd2e4c2f5986","resolution":{"observed_at":"2026-08-07T15:03:29.655615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:29.769328Z","title":"Detecting Cognitive Decline Using Speech Only: The ADReSSo Challenge","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.769328Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:d6aecf3d587104e8e83d46964106254eb73f61f3b2360f12e42a3de626bbf26b","observation_id":"6c3abdff-68dd-4480-8f59-8c33bf113fa2","resolution":{"observed_at":"2026-08-07T15:03:29.769328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08720","last_updated":"2023-07-17T04:19:30Z","snapshot_observed_at":"2026-08-09T13:14:53.944191Z","submitted_at":"2023-07-17T04:19:30Z","title":"ivrit.ai: A Comprehensive Dataset of Hebrew Speech for AI Research and Development","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08720","snapshot_observed_at":"2026-08-07T15:03:29.870629Z","title":"ivrit.ai: A Comprehensive Dataset of Hebrew Speech for AI Research and Development, July 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.870629Z"},"links":{"cited_paper":"/paper/2307.08720","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:c26803887b56297537d075ab30062a27596471089aefa1fc59812bf6f2853296","observation_id":"029fd8f7-27a9-43fd-b5fc-f58c97f9947c","resolution":{"observed_at":"2026-08-07T15:03:29.870629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1500694","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:36.190224Z","title":null,"venue":null,"work_id":"5dab97f4-0408-4e30-8c74-528d62952916","year":2025},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:29.955537Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:ee65a176345a4aaedf915f5bc957226e2be13e64f10a4ef0aa12cb0ced254462","observation_id":"b0b36358-20a2-4d38-97f6-51c5d0bb7826","resolution":{"observed_at":"2026-08-07T15:03:36.320031Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.974404Z","title":"Automatic speaker verification systems and spoof detection techniques: review and analysis.International Journal of Speech Technology, 25(1):105–134, 2022","venue":null,"work_id":"e4c91e5b-f0c9-4826-b25e-ccf77d2c9220","year":2022},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.049159Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:2098d989313f3c77eeadbdf0595608c2872cc94c254bc31c213c041022267584","observation_id":"4ca6ad5c-944e-4aee-a7b8-b76b25396db3","resolution":{"observed_at":"2026-08-07T15:03:40.139457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.685264Z","title":"Study of the performance of automatic speech recognition systems in speakers with parkinson’s disease","venue":null,"work_id":"c7c0b23b-0e68-4abc-81ff-90122ca9fc7c","year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.162076Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:9098650ea99dd95cee80762ca450c91330dd527e8c3479ede187b66d798cfe36","observation_id":"8d725437-679f-4160-8817-7af1d1a51947","resolution":{"observed_at":"2026-08-07T15:03:39.813561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:39.355343Z","title":null,"venue":null,"work_id":"0a4305b8-3ead-4cc5-8ded-47a2a28bc10c","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.263507Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:14133326fec0d8d590ba5ebe586bc54cdcaaddf455b533f680a2c485d7a1795d","observation_id":"03cf80d6-b99b-425d-84b0-ead00d5eebcc","resolution":{"observed_at":"2026-08-07T15:03:39.517906Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:30.396776Z","title":"V oxceleb: Large-scale speaker verification in the wild.Computer Speech & Language, 60:101027, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.396776Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:1349e3b70b988e82260d981646512f87f1d72abee49b3af88f16337c1496ad9a","observation_id":"2e3e7bfc-47bd-460b-bf78-de746daf150a","resolution":{"observed_at":"2026-08-07T15:03:30.396776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.980166Z","title":"The coughvid crowdsourcing dataset, a corpus for the study of large-scale cough analysis algorithms.Scientific Data, 8(1):156, 2021","venue":null,"work_id":"400cc809-1589-478e-bbb2-f08cc2571afa","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.465018Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:8fdb67c599b838d3d5978f82ac021970da9bf1eaee82246c0c6464329040c916","observation_id":"c450ccf1-ad85-495f-a9e4-f8e95f5bf4fa","resolution":{"observed_at":"2026-08-07T15:03:39.198345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:30.576014Z","title":"Librispeech: an asr corpus based on public domain audio books","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.576014Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f1c21d2bbbf129e4b5d712648fd862a06ef4f5e13334da60d5f1b484d6be2be1","observation_id":"70c65c79-405b-4780-a3f8-ae747b68c282","resolution":{"observed_at":"2026-08-07T15:03:30.576014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.726124Z","title":"A german database of patterns of pathological vocal fold vibration.Phonus, 3:143–153, 1997","venue":null,"work_id":"a7561d96-1fac-4256-a267-8b2ebf761f52","year":1997},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.690670Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:8907f68e5eeb5ca0eb7754edca3741390ab42aeb47d2be1ea299a71df039a0f8","observation_id":"f328333c-2850-43ba-8a74-83aafec05188","resolution":{"observed_at":"2026-08-07T15:03:38.812874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-08-04T07:20:14.379561Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-08-07T15:03:30.859532Z","title":"SpeechBrain: A General-Purpose Speech Toolkit, June 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:30.859532Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:f7bc593854df75ef3ca81f643710b9c4485b2d5671fc19d0f87e9eb9c56f684c","observation_id":"27c91a71-7075-4c38-9c84-3c05a8d17e38","resolution":{"observed_at":"2026-08-07T15:03:30.859532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.01477","last_updated":"2021-04-05T17:23:19Z","snapshot_observed_at":"2026-08-09T19:06:32.767133Z","submitted_at":"2020-12-02T19:33:44Z","title":"The Third DIHARD Diarization Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.01477","snapshot_observed_at":"2026-08-07T15:03:31.066762Z","title":"The Third DIHARD Diarization Challenge, April 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.066762Z"},"links":{"cited_paper":"/paper/2012.01477","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:d08bd6af8b8bf7612df95159958db14cf2a24111b2b7c0b816ab273c388e3645","observation_id":"857ee834-e217-4ca8-a5f2-bdf163b4d894","resolution":{"observed_at":"2026-08-07T15:03:31.066762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.452158Z","title":"Evaluation of speech and pause alterations in patients with acute and chronic heart failure.Journal of the American Heart Association, 11(21):e027023, 2022","venue":null,"work_id":"0315373a-a38b-4668-8b73-9264e18878b9","year":2022},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.183485Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:0723ce41de8f8338b5b3852d6663936ec459a408dca0e66015450127098854cf","observation_id":"99d99941-6e59-42b0-a5ff-cd87545fd0b9","resolution":{"observed_at":"2026-08-07T15:03:38.618424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.10548","last_updated":"2020-08-11T06:45:40Z","snapshot_observed_at":"2026-08-06T19:15:27.339369Z","submitted_at":"2020-05-21T10:04:52Z","title":"Coswara -- A Database of Breathing, Cough, and Voice Sounds for COVID-19 Diagnosis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.10548","snapshot_observed_at":"2026-08-07T15:03:31.354500Z","title":"Coswara–a database of breathing, cough, and voice sounds for covid-19 diagnosis.arXiv preprint arXiv:2005.10548, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.354500Z"},"links":{"cited_paper":"/paper/2005.10548","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:6341b8b65374d182ded0692096d72a732710c1db9b1d2fc4c79c91845be6b86f","observation_id":"91dad948-b8da-48bc-baf6-be3feaa7cbc6","resolution":{"observed_at":"2026-08-07T15:03:31.354500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10654-021-00753-5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:03:40.895421Z","title":"10 K: a large-scale prospective longitudinal study in Israel.European Journal of Epidemiology, 36(11):1187–1194, November 2021","venue":"European Journal of Epidemiology","work_id":"55cb0338-6c00-4691-9977-56287f897fa0","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.521588Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:a05f5d3760e9b2aece86c731e5016252bf0538c5a1495e6db81c1ee80abbe542","observation_id":"a974cb2f-d8e8-461d-8d9a-ce06875b02fc","resolution":{"observed_at":"2026-08-07T15:03:34.339156Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:31.678096Z","title":"X-Vectors: Robust DNN Embeddings for Speaker Recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.678096Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:4cb354a1fd8eabe9358ad9a238cb972c35b0aa6abe67baf9770951f21b325cf7","observation_id":"e5e4bf8e-0455-4785-8340-2ca860bf1ce4","resolution":{"observed_at":"2026-08-07T15:03:31.678096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:38.138147Z","title":"Comparison of speech tasks and recording devices for voice based automatic classification of healthy subjects and patients with amyotrophic lateral sclerosis","venue":null,"work_id":"26df8db3-c484-4c21-8d31-4bda98fb1872","year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:31.910944Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:a9f822b50ea7e04e034cd7aa2f96a8fec441252bbf3a6eece85e032a91fba6db","observation_id":"ef0aee27-88a2-4cae-968f-36fc5e49f657","resolution":{"observed_at":"2026-08-07T15:03:38.278926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:32.068328Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.068328Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:6bf613ebf3fcb34be8efe695d4fd567da685b44973d54e0d725fbdaf958f3728","observation_id":"1ad11b27-5004-4f2f-9974-1f63f11f2770","resolution":{"observed_at":"2026-08-07T15:03:32.068328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11946","last_updated":"2020-09-11T05:08:01Z","snapshot_observed_at":"2026-08-10T19:44:30.311627Z","submitted_at":"2019-05-28T17:05:32Z","title":"EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.11946","snapshot_observed_at":"2026-08-07T15:03:32.217169Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.217169Z"},"links":{"cited_paper":"/paper/1905.11946","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:16415965e373a3aa9c30a9f72ee60eb2d99f552d9f83144a80440b7696d364d6","observation_id":"b4a36263-7da7-4af6-b59b-538369d5a5eb","resolution":{"observed_at":"2026-08-07T15:03:32.217169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.847304Z","title":"Early dementia detection using multiple spontaneous speech prompts: The process challenge","venue":null,"work_id":"dfa17876-9808-4805-9ef9-13939d9ccadc","year":2025},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.416589Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:e982c4aa35754665ac03ffa4117ff87da9c2c5dbb113bbc62f9f478dc24f7a85","observation_id":"667e7095-a84a-45a1-b203-9a12749bc16f","resolution":{"observed_at":"2026-08-07T15:03:37.955031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-023-49352-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Ray Dorsey, and Adam V ogel","venue":"Scientific Reports","work_id":"d7221a05-1178-432b-8e15-9c7ee9322852","year":2023},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.619548Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:5fb1a12faa6fab885971c5f6911002961e2266b6488ddf887380b81b8cd7afd7","observation_id":"5497cff9-ca9c-4d59-be1a-35501d56a60b","resolution":{"observed_at":"2026-08-07T15:03:33.930434Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00390","last_updated":"2021-07-27T04:04:57Z","snapshot_observed_at":"2026-08-09T19:09:23.880235Z","submitted_at":"2021-01-02T07:24:21Z","title":"VoxPopuli: A Large-Scale Multilingual Speech Corpus for Representation Learning, Semi-Supervised Learning and Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00390","snapshot_observed_at":"2026-08-07T15:03:32.780424Z","title":"V oxpopuli: A large-scale multilingual speech corpus for representation learning, semi-supervised learning and interpretation.arXiv preprint arXiv:2101.00390, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:32.780424Z"},"links":{"cited_paper":"/paper/2101.00390","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:36bfe5e5bdfb020a5e0bcb8d489ea8b2037f6491c6ff0fb6d4b7fbf91c37ac09","observation_id":"3cfacb16-af02-45e6-9163-d43e839a6056","resolution":{"observed_at":"2026-08-07T15:03:32.780424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12991","last_updated":"2023-10-20T11:31:26Z","snapshot_observed_at":"2026-07-06T15:45:35.947502Z","submitted_at":"2023-06-22T15:47:36Z","title":"Speech Emotion Diarization: Which Emotion Appears When?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12991","snapshot_observed_at":"2026-08-07T15:03:33.019374Z","title":"Speech Emotion Diarization: Which Emotion Appears When?, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.019374Z"},"links":{"cited_paper":"/paper/2306.12991","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:5bad0ed5d2e2e52b03f6b0ecc30959140b214b9319f5d41af1f4d96a9e6b48f0","observation_id":"0a14560d-c012-4180-9396-14040a0f2328","resolution":{"observed_at":"2026-08-07T15:03:33.019374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.554332Z","title":"A comprehensive review of speech emotion recognition systems","venue":null,"work_id":"b2852509-3f17-4cda-924d-aa9c4fbe6b62","year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.162888Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:e7cb7e04f4696ccc5009acde2db5f67ca7badad12b64b1625e73d6b6b7847dc5","observation_id":"01bd70cb-f87b-4d36-9553-746c99c0a10f","resolution":{"observed_at":"2026-08-07T15:03:37.657161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:37.276554Z","title":"Quantifying talk: developing reliable measures of verbal productivity.Behavior research methods, 43:168–178, 2011","venue":null,"work_id":"4ab543f6-e997-48c2-99d2-fd5dcf23f91a","year":2011},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.250296Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:18f4c851cd0e5a6df1ca9cd0dd24e6962dff3a52ee206ce2b3d3af07455e182d","observation_id":"26ae48ae-a54d-4374-8d4c-091405627585","resolution":{"observed_at":"2026-08-07T15:03:37.401094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:33.395624Z","title":"Superb: Speech processing universal performance benchmark.Interspeech 2021, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.395624Z"},"links":{"citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:e5a7f2d8c53a5046b6e8f2b4f3ae2149aa040edc3e579f25d90a8c75439bd870","observation_id":"398c6fa1-ceae-4ef8-a034-6e8df484fb9a","resolution":{"observed_at":"2026-08-07T15:03:33.395624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09385","last_updated":"2024-05-29T21:24:40Z","snapshot_observed_at":"2026-08-09T18:52:33.026142Z","submitted_at":"2024-04-15T00:03:16Z","title":"A Large-Scale Evaluation of Speech Foundation Models","version":2},"cited_work":{"arxiv_id":"2404.09385","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.09385","snapshot_observed_at":"2026-08-07T15:03:35.362005Z","title":"A Large-Scale Evaluation of Speech Foundation Models","venue":"eess.AS","work_id":"6b60ec82-1102-44f4-9da1-c4dd149ea40d","year":2024},"citing_paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:33.486691Z"},"links":{"cited_paper":"/paper/2404.09385","citing_paper":"/paper/2505.16490"},"observation_digest":"sha256:e141c52bb67d814ebf6a6f347d5cbb1ac2dd18271ed9168c7e510fb3455e2282","observation_id":"f346085e-7d80-4562-b430-ce6fb7ade033","resolution":{"observed_at":"2026-08-07T15:03:35.459437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16490","last_updated":"2025-05-25T10:12:09Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-08T08:15:06.297411Z","submitted_at":"2025-05-22T10:22:15Z","title":"HPP-Voice: A Large-Scale Evaluation of Speech Embeddings for Multi-Phenotypic Classification"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":9,"verified_fuzzy":17},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2505.16490."}