{"as_of":"2026-08-18T19:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:110a7b094207d2ceae9694785ffe3bb08bf4bea6b35e3dbfa9c7399886e687f2","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:09:20.903912Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:09:20.730196Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T21:09:21.166119Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"cited_work":{"arxiv_id":"2501.05966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.05966","snapshot_observed_at":"2026-08-10T21:09:21.166119Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","venue":"cs.SD","work_id":"34ecab43-94dd-4b1d-87f9-6f8d0ecd4691","year":2025},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.730196Z"},"links":{"cited_paper":"/paper/2501.05966","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:10409c018068fe44f93127d2c772f09ec2dac32e27fef6584e9d05ad645b8acc","observation_id":"a22d3847-3b3a-4c98-a15d-59994b323445","resolution":{"observed_at":"2026-08-10T21:09:21.172743Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.05966/citation-record","integrity":"/paper/2501.05966/integrity","json":"/paper/2501.05966/citation-record.json","paper":"/paper/2501.05966"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.644493Z","title":null,"venue":null,"work_id":"fc956191-1cf0-4e96-9c3f-49037a25ceb9","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.723882Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:76929110498ec0b1dce04c5bcc00d86abf1063a00a9f48fe7f221ad8e656de7f","observation_id":"32286f49-282d-48e3-a03f-b3810ed3841d","resolution":{"observed_at":"2026-08-10T21:09:21.651865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"cited_work":{"arxiv_id":"2501.05966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.05966","snapshot_observed_at":"2026-08-10T21:09:21.166119Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","venue":"cs.SD","work_id":"34ecab43-94dd-4b1d-87f9-6f8d0ecd4691","year":2025},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.730196Z"},"links":{"cited_paper":"/paper/2501.05966","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:10409c018068fe44f93127d2c772f09ec2dac32e27fef6584e9d05ad645b8acc","observation_id":"a22d3847-3b3a-4c98-a15d-59994b323445","resolution":{"observed_at":"2026-08-10T21:09:21.172743Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.623550Z","title":null,"venue":null,"work_id":"db1ceaa6-26ed-4663-a2e6-f4a71a69a72b","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.736257Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:bb04eca48891f592247135a494d96c7ae8ada47424fdb7bd6a147507fdd63702","observation_id":"db8b6727-8912-4a2d-ba60-c9647c3d8619","resolution":{"observed_at":"2026-08-10T21:09:21.631107Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.600220Z","title":"Then we present results for each task","venue":null,"work_id":"83db87e7-954c-4bff-8865-23e9f77248a5","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.741418Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:af19b42f84cb50a4fda4e9d3c6f5348b6cd856a2106e6f5e81d1ed1d9f648725","observation_id":"4d939346-0b3e-4066-ad00-2735ce5ccbc6","resolution":{"observed_at":"2026-08-10T21:09:21.609069Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.571595Z","title":"To illustrate the potential compute savings, suppose one pre- trains the 30 models from this work to 400k steps","venue":null,"work_id":"534a0814-9689-4ee8-a9b8-0d9573d230aa","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.746895Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:6a127428017ebd5f011bcbe557f2ad3258a016e979cc7f498c4b7d0afaf58cc3","observation_id":"8fc46881-5183-4432-83cb-a857a01425e2","resolution":{"observed_at":"2026-08-10T21:09:21.580035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.551124Z","title":null,"venue":null,"work_id":"5e0d3b2d-345b-4f50-91ed-34314225a290","year":null},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.751536Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:c8fb2a71337793fd5dd0b7bb50b607af0ffaae1dbe4dba3385bf5545c479bd00","observation_id":"a2ff2a40-a06b-4209-a4df-3d5ad3fc21e7","resolution":{"observed_at":"2026-08-10T21:09:21.557600Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.756514Z","title":"Self-supervised speech representation learning: A review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.756514Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:591bcd1eae3edd3099be9324126e1b274744f21bd11b914a5c81530c136aa389","observation_id":"2c08ea3c-222d-421d-94ef-c31fafdb35b0","resolution":{"observed_at":"2026-08-10T21:09:20.756514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.761781Z","title":"Superb: Speech pro- cessing universal performance benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.761781Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:59c299b9675c0af48e5d9afe015e86ca29bd282bc96e7396c8edd0d5465607a1","observation_id":"28ac3184-9ec2-4fff-a480-f654dbee603c","resolution":{"observed_at":"2026-08-10T21:09:20.761781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.511720Z","title":"Reducing barriers to self-supervised learning: Hubert pre- training with academic compute,","venue":null,"work_id":"5fb601b3-d212-4f2e-af1e-9b6d877fabdb","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.766785Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:0e396aaff0e51c880fe1fbc2d5a97d12ddf20be34f14015170b2aed2131be365","observation_id":"80298ea6-7411-462e-83b4-37bdb49f3d00","resolution":{"observed_at":"2026-08-10T21:09:21.517900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.771671Z","title":"Xls-r: Self-supervised cross-lingual speech representation learning at scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.771671Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:7de51711afc89d2e5d58483b3ff580de8cc5758aef430b1c8d382064f337204d","observation_id":"ca310b70-fed9-4213-a42f-20079f828961","resolution":{"observed_at":"2026-08-10T21:09:20.771671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-16T15:51:28.593814Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-10T21:09:20.777083Z","title":"Google usm: Scaling auto- matic speech recognition beyond 100 languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.777083Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:3560c59dd5c96a1d97294c7a923dc562adb98ca76534d74a01a4a349f3c4a7f6","observation_id":"67ad8de9-c5a0-4ce1-bf90-a4e8da9ec1b3","resolution":{"observed_at":"2026-08-10T21:09:20.777083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.478395Z","title":"Efficient self- supervised learning with contextualized target representations for vision, speech and language,","venue":null,"work_id":"4057e1ac-de9a-4e7b-81e2-c4161f8f0af1","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.783177Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:6bf2edb3ab34641c3403ebc36fa73c22ea7c697f940618ebcc4f31ab2b900ea2","observation_id":"33e6f3e0-c1f4-4548-8922-ac86a2d1bead","resolution":{"observed_at":"2026-08-10T21:09:21.486228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.457043Z","title":"On the (in)efficiency of acoustic feature extrac- tors for self-supervised speech representation learning,","venue":null,"work_id":"7adcd351-b241-427b-9372-99b4769aa4c6","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.788355Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:c5ab070e42c8724830a2d038971c9fe6bdbd4a6cb1a5a92d01c8d7bbbf7f62ba","observation_id":"9f51d3de-c7bd-4d43-b1e5-e3872f636eaf","resolution":{"observed_at":"2026-08-10T21:09:21.463361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.440203Z","title":"An analysis of linear complexity attention substitues with best- rq,","venue":null,"work_id":"736f6e35-d148-4fbd-8ea1-4f6f145ec9b2","year":2024},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.793021Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:ebe71461896552c580ec209afda607fc8d7df751dcc31dd7efc8782eb688f9d0","observation_id":"3fb41a4a-a8e6-4ea6-9911-810faf2fd781","resolution":{"observed_at":"2026-08-10T21:09:21.445319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.423392Z","title":"Speech self-supervised representation benchmarking: Are we doing it right?","venue":null,"work_id":"a13c20c5-bb2c-4af1-80a3-37a39328af1d","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.797247Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:6b061a12fd365938805ef221464da9c502c92466c6574d187717df81f77acdf1","observation_id":"04250c51-1828-4e39-b571-261aca2529df","resolution":{"observed_at":"2026-08-10T21:09:21.428907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.406626Z","title":"RankMe: Assessing the downstream performance of pretrained self-supervised representations by their rank,","venue":null,"work_id":"d8565eed-7718-417f-8b08-821dc3aee5f9","year":2023},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.802014Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:e0e9f1319b982ce8ff138ea4f6292a9dd5f929940281b4b96c34d26536521cba","observation_id":"b71cdaf1-47dc-486e-8693-6c6505545a14","resolution":{"observed_at":"2026-08-10T21:09:21.412228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.387306Z","title":"The effective rank: A measure of ef- fective dimensionality,","venue":null,"work_id":"e1851791-b943-49ec-a7cf-b96f3e6ed21d","year":2007},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.807732Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:e1b3529394ebb3c3f6092690e1ce59c5199656bdfceed5fcde68d64f3b7af559","observation_id":"a6879337-1188-4bbc-ae60-7f5eeb157563","resolution":{"observed_at":"2026-08-10T21:09:21.393814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10787","last_updated":"2025-01-17T21:34:34Z","snapshot_observed_at":"2026-08-16T15:13:09.303602Z","submitted_at":"2024-09-16T23:49:41Z","title":"Towards Automatic Assessment of Self-Supervised Speech Models using Rank","version":2},"cited_work":{"arxiv_id":"2409.10787","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.10787","snapshot_observed_at":"2026-08-10T21:09:21.121699Z","title":"Towards Automatic Assessment of Self-Supervised Speech Models using Rank","venue":"eess.AS","work_id":"d2ab7fa9-153f-440b-ab64-a1940d0ee8a9","year":2024},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.812965Z"},"links":{"cited_paper":"/paper/2409.10787","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:10adb42cff794b2ebaaad49a09c980ddee10f042a528d148be3be485d8894458","observation_id":"821ee8b3-1945-452c-b7d1-cb3c8f22dbe9","resolution":{"observed_at":"2026-08-10T21:09:21.128818Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.366365Z","title":"Self- supervised learning with random-projection quantizer for speech recognition,","venue":null,"work_id":"f2071128-f98b-4960-a311-57237cf88771","year":2022},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.818025Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:25ab18fd265846c7e094635fb76020f6debe3bbcdffe5664f27357b66cc1e9c5","observation_id":"344e8bd8-6df3-4293-b53a-66792838a844","resolution":{"observed_at":"2026-08-10T21:09:21.372396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04296","last_updated":"2024-09-04T10:23:04Z","snapshot_observed_at":"2026-08-16T13:54:41.873921Z","submitted_at":"2024-05-07T13:11:37Z","title":"Open Implementation and Study of BEST-RQ for Speech Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04296","snapshot_observed_at":"2026-08-10T21:09:20.823632Z","title":"Open implementation and study of best-rq for speech processing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.823632Z"},"links":{"cited_paper":"/paper/2405.04296","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:a01a84a045253779f4a7e4676b144f71f232c244c6cec67aab68aab1651fe972","observation_id":"0f7a008d-387b-46a6-ad99-53b572ff021c","resolution":{"observed_at":"2026-08-10T21:09:20.823632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-08-18T17:51:41.801692Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-08-10T21:09:20.829529Z","title":"SpeechBrain: A general-purpose speech toolkit,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.829529Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:cd87bbe2888b3613ef1487bb759a0ab8a6efe843d76ff29fccfedd8694939d45","observation_id":"0e9fc001-30f6-40fe-96a2-ffabb2c1099e","resolution":{"observed_at":"2026-08-10T21:09:20.829529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.835077Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.835077Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:b08b1ef507558581f01597c4ebc3bed9bf2cdad3f638fc934834ab1712f1cbea","observation_id":"ad974c70-fd40-4adc-af6c-fa180d2779ac","resolution":{"observed_at":"2026-08-10T21:09:20.835077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.338457Z","title":"Some methods for classification and analysis of multivariate observations,","venue":null,"work_id":"a26cf4ef-73c3-4584-84ec-f53f64d7e81d","year":1967},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.840683Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:5465e5879507b3d6b43faab09c6346a1cb74253fe532f4743d7d5099e74d02c6","observation_id":"677c3ae5-9377-4f3d-a3a0-e1055fef8932","resolution":{"observed_at":"2026-08-10T21:09:21.344254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.846033Z","title":"Least squares quantization in pcm,","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.846033Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:d48c885922660596725f50dd8c859fbcaefbf8fd2a9c6ed5c3ccb9dbc34a3786","observation_id":"b93951bf-8e11-4309-918e-506c84e21d6d","resolution":{"observed_at":"2026-08-10T21:09:20.846033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.851998Z","title":"Web-scale k-means clustering,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.851998Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:44d009b45475685fc938326a35253db47b7bafcd102c30b413dcbf0b6524a291","observation_id":"4d53263b-3386-4d14-8a98-639130bab03b","resolution":{"observed_at":"2026-08-10T21:09:20.851998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.857645Z","title":"Scikit-learn: Machine learning in Python,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.857645Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:6cb628947e64a2c791afcbfb642f5607b64814a2559c69d9a8967136613e20d8","observation_id":"0d2ac95c-85fa-4420-bf58-5ad1862cc4fa","resolution":{"observed_at":"2026-08-10T21:09:20.857645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.295020Z","title":"k-means++: the advantages of careful seeding,","venue":null,"work_id":"e169f4ab-da0b-4113-a94e-53a085abc45b","year":2007},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.862462Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:0f3102a22a740ed8056782682315d58d18e1bef2757f02d5e3db388c80ad8bf2","observation_id":"7ed4d604-4f12-4b0f-8697-8d70416e408f","resolution":{"observed_at":"2026-08-10T21:09:21.301633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.275118Z","title":"A cluster separation measure,","venue":null,"work_id":"92db738d-4652-4757-ae42-751290b18bb6","year":1979},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.866485Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:26f54e57475a4fbae372e4902c92413a6297a965c2e0e4d46ab89c5d9c04b41e","observation_id":"266beb86-e799-468e-a268-1b31ff43e703","resolution":{"observed_at":"2026-08-10T21:09:21.280390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.871079Z","title":"Lib- rispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.871079Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:40e57f3b590d24a777305d90585b060b5fae1f88db5e0f4f08e86233d096e028","observation_id":"e850321f-9d73-47b0-a393-3a00109527c6","resolution":{"observed_at":"2026-08-10T21:09:20.871079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.875401Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.875401Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:3f6f0cc050b8146d6f8a15c349f84a9ca34b5ad31c22e9aa7793e210894e72b6","observation_id":"d77feaaa-6092-496e-a623-2f9ee6ccd3f1","resolution":{"observed_at":"2026-08-10T21:09:20.875401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.880574Z","title":"Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.880574Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:cf666631db0834f30982b96e2642f6c81946a7e33f91a790680de8c821ef45e8","observation_id":"46ea029b-be06-42bc-820e-2afa5cf92340","resolution":{"observed_at":"2026-08-10T21:09:20.880574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:21.219836Z","title":"ContextNet: Improving Convolutional Neural Networks for Automatic Speech Recognition with Global Context,","venue":null,"work_id":"e634aa01-d8d2-41c7-8c16-543ad1e11ad5","year":2020},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.886242Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:842085a65c264a45b0c3c3f5b243688549396ad7fcbcb83d8858c2034e175577","observation_id":"ecd7c788-93f4-4b3a-bf14-d7a8899c9801","resolution":{"observed_at":"2026-08-10T21:09:21.225818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.892598Z","title":"V oxceleb: A large- scale speaker identification dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.892598Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:44b2e627950ac5820da7790508ae610a25225db96f99a608237efcd7419775ff","observation_id":"4d0a56d3-1e37-4a0a-a1e2-1e9ce84d3ea9","resolution":{"observed_at":"2026-08-10T21:09:20.892598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.898139Z","title":"Ecapa-tdnn: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.898139Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:4f7847ab40d0e7da52f9620438df4c16be76498b9a4b95518ca0d4432aa23226","observation_id":"774dac3f-dd1e-4e4d-a6f1-93d15a889119","resolution":{"observed_at":"2026-08-10T21:09:20.898139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:09:20.903912Z","title":"Layer-wise analysis of a self-supervised speech representation model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:20.903912Z"},"links":{"citing_paper":"/paper/2501.05966"},"observation_digest":"sha256:b49c5bfd664ea1ccb311a11a5bf4297bec6fc12f7bb789e5a298e3b4e950dab1","observation_id":"746c7500-0a02-4cd4-89ce-e63db7ae8908","resolution":{"observed_at":"2026-08-10T21:09:20.903912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.05966","last_updated":"2025-05-31T14:29:13Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-18T17:52:31.994910Z","submitted_at":"2025-01-10T13:49:09Z","title":"Towards Early Prediction of Self-Supervised Speech Model Performance"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2501.05966."}