{"as_of":"2026-08-19T10:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1f65c374c4ec3cc86f992c04475a1e1683929f16b31e1f73da2eb90dd2ccb53","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T09:14:23.986764Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T16:22:07.001549Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T21:46:15.489876Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"cited_work":{"arxiv_id":"2506.12606","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12606","snapshot_observed_at":"2026-07-01T21:46:15.489876Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","venue":"cs.CL","work_id":"aff4cfbc-2eae-4bab-b84d-af50d9da99fa","year":2025},"citing_paper":{"arxiv_id":"2606.01135","last_updated":"2026-05-31T10:15:08Z","snapshot_observed_at":"2026-08-14T10:06:17.182799Z","submitted_at":"2026-05-31T10:15:08Z","title":"Spiking and Event-driven Neuromorphic Mamba Models for Efficient Speech Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T16:22:07.001549Z"},"links":{"cited_paper":"/paper/2506.12606","citing_paper":"/paper/2606.01135"},"observation_digest":"sha256:5b4c57b0f33f275472c41940ea8642db67f6aac10d31c940efe11cb75b0c6d1f","observation_id":"4ff077a9-6024-43fc-893d-1013741a479f","resolution":{"observed_at":"2026-07-01T21:46:15.491266Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12606/citation-record","integrity":"/paper/2506.12606/integrity","json":"/paper/2506.12606/citation-record.json","paper":"/paper/2506.12606"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","venue":null,"work_id":"6bd9d9f3-9a8d-4a8a-94cc-caa69e2f4588","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:22e3a840bb9314fc386352d2f8c3c700606051a860b8ca9ba62a9087fa0956d8","observation_id":"f424a9ab-e333-4a89-89b0-5eb53ffff89d","resolution":{"observed_at":"2026-05-19T09:17:15.655242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MambaMOT: State-Space Model as Motion Predictor for Multi-Object Tracking","venue":null,"work_id":"738c7a8c-81d2-4e58-a121-9b8c0ee9d25b","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:48776b9b0dc8e5609cd111634baa5a3d23226250f0988258253f930135861967","observation_id":"5b03949f-76e9-44a3-a0c5-5100cc5a7742","resolution":{"observed_at":"2026-05-19T09:17:15.631965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jamba: Hybrid Transformer-Mamba Language Models","venue":null,"work_id":"fcf9e26b-23ce-447a-a458-99b1dee81231","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:190ef5a4815579dd09b6bc49ea280949b31457201ad3ab473ba0720caa56549d","observation_id":"5eeb0285-9a97-42d0-809a-edd8e7dc1429","resolution":{"observed_at":"2026-05-19T09:17:15.635636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:a89b14691cf32a7977f08a249daf357f920568c5cac552b9f44291c98992000c","observation_id":"5c29b323-2c6b-489e-9fb0-941c4e660d2e","resolution":{"observed_at":"2026-05-19T09:17:14.254488Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:38:14.544227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:38:14.544227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech slytherin: Examining the performance and efficiency of mamba for speech separation, recognition, and synthesis","venue":null,"work_id":"030cca90-8815-43b9-bec1-7e2b2365a3aa","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:b37a0d59b0d54fe6104928eda3fbd89619c6938ac3e24cf614f5692f6a97154d","observation_id":"5480c8ad-cd3f-45dd-aeae-2255ef53ab99","resolution":{"observed_at":"2026-05-19T09:17:15.628212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dual-path Mamba: Short and Long-term Bidirectional Selective Structured State Space Models for Speech Separation","venue":null,"work_id":"9b5f95ac-7501-4a11-b5ee-8699d3c69b11","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:3f5ce48bf11fd550860c50269212d6bb7bbf4f2f7c92290eb0a780227e813307","observation_id":"9b97412f-20b2-4203-a461-b1ee7d65fa37","resolution":{"observed_at":"2026-05-19T09:17:15.670482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech-Mamba: Long-Context Speech Recog- nition with Selective State Spaces Models","venue":null,"work_id":"fc1935e5-d6c3-4672-98bd-5e91edfc55e6","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:283ce5f0834688dd95548c79f6d77a559be1c64e243c2fcf16ef1aa62b016392","observation_id":"0371e0f9-0957-4749-9661-2267dbeace1e","resolution":{"observed_at":"2026-05-19T09:17:15.742881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02063","last_updated":"2024-09-10T14:02:58Z","snapshot_observed_at":"2026-08-16T14:04:14.953751Z","submitted_at":"2024-04-02T16:04:31Z","title":"SPMamba: State-space model is all you need in speech separation","version":2},"cited_work":{"arxiv_id":"2404.02063","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.02063","snapshot_observed_at":"2026-07-04T19:30:07.489304Z","title":"SPMamba: State-space model is all you need in speech separation","venue":null,"work_id":"0bb0d56f-1ac4-4ee1-80ec-09c3d20c9a0c","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2404.02063","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:17547add74c053eb6c3900cae9a85cf574b9b0bd570244b0dd66316ef63865e2","observation_id":"8cc3e1fc-3fc3-4f61-8252-f5fb66fd66c2","resolution":{"observed_at":"2026-05-19T09:17:14.294989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HuBERT: Self-supervised speech representation learning by masked prediction of hidden units","venue":null,"work_id":"290be48d-14fb-4797-8a56-9b3279fd1a40","year":2021},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:dcbac76910ce9d46b3e3cce5e5d3831a3c6c80578dc0d4a433e85fdb9e117342","observation_id":"f1f37833-93df-4059-b0cc-913899fdac33","resolution":{"observed_at":"2026-05-19T09:17:15.759286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12609","last_updated":"2025-04-27T05:17:15Z","snapshot_observed_at":"2026-08-18T03:30:36.090539Z","submitted_at":"2024-05-21T09:04:48Z","title":"Mamba in Speech: Towards an Alternative to Self-Attention","version":6},"cited_work":{"arxiv_id":"2405.12609","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.12609","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mamba in Speech: Towards an Alternative to Self-Attention","venue":null,"work_id":"3d0b50c3-a793-4740-80ef-972480fa7687","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2405.12609","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:1c28b8ebee300d64feafaf39e6411bdaf1095356814d039bf73dc389e58277cf","observation_id":"e99a844c-562b-4fc8-8c4f-7d0d87706270","resolution":{"observed_at":"2026-05-19T09:17:14.288905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Relations between two sets of variates","venue":null,"work_id":"e5254a2a-e062-4a10-9f5f-88f2945eb67a","year":1936},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:64917aeac3232c126e53f2fa01fa7ab5e9308b6d95cfdf703abb0cc392fce039","observation_id":"eecddfcf-583d-4b3d-9909-49a9ace310fb","resolution":{"observed_at":"2026-05-19T09:17:15.774158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SUPERB: Speech Processing Universal PERformance Benchmark","venue":null,"work_id":"08cff5b7-3053-41ae-b3d2-054341669d23","year":2021},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:5ae79a88db403719e7b6107c84f37fca88f7b1850bb78c6139b7e56de4db67a1","observation_id":"816519ec-c69c-4629-a9b4-d4ec77d54772","resolution":{"observed_at":"2026-05-19T09:17:15.659459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","venue":null,"work_id":"302bf8cf-c3c0-4d9d-baaf-fe7d3d42e0d8","year":2020},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:4b8323297bcc6a93af21c1035b758c6bc133c8f372525b3d4f4dc4fd2e384377","observation_id":"cee98c5b-a1e0-4453-be6e-cac36b8d7820","resolution":{"observed_at":"2026-05-19T09:17:15.643466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An Investigation of Incorporating Mamba For Speech Enhancement","venue":null,"work_id":"50a04027-ff5d-46d5-af99-6d2105dc5856","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:7ee49a4c357545c094b8c0e46a71ae7151b9533025c18fc7507037b6d06ca861","observation_id":"1bb5e881-b469-4d0e-b0f0-fb4d8215449b","resolution":{"observed_at":"2026-05-19T09:17:15.639374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mamba for Streaming ASR Combined with Unimodal Aggregation","venue":null,"work_id":"8e1d30dc-8da6-4766-a3a7-618473df230c","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:cd8f2ceef1dbea54e9fe32d7f3ab5857278cfd2d103185529d66847d8e51ba4d","observation_id":"82f852cf-ac10-4044-89f3-faca2b8f740c","resolution":{"observed_at":"2026-05-19T09:17:15.647383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rethinking Mamba in Speech Processing by Self-Supervised Models","venue":null,"work_id":"b234a3d6-60c7-4bf6-a6e8-d4edd326ea97","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:4b215b187d44b03c087cdc24f609c51a10d06787a7d442a4fb2e86fe5777f49c","observation_id":"ea121dea-62bc-44cb-a12f-c30af5731637","resolution":{"observed_at":"2026-05-19T09:17:15.651118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audio Mamba: Selective State Spaces for Self- Supervised Audio Representations","venue":null,"work_id":"bfa53483-fbba-4991-9874-7f035331beb8","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:c960b854d59b02f5c41b62abda0e13d63615380a358ad924db50d9c3b4221992","observation_id":"8b2f420b-3a42-4fbf-81cc-c300b460109b","resolution":{"observed_at":"2026-05-19T09:17:15.663014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Superb@ slt 2022: Challenge on generalization and efficiency of self-supervised speech representation learning","venue":null,"work_id":"675b36b9-2567-447b-96bd-265c774a52c3","year":2022},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:132d844e3bc1656a03150239f914a39c5e71bad853880fb2e7e6a0dc9aef79a8","observation_id":"36b8ad1c-690c-4b23-963e-45aa9583c529","resolution":{"observed_at":"2026-05-19T09:17:15.769582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09949","last_updated":"2025-08-17T11:06:06Z","snapshot_observed_at":"2026-08-18T13:29:00.656251Z","submitted_at":"2022-11-17T23:53:52Z","title":"Is Smaller Always Faster? Tradeoffs in Compressing Self-Supervised Speech Transformers","version":4},"cited_work":{"arxiv_id":"2211.09949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09949","snapshot_observed_at":"2026-07-23T01:24:11.529612Z","title":"Compressing transformer-based self-supervised models for speech processing","venue":null,"work_id":"4ca04493-8873-412b-b14d-c19754f8b654","year":2022},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2211.09949","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:66f4798aa59b7382c35876c112775d973be508da45eaa5404e07cc324f31670b","observation_id":"9500473b-58fc-42d1-8b99-523b99de3b82","resolution":{"observed_at":"2026-07-23T01:24:11.529612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TED-LIUM 3: Twice as much data and corpus repartition for experi- ments on speaker adaptation","venue":null,"work_id":"49e188b7-1855-4cad-87cb-c026b9b828ef","year":2018},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:4e382ab0ff224e1648812eb60a9715908647f138ab9ba3b0de85ca50b1160ff8","observation_id":"f538a518-ec3f-41c2-a89e-d6b0f9552a1c","resolution":{"observed_at":"2026-05-19T09:17:15.747621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On gener- ative spoken language modeling from raw audio","venue":null,"work_id":"ddf78eea-2f67-4f14-9b80-b8b9caa980e7","year":2021},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:5166855a645d24c26732d20b6b8f44d71b8df1f98c0d5850dbacd5f3f746e8dd","observation_id":"c0b7c5db-88f8-4541-a282-db6da309a436","resolution":{"observed_at":"2026-05-19T09:17:15.733960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Textually Pretrained Speech Language Models","venue":null,"work_id":"2ce967f8-2ac1-475f-bb7d-91475459f5cb","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:86e21bbcdb70fd782069b067693413a3a9f4889bdf9523bda8fe53e78182088f","observation_id":"daeaf476-bac1-4e13-af04-e655732b1892","resolution":{"observed_at":"2026-05-19T09:17:15.730097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08528","last_updated":"2026-04-07T06:11:20Z","snapshot_observed_at":"2026-08-14T11:32:49.145887Z","submitted_at":"2025-04-11T13:40:53Z","title":"On The Landscape of Spoken Language Models: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2504.08528","doi":"10.48550/arxiv.2504.08528","metadata_source":"pith","pith_arxiv_id":"2504.08528","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"On The Landscape of Spoken Language Models: A Comprehensive Survey","venue":"cs.CL","work_id":"92746bbc-1fe6-410d-a1e9-8afab3e0a8e5","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2504.08528","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:8a2bafe5cb9a6cbc9707ce8e0be5f37e63824ea293f3e0baca206aab40dba229","observation_id":"0ddffa19-1352-46ff-b2f6-adf4f1bfdc26","resolution":{"observed_at":"2026-05-19T09:17:14.267181Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07111","last_updated":"2024-12-27T07:29:19Z","snapshot_observed_at":"2026-08-16T13:01:06.676582Z","submitted_at":"2024-11-11T16:37:40Z","title":"Building a Taiwanese Mandarin Spoken Language Model: A First Attempt","version":2},"cited_work":{"arxiv_id":"2411.07111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.07111","snapshot_observed_at":"2026-07-04T11:59:50.259182Z","title":"Building a taiwanese mandarin spoken language model: A first attempt","venue":null,"work_id":"124b430d-5f85-4a49-a1a2-0e0ff371dbcb","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2411.07111","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:7b9cdaf230754a00b19c2b1726cd7b5887c621de089d554bc083737891ad7e7a","observation_id":"ff4670ec-3110-42d1-a873-856cc67b65f2","resolution":{"observed_at":"2026-05-19T09:17:14.276089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Ex- panding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","venue":null,"work_id":"feeb47e1-3f34-4321-9e10-858a40429651","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:c337802d302558084c8646dcfcf69877e24aacb62d602f6c4d944b18c2d7b29d","observation_id":"29dfd8ae-25fb-4689-998e-f25803d939bd","resolution":{"observed_at":"2026-05-19T09:17:15.712593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Layer-wise analysis of a self-supervised speech representation model","venue":null,"work_id":"2621104f-bf5b-4426-aeb4-e5c9511b385a","year":2021},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:e842c1e9802606ea3235b8518597a4dcbcff4acbc2d81c9b3287fe0194516904","observation_id":"49a0c977-947f-4312-a495-5dca35bc74e4","resolution":{"observed_at":"2026-05-19T09:17:15.666631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DAISY: Data Adaptive Self- Supervised Early Exit for Speech Representation Models","venue":null,"work_id":"cf5db85d-eccd-4143-911f-a86af7594fb2","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:bfb02a97d2158ebd993461e8d24a28dfe6eecdb3ae3a9e91b66ab0ff9bca93dd","observation_id":"9161b507-8222-4825-b721-ea305aea33cd","resolution":{"observed_at":"2026-05-19T09:17:15.751975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What do self- supervised speech models know about words?","venue":null,"work_id":"dfefe36e-0373-44c4-b955-923cbf51763e","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ccb98fecec1caefeb9332966b37d8b07336133c02559af409090c1dd896eeaa7","observation_id":"5c474dcc-405c-4622-a1b1-0e6464bd3d3f","resolution":{"observed_at":"2026-05-19T09:17:15.716567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Property Neurons in Self-Supervised Speech Transformers","venue":null,"work_id":"6f82afbc-d112-443a-83f2-091a71e8b158","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:f5d66d573abe2656386b1097ad9f9325372d4b66f34f1d26a04049300a7f9f5d","observation_id":"683849fe-c91e-4ccc-a4df-7274498c7a8e","resolution":{"observed_at":"2026-05-19T09:17:15.720658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MelHuBERT: A Simplified Hubert on Mel Spectrograms","venue":null,"work_id":"68abea54-0f68-4eda-9d29-2a83d1eee8dd","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:74e96c6ad14b67ed3fc3e95b3ae271f1ec6f86d6108afdff5527c66f5e147a48","observation_id":"d0313ef1-5db8-4fd3-bd3d-61cd900ead47","resolution":{"observed_at":"2026-05-19T09:17:15.708177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generalized end-to-end loss for speaker verification","venue":null,"work_id":"9c81e347-9082-4bd2-91bc-cee8a9f298d1","year":2018},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ba77f46bc9f6e472bd6d8e039d529ffb3af8e1a4e8280f458cd72a0777eefc98","observation_id":"a2a114d9-cada-4cd9-9561-6301a9b14ac6","resolution":{"observed_at":"2026-05-19T09:17:15.724826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Titanet: Neural model for speaker representation with 1d depth-wise separable convolutions and global context","venue":null,"work_id":"e4447355-25c1-4218-9e32-cd22c016464f","year":2022},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:bb0179c170eae4c8c896342cd35f090b080ba57ef4df3e20e415345e82eb87ea","observation_id":"2e2daf8c-8c93-4ec9-b5b1-ea598e6c7cd6","resolution":{"observed_at":"2026-05-19T09:17:15.738595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07143","last_updated":"2020-08-10T13:50:24Z","snapshot_observed_at":"2026-08-16T12:49:35.884517Z","submitted_at":"2020-05-14T17:02:15Z","title":"ECAPA-TDNN: Emphasized Channel Attention, Propagation and Aggregation in TDNN Based Speaker Verification","version":3},"cited_work":{"arxiv_id":"2005.07143","doi":"10.48550/arxiv.2005.07143","metadata_source":"pith","pith_arxiv_id":"2005.07143","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ECAPA-TDNN: Emphasized Channel Attention, Propagation and Aggregation in TDNN Based Speaker Verification","venue":"eess.AS","work_id":"45c323c0-4c7b-4c68-9f61-82af9cce05aa","year":2020},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2005.07143","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:defdb3c8ee3056617ed0393d9f0321c2a3a05a42ee1c8fc85f273b2bdc2d8278","observation_id":"2174fa52-9df8-49a8-8460-34183b0b55b5","resolution":{"observed_at":"2026-05-19T09:17:14.261196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"emotion2vec: Self-Supervised Pre-Training for Speech Emotion Repre- sentation","venue":null,"work_id":"6eac8f3c-dd7c-45d2-be16-70c9924214bc","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:74380cfb43b86ff56b4c7311866a26f4e506fbab19c713b37a7fa6bd0c150fa4","observation_id":"b2b38881-561e-42c4-a509-13d6da057884","resolution":{"observed_at":"2026-05-19T09:17:15.763593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MiniSu- PEBR: Lightweight benchmark for self-supervised speech models","venue":null,"work_id":"62d88c03-0993-4d2a-a6c3-009a167584c5","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:c45174ff70f62db53107a09385375f4e42e5f72f0c0b0bd33418b8ddd272894d","observation_id":"7cfc88f7-5f54-4835-81f2-9992cdc4040a","resolution":{"observed_at":"2026-05-19T09:17:15.704289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ML- SUPERB: Multilingual Speech Universal PERformance Benchmark","venue":null,"work_id":"d8bff25a-c94f-42b6-a08b-9f8237f47ee4","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:5cdd2042b7aa5d49cf6d63407102a73a0332bcf851eb5441f97d3a3d88529bca","observation_id":"68af80ba-0743-49d7-91ca-d1307323ee72","resolution":{"observed_at":"2026-05-19T09:17:15.689476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Findings of the 2023 ML-SUPERB challenge: Pre-training and evaluation over more languages and beyond","venue":null,"work_id":"5e147a09-c0c8-4e61-86b0-eb47916ad686","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:8e0720a9866a86c7d7e1ed4d2ab88729578351d280fa4c1584f95cb317a73585","observation_id":"eb230e87-06e0-4acb-abf7-375c622bac07","resolution":{"observed_at":"2026-05-19T09:17:15.685720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-resolution Hu- BERT: Multi-resolution Speech Self-Supervised Learning with Masked Unit Prediction","venue":null,"work_id":"30553a72-dd91-4d0b-91d0-c8289aebcbe4","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:92b1b2539701c29efdaaf422a59cae17de1de1f5af11e8be986655ab826388da","observation_id":"006eab8f-774a-4fba-a1d9-f6091a340cf4","resolution":{"observed_at":"2026-05-19T09:17:15.693018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Task- Agnostic Structured Pruning of Speech Representation Models","venue":null,"work_id":"7b4043be-2866-4927-b019-38c8ef295728","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:cb34842c9228e31c063082ee223d5cbc15f8b5229787a89a38dadf5b1f7d2473","observation_id":"c1df901f-6a9b-42a3-a92c-a890968978d9","resolution":{"observed_at":"2026-05-19T09:17:15.696930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12672","last_updated":"2026-04-25T10:18:13Z","snapshot_observed_at":"2026-08-15T16:45:58.762915Z","submitted_at":"2025-02-18T09:23:42Z","title":"Speech-FT: Merging Pre-trained And Fine-Tuned Speech Representation Models For Cross-Task Generalization","version":4},"cited_work":{"arxiv_id":"2502.12672","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.12672","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech-FT: Merging Pre-trained And Fine-Tuned Speech Representation Models For Cross-Task Generalization","venue":"cs.CL","work_id":"879c0ef5-9ddb-4579-9ae2-ee7fba5d2f37","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2502.12672","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:e812e0666762fb5894c05985b059a6a823ee4761f6541f6a0110dd20e9d145db","observation_id":"fe281e32-c847-4520-9570-5250e386113f","resolution":{"observed_at":"2026-05-19T09:17:14.282401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech Self-Supervised Representation Benchmarking: Are We Doing it Right?","venue":null,"work_id":"9335005f-fc73-4f18-a19b-9402ef0a73af","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:301052506e4e5268a9324c2f5cfd3f9c5340caa3387bb6497514eb5f962abf64","observation_id":"3491453f-5c13-4721-a53c-02700e85aa60","resolution":{"observed_at":"2026-05-19T09:17:15.674247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards a Unified Representation Evaluation Framework Beyond Downstream Tasks","venue":null,"work_id":"ab195cb7-5471-41e2-9f12-1d13a7edc1b6","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:6268fb9573a4a495ef2e3a748d85cd00326919e6a10d90f279836bf60cfd5e1c","observation_id":"ba8b37de-8fd1-4b06-ab55-6765351b0fd4","resolution":{"observed_at":"2026-05-19T09:17:15.677852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What Can an Accent Identifier Learn? Probing Phonetic and Prosodic Information in a Wav2vec2-based Accent Identification Model","venue":null,"work_id":"07b9ebcb-619d-43d6-8c80-1800fe3210b8","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:5744c3a822ab0e2dc2806dbd12ccdf2a484a77cf7a2bafb0fbe9d8d7632be732","observation_id":"a0706b73-fd7a-41b9-b3db-844d781c9e9c","resolution":{"observed_at":"2026-05-19T09:17:15.681904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What Do Self-Supervised Vision Transformers Learn?","venue":null,"work_id":"eac91849-8055-4fcf-92d8-997076d0a362","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:169f7840e790ffd36c6b6cbc0d1724167ba688b9d422a554c27e4bfd65d81897","observation_id":"52199b8a-a4bc-4203-b4ec-3525bfb97348","resolution":{"observed_at":"2026-05-19T09:17:15.700569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":8,"verified_fuzzy":36},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2506.12606."}