{"as_of":"2026-08-14T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ed7ecb708406db2dad1fcbace80a5536032557934c5b0b65db7b3631fbec7af","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:40:51.670696Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:40:47.825821Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:40:51.796962Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"cited_work":{"arxiv_id":"2506.13300","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13300","snapshot_observed_at":"2026-08-07T00:40:51.796962Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","venue":"cs.CL","work_id":"347da9d7-10b8-474b-b25a-f6c0a01be080","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.825821Z"},"links":{"cited_paper":"/paper/2506.13300","citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:adcab842454e0e567ad93afa229353c32d69babcb9669fefd76ecf0f951db886","observation_id":"3fe8fc93-b57f-4451-8ce0-36f2fd646a8c","resolution":{"observed_at":"2026-08-07T00:40:51.853914Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13300/citation-record","integrity":"/paper/2506.13300/integrity","json":"/paper/2506.13300/citation-record.json","paper":"/paper/2506.13300"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:59.361427Z","title":"The English subset contains approximately 500 hours of recordings from diverse regions, including British, American, Australian, In- dian, and Philippine English","venue":null,"work_id":"475563dd-063c-42d3-997e-e44f5b4435b3","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.739229Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:00d32058ab4dd12a110e723716ed9f37d66a96c443059ba1cb8fc4c68600de22","observation_id":"0988bf3b-5ecb-4609-93aa-97c0222e0e26","resolution":{"observed_at":"2026-08-07T00:40:59.435633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"cited_work":{"arxiv_id":"2506.13300","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13300","snapshot_observed_at":"2026-08-07T00:40:51.796962Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","venue":"cs.CL","work_id":"347da9d7-10b8-474b-b25a-f6c0a01be080","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.825821Z"},"links":{"cited_paper":"/paper/2506.13300","citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:adcab842454e0e567ad93afa229353c32d69babcb9669fefd76ecf0f951db886","observation_id":"3fe8fc93-b57f-4451-8ce0-36f2fd646a8c","resolution":{"observed_at":"2026-08-07T00:40:51.853914Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:59.183711Z","title":null,"venue":null,"work_id":"e28041ca-2284-4eb7-9f54-7802475ed78b","year":2000},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.911019Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:97865c690bb8b8e03143c36f7854b0428deaf3f7d7de36edef910130f379e90c","observation_id":"8da66008-3889-4ceb-888d-b73954a21795","resolution":{"observed_at":"2026-08-07T00:40:59.274267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:59.025754Z","title":null,"venue":null,"work_id":"16beaac5-ce59-4c9f-a126-1f673928a910","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.984858Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:30ad0b157854c689db57ddf58de348d4f13bfce279fafa6cfcbfcaa20144ae3b","observation_id":"15b178ee-9bc3-4c79-8389-7bc1bcb4c0b3","resolution":{"observed_at":"2026-08-07T00:40:59.096412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.811336Z","title":null,"venue":null,"work_id":"7cfe014f-7ce4-49a9-8a8d-29335108f80c","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.065949Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:e9d00929786561e42facf3b41985bc417e4ad25fe381753d9eaaa8c6713e7f2e","observation_id":"25dff974-c290-47a6-bc1e-a81ac18f305a","resolution":{"observed_at":"2026-08-07T00:40:58.923256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.458372Z","title":"Our approach achieves substantial improvements over the official challenge baselines","venue":null,"work_id":"75d067a8-a982-4305-bc7e-c93c4df835c8","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.233758Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:d5fce9f9b1033b039be0ac8f1699e7d2a8d0b7d8b279eb70c5d07b386ea79a10","observation_id":"fbaeffe3-38e6-434b-a597-a19d7571b8d6","resolution":{"observed_at":"2026-08-07T00:40:58.563114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:56.915447Z","title":"Instruction fine-tuning: Does prompt loss matter?","venue":null,"work_id":"891a060b-ac35-4c43-bfca-ff4a1c0f1b23","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.951213Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:6068b118a8c52e9d2627e4b9df10e04287ceacbd884aae62d2eee583b08614e6","observation_id":"32926180-4cfc-4b2b-9c52-c25959fca66f","resolution":{"observed_at":"2026-08-07T00:40:57.079554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.284756Z","title":"Mlc-slm-baseline,","venue":null,"work_id":"2c850d94-ba9a-4e9a-ade7-11b3e1eaedb4","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.317209Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:979e4f7b5a16f414a81870cb2b1c4bde74a62ad8c8eca85a1100ada2ce471a28","observation_id":"35c8c82b-3638-444c-8dd6-f3403fcdc84e","resolution":{"observed_at":"2026-08-07T00:40:58.355942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.093887Z","title":"An embarrassingly simple ap- proach for llm with strong asr capacity,","venue":null,"work_id":"284a005e-5989-4d92-a5bd-067c42cc2680","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.413321Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:bf5b5fd2a56e860363b2b4a4af31c473422028a20008c56ecc5606b78e5d4e2b","observation_id":"d5945955-3b31-472b-9cb3-547f17d737b2","resolution":{"observed_at":"2026-08-07T00:40:58.189054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:57.808218Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":"9d9bffe6-a62d-47e8-b804-95df2fe2a031","year":2022},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.510663Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:44d654b2664462c4e811737ac082b0e6282934f0cff511d5b9ec9cf2319d96d8","observation_id":"6d1f69f6-7e6d-4105-954a-a18f77960cd0","resolution":{"observed_at":"2026-08-07T00:40:57.960106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:57.460391Z","title":"Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,","venue":null,"work_id":"700e8cff-a2c1-4a52-b6cf-dfc18a6c3155","year":2021},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.628294Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:baffcc4fc55d76ba11ef7ba1e62a8cd22af7a87fa78cdc847330d8d69af911c7","observation_id":"ac59bc0f-c477-4ca8-a1f7-bc99a0e20c47","resolution":{"observed_at":"2026-08-07T00:40:57.623425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:48.717270Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.717270Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:543552514cd30346304039232ef07dec414834535c97ef711a863ba997666dd9","observation_id":"51ad9776-b3ee-4154-bc70-e107836eaae7","resolution":{"observed_at":"2026-08-07T00:40:48.717270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:57.180096Z","title":null,"venue":null,"work_id":"f4144b08-ca92-4a71-a58b-ca5400e5cea6","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.839146Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:ef4bbe22b634ef9e331f872fad3b8c8de2f2cb0329d399c24c495bf09d9a85bd","observation_id":"36bec901-32c6-40f4-9772-d5a4e51934f3","resolution":{"observed_at":"2026-08-07T00:40:57.275837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:49.676520Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.676520Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:1f24a8356a19dd7527a6bff5f02f9b987ce5bf37cf8071c1826653ce6a61d93c","observation_id":"448cb8dc-4cc3-4ce1-90c5-9f29368dc1ea","resolution":{"observed_at":"2026-08-07T00:40:49.676520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:56.745079Z","title":"Understanding r1-zero-like training: A critical perspec- tive,","venue":null,"work_id":"3b9584f2-8406-49c6-b2de-ae8f0e7ebe02","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.044218Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:cd7d5557dafcdefd62811690d599639f27e9543e0f2258ccc233dc605d23b0d2","observation_id":"d5e09c64-522f-48ad-8dd0-22c3b74c9917","resolution":{"observed_at":"2026-08-07T00:40:56.803266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:56.465819Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":"e29a5bbf-05b2-47eb-b120-37e60ada4932","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.158768Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:408158a614c8fba71d725144a2b3a96732dfb0d0d358e4cc858d42709af6ee4e","observation_id":"c71ad94d-1934-4fd9-9022-2182fe6b625d","resolution":{"observed_at":"2026-08-07T00:40:56.609437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:56.204112Z","title":"Cn-celeb: multi-genre speaker recogni- tion,","venue":null,"work_id":"9b6f0466-4aa1-44ca-a13c-240f03e7dd6f","year":2020},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.243866Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:748bd12c2fde16bd61e92fc8d4bf30dfac452a4055330566c9746d704d2dbcfb","observation_id":"914ede12-f1f8-46ab-bfca-eefa3d51e079","resolution":{"observed_at":"2026-08-07T00:40:56.319280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:55.945558Z","title":"V oxblink: A large scale speaker verification dataset on camera,","venue":null,"work_id":"01323fda-ea3b-4152-9c79-a0390f08821b","year":2023},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.401485Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:808e2e1b751ef535308a2ea2eb265c11728b5869b3dff0afbb83fca25c237405","observation_id":"ab8750e0-8d84-4239-8275-06440d2df614","resolution":{"observed_at":"2026-08-07T00:40:56.079815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:55.652326Z","title":"V oxblink2: A 100k+ speaker recognition corpus and the open- set speaker-identification benchmark,","venue":null,"work_id":"5e3f3434-d73a-4ce2-9cc7-7248a4255b2d","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.498163Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:e6c76ef6128df09db3711ef7e5a79c3285b4b398519b8a84e20643e73abf23cb","observation_id":"86254e6a-17f1-45b4-9525-4b309301e6ba","resolution":{"observed_at":"2026-08-07T00:40:55.784963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:55.427335Z","title":"Wespeaker: A research and production oriented speaker embedding learning toolkit,","venue":null,"work_id":"e2a98deb-55a5-4e0c-b3d4-b16eaf066e72","year":2023},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.564810Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:02c8104cf281cdcfdde0fde7209fd99847427813f7555af329d80402a6667b6b","observation_id":"71328a65-d61b-47cd-b233-ed993cdab8d5","resolution":{"observed_at":"2026-08-07T00:40:55.530995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:50.385187Z","title":"Qwen2.5 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.385187Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:1cfbe61b59e9835aa7c90c3d713a28360f03796241195583bc389018164a65d7","observation_id":"8bbda074-6281-4540-9ee1-cc38927ef1e6","resolution":{"observed_at":"2026-08-07T00:40:50.385187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-07-06T04:34:36.474437Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-07T00:40:49.758472Z","title":"MUSAN: A Music, Speech, and Noise Corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.758472Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:f265ce191fa818cd4f89f9ccc74685eb499395a5b71438f7ec942821cc1688e2","observation_id":"a06c87fd-a0c2-49b8-8c96-8f126f1f1ce8","resolution":{"observed_at":"2026-08-07T00:40:49.758472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:55.062617Z","title":"We speech transcript, llm based speech recog- nition/transcript in 300 lines of code,","venue":null,"work_id":"3e123342-ec83-41f0-be6d-d17efe53328c","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.896817Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:8405221b112e13e77a6e1517d273981ca6cef46ff135317c605aaf0e722e862b","observation_id":"8163074c-7e0d-4425-b6ff-2abab8bea33f","resolution":{"observed_at":"2026-08-07T00:40:55.229748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:54.789194Z","title":"Transform- ers: State-of-the-art natural language processing,","venue":null,"work_id":"ffcb6b80-4704-4885-babd-7dd71cd17b36","year":2020},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.995311Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:9ab2fe3661c852567d4803d9a8e012902bf399e33085fa83fc8803132054c420","observation_id":"fc6ae9e1-d6c2-4625-8e2e-acf2106ad1d0","resolution":{"observed_at":"2026-08-07T00:40:54.917888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:54.506532Z","title":"Accelerate: Training and in- ference at scale made simple, efficient and adaptable","venue":null,"work_id":"c4b03368-f8ea-4672-ae84-cd13e5d6ddfe","year":2022},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.103440Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:7c60dc384a6be00c5a79bd330086d9097db9c78e62589f9ccc919a9f5bf8b9ac","observation_id":"ff866774-cd21-45ab-9701-1d02530f4f96","resolution":{"observed_at":"2026-08-07T00:40:54.645166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:54.184887Z","title":"Peft: State-of-the-art parameter-efficient fine-tuning methods,","venue":null,"work_id":"7e20c856-5049-4a90-8b2a-849ec332deee","year":2022},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.192369Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:7fc08375966e8b0138a6bf55e98bf8f6886a563144467c54b6c1dbe6883fdb61","observation_id":"eecffd14-2fda-47ba-97aa-cccc869c0602","resolution":{"observed_at":"2026-08-07T00:40:54.350973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.819435Z","title":"Trl: Trans- former reinforcement learning,","venue":null,"work_id":"a45a5048-86e7-4c46-916b-54ef356b994f","year":2020},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.287442Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:d5e32f447cea3039231ba180b6c306fc8a4fe43c64709a6f5b39ba3c70b097ab","observation_id":"1d57ade6-664e-407c-9f6a-b9ed2488fb21","resolution":{"observed_at":"2026-08-07T00:40:54.007307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.729843Z","title":"Reasoning language models: A blueprint,","venue":null,"work_id":"0aeceea0-c0e1-43bb-9c12-f75bcd98aa4d","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.019487Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:cc6a662d2f792021a54fccc812bb397fd4f3a4384d3bd464030151293bb02696","observation_id":"2c141f99-89ae-42d3-9ee1-6933053e8254","resolution":{"observed_at":"2026-08-07T00:40:52.777380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.502642Z","title":"Unified language-vision pretraining in llm with dynamic discrete visual tokenization,","venue":null,"work_id":"7518b4e7-d3cd-4068-b5fa-1ec54b4ac9f7","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.474646Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:d6e071c2a9cdd214c9f129f0ac27919e442537a7d8b25bd43eb6cd76e8fbe47c","observation_id":"f0c98e6e-b284-4d66-9c8a-b252a50f1cf6","resolution":{"observed_at":"2026-08-07T00:40:53.661057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.292505Z","title":"Lora: Low-rank adaptation of large lan- guage models,","venue":null,"work_id":"7bf124e3-1265-457a-951e-fbfeeb72ec39","year":2021},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.587307Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:0e477d7a38fd9de4eaa1f0ac424a51a0afea5bbc4807b7ed1c9db32b85d65b4f","observation_id":"8940571d-7737-47a7-8d36-5c6332b3ae81","resolution":{"observed_at":"2026-08-07T00:40:53.360936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.228584Z","title":"S 2r: Teaching llms to self-verify and self- correct via reinforcement learning,","venue":null,"work_id":"ac13ec06-2597-4e2d-97ff-df6537407479","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.668664Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:334f637f16316ac81f95277b32ca11270f0560a3846e574669cddc1e10163966","observation_id":"c97bda16-1539-47ab-b024-ee83e4bdf758","resolution":{"observed_at":"2026-08-07T00:40:53.233747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.081951Z","title":"Training language mod- els to self-correct via reinforcement learning,","venue":null,"work_id":"96705846-6465-42be-b45c-03397e3f7e6d","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.788647Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:78762a148a1e93fb0a4f03478bc21c2987635d62266fee4bd9fc0c32915d21e7","observation_id":"cd466234-d65c-4d8d-99bf-fd7ff216bb3d","resolution":{"observed_at":"2026-08-07T00:40:53.119234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.967000Z","title":"Instruction tuning with loss over instructions,","venue":null,"work_id":"705f7676-9b6b-4d61-9310-5c1462864c28","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.871988Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:c80797477d0b27c10aa68116039b53852d994a34761baaaa7419f9e979a98dbc","observation_id":"9ee05ce6-0caf-4413-800f-569671e82ce5","resolution":{"observed_at":"2026-08-07T00:40:53.019189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.838679Z","title":"Glore: When, where, and how to improve llm reasoning via global and local refinements,","venue":null,"work_id":"3d1a06b3-3001-487d-b9eb-4d23fb351210","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.964775Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:a6f2bc3b0301efb0aa697d01ecacf3179de638075c109b238d9fc6ca5974b9a1","observation_id":"9ea18f16-97ec-4f29-af9d-664dde917b8f","resolution":{"observed_at":"2026-08-07T00:40:52.896463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.629467Z","title":"The ResNet-101 model was specifically trained on a diverse corpus comprising CnCeleb1, CnCeleb2 [10], V oxBlink [11], and V oxBlink2 [12] datasets","venue":null,"work_id":"3c1d7cfd-c2ae-4c83-b5fe-99ad5b0bc6ad","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.144192Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:28d6c395411f86fc72a72c1dcd16d4ce5d614af3c6aab056a3eb0a6645770d9c","observation_id":"f2590b15-c4d6-4a18-9c7f-6dd372cac0c5","resolution":{"observed_at":"2026-08-07T00:40:58.690558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.607044Z","title":"Gec-rag: Improving generative error correction via retrieval-augmented generation for automatic speech recognition systems,","venue":null,"work_id":"a3c29f3a-30eb-4082-aacd-981a57995fa9","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.106091Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:b84bcd0d9bac958ac6c3e1c25b0e1dd338831d5adccc7eaee9e8d1aee9f84b8e","observation_id":"d36e8083-3e76-49dd-b79f-e959c6673943","resolution":{"observed_at":"2026-08-07T00:40:52.649409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.468920Z","title":"3d-speaker-toolkit: An open source toolkit for multi-modal speaker verification and diarization,","venue":null,"work_id":"b8098204-db19-4b08-b252-5b3048638d1c","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.182507Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:e4f74d45ea59730a8b0f8c67765a4d4408400b923cf9a4fdf68efc5dd7b14b40","observation_id":"5d7e8350-6e46-426c-84ad-f32cf232a793","resolution":{"observed_at":"2026-08-07T00:40:52.531472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.345387Z","title":"Deep-fsmn for large vo- cabulary continuous speech recognition,","venue":null,"work_id":"1fe89dbd-2d4c-42bc-9501-b5f416c6e9ad","year":2018},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.297451Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:62788d4719f61a87555adaf69dc3617a1456d837d13784fbdaf5eabadba617a5","observation_id":"ebb2b8ea-9031-40ac-91d9-a4a5dd17f2c8","resolution":{"observed_at":"2026-08-07T00:40:52.386857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:51.365489Z","title":"Advancing speaker embedding learning: Wespeaker toolkit for research and produc- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.365489Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:44b7aa0f0a9bdbe6b1a59f7e10a14216088f4f38e56134f97a12b85635b5d5f6","observation_id":"e593e5f9-29b1-4e71-88c9-720b7f7a2542","resolution":{"observed_at":"2026-08-07T00:40:51.365489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.216091Z","title":"A spectral clustering approach to speaker diarization","venue":null,"work_id":"e4fa35db-a7cb-4f79-b501-dc6e9be3dd71","year":2006},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.443802Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:bcb50f6e20b5d8a6e6ca9778fe62e4161ef25574e630573ee0ca55d25265b778","observation_id":"89c2d929-b961-44d9-961e-177e77807c0d","resolution":{"observed_at":"2026-08-07T00:40:52.271335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.106149Z","title":"An enhanced res2net with local and global feature fusion for speaker verification,","venue":null,"work_id":"664b2e7a-1b74-438b-8980-b3b6dd457c72","year":2023},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.508068Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:f504186910373680837bece1f765865397bfa002d45470ff1b9646b68ae07093","observation_id":"fbc0e57e-aef3-421b-97b6-5f6fb3fb163b","resolution":{"observed_at":"2026-08-07T00:40:52.156205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00332","last_updated":"2023-06-16T09:07:11Z","snapshot_observed_at":"2026-08-13T12:34:33.611807Z","submitted_at":"2023-03-01T08:50:31Z","title":"CAM++: A Fast and Efficient Network for Speaker Verification Using Context-Aware Masking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00332","snapshot_observed_at":"2026-08-07T00:40:51.583965Z","title":"Cam++: A fast and efficient network for speaker verification using context- aware masking,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.583965Z"},"links":{"cited_paper":"/paper/2303.00332","citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:ebbf73cea44add113a748ac1fcce1cf4fb0ba077fa9bfc6af85ee25758e1cf97","observation_id":"23f45442-877c-47ea-b01a-055032f9d6d4","resolution":{"observed_at":"2026-08-07T00:40:51.583965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:51.954151Z","title":"Modelscope: bring the notion of model-as-a-service to life","venue":null,"work_id":"03f1001d-06f5-467a-94c2-1b62bfad5752","year":2023},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.670696Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:fef9c828540d048cb488f349ed3b18a6794c3a275a55b6b940a123b5d99bad7e","observation_id":"23099b38-c337-4580-9a37-8505f6e3576c","resolution":{"observed_at":"2026-08-07T00:40:52.022804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T21:12:02.646705Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2506.13300."}