{"as_of":"2026-08-15T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d1b4299e8a208c57a139049c3330f42c4960af4cb8497ad2d24bb8b229452252","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:45:27.070910Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:45:23.192060Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:45:27.557256Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2507.18051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18051","snapshot_observed_at":"2026-08-06T14:45:27.557256Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","venue":"cs.SD","work_id":"33aade1d-7503-48d0-be33-0e19b149eb8c","year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.192060Z"},"links":{"cited_paper":"/paper/2507.18051","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:090468736e531c26e17f5804d453c5ab6a5233e6bcbf647c8e2ff733a5b32e01","observation_id":"0dfb4d47-140b-46b2-a8ed-8deb1a2b1db9","resolution":{"observed_at":"2026-08-06T14:45:27.629575Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18051/citation-record","integrity":"/paper/2507.18051/integrity","json":"/paper/2507.18051/citation-record.json","paper":"/paper/2507.18051"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:33.139056Z","title":"Recently, there has been growing interest in combining LLMs with audio encoders, en- abling the models to process and understand audio modali- ties [6, 7, 8, 9, 10, 11]","venue":null,"work_id":"2a052e9d-cd3d-475c-80de-513fc4e2c144","year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.093860Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:1d84ed15421d453ad89e8c7067cd3fb895b70043fd27b9b9b7bc840ffb725567","observation_id":"5109d340-43e8-4c8e-9ffe-06374adade8b","resolution":{"observed_at":"2026-08-06T14:45:33.177289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2507.18051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18051","snapshot_observed_at":"2026-08-06T14:45:27.557256Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","venue":"cs.SD","work_id":"33aade1d-7503-48d0-be33-0e19b149eb8c","year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.192060Z"},"links":{"cited_paper":"/paper/2507.18051","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:090468736e531c26e17f5804d453c5ab6a5233e6bcbf647c8e2ff733a5b32e01","observation_id":"0dfb4d47-140b-46b2-a8ed-8deb1a2b1db9","resolution":{"observed_at":"2026-08-06T14:45:27.629575Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:33.095953Z","title":"Datasets We use a large corpus to train our model, totaling 180k hours, as shown in Table 1","venue":null,"work_id":"1d12ec99-f674-4c96-a986-37a318f0bc40","year":null},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.265352Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:2256e85adb839be629aab0b317b5df6ca7fdd71d7146831598607c2e39a968ae","observation_id":"5d775110-1ef9-4a06-950a-1414e79b7f4f","resolution":{"observed_at":"2026-08-06T14:45:33.105266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.726089Z","title":null,"venue":null,"work_id":"d1542fcc-3ec1-4d86-9d2d-b262646f2e18","year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.471799Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:432d8f2e763b209144f20384851db97af6d394c13bb77bd74bbb1d744759db16","observation_id":"7bd1b50e-1044-4c5a-bf71-354710cda3e1","resolution":{"observed_at":"2026-08-06T14:45:32.846122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T14:45:24.021390Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.021390Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:dcfc4780b6573b88f7427a3aff665ed3f7f56b51d2707b9813c8c00b94c97dcc","observation_id":"fffbe01d-97e6-4919-bffa-b2f568792835","resolution":{"observed_at":"2026-08-06T14:45:24.021390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.475605Z","title":"Introducing chatgpt,","venue":null,"work_id":"abb48200-5a4d-4e51-9564-96f5c6fcc8ff","year":2022},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.601187Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:e6623d70f72ea6fb43a396442da483e7b43f1e38f23ca67cb7f309a796f3bbeb","observation_id":"cfc1d010-c7d2-4b1a-a87b-482318edd8d6","resolution":{"observed_at":"2026-08-06T14:45:32.581263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11276","last_updated":"2023-08-22T08:43:33Z","snapshot_observed_at":"2026-08-14T19:55:54.378555Z","submitted_at":"2023-08-22T08:43:33Z","title":"Music Understanding LLaMA: Advancing Text-to-Music Generation with Question Answering and Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11276","snapshot_observed_at":"2026-08-06T14:45:23.708169Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.708169Z"},"links":{"cited_paper":"/paper/2308.11276","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:b94c938c23c73fc43e8a58888028159e2e8288693db304d3da83832bdad0f89e","observation_id":"52bb2a9c-25da-45f6-b483-6ca5e705639b","resolution":{"observed_at":"2026-08-06T14:45:23.708169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:23.778593Z","title":"Lan- guage models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.778593Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:2f53ef675680eb9b91304a412c1683c452f470beb13ed85198f6cd9af78b72ac","observation_id":"28041e31-5707-4627-afd5-1fa157c5d4f5","resolution":{"observed_at":"2026-08-06T14:45:23.778593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-06T14:45:23.908071Z","title":"Palm 2 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.908071Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:795304cd788e4e8cf92802ee860a8ce4d044886b16f9e211420feccadca07073","observation_id":"e65baf4f-a4aa-43b8-8ff1-79d3209d714b","resolution":{"observed_at":"2026-08-06T14:45:23.908071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-06T14:45:24.551512Z","title":"Qwen2-audio technical re- port,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.551512Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:5a04e7aa2e911de4c820eedfc862684fc9bd557979ebf9093a48e3ab539b8989","observation_id":"15bf3a22-e640-42a6-ac35-a7cebfa1ddc7","resolution":{"observed_at":"2026-08-06T14:45:24.551512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.356407Z","title":"Listen, think, and understand,","venue":null,"work_id":"d477bf81-3257-4dde-9134-4f8ac3af6250","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.133093Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:063a811c01ff328c490b1e62ef4fdc30adc061883fa6d46b2afe47991d055ea6","observation_id":"06463cb4-f5b1-4d7c-ac65-6b8cf78fd1f2","resolution":{"observed_at":"2026-08-06T14:45:32.390503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.045004Z","title":"SALMONN: towards generic hearing abilities for large language models,","venue":null,"work_id":"b55717db-e5ff-49c8-98fe-07b64e0636ee","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.248748Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:b1496b82033c232facd125437fece095198793b458f874d92ebee063b424106d","observation_id":"17bbea26-8b35-4c54-a625-422d306902df","resolution":{"observed_at":"2026-08-06T14:45:32.181787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-06T14:45:24.360453Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.360453Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:87b8e03f73987507607f5f4598b753c386986f0ab98c5a0d416b9631fc9b76d7","observation_id":"3f8dff7b-4211-432a-912a-6a0aecb86f02","resolution":{"observed_at":"2026-08-06T14:45:24.360453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:31.787639Z","title":"Wavllm: Towards robust and adaptive speech large language model,","venue":null,"work_id":"0280ad98-7e61-4f45-a8d6-ff8dc7a21790","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.472799Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:6d36b9ceb508318dfea7c88bdad25e83a004e10477eacbf5005a52b22221b29b","observation_id":"0f621295-184c-4542-8607-9fd292aec52c","resolution":{"observed_at":"2026-08-06T14:45:31.923638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04675","last_updated":"2024-07-10T09:01:17Z","snapshot_observed_at":"2026-08-13T15:17:10.560696Z","submitted_at":"2024-07-05T17:38:03Z","title":"Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04675","snapshot_observed_at":"2026-08-06T14:45:25.066761Z","title":"Seed-asr: Understanding diverse speech and contexts with llm-based speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.066761Z"},"links":{"cited_paper":"/paper/2407.04675","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:20ca9a7f8696c4d4a397d0eb02f58022b3399709f9468cc8f6ed94fd008a5734","observation_id":"28c0212d-65f8-4799-9caa-4ca13afb055e","resolution":{"observed_at":"2026-08-06T14:45:25.066761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:31.479604Z","title":"E- chat: Emotion-sensitive spoken dialogue system with large lan- guage models,","venue":null,"work_id":"62628677-4a42-4710-8b79-abfea9a205ab","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.655324Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:2b999018346586cbc8db8e63c19d284b6e20985ae81483c924d273b080292120","observation_id":"32579c91-6bec-4326-8dde-a4a24d216c10","resolution":{"observed_at":"2026-08-06T14:45:31.615396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:31.290095Z","title":"Prompt- ing large language models with speech recognition abilities,","venue":null,"work_id":"5c9176f7-e109-420d-aab6-a04b3199fb0f","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.767415Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:73a98f792bbdded78cd2aa29d054e4a504c0d29dec2419c1341c1a765b9026c7","observation_id":"daebb02b-03d7-4ea6-9408-6390ab429414","resolution":{"observed_at":"2026-08-06T14:45:31.366251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:31.103043Z","title":"On decoder-only architecture for speech-to-text and large language model integration,","venue":null,"work_id":"d616c01c-f162-43e5-aff7-ac7b00a4086d","year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.870280Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:c3704ca96908c88d79f092fc90d8db45760282897b79ca41bf2dd208f50cfec5","observation_id":"abfbe24e-4e76-4fe2-a6df-5aaf152ba1b2","resolution":{"observed_at":"2026-08-06T14:45:31.173055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-13T04:19:27.486516Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-06T14:45:24.973672Z","title":"An embarrassingly simple approach for llm with strong asr capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.973672Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:8c2bd9bf072d78dd23d2a2fdda186c8be24097d8e179a3781501401717508c55","observation_id":"67cee1df-1eb8-46de-a7c2-5a0a038666a7","resolution":{"observed_at":"2026-08-06T14:45:24.973672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.814405Z","title":"Attention is all you need,","venue":null,"work_id":"2f001fa9-6d55-4d38-b35d-231162b20ba5","year":2017},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.520001Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:7b5090cd547b1e9a96b17ce55bcb8073af4fe2a8df7c6f52823192b6f9a30dda","observation_id":"a8e10e73-6a3c-4b70-9f59-31dcc66b6264","resolution":{"observed_at":"2026-08-06T14:45:29.861719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:30.743000Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"2c83af7f-9dc2-4390-9d8d-5c2116a96b09","year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.158657Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:bbde7b07c17ebbb9fa2b3301d22c14885f019475a45a3e47eaa1fc3af815d409","observation_id":"c2a40359-1de6-4ed0-8891-c5c29938ee7e","resolution":{"observed_at":"2026-08-06T14:45:30.924050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11214","last_updated":"2024-09-17T14:10:57Z","snapshot_observed_at":"2026-08-14T13:09:33.353594Z","submitted_at":"2024-09-17T14:10:57Z","title":"Ideal-LLM: Integrating Dual Encoders and Language-Adapted LLM for Multilingual Speech-to-Text","version":1},"cited_work":{"arxiv_id":"2409.11214","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.11214","snapshot_observed_at":"2026-08-06T14:45:27.373120Z","title":"Ideal-LLM: Integrating Dual Encoders and Language-Adapted LLM for Multilingual Speech-to-Text","venue":"eess.AS","work_id":"8dd4605a-c157-4dfe-96ff-1bdee9f51b34","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.234732Z"},"links":{"cited_paper":"/paper/2409.11214","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:d383fa7133c043b35e83a331ca389cefa07f456925f4f9289c049d49cd1f7d3d","observation_id":"1740bf53-f428-4acf-b6c7-4002450b954c","resolution":{"observed_at":"2026-08-06T14:45:27.419040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:30.378394Z","title":"Scaling speech technology to 1, 000+ languages,","venue":null,"work_id":"3fdb8ce0-b9d6-4265-89c6-de2c1856e328","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.328275Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:71ef04f7ab4d6fba98c8d4a669cc332e665e35a94a8790932823c48c807c8ac8","observation_id":"8583cb70-0878-4e89-850c-cdb15dd14945","resolution":{"observed_at":"2026-08-06T14:45:30.544635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.961554Z","title":"Lora: Low-rank adaptation of large lan- guage models,","venue":null,"work_id":"d5e31a8b-4aef-4244-939f-728833a91f62","year":2022},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.421157Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:ea029582ac108d08641d808b604f7bfc370b1b05a0db38d687aa82a57335bef0","observation_id":"e3ecebeb-1db4-43b7-94fd-4fa84352cb52","resolution":{"observed_at":"2026-08-06T14:45:30.146746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11546","last_updated":"2025-05-27T04:49:35Z","snapshot_observed_at":"2026-08-12T23:41:05.299596Z","submitted_at":"2024-06-17T13:44:20Z","title":"GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11546","snapshot_observed_at":"2026-08-06T14:45:25.987528Z","title":"Gigaspeech 2: An evolving, large-scale and multi-domain asr corpus for low-resource languages with au- tomated crawling, transcription and refinement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.987528Z"},"links":{"cited_paper":"/paper/2406.11546","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:7cc89d0543f9c5368fe742bdc629306e10f3e358824a2e1bdc8b885cafcec07f","observation_id":"e90c6ac7-541e-4607-a8ff-36897dca7c6f","resolution":{"observed_at":"2026-08-06T14:45:25.987528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T14:45:25.579054Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.579054Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:1e9eef01a1488b2b085c759d49ec98435b4e51e5755d1a672371d4d618e0fb47","observation_id":"f3bb7416-d714-480e-ad6e-3285b8bcc404","resolution":{"observed_at":"2026-08-06T14:45:25.579054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.693970Z","title":"MSR- 86K: an evolving, multilingual corpus with 86, 300 hours of tran- scribed audio for speech recognition research,","venue":null,"work_id":"4278fe67-a28d-4ee7-8211-eaded0e37660","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.676361Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:3eff69ba25da07d87b304335d32d4d7292579b5f23f83f0b8f581014d8124519","observation_id":"bbbea1d3-daa5-4663-98ef-63919ef87493","resolution":{"observed_at":"2026-08-06T14:45:29.777252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.487482Z","title":"Com- mon voice: A massively-multilingual speech corpus,","venue":null,"work_id":"248b51dc-b0d6-4aa0-92e2-04d18b07bf78","year":2020},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.771272Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:af9aea8b360af5c17111865f8c653083776e1b4e610904b7445ccddf6a578b24","observation_id":"82786020-78f8-4738-83ba-96ad4d5467aa","resolution":{"observed_at":"2026-08-06T14:45:29.592363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.170837Z","title":"MLS: A large-scale multilingual dataset for speech research,","venue":null,"work_id":"061fdef6-d22a-4cef-9771-1cf9c1281feb","year":2020},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.894675Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:4da187b3624182f5611270566fa9a37c3b2312075251ac3be2568b4af7acf300","observation_id":"9b9625b0-a0b5-41b2-822e-862b2cef0243","resolution":{"observed_at":"2026-08-06T14:45:29.369100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.395991Z","title":"The fisher corpus: a resource for the next generations of speech-to-text,","venue":null,"work_id":"2166b921-e1b3-4483-a791-f05c17367180","year":2004},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.556919Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:6aec6176ff61297a2bc410d8dc87183ed9b9d268379a3089cc336c5242372915","observation_id":"89298056-c8c7-4a4e-887a-00ebc84249df","resolution":{"observed_at":"2026-08-06T14:45:28.503271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.905674Z","title":"Emilia: An extensive, multilingual, and diverse speech dataset for large-scale speech generation,","venue":null,"work_id":"de6e4ff0-aa66-48d4-abbb-88fc3914f43b","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.112013Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:9476da3affc2b824694f0b10be5ed5962dc5575224729f9c9a8d97e09cc7ab53","observation_id":"3aeb822d-7a4b-4a68-b6f2-775f3e162188","resolution":{"observed_at":"2026-08-06T14:45:29.012624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.888348Z","title":"The average WER is reduced by 3.6% compared to the original baseline","venue":null,"work_id":"1079e354-27e0-46bb-a8bb-1bfabcada544","year":null},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.366324Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:3e7382e17ee05f80ca86f36df657562eda13ddacd683129f90cf6686ada38099","observation_id":"c9f30bf0-4c0f-404a-94c5-ca55bd764167","resolution":{"observed_at":"2026-08-06T14:45:32.945762Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.688316Z","title":"Opendatalab: Empowering general artificial intelligence with open datasets,","venue":null,"work_id":"85d96053-cba3-44d6-a6d8-d6f99488059b","year":null},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.204777Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:12cd74bd9e26dceda1929a72a6f06602fb6aec0e546ebb4fc6de14f5eac9fbce","observation_id":"dcf92287-9c04-4773-97b2-d191d4ce13fd","resolution":{"observed_at":"2026-08-06T14:45:28.813061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.652361Z","title":"Lib- rispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":"9bec4a43-4a47-4a5d-ace0-b0df4f5c551b","year":2015},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.395403Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:d18c28cfd47b282590ddcbfbd6080353ea0c82e268bcaa02ffa3df6c8f693b9a","observation_id":"75539b25-e724-4fb9-b893-1e75bff383f9","resolution":{"observed_at":"2026-08-06T14:45:28.661767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06909","last_updated":"2021-06-13T04:09:16Z","snapshot_observed_at":"2026-08-15T02:30:18.191799Z","submitted_at":"2021-06-13T04:09:16Z","title":"GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06909","snapshot_observed_at":"2026-08-06T14:45:26.487908Z","title":"Gigaspeech: An evolving, multi-domain asr corpus with 10,000 hours of transcribed audio,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.487908Z"},"links":{"cited_paper":"/paper/2106.06909","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:e95979ea92e453105b2b1a18079ffd7b0abbdb2125fc8a08c89e102ab52c4d84","observation_id":"d5156ee4-8fc9-44d8-9f7d-ac6a252ac9bb","resolution":{"observed_at":"2026-08-06T14:45:26.487908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12654","last_updated":"2024-08-27T02:22:00Z","snapshot_observed_at":"2026-08-13T04:14:53.735819Z","submitted_at":"2024-02-20T02:04:38Z","title":"OWSM-CTC: An Open Encoder-Only Speech Foundation Model for Speech Recognition, Translation, and Language Identification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12654","snapshot_observed_at":"2026-08-06T14:45:27.070910Z","title":"Owsm-ctc: An open encoder-only speech foundation model for speech recog- nition, translation, and language identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:27.070910Z"},"links":{"cited_paper":"/paper/2402.12654","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:6ed7ed1c269f0e25505bc183079927e99b1979da600b270c0c36f02662935448","observation_id":"63ac38bd-0606-47c4-8841-5fc2e2247696","resolution":{"observed_at":"2026-08-06T14:45:27.070910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.190742Z","title":"Reazonspeech: A free and massive cor- pus for japanese asr,","venue":null,"work_id":"383effb8-12fd-450f-a72d-cdb43e3fc915","year":2016},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.636811Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:cbf029427be0e06ff4bfbe915921642a39aa54285932bf0c9bd8440848e7ce12","observation_id":"3259b15b-c866-40ff-a0c8-597a8cdd2385","resolution":{"observed_at":"2026-08-06T14:45:28.255794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.040068Z","title":"Construction of a large-scale japanese asr corpus on tv recordings,","venue":null,"work_id":"f364ba52-6828-4eba-b75d-cbb0e7dd8ade","year":2021},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.732456Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:10c2df962742e29e5691a9daba785e26ecfbfd6bb8670c494c7a55d608428404","observation_id":"5cde0366-8bd5-4531-b737-3502dc8d79e1","resolution":{"observed_at":"2026-08-06T14:45:28.099032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10161","last_updated":"2021-06-18T14:55:02Z","snapshot_observed_at":"2026-08-13T19:00:49.512782Z","submitted_at":"2021-06-18T14:55:02Z","title":"Golos: Russian Dataset for Speech Research","version":1},"cited_work":{"arxiv_id":"2106.10161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.10161","snapshot_observed_at":"2026-08-06T14:45:27.186399Z","title":"Golos: Russian Dataset for Speech Research","venue":"eess.AS","work_id":"341fc63a-1e99-463f-824a-5e6a2f6f7de8","year":2021},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.849514Z"},"links":{"cited_paper":"/paper/2106.10161","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:2511ad3ab78f23bf2b9d41cbc272e4631c5c24b75340a7e2ae324e40011e2d19","observation_id":"2d5b036b-fd34-4bee-90ba-3b2ce05fe765","resolution":{"observed_at":"2026-08-06T14:45:27.229289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:27.845132Z","title":"Ksponspeech: Korean spontaneous speech corpus for automatic speech recog- nition,","venue":null,"work_id":"4ae99a10-0f6c-4769-b802-fac54efbeed1","year":2020},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.944483Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:bb710f4bdce84ad6606a1f526e39246ec82b22cae2a27ec5abd8eba7481ac36b","observation_id":"b6ef063f-f903-4c64-ae0f-cc53f4397866","resolution":{"observed_at":"2026-08-06T14:45:27.943351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:27.707003Z","title":"Unsupervised cross-lingual representation learning for speech recognition,","venue":null,"work_id":"81cd9b7f-a37e-4b12-af37-ae17c4aefca1","year":2021},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:27.014884Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:5d1b25e7d05095b62c2048de85be687fae738439d0902bd10a193374794a0346","observation_id":"860f4c4f-497a-479d-bef6-e2ccefbae6ad","resolution":{"observed_at":"2026-08-06T14:45:27.769815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13773","last_updated":"2024-06-04T10:42:01Z","snapshot_observed_at":"2026-08-12T23:50:39.159286Z","submitted_at":"2024-06-04T10:42:01Z","title":"OpenDataLab: Empowering General Artificial Intelligence with Open Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13773","snapshot_observed_at":"2026-08-06T14:45:26.301812Z","title":"Available: https://arxiv.org/abs/2407.13773","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.301812Z"},"links":{"cited_paper":"/paper/2407.13773","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:bab2d6fa2d3e28412dae175caec1556097c81ed05f0eb8aa3512bfee2b3c558b","observation_id":"c535d169-99fa-47cc-926f-bb5f0e7e7c2a","resolution":{"observed_at":"2026-08-06T14:45:26.301812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T00:50:37.532708Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":24},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2507.18051."}