{"as_of":"2026-08-16T09:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:51cea35e18782b0ac4dac99d3ecc227fc61c79756ef91e92b77840a566e752b9","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:58:16.437724Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T17:17:56.737611Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T07:06:12.933234Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"cited_work":{"arxiv_id":"2505.11352","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.11352","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Legoslm: Connecting llm with speech encoder using ctc posteriors","venue":null,"work_id":"d78174a0-9a0b-49f5-8115-8e520ac1e373","year":2025},"citing_paper":{"arxiv_id":"2604.08384","last_updated":"2026-04-09T15:44:45Z","snapshot_observed_at":"2026-08-11T12:19:06.763139Z","submitted_at":"2026-04-09T15:44:45Z","title":"TASU2: Controllable CTC Simulation for Alignment and Low-Resource Adaptation of Speech LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T17:17:56.737611Z"},"links":{"cited_paper":"/paper/2505.11352","citing_paper":"/paper/2604.08384"},"observation_digest":"sha256:5a420bbd52f3f18591db0918ee4ce8cd5b01cf7e4a8433b516a41acaa30f70f7","observation_id":"517bb2a6-80bf-4895-8464-a4e1c67de9e3","resolution":{"observed_at":"2026-05-11T07:06:13.016146Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.11352/citation-record","integrity":"/paper/2505.11352/integrity","json":"/paper/2505.11352/citation-record.json","paper":"/paper/2505.11352"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T20:58:16.239507Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.239507Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:ac687b8182417bd126a59b3bd68a96e57aa0f0d1cbce4ce81d3652a8f4a42c46","observation_id":"c8b9c4ee-be4e-42db-b60f-16123dfa8179","resolution":{"observed_at":"2026-08-15T20:58:16.239507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.246013Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.246013Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:88ba6a42ef736b69bbe3040bc627334ed91e349dc8934a36007862a8693b687d","observation_id":"d853d814-7743-43b0-9cf3-2d830b976e17","resolution":{"observed_at":"2026-08-15T20:58:16.246013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11596","last_updated":"2023-10-25T03:52:07Z","snapshot_observed_at":"2026-08-14T20:49:45.201003Z","submitted_at":"2023-08-22T17:44:18Z","title":"SeamlessM4T: Massively Multilingual & Multimodal Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11596","snapshot_observed_at":"2026-08-15T20:58:16.250955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.250955Z"},"links":{"cited_paper":"/paper/2308.11596","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:6275ebc510151f6f519c7412e79e41a20cd2f50ba42568d74f02d55d8b37da00","observation_id":"0710540e-d2c1-41df-904a-368ccc312d0f","resolution":{"observed_at":"2026-08-15T20:58:16.250955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-15T20:58:16.256710Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.256710Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:20ebb73470934a5c7d11e263f41a27c1acd5fed439ebab07742979b3197ff3ca","observation_id":"ea21f78f-ad20-4f27-8f39-4e6342984030","resolution":{"observed_at":"2026-08-15T20:58:16.256710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:17.072132Z","title":null,"venue":null,"work_id":"7ef2557d-d1c0-4e16-9fc6-1fe3a1c3e543","year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.261992Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:e9abcd08b19207fad76584edc24bfff0647e76f40fb1ad7cf38a914471414e61","observation_id":"94640809-4508-457b-bb3b-af464c854028","resolution":{"observed_at":"2026-08-15T20:58:17.077047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02133","last_updated":"2021-04-27T13:23:27Z","snapshot_observed_at":"2026-08-14T06:46:28.505083Z","submitted_at":"2021-04-05T20:13:36Z","title":"SpeechStew: Simply Mix All Available Speech Recognition Data to Train One Large Neural Network","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02133","snapshot_observed_at":"2026-08-15T20:58:16.267337Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.267337Z"},"links":{"cited_paper":"/paper/2104.02133","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:07817c92b78543585494a0ffbc83b24349a3b3a6ef76ff7bfa2344dc85803d30","observation_id":"20938b80-b402-493f-9ead-0c73bb27d241","resolution":{"observed_at":"2026-08-15T20:58:16.267337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:17.055958Z","title":null,"venue":null,"work_id":"04bfff36-777e-4121-9400-fb0153af7013","year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.273101Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:f63417dfb0684e541d435a37b25dceb185e420082f58527f56e361879e68fda2","observation_id":"e0808298-92c9-4baf-8918-bb98afc4bcd5","resolution":{"observed_at":"2026-08-15T20:58:17.060930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:17.039889Z","title":null,"venue":null,"work_id":"499bb104-0bae-40c5-af6e-4ad303f388e5","year":2022},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.278261Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:1912bee18f25c899517f0bffac9eda58113f197872c561c5fc5ddf94fd1d1e59","observation_id":"49add4e9-0f7b-4dac-9ba7-61b78aa997ec","resolution":{"observed_at":"2026-08-15T20:58:17.044901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:17.024298Z","title":null,"venue":null,"work_id":"e9c30f25-ec09-4cb4-8f8e-737d3cfcb043","year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.283086Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:a941b619cccf82667ada405ea32a953f4f8b30ba9d0876f33cb94cdbf727e47f","observation_id":"15c08fbd-f6cc-4f6b-802a-5fbf21a9d1eb","resolution":{"observed_at":"2026-08-15T20:58:17.028925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:17.007331Z","title":null,"venue":null,"work_id":"e16c1f40-eb7c-4936-a86c-866529dac488","year":2018},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.287868Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:d4d0ffc805252761890ab7d46a3a70d7e6e1479f4f158baadbbebee0394e0391","observation_id":"445a84a9-288e-4351-8796-83bf9d5237a6","resolution":{"observed_at":"2026-08-15T20:58:17.012968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.991416Z","title":null,"venue":null,"work_id":"85f5322d-5737-4e22-b437-8cb17c3cba84","year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.292970Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:c8e0593dac7d53409ed8743bc45b294aa39f267dc4d3971b03fe4a58791eafd6","observation_id":"dcd8af70-f3f5-4bd9-baaa-e87e4cdf72e6","resolution":{"observed_at":"2026-08-15T20:58:16.996618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.973201Z","title":null,"venue":null,"work_id":"dc74575c-1948-49f2-9f45-0c7bedf33740","year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.298762Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:7120bea297545b4fff2e45d149681a9a3ca0e47925d1019e8ca6fce33043b4f0","observation_id":"69ae0cd9-d3d2-4c22-8cfa-3c638df275a6","resolution":{"observed_at":"2026-08-15T20:58:16.978555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.955889Z","title":null,"venue":null,"work_id":"d333728a-59d2-4e16-9be5-766f9019ba37","year":2006},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.304114Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:6d3a6da678ff41a0744aefafa8b4939be2febf172cf9406073252f8873ff71ed","observation_id":"1f574509-ba7c-447f-b47a-e45c55c3119c","resolution":{"observed_at":"2026-08-15T20:58:16.961158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03668","last_updated":"2024-06-06T15:24:16Z","snapshot_observed_at":"2026-08-13T05:08:31.724164Z","submitted_at":"2023-12-06T18:34:42Z","title":"Integrating Pre-Trained Speech and Language Models for End-to-End Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03668","snapshot_observed_at":"2026-08-15T20:58:16.309493Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.309493Z"},"links":{"cited_paper":"/paper/2312.03668","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:146fc6ba8ec0913a6832c5a9498c02ffd0aacbcfe150e5614fbf19efc85865ec","observation_id":"7bd240eb-5da6-43e9-9cd4-b4e9ad8f0f53","resolution":{"observed_at":"2026-08-15T20:58:16.309493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.939166Z","title":null,"venue":null,"work_id":"918a1353-c0a8-436b-94b7-09c6dbc9d388","year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.315338Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:35da38aaa69ba67c3cde3f1b202ee11e6e90885533ac7c5e94ae956858020111","observation_id":"e5425a33-0ba1-4b8e-a66c-7f82f56f1815","resolution":{"observed_at":"2026-08-15T20:58:16.943986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.923188Z","title":null,"venue":null,"work_id":"8a997e7f-4052-465f-b4ab-3f848badd907","year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.320683Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:a96f355c5f10c53340129d78a921faffef8388cbb3d4788d38ab8c64fb934c1a","observation_id":"d248144a-d5fc-4709-9d56-cfe4e80f5978","resolution":{"observed_at":"2026-08-15T20:58:16.928252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.906018Z","title":null,"venue":null,"work_id":"5f19a15f-8d8a-4b00-92a2-8cf0ba1c73dc","year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.325327Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:0d6c04be5dfd468e8238a84147ba631c21316768a0ac1e3bae3ce7e41104e2ea","observation_id":"2211a240-80cd-4d37-9659-88584aea9f2d","resolution":{"observed_at":"2026-08-15T20:58:16.912389Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04172","last_updated":"2023-09-29T07:32:03Z","snapshot_observed_at":"2026-08-14T02:27:46.713494Z","submitted_at":"2023-07-09T13:38:25Z","title":"Can Generative Large Language Models Perform ASR Error Correction?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04172","snapshot_observed_at":"2026-08-15T20:58:16.329989Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.329989Z"},"links":{"cited_paper":"/paper/2307.04172","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:25b81fff6f9fb0c54206646104e2bcf2d2759e0c6c9866105d1fd4abd6d9952e","observation_id":"ef9c8674-8e7e-460b-bdf8-b6748e6dff54","resolution":{"observed_at":"2026-08-15T20:58:16.329989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-13T04:19:27.486516Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-15T20:58:16.334856Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.334856Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:3717f79ca000dfc4e53aaa283c1ce05f7c86d10dbbe8a0691cf8af6994b5f2e9","observation_id":"50b088eb-3c83-487f-a736-80ea01fe53af","resolution":{"observed_at":"2026-08-15T20:58:16.334856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.889839Z","title":null,"venue":null,"work_id":"0e8bc748-8679-43a4-8060-ab23e0e41b68","year":2020},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.340154Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:e8f9618b01f18a5479d12c0732d726d7482c9ac787e2d2fe4b82721bbd161916","observation_id":"42050f56-642e-4bb1-af25-d0e357528173","resolution":{"observed_at":"2026-08-15T20:58:16.895035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.344454Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.344454Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:20e7b833f126ab70c5bb3958e526cbb99c934068279fe2117e2bc85c21ac3e87","observation_id":"eab70700-5e5d-4382-84f7-b1d1371d566b","resolution":{"observed_at":"2026-08-15T20:58:16.344454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.861767Z","title":"Park, William Chan, Yu Zhang, Chung-Cheng Chiu, Barret Zoph, Ekin D","venue":null,"work_id":"0a276cdd-fc94-4cb1-8c93-422b496f7b45","year":2019},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.349220Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:1633b0a9ebaef307d99bd2154924e47948ea60f5c6c678167bcf9215bc78913c","observation_id":"f8346084-a1c0-4dbe-a2d9-c2f0af1af2aa","resolution":{"observed_at":"2026-08-15T20:58:16.867651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.846171Z","title":null,"venue":null,"work_id":"a853af1e-8434-4782-aae7-4a19c6b4e7f7","year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.353887Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:6c97c0f62628f0848838695741894510f502d79f9ea6018e60cb5c17f0848c96","observation_id":"24b6dcff-1d9a-4180-9178-efa502607201","resolution":{"observed_at":"2026-08-15T20:58:16.851448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.829943Z","title":null,"venue":null,"work_id":"4d460718-feec-4c94-a6de-a470ddee579e","year":2020},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.359676Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:aa498d5c97e29f17b1e492b4b8a46c1d0bea5d53d489c3a7ab22836548c1de82","observation_id":"a8e39d6e-00e6-4c94-a762-2ffd090b580e","resolution":{"observed_at":"2026-08-15T20:58:16.834898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.814784Z","title":null,"venue":null,"work_id":"c868df29-273c-4bc8-a523-50fc2c757bb9","year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.368651Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:617d7b6782f81204a7ad5151c306c7123dd8675b7dc409e6203ae1bbcd8af800","observation_id":"38ca01da-f796-45c8-9055-5452a8ab4681","resolution":{"observed_at":"2026-08-15T20:58:16.819731Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-15T20:58:16.374325Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.374325Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:0d36998b51603a95d9a0eefe7011835ff827a17c812ec2cee1f5e9d43f6f4c31","observation_id":"ce87cb7f-4e5a-4f3b-9352-b52c75e77f25","resolution":{"observed_at":"2026-08-15T20:58:16.374325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.797366Z","title":null,"venue":null,"work_id":"5f2320f5-4b3a-4891-842f-398dca65da24","year":2018},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.380479Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:a67ac898a9e1f58e498a369f181b38ab22464b5839ea597ea60ca1dd1e9deac3","observation_id":"1952bd64-9da5-4c63-a172-7c04e1d3852d","resolution":{"observed_at":"2026-08-15T20:58:16.802689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T20:58:16.385887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.385887Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:318e4e379f92f6a2289a8f544eb570aa3209886d3a807af71621da43634f82e5","observation_id":"64649e57-c122-4eb2-8aca-db627c0e2a89","resolution":{"observed_at":"2026-08-15T20:58:16.385887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17044","last_updated":"2025-06-03T10:28:07Z","snapshot_observed_at":"2026-08-13T13:57:05.874236Z","submitted_at":"2024-09-25T15:54:29Z","title":"How to Connect Speech Foundation Models and Large Language Models? What Matters and What Does Not","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17044","snapshot_observed_at":"2026-08-15T20:58:16.390927Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.390927Z"},"links":{"cited_paper":"/paper/2409.17044","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:1b5d2ec4ba17488e3340d2c4a0e433851460329137520f20f3745ca0a463e26f","observation_id":"87802fd7-d6d4-4ae0-8ecb-79761ce2798f","resolution":{"observed_at":"2026-08-15T20:58:16.390927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.779016Z","title":null,"venue":null,"work_id":"59a8cb42-f34c-4181-8157-aafb580b08e0","year":2021},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.395596Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:7626c10e1ad0936a1ae83c1ef3c363711596e6ad76183147b76f8e94e41f353a","observation_id":"0bd56691-4b24-420f-a6cc-ce3134aade79","resolution":{"observed_at":"2026-08-15T20:58:16.784014Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.758997Z","title":null,"venue":null,"work_id":"75d0efd3-2740-4954-993e-7f6e336ae267","year":2024},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.400841Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:4da53ab90c964cb324e202f032d07ebaadca3b5e60fb7af6710ee20aaf798205","observation_id":"06f3503a-1525-44f9-94e4-da91349908a8","resolution":{"observed_at":"2026-08-15T20:58:16.767543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.743478Z","title":null,"venue":null,"work_id":"a0703360-ab51-49b3-810f-835aefb772c9","year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.408653Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:1ecc8d46c82d590c6cef8f3bc9120d3956c39d9e9102b7a652fef010619f8a2e","observation_id":"f0097130-e277-425c-a1b5-037f47aea065","resolution":{"observed_at":"2026-08-15T20:58:16.748269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.725871Z","title":null,"venue":null,"work_id":"c881194d-d1a3-4541-96c1-93609c391573","year":2002},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.415591Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:9b1ad720c6fbb1d1b34ca18a3d05129ea47ec14ae29a850b956ecde6025f71c3","observation_id":"e59bd3e8-1281-486f-ba72-a440a207802f","resolution":{"observed_at":"2026-08-15T20:58:16.732004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-13T12:33:46.085209Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-15T20:58:16.421993Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.421993Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:c92a19c8f8cb08227232ff2bd4af96fc858d354e57bcb44b9f7347a71b178ad3","observation_id":"7ad11417-a26c-4f42-b6db-912bd970b7e6","resolution":{"observed_at":"2026-08-15T20:58:16.421993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.707724Z","title":null,"venue":null,"work_id":"63e4fa16-c334-4528-8f52-fda09b8b5e52","year":2021},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.427398Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:d35021c0ac601e50309ac29e0a5780ccc6e0208c6151a0425eb19f2aaefb0726","observation_id":"7fa85fe4-98c9-40fd-b1ba-c53a71aa3bdf","resolution":{"observed_at":"2026-08-15T20:58:16.714119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.432331Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.432331Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:e27e117e13cfc827be7c8214e494482c024e93e407cd58e63a6a96c3e1a09816","observation_id":"5f8a8155-7b00-4e69-840c-7a6ac749ab4d","resolution":{"observed_at":"2026-08-15T20:58:16.432331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:58:16.437724Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:58:16.437724Z"},"links":{"citing_paper":"/paper/2505.11352"},"observation_digest":"sha256:aca94a817c02cb3ad06ee7fbb070f8389e2bbd006cf0ef98a2a020dc9ea2ec26","observation_id":"0bd6bcbd-bcc2-4a99-9386-f9efb4c01140","resolution":{"observed_at":"2026-08-15T20:58:16.437724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.11352","last_updated":"2025-05-16T15:15:19Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T22:23:54.156212Z","submitted_at":"2025-05-16T15:15:19Z","title":"LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2505.11352."}