{"as_of":"2026-08-22T11:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e5b4c0599911a70598a388765437a0a735d51e0fe04e4484bb39575256e42d80","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:30:22.046679Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T18:40:19.688550Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:47:25.661394Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"cited_work":{"arxiv_id":"2504.15509","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15509","snapshot_observed_at":"2026-07-02T22:47:25.661394Z","title":"Woodland","venue":null,"work_id":"242c30e3-3a43-460a-bb61-2b86f17be266","year":2025},"citing_paper":{"arxiv_id":"2606.08486","last_updated":"2026-06-07T07:15:34Z","snapshot_observed_at":"2026-08-14T07:00:54.042268Z","submitted_at":"2026-06-07T07:15:34Z","title":"TRADE: Transducer-Augmented Decoder for Speech LLM","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T18:40:19.688550Z"},"links":{"cited_paper":"/paper/2504.15509","citing_paper":"/paper/2606.08486"},"observation_digest":"sha256:dad605dd8ae922112c76ccc0f6b9f0ff8d77dc60153097f947b1a7e9771fba72","observation_id":"76c9bf33-d11b-4aad-a659-f44fddc17aec","resolution":{"observed_at":"2026-07-02T22:47:25.663003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.15509/citation-record","integrity":"/paper/2504.15509/integrity","json":"/paper/2504.15509/citation-record.json","paper":"/paper/2504.15509"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T11:30:21.769901Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.769901Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:b9a7f10e3d7e4b9087b3cf5f28d6b84aed3502d7aab7207daad2d305cf858dc7","observation_id":"2b36da81-1e4f-42f7-9b12-f55f3ba7b96d","resolution":{"observed_at":"2026-08-16T11:30:21.769901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05187","last_updated":"2023-12-08T17:18:42Z","snapshot_observed_at":"2026-08-19T22:26:55.755677Z","submitted_at":"2023-12-08T17:18:42Z","title":"Seamless: Multilingual Expressive and Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05187","snapshot_observed_at":"2026-08-16T11:30:21.774260Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.774260Z"},"links":{"cited_paper":"/paper/2312.05187","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:9311b7dc387a555e084e56088f1656c0f0e415429d89c2c28139152f4b52ef6c","observation_id":"cf203f16-d5b3-49ae-bbdc-cad0f64f0c35","resolution":{"observed_at":"2026-08-16T11:30:21.774260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:21.778114Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.778114Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:5fd19954162ee18c08ab4cd7e243543c56913f5fb3a41e8c2c1271f60bd58dff","observation_id":"76cc4930-33c1-4ad9-88d8-e00de7c96a4a","resolution":{"observed_at":"2026-08-16T11:30:21.778114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.129876Z","title":null,"venue":null,"work_id":"4b0abd8a-1c38-414f-a1e2-4d47b5b3d92e","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.781457Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:85df70796a979e1b0d7bcd81f3e534da3f717bedff8de6f59dad00ff4edceade","observation_id":"b5bd6b4e-8efe-492d-b2f6-5d37b9fb5200","resolution":{"observed_at":"2026-08-16T11:30:23.132881Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2022-10627","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.107054Z","title":null,"venue":null,"work_id":"b6c87c2d-215c-420a-b243-d5e8e1f484f3","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.785321Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:0f1d59b6dc5de332001a083279fd42a5a10e4bb6d555df2815bf983d0efe3af8","observation_id":"23539026-72a4-49c6-a9b0-6ad35c068e30","resolution":{"observed_at":"2026-08-16T11:30:22.111564Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.120755Z","title":null,"venue":null,"work_id":"e205f257-91e5-4e2f-9ec5-f0f09474804f","year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.789643Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:c6414f641b199ec548b22019a583b371005254864acdbfb118550a4e93171245","observation_id":"dacaca67-af37-42ba-b987-84b22bae6e4b","resolution":{"observed_at":"2026-08-16T11:30:23.123967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04160","last_updated":"2023-05-22T02:37:02Z","snapshot_observed_at":"2026-08-17T18:21:22.894737Z","submitted_at":"2023-05-07T02:25:42Z","title":"X-LLM: Bootstrapping Advanced Large Language Models by Treating Multi-Modalities as Foreign Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04160","snapshot_observed_at":"2026-08-16T11:30:21.793349Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.793349Z"},"links":{"cited_paper":"/paper/2305.04160","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:053f19a56d831d5c8b18756efe135bbc6d07f553836c1f506b3f0962d1d58a7a","observation_id":"874325c5-f1fd-49bd-90a4-e1277ab957b6","resolution":{"observed_at":"2026-08-16T11:30:21.793349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19954","last_updated":"2024-06-28T14:40:03Z","snapshot_observed_at":"2026-08-21T21:21:48.498259Z","submitted_at":"2024-06-28T14:40:03Z","title":"BESTOW: Efficient and Streamable Speech Language Model with the Best of Two Worlds in GPT and T5","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19954","snapshot_observed_at":"2026-08-16T11:30:21.796948Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.796948Z"},"links":{"cited_paper":"/paper/2406.19954","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:531b8f02e17461163750a7269a72dd6a269ff2b11b56ee6cbc9e3e08f13897b1","observation_id":"d438b19b-de9d-4f90-be01-d0901ab500c6","resolution":{"observed_at":"2026-08-16T11:30:21.796948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-16T11:30:21.800728Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.800728Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:92a88032cc6e8270adc0f2a03e14a2b13e1233f04d58b1a6fe4fefce9b5d624e","observation_id":"0e82a07e-9811-4ed2-869d-15ed4c63fe9d","resolution":{"observed_at":"2026-08-16T11:30:21.800728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03751","last_updated":"2025-08-07T13:29:43Z","snapshot_observed_at":"2026-08-16T13:13:34.592774Z","submitted_at":"2024-10-01T21:48:12Z","title":"Recent Advances in Speech Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03751","snapshot_observed_at":"2026-08-16T11:30:21.808555Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.808555Z"},"links":{"cited_paper":"/paper/2410.03751","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:3a98db93d07f71198c6aadd4d21994954df1ff00d9438499595f32697be625b9","observation_id":"c28e7526-0906-4854-a376-2aa76dee4f7f","resolution":{"observed_at":"2026-08-16T11:30:21.808555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:21.812762Z","title":"Costa-juss \\`a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.812762Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:98909ff1f72abc35112e0fb2348f00689050964ea15752cb6520b52c80343931","observation_id":"08fc39a4-1162-41ec-9762-a9475e5b7571","resolution":{"observed_at":"2026-08-16T11:30:21.812762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-16T11:30:21.816174Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.816174Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:3b4cc2a219de85269aead9a2d9c9f3731e841a6140e7f017fce1b865c7ae8a7c","observation_id":"f7330245-586f-44c2-9a2e-ff8cf306c08c","resolution":{"observed_at":"2026-08-16T11:30:21.816174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.112083Z","title":null,"venue":null,"work_id":"49d7317d-64ba-46ed-a04c-5df0350d7c0f","year":2025},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.820066Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:9bd318cb8dba07f0c902f29813f5f25d76ed665f52bfef9e8c1d0c90bd4dfbbd","observation_id":"5b6f9cf8-ff4b-4c35-8309-bf66e633e7f3","resolution":{"observed_at":"2026-08-16T11:30:23.115004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:21.823285Z","title":"Woodland","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.823285Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:5fca35154faee64744c846855e0528db8224c0b48e7d4f72c55b7011642d61c2","observation_id":"62706f95-7ea3-414f-8ffa-e1aa52d416e3","resolution":{"observed_at":"2026-08-16T11:30:21.823285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.103812Z","title":null,"venue":null,"work_id":"55e0e1ef-30f1-4b91-ba7b-bcf609356798","year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.826672Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:edd99c4c62623cc0481c763e926bef4b7ab9a87b83b0a54396e951d2eb2ac666","observation_id":"87f652cb-9ef0-4b16-80a3-877489ed1482","resolution":{"observed_at":"2026-08-16T11:30:23.106686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:21.829948Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.829948Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:f1ad42076a2efe06eb3c206020bb883cac469451380b34cc05b0779da62ad79e","observation_id":"358a2f55-246e-4834-b06a-c79b2d8af45c","resolution":{"observed_at":"2026-08-16T11:30:21.829948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.094854Z","title":null,"venue":null,"work_id":"0f00128d-1b67-4a43-9a5c-92b88d32b14c","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.833445Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:478ca946d95e21c33660d7d93a1fa6f42b3c3683f59df0b2064a5e3942fb6c19","observation_id":"0f9040c9-2f34-4806-91ae-2bd466ee3d6c","resolution":{"observed_at":"2026-08-16T11:30:23.098003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.085878Z","title":null,"venue":null,"work_id":"b7ccb3e1-3d8d-45d1-9b2f-80a3cbd0ab70","year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.837444Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:dd38aee621c7be0554938a4374b677db7c83ebbb2f1f236d5369dc209023a387","observation_id":"2282ec86-cb8a-4004-baa7-8f2afb2c8cef","resolution":{"observed_at":"2026-08-16T11:30:23.089168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T11:30:21.841003Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.841003Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:1105f983729bbece5f1ceae469c8f960f44c60872eda50f6f0f847e30e01e8cb","observation_id":"0ef8eaa0-fc6d-4781-b5b6-73b8625b496c","resolution":{"observed_at":"2026-08-16T11:30:21.841003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06666","last_updated":"2025-03-01T12:59:49Z","snapshot_observed_at":"2026-08-16T13:19:40.907971Z","submitted_at":"2024-09-10T17:34:34Z","title":"LLaMA-Omni: Seamless Speech Interaction with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06666","snapshot_observed_at":"2026-08-16T11:30:21.844448Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.844448Z"},"links":{"cited_paper":"/paper/2409.06666","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:7a88954e5dc876f3c5d6d8d0d5af7abcf2a04675542196b171e09f0c5a421421","observation_id":"c42a38e6-940d-4402-9758-56a45182388f","resolution":{"observed_at":"2026-08-16T11:30:21.844448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.077504Z","title":null,"venue":null,"work_id":"409ac0ad-f236-4622-bb45-be176a590e0a","year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.848069Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:02cb4509dcde9cfb4fea5757a2a45de1f8893cad7c0f17ac3b59891f89e6abab","observation_id":"708fdfef-ca5d-4f32-b763-0ca267016b99","resolution":{"observed_at":"2026-08-16T11:30:23.080810Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1211.3711","last_updated":"2012-11-14T19:25:21Z","snapshot_observed_at":"2026-08-15T00:39:21.296689Z","submitted_at":"2012-11-14T19:25:21Z","title":"Sequence Transduction with Recurrent Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1211.3711","snapshot_observed_at":"2026-08-16T11:30:21.855340Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.855340Z"},"links":{"cited_paper":"/paper/1211.3711","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:a66600bcdf4ea6bc5831efe73697d556058e70e8f23235bad0473bfc117d6c38","observation_id":"031c0a26-bb4f-4dcf-97e4-7c1123cb5732","resolution":{"observed_at":"2026-08-16T11:30:21.855340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.068775Z","title":"Gomez, and J \\\" u rgen Schmidhuber","venue":null,"work_id":"e17fd550-02ab-48f5-87ad-048b1a35cedc","year":2006},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.859372Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:54098f3d8f888dc1471ed8b3b61ae9a7b4cec2197d385cf4dacad76ba1ddbb4f","observation_id":"91199123-db4b-4d67-ba6e-a52488904197","resolution":{"observed_at":"2026-08-16T11:30:23.071943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.059909Z","title":null,"venue":null,"work_id":"bd6ef1ad-6352-4270-8b29-ee5ce61d94a3","year":2017},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.862666Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:77bd65eb0397d1b362f01e741ec1d1b7b942ff475ad566ad5af7fd94b132c932","observation_id":"29e55067-3c5b-4dc4-8e18-08e6da08ba3d","resolution":{"observed_at":"2026-08-16T11:30:23.062937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:21.866179Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.866179Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:e7a6f75f28737fd0283fa1711e954c7387bb0c52e0d44ab7f3d2deda239e8389","observation_id":"4f18ae35-bf2a-4472-8622-8424e4e64512","resolution":{"observed_at":"2026-08-16T11:30:21.866179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.049716Z","title":null,"venue":null,"work_id":"90a04a0d-f186-4145-adaf-21a3b84c36a5","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.873352Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:24644e5974aab22d72d067629008d5ad641336d47b4cb62b480d201228d02d7f","observation_id":"1db8f7de-d2a5-42f5-b977-528c6cf8e628","resolution":{"observed_at":"2026-08-16T11:30:23.052913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:21.876865Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.876865Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:5d95ffe977a8216aca356938c2503d8f7e668a30a83f0d21795f26b6f36844e3","observation_id":"288a8aff-0e8a-4b01-9817-7507e38d3f78","resolution":{"observed_at":"2026-08-16T11:30:21.876865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.040904Z","title":null,"venue":null,"work_id":"c992dcb4-ff8c-430d-9f5a-b6cdf447e173","year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.880366Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:14d598ca84a35c2c82413d9b4fa3c536ce7cb343291ef96f79a49823626c70a8","observation_id":"74c48941-c401-4124-8613-309a5e4d856f","resolution":{"observed_at":"2026-08-16T11:30:23.043846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.031817Z","title":null,"venue":null,"work_id":"02f3ece7-a0c7-417b-a69b-80a9ecb99da0","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.883452Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:abc31c76c7163a53c4127f010d9c38073a9a2eed38772453c3227252bcd36a11","observation_id":"aa640a2c-f32c-4847-b6e6-6dea0b29faba","resolution":{"observed_at":"2026-08-16T11:30:23.035115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.022150Z","title":null,"venue":null,"work_id":"f913c698-d075-4946-9aba-a9503e991893","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.886947Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:bcf67838e64be5b675abf12b5743539781b22b879cf029a3da9b5edbb42b372b","observation_id":"4a8e1082-4fa8-4b30-a917-2ad1292e5aea","resolution":{"observed_at":"2026-08-16T11:30:23.025494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.013077Z","title":"Weiss, Fadi Biadsy, Wolfgang Macherey, Melvin Johnson, Zhifeng Chen, and Yonghui Wu","venue":null,"work_id":"b068c586-27cd-4073-a7c8-46c3981ab71d","year":2019},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.890570Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:83111a8823c0c931006f949e4ec2b81403487a0756b3a8a7d8eb0f8604eb236c","observation_id":"d5cc1936-88d1-4100-a688-f520aa5e1655","resolution":{"observed_at":"2026-08-16T11:30:23.016267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13173","last_updated":"2023-02-09T03:45:41Z","snapshot_observed_at":"2026-08-16T16:14:17.854320Z","submitted_at":"2022-11-22T06:45:13Z","title":"Average Token Delay: A Latency Metric for Simultaneous Translation","version":2},"cited_work":{"arxiv_id":"2211.13173","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.13173","snapshot_observed_at":"2026-08-16T11:30:22.348884Z","title":"Average Token Delay: A Latency Metric for Simultaneous Translation","venue":"cs.CL","work_id":"d2a03aa2-9d61-45ef-9671-649467ddaffc","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.894056Z"},"links":{"cited_paper":"/paper/2211.13173","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:d88c783d3c7cc3a00405d7c6f94c8c8f943d4724d97a48a7e9a8f01fd7d05d2e","observation_id":"b5f1eda2-387a-44de-aebc-64871496e5da","resolution":{"observed_at":"2026-08-16T11:30:22.353426Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:23.003555Z","title":null,"venue":null,"work_id":"6af4df8f-dc63-4c4b-80e3-405ed842c86a","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.897690Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:2c66527af2f68fb91d716e95e7fc9c6e24030cdd1fc2c1fab7d15409a6251961","observation_id":"fb91d6fc-395f-4e52-9eeb-174475718bd8","resolution":{"observed_at":"2026-08-16T11:30:23.007161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.994567Z","title":null,"venue":null,"work_id":"6e14a6c8-d9ef-4387-bb1c-b4eb727be80d","year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.901302Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:169bb5ea8eae608ce4f6f9c866a70fd14f2ce0d7bd6c531d8c7e095d535e554c","observation_id":"c3d07145-30d0-43e5-8a48-f34c3516ab69","resolution":{"observed_at":"2026-08-16T11:30:22.997703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.985807Z","title":null,"venue":null,"work_id":"7bbbae35-566f-448d-94b2-b31933f3af8e","year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.904763Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:d56bde7132c0ab2254b78733079cb6b6b26462f4f5472577b8f11541ac07996f","observation_id":"82720d40-9b60-4094-955d-d4178acd12aa","resolution":{"observed_at":"2026-08-16T11:30:22.988825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17809","last_updated":"2024-10-31T03:11:16Z","snapshot_observed_at":"2026-08-19T09:40:05.812801Z","submitted_at":"2024-05-28T04:11:37Z","title":"TransVIP: Speech to Speech Translation System with Voice and Isochrony Preservation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17809","snapshot_observed_at":"2026-08-16T11:30:21.908107Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.908107Z"},"links":{"cited_paper":"/paper/2405.17809","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:955684abcfe257bdd19affe6cd09520ab4f2559429a4df58b2aae3ff8532f92c","observation_id":"e9b816fb-b292-461c-af97-533fd9d0be68","resolution":{"observed_at":"2026-08-16T11:30:21.908107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:21.911952Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.911952Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:189799b3d2c590615398ff26ae9127e303556748442b0a12647ea4d97abdbdac","observation_id":"bff4500a-7e4a-4716-9064-756f06ec8797","resolution":{"observed_at":"2026-08-16T11:30:21.911952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.976862Z","title":null,"venue":null,"work_id":"706e9aca-14db-4436-a30d-f1841f60ff30","year":2021},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.915237Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:b72f19ed816dcd98791d7e65670464931ffbfd4e778432f77767118f390c92f5","observation_id":"95eddb0c-56d2-4041-8b5b-b07da44e36db","resolution":{"observed_at":"2026-08-16T11:30:22.979913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.968387Z","title":null,"venue":null,"work_id":"96b0000a-77cd-4cba-b5a5-1584dfaba61c","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.918513Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:5580513cbc567acb1d3952a890201004043b02091d13d96418fdecd5950fcdf9","observation_id":"c8296fd7-9f5f-4b90-b2fd-74ed0fdd0a1a","resolution":{"observed_at":"2026-08-16T11:30:22.971354Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.959709Z","title":null,"venue":null,"work_id":"0709d0cd-b4c6-49c9-8093-867b9e932594","year":2018},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.922093Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:2395df3fd4c9f615a3bdb6385c305e9270aed07c790c55e4d9b51bf2e98e7cf4","observation_id":"d53e4709-0af2-480e-ab26-fb70a28a9c12","resolution":{"observed_at":"2026-08-16T11:30:22.962769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.950679Z","title":null,"venue":null,"work_id":"358dce85-8f5d-4937-a54a-16f83635102e","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.925194Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:043d18a94000ec81c7285c6c4fc3159869c69092f2d847561e0a191466e7db76","observation_id":"8aecf476-259d-4b52-b59f-38b895042b92","resolution":{"observed_at":"2026-08-16T11:30:22.953707Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.942524Z","title":null,"venue":null,"work_id":"c0f22bde-98d7-4ebc-bd9b-6d539e6ba30a","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.929996Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:9cb9e6701b6bdeb4caf63d76b209f6b1e0fcbd9b53efff84ca01849fac3357c0","observation_id":"f47bebc3-c92b-443b-bc4b-afaeefae4734","resolution":{"observed_at":"2026-08-16T11:30:22.945400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.934225Z","title":null,"venue":null,"work_id":"98c8aac7-dc81-4bbb-b901-8070e3321c7c","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.933475Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:ae93182aa39d3507d861cbe00eb7e60554b5f87e6bd1d4dec8ebdb18480e776f","observation_id":"efcf059c-7b89-4dc5-b1fd-faa44c06590f","resolution":{"observed_at":"2026-08-16T11:30:22.937324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17170","last_updated":"2025-05-28T11:20:49Z","snapshot_observed_at":"2026-08-18T00:32:34.978260Z","submitted_at":"2024-11-26T07:19:26Z","title":"Overcoming Non-monotonicity in Transducer-based Streaming Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17170","snapshot_observed_at":"2026-08-16T11:30:21.937008Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.937008Z"},"links":{"cited_paper":"/paper/2411.17170","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:db142abaff2e741fcc06191d49a9c0dd22edbdcc41c990a5cf6fddfddc03c4a6","observation_id":"e979dbd3-84b2-44fc-a552-5625e57c4a24","resolution":{"observed_at":"2026-08-16T11:30:21.937008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-16T13:28:24.886213Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-16T11:30:21.941410Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.941410Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:fd9d71f6573ecfc4053497bfcb7edf4d52aeec922521fc9c6b2f8c7223f0e1ac","observation_id":"2cc726c3-a956-4c4b-a178-b6f894a9ff56","resolution":{"observed_at":"2026-08-16T11:30:21.941410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-16T14:18:48.581750Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-16T11:30:21.944933Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.944933Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:ac7121d10414a70c03d77704c0534ebbf8b752db7fa1c0d8c30890950bb81762","observation_id":"2f93cee4-dfda-4f7c-8d57-6d4138a8e0e3","resolution":{"observed_at":"2026-08-16T11:30:21.944933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2005.86077","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.299021Z","title":"Nakamura, K","venue":null,"work_id":"4ac92a16-b6c3-4e0e-a578-e7533e3cc9b4","year":2006},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.949513Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:c6087465a1a846fdce9d41484365146f56f4d8cb1193345f9638d9956fdf4737","observation_id":"6c6de837-4548-4bb8-8c9f-12fa4bcca723","resolution":{"observed_at":"2026-08-16T11:30:22.304038Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.925593Z","title":null,"venue":null,"work_id":"e5abee13-aacb-42b6-ba16-9428f9c31a6f","year":2019},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.953138Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:fb3cea54b0ea899ad8b98a4615f904281b7d8ef910c87335950d2c8aa8ddcbee","observation_id":"b82bc677-9b78-401f-b720-f78e1dd3f783","resolution":{"observed_at":"2026-08-16T11:30:22.928610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.916985Z","title":null,"venue":null,"work_id":"3f295d60-1fba-4c73-9aa5-c3da9da60f2f","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.957351Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:c8e11a17b24fc4bea5311627dc22de8912cc33d0d6d21aa02336d519d19599a4","observation_id":"fbd4629b-0022-4ea4-a531-060601d46f23","resolution":{"observed_at":"2026-08-16T11:30:22.920019Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.908172Z","title":null,"venue":null,"work_id":"7cc4e51b-e76e-424b-95dc-2730bf43fb4a","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.960605Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:8329edf16d1001d421259e6db934dadd76c94f545804b13457b5151736d0921f","observation_id":"d7be8921-fce8-4cfa-a26d-baa2191a10b8","resolution":{"observed_at":"2026-08-16T11:30:22.911325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.899095Z","title":null,"venue":null,"work_id":"fe52984f-42f4-4aad-8b3e-8947632757d6","year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.963638Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:558d58d37417bc26d1ad1732dda410f6b0d43788975a84b9b17a2e53a3f36896","observation_id":"043a74c8-4752-4e09-928f-28aafe047544","resolution":{"observed_at":"2026-08-16T11:30:22.902149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.888840Z","title":null,"venue":null,"work_id":"2a29d142-07c5-4071-9811-b94279bdf20a","year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.966930Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:89b09cbcd2c8659b30d71acbf2c17cd1be225e2643e0c33d65b9234f4d270b2a","observation_id":"a9d66e1f-7aea-4400-8c3e-f7453b1df453","resolution":{"observed_at":"2026-08-16T11:30:22.892468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.878580Z","title":null,"venue":null,"work_id":"8fb10fd9-7fe9-44da-9bcb-e72860551ace","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.970084Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:14fe02af7afa4cd21baae4e63650dc6ba141fd1cb5d345d1f6b96cf1cda760ee","observation_id":"d1436563-400c-42d0-bc78-04506a3f17f6","resolution":{"observed_at":"2026-08-16T11:30:22.881734Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.868669Z","title":null,"venue":null,"work_id":"a6946f40-29cf-41e3-ab38-07f3f3d48a5e","year":2018},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.973020Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:0949616a837798742bc6fb50ee66935555fd158dd47bfb3d8b4fcaf3370e8421","observation_id":"6769b5bc-0a37-4e61-ac85-73d06f6d6686","resolution":{"observed_at":"2026-08-16T11:30:22.872206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.858183Z","title":null,"venue":null,"work_id":"0f020b4b-830d-4099-9d2a-456df012ccac","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.976478Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:aee1724b471f36e0a63b2f5a4d87e310ade7bf5b78c6ea8334d5f85030f55c8c","observation_id":"583bd262-0582-47eb-a885-ea54ec3ca5bc","resolution":{"observed_at":"2026-08-16T11:30:22.861882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.847870Z","title":null,"venue":null,"work_id":"e297a335-c1be-40e7-9779-eb7c302e3c77","year":2020},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.980143Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:cf548abae1f6cad750c3d0bb3eaa9cae9668927b31ad84772ef900781836fce9","observation_id":"0e96a829-0307-403f-a35f-0dfe031a699c","resolution":{"observed_at":"2026-08-16T11:30:22.851361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-16T11:30:21.983415Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.983415Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:54fa3c6f40d5616e8fa3f120fa08ff9d75e5db40b214dd86daabbebdcf01ba63","observation_id":"11969274-70b7-4034-aa88-7e2c157bb1eb","resolution":{"observed_at":"2026-08-16T11:30:21.983415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09569","last_updated":"2024-06-13T20:20:29Z","snapshot_observed_at":"2026-08-21T21:21:42.778420Z","submitted_at":"2024-06-13T20:20:29Z","title":"Speech ReaLLM -- Real-time Streaming Speech Recognition with Multimodal LLMs by Teaching the Flow of Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09569","snapshot_observed_at":"2026-08-16T11:30:21.987145Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.987145Z"},"links":{"cited_paper":"/paper/2406.09569","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:15cfeb322b03f3432f71aeefc2ed85e07f84bdc7fd2ed3b81b615e7678a8a3d0","observation_id":"941e9b85-e11f-4550-be7a-d47ea1b97949","resolution":{"observed_at":"2026-08-16T11:30:21.987145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.837708Z","title":null,"venue":null,"work_id":"9e897031-55e7-41f3-ae4e-2d8984286294","year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.990952Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:cc81e0773ef0e60cd79075ee1ec01839caabd6977ccba58d76c922c4c71caeb9","observation_id":"7096e9ae-a161-4509-8135-99ac2ab4de01","resolution":{"observed_at":"2026-08-16T11:30:22.841193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.827864Z","title":null,"venue":null,"work_id":"885b2a3f-c709-46e2-9e89-e54a64244141","year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.994268Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:5978b82f5c9804b776997dd487b5ece8977981b5c84959fdb3d7369bb5d16a00","observation_id":"7e3dcaf1-b664-4346-a461-d35ccbdef16e","resolution":{"observed_at":"2026-08-16T11:30:22.831203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-16T11:30:21.997461Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:21.997461Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:f1f3a77d11b470d829c3d2686a8f6dc7a606275edd9ff758e17c07bef431900e","observation_id":"03afa1de-3061-4848-85fb-65db5f94c8da","resolution":{"observed_at":"2026-08-16T11:30:21.997461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16107","last_updated":"2024-08-01T13:55:54Z","snapshot_observed_at":"2026-08-21T21:21:47.908638Z","submitted_at":"2024-06-23T13:50:08Z","title":"Decoder-only Architecture for Streaming End-to-end Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16107","snapshot_observed_at":"2026-08-16T11:30:22.001244Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.001244Z"},"links":{"cited_paper":"/paper/2406.16107","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:09d85d02ee9cd8e4261176542627e298c05f01dda4aba154781c0dae6cdcd5c9","observation_id":"821afaf1-fa38-4854-bf93-c572627d5498","resolution":{"observed_at":"2026-08-16T11:30:22.001244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.004997Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.004997Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:d95c8028415375195883cf2488b86c219076a500de4cd74f892b1791c8cdda83","observation_id":"66c99ed8-3f84-47b4-b65c-426871172479","resolution":{"observed_at":"2026-08-16T11:30:22.004997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-16T11:30:22.008703Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.008703Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:03f945a5d0977f9d7040f113f618eeb2d7599ae5b2746174995e3735643e49ee","observation_id":"38c028fd-a263-4853-928b-34b731e8a068","resolution":{"observed_at":"2026-08-16T11:30:22.008703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.012715Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.012715Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:2782566971a06214695fbf3b12517fb82e1e4ce533c98bd474b031e82ac170de","observation_id":"1b116500-2f0e-46c2-a534-13f94a188c22","resolution":{"observed_at":"2026-08-16T11:30:22.012715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16725","last_updated":"2024-11-05T02:24:18Z","snapshot_observed_at":"2026-08-20T16:00:12.325133Z","submitted_at":"2024-08-29T17:18:53Z","title":"Mini-Omni: Language Models Can Hear, Talk While Thinking in Streaming","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16725","snapshot_observed_at":"2026-08-16T11:30:22.016076Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.016076Z"},"links":{"cited_paper":"/paper/2408.16725","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:29ac231ff79812f79d2be7aab2ec2efa1f377d810734bb960a4cc72d3ec36f10","observation_id":"e236cd79-280d-4f0a-9e3b-e4e779f16c9e","resolution":{"observed_at":"2026-08-16T11:30:22.016076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.817820Z","title":null,"venue":null,"work_id":"28dd1e79-9f5b-47ab-8e18-90898a589671","year":2022},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.019598Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:27998a9a7be9623aa124669638d0a7444a9dae249b3e8eb47ee52e46235a4aaf","observation_id":"b97d24be-8d59-4e0a-8da4-d5d460eaf268","resolution":{"observed_at":"2026-08-16T11:30:22.821355Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.022873Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.022873Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:9fa32459aaa7999630daa467e92c20db304465aa7953813d01b766c75a3732d3","observation_id":"0743d5fb-12ef-4fb3-ab4c-f04b06efa38d","resolution":{"observed_at":"2026-08-16T11:30:22.022873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.807156Z","title":null,"venue":null,"work_id":"d09311e7-4621-4120-9db0-ddec96ce1960","year":2021},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.025941Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:1771c271678488c94f74b34c3067ca7ab76c643764126f98915b9a589350ed39","observation_id":"7e321446-9b02-4c73-ab65-d59243ead020","resolution":{"observed_at":"2026-08-16T11:30:22.810683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12226","last_updated":"2025-09-08T07:04:17Z","snapshot_observed_at":"2026-08-19T05:12:40.917141Z","submitted_at":"2024-02-19T15:33:10Z","title":"AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12226","snapshot_observed_at":"2026-08-16T11:30:22.029152Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.029152Z"},"links":{"cited_paper":"/paper/2402.12226","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:39002db9e7adce0865de89eef33c74e77f4cfc3a5aa08792b2dcb131ead3ef22","observation_id":"e47b48b0-45f7-4edf-a193-335666fc990b","resolution":{"observed_at":"2026-08-16T11:30:22.029152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.033001Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.033001Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:a909725052ee9e9233dc299cdacb826612be393f5621223fb9f782484e93c31f","observation_id":"3be97780-8cf1-4679-8c15-065a3ad2f75e","resolution":{"observed_at":"2026-08-16T11:30:22.033001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.036397Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.036397Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:67e1aca3347fd1efe039b0af83f7ca419c2c560ece7e80d72e08201d317dc7ee","observation_id":"08bbad02-3a4e-4942-86e1-eaa901967cdd","resolution":{"observed_at":"2026-08-16T11:30:22.036397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03298","last_updated":"2024-10-04T10:21:15Z","snapshot_observed_at":"2026-08-16T13:12:38.731269Z","submitted_at":"2024-10-04T10:21:15Z","title":"Textless Streaming Speech-to-Speech Translation using Semantic Speech Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03298","snapshot_observed_at":"2026-08-16T11:30:22.039696Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.039696Z"},"links":{"cited_paper":"/paper/2410.03298","citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:6ce983642a91e2dd5cedcfca33bc3d01270558069a552127bfb7514e77590d6d","observation_id":"6e6d0dba-9929-4f7e-bcb0-8df82e47f975","resolution":{"observed_at":"2026-08-16T11:30:22.039696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.042967Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.042967Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:14b9fb3ef51c92c73e6ab1d8372b7502ee832eaec67881af06df2c1e005d1300","observation_id":"8aa14f9a-8265-4265-a131-6c05cbcdcace","resolution":{"observed_at":"2026-08-16T11:30:22.042967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:30:22.046679Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-16T11:30:22.046679Z"},"links":{"citing_paper":"/paper/2504.15509"},"observation_digest":"sha256:cadf780bd2d690d558ea40d43c891ac4e9b4e00953462a426154cd7dea833029","observation_id":"55c167b8-e84d-4b0b-8136-4b7860251234","resolution":{"observed_at":"2026-08-16T11:30:22.046679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.15509","last_updated":"2025-04-22T01:05:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T18:21:34.488020Z","submitted_at":"2025-04-22T01:05:32Z","title":"SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":70,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 1 inbound Pith citation observation for arXiv:2504.15509."}