{"as_of":"2026-08-15T13:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:055e4d920684f682109f4b7da64bf1de3a6c5c8741c095120baa00d2f382e7cf","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:23:38.975972Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.15333/citation-record","integrity":"/paper/2505.15333/integrity","json":"/paper/2505.15333/citation-record.json","paper":"/paper/2505.15333"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:42.234768Z","title":null,"venue":null,"work_id":"7143d4cf-0870-4d63-8913-2de243d89706","year":2006},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:33.961350Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:2055784fb10a0b9cc4084c5e38c18f2ef72a63569b1bbb66fa9b38f19d8ed31c","observation_id":"24a26a74-a17e-4cc6-b8da-378701b8bfde","resolution":{"observed_at":"2026-08-07T15:23:42.276541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11596","last_updated":"2023-10-25T03:52:07Z","snapshot_observed_at":"2026-08-14T20:49:45.201003Z","submitted_at":"2023-08-22T17:44:18Z","title":"SeamlessM4T: Massively Multilingual & Multimodal Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11596","snapshot_observed_at":"2026-08-07T15:23:34.047631Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:34.047631Z"},"links":{"cited_paper":"/paper/2308.11596","citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:97e4811a9cb2efbd34fc116907a9db6ce079920d167ed2361dccc84e1e7aadc2","observation_id":"ee3275d6-d85a-4b62-acc5-4d530c13db39","resolution":{"observed_at":"2026-08-07T15:23:34.047631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:42.152773Z","title":null,"venue":null,"work_id":"2f957cce-9853-4b4a-9682-a8b79f4a6a8e","year":2004},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:34.163803Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:bd7e8820406acc1f2f7b6ba86956510a1e78d9564dcabe9e14e02be8f2fcaa77","observation_id":"3e9485c9-9ae1-4dd7-9605-098d145e990d","resolution":{"observed_at":"2026-08-07T15:23:42.185127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01211","last_updated":"2015-08-20T00:38:43Z","snapshot_observed_at":"2026-08-14T22:37:33.413960Z","submitted_at":"2015-08-05T20:17:58Z","title":"Listen, Attend and Spell","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01211","snapshot_observed_at":"2026-08-07T15:23:34.281997Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:34.281997Z"},"links":{"cited_paper":"/paper/1508.01211","citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:399522b9464eb519017607234d3528eb2b1a2899013805ce9ce9363f22cf0507","observation_id":"b7dc1772-fa5f-4ae5-8a4c-75c29f254617","resolution":{"observed_at":"2026-08-07T15:23:34.281997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.307","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"c7c8138f-3ca4-40a1-96e6-8f3e3ad0907c","year":2023},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:34.438190Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:c95d6965d737133d48be2748126702440ecdf4fbeddcc5a2c76d06ce8a2b0331","observation_id":"8b6ac37a-9536-4bb0-a5e9-f010193058d5","resolution":{"observed_at":"2026-08-07T15:23:40.350037Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2022-10011","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Interspeech 2022","work_id":"c1e7c7e8-254e-4bc3-8c74-27e958805c7f","year":2022},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:34.581757Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:49b8bef3e0c96e69d0e5a4e809fa9ff2de72885a03645048f86921eb255c0010","observation_id":"d90c2344-7b6c-4be1-a005-97e5c003bf55","resolution":{"observed_at":"2026-08-07T15:23:40.251590Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07403","last_updated":"2023-10-11T11:39:36Z","snapshot_observed_at":"2026-08-13T05:52:16.036814Z","submitted_at":"2023-10-11T11:39:36Z","title":"DASpeech: Directed Acyclic Transformer for Fast and High-quality Speech-to-Speech Translation","version":1},"cited_work":{"arxiv_id":"2310.07403","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.07403","snapshot_observed_at":"2026-08-07T15:23:40.705328Z","title":"DASpeech: Directed Acyclic Transformer for Fast and High-quality Speech-to-Speech Translation","venue":"cs.CL","work_id":"46878afe-c954-45c8-8f81-3d463ef3f633","year":2023},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:34.726268Z"},"links":{"cited_paper":"/paper/2310.07403","citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:7939addad274eecd1e8ce77367b79688d013fa2896bcf0b77d1745371e719e69","observation_id":"f768286a-c929-44a4-964f-64bb3ec202f6","resolution":{"observed_at":"2026-08-07T15:23:40.806206Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:34.886270Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:34.886270Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:b2b40c33a15ef5fd22d37d072897be1d055b2759e3485507a3bf3d9a2138ca17","observation_id":"1607e00e-7ff6-4898-a1e5-6fa6416ec808","resolution":{"observed_at":"2026-08-07T15:23:34.886270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:35.043000Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:35.043000Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:9abaa964449b5bdfcb049f1c48560c9bcd83c2b747bcb18f15d5b0b4fa17c70b","observation_id":"5cc9e8db-ef32-47e2-8d65-832c3e721b82","resolution":{"observed_at":"2026-08-07T15:23:35.043000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:41.972175Z","title":null,"venue":null,"work_id":"87c87e27-34aa-4181-a533-82e8c2e33ceb","year":2022},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:35.212650Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:65245cb42348583ec8570b6fb4f8ab298094b4e8af2b5679057e0fb702825ab8","observation_id":"f557dfea-c812-4f7a-8d77-d4421e24f703","resolution":{"observed_at":"2026-08-07T15:23:42.061084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:35.344774Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:35.344774Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:0057abb974d1c10cc307011ccaa2b9088c504e48ed0aa2f03b19ad49914a6228","observation_id":"688350fe-ac58-4e19-ab64-677a08594b82","resolution":{"observed_at":"2026-08-07T15:23:35.344774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:35.477936Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:35.477936Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:cb2b3566eaad4ea66345706234fedacb86ab9b4e34b0ff856f5a1edb3ea16126","observation_id":"3065fdb7-d660-4c18-a15e-69ef7da8a8d3","resolution":{"observed_at":"2026-08-07T15:23:35.477936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:41.852070Z","title":null,"venue":null,"work_id":"379f7954-c98d-4425-bc17-6ca06ff6ae78","year":2021},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:35.660575Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:02d659e950c5c2046cea9d7f81183bfac2fd1da546acc8a43920c444b8413ed3","observation_id":"8a358b91-6bac-44b2-a35d-bd5d99b913ab","resolution":{"observed_at":"2026-08-07T15:23:41.913008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2019-1951","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Weiss, Fadi Biadsy, Wolfgang Macherey, Melvin Johnson, Zhifeng Chen, and Yonghui Wu","venue":null,"work_id":"ac7ea8d1-abbb-4591-b838-69c48889bd1d","year":2019},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:35.853628Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:a1bd7415178587fd1be7c44f83bdaf6419423fd85797c018519d7cb8748165b1","observation_id":"04c4e7cd-23c0-4a54-b457-471c01ad0473","resolution":{"observed_at":"2026-08-07T15:23:40.128246Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:41.747615Z","title":null,"venue":null,"work_id":"f81815cf-ffe2-46ba-8c75-d4633fae6ce0","year":2020},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:35.968814Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:d2c19e08d79243146bf6618386110aa3d3ce93cc3c02437cd598d5803bc0f3c6","observation_id":"55dfa6e9-b78f-44e4-bdfa-222396213c61","resolution":{"observed_at":"2026-08-07T15:23:41.807432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:36.125818Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:36.125818Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:85122c1c3d9bc1d2fadc275cfe715910f1ea2ec184c176d63a3f166aa820a2a7","observation_id":"a34c12cc-ca37-44d1-bd90-057b6fd1eca8","resolution":{"observed_at":"2026-08-07T15:23:36.125818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.235","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"de39afeb-4f2b-4656-82a7-7d33a0a30608","year":2022},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:36.301495Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:8ba57d3287beb95215d991d00c68f5e112637da2c508fb5ed4e844da5a1845ad","observation_id":"e17d6bd8-af32-4bc7-8ed7-c413d9a340c2","resolution":{"observed_at":"2026-08-07T15:23:39.947323Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.naacl-main.63","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the 2022 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies","work_id":"08bf5fa4-6255-4e5e-a92d-0c07d673250f","year":2022},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:36.478888Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:e0b20db72c35fcfd75eae84a06735106a07174e98baf30421c06b6870e02e4a1","observation_id":"0d9475f3-5be0-4a57-a2a0-0926e8b8be5b","resolution":{"observed_at":"2026-08-07T15:23:39.778842Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:36.688445Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:36.688445Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:0a41e2f4644bd6cc9febe848eaf0e152ac4ab12a4a5bee727f229e1770cd9c5a","observation_id":"71cd469a-37be-4524-853f-2c2f464b1dd7","resolution":{"observed_at":"2026-08-07T15:23:36.688445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00355","last_updated":"2021-07-27T14:27:27Z","snapshot_observed_at":"2026-08-14T02:22:39.819958Z","submitted_at":"2021-04-01T09:20:33Z","title":"Speech Resynthesis from Discrete Disentangled Self-Supervised Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.00355","snapshot_observed_at":"2026-08-07T15:23:36.807644Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:36.807644Z"},"links":{"cited_paper":"/paper/2104.00355","citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:70883954b94f6116881293dbf03c6ab193f422c760e7e64ba38b88a36ecc4d58","observation_id":"8ba4543b-61f2-4dbe-acb1-fd092834efb4","resolution":{"observed_at":"2026-08-07T15:23:36.807644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2022-11032","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Interspeech 2022","work_id":"3f2adea3-8e3b-4f77-bc4b-670a4fead0f9","year":2022},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:36.967802Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:605204c7c8da7cf600c408cdf4092094d493cd27986f668b9402a05b6618620f","observation_id":"871589f0-2fe1-41c6-9968-430d95dc4d75","resolution":{"observed_at":"2026-08-07T15:23:39.572449Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:37.098497Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:37.098497Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:5a6f1bcf76e1f6ec08945ea7a8526d5106b8af04d2714a6ce9f834dc7239173a","observation_id":"69afaaf3-cc30-44a5-a659-380caa844325","resolution":{"observed_at":"2026-08-07T15:23:37.098497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:41.547502Z","title":null,"venue":null,"work_id":"252f23f4-db57-4414-8a19-67039bdc2010","year":2024},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:37.238562Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:410f4f1cbe2fa87de88c301405ecadb37053171910fd2c01bf2141f6bd4cbcd1","observation_id":"c37c7e05-5e4f-4dcb-b063-8504109c4a26","resolution":{"observed_at":"2026-08-07T15:23:41.625637Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2023-648","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"6b1a9cec-6cdd-409f-99d6-7dc54b6e6a7a","year":2023},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:37.442871Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:c7664642f2230ae550ad8f28536bce90efad1f7d2970aba220484b7dcbe05da4","observation_id":"d24169a8-3ed8-438b-bb41-b1fdc59bbe88","resolution":{"observed_at":"2026-08-07T15:23:39.409995Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:37.650407Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:37.650407Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:38d37099b72ea80591e21eac7e3186575e705fddb1b1091bf5f91ab851ac484f","observation_id":"70891645-dbb1-4009-baa0-2f1ecff393b9","resolution":{"observed_at":"2026-08-07T15:23:37.650407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:37.790591Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:37.790591Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:28fbaedba2e73e38442f481905f0a0c42b8cb007cfb8e3b5256174888b5327a5","observation_id":"e0b28780-3a6d-443f-8942-149d3c763362","resolution":{"observed_at":"2026-08-07T15:23:37.790591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:41.343275Z","title":null,"venue":null,"work_id":"ab1996eb-be2e-4e23-9a55-ab448ef0c0ff","year":1997},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:37.921397Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:9bd9b8d1e68d63bda7d928debaf11f1ba4c3c845bcbb5e6062012371eed4376c","observation_id":"e858826c-21be-48bd-8288-2ecdb91d07c0","resolution":{"observed_at":"2026-08-07T15:23:41.424923Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:38.089150Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:38.089150Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:17686d39b8965ca20aec6d10aff98078cfa76a7f476eeb2387c73ed235b0d208","observation_id":"240f8ff4-5837-4beb-9a38-f8c126addb86","resolution":{"observed_at":"2026-08-07T15:23:38.089150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:41.141024Z","title":null,"venue":null,"work_id":"409a92f9-519c-4c4b-b017-f4d35b38c756","year":2023},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:38.237502Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:f2b432723c3ea7328740745d81a5c3c124fae0c0af31d9554f00326f02d51647","observation_id":"fdef918c-2891-430b-9638-2825f249937b","resolution":{"observed_at":"2026-08-07T15:23:41.240065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-long.204","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"9cf751e3-2ebf-478d-b6c6-bd0dc5e3b9d4","year":2021},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:38.381648Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:3b8ac52db8040d579dced1b4c23554b825850dea13e613ba2e0dc756f253cda7","observation_id":"94ad6484-af20-46c2-bf89-29aec0b2eab9","resolution":{"observed_at":"2026-08-07T15:23:39.200783Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:40.969919Z","title":null,"venue":null,"work_id":"c44e44a5-5121-43c6-875d-ecaa8e717e9f","year":2020},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:38.576173Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:dd8f9be54e2567e1f8275cf545faadde977aa9f0da49ece98c550d00d425ce55","observation_id":"9fc0f656-7b64-475a-a604-89fe17a271db","resolution":{"observed_at":"2026-08-07T15:23:41.039092Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:38.720790Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:38.720790Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:8ff2e57a7381f382a6c22ca04b066857ee47f13e005b2fc14c0ca6ce4a2283a2","observation_id":"59d9d040-5dce-4faa-b018-19b10c0a1a68","resolution":{"observed_at":"2026-08-07T15:23:38.720790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:38.861560Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:38.861560Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:ef3f2a5fdacc27a0fe1f4366d14858f64e105d37e25718331bcb7c1873704cc0","observation_id":"73015273-84a2-43c3-b93a-fddc8bf44ccd","resolution":{"observed_at":"2026-08-07T15:23:38.861560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:23:38.975972Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:38.975972Z"},"links":{"citing_paper":"/paper/2505.15333"},"observation_digest":"sha256:e5224c84b3289ee8b01833d6f5828056dbcf98c5c1447403ef32f3f4b611726f","observation_id":"8880101e-e023-49b2-b8bc-a8d180a45b36","resolution":{"observed_at":"2026-08-07T15:23:38.975972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.15333","last_updated":"2025-05-21T10:05:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T11:02:18.364751Z","submitted_at":"2025-05-21T10:05:25Z","title":"Leveraging Unit Language Guidance to Advance Speech Modeling in Textless Speech-to-Speech Translation"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2505.15333."}