{"as_of":"2026-08-10T06:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86545d0a6d5d4203fb892a06039a535edef97dd51eee45584638208854a8259d","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:58:44.194819Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T05:50:33.363981Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06343","snapshot_observed_at":"2026-08-01T05:50:33.363981Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22100","last_updated":"2026-07-24T08:52:44Z","snapshot_observed_at":"2026-08-08T14:23:38.469443Z","submitted_at":"2026-07-24T08:52:44Z","title":"MEUSLI: a Multilingual Projector for LLM-based ASR and Beyond","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T05:50:33.363981Z"},"links":{"cited_paper":"/paper/2506.06343","citing_paper":"/paper/2607.22100"},"observation_digest":"sha256:a2bfc3ef18673c9e844bfde8389d7946f257b50ff95213f1b0d8d55f41fd1788","observation_id":"1302492f-f91d-49b9-82bd-e80a90afee7b","resolution":{"observed_at":"2026-08-01T05:50:33.363981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06343/citation-record","integrity":"/paper/2506.06343/integrity","json":"/paper/2506.06343/citation-record.json","paper":"/paper/2506.06343"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-07T11:58:40.491594Z","title":"Moshi: a speech-text foundation model for real-time dialogue,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:40.491594Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:41447dc28542211a406bb050c999cae433236d702f7052eb09ae9487ea795d28","observation_id":"c806618a-d343-424a-993a-e6ff54626dfd","resolution":{"observed_at":"2026-08-07T11:58:40.491594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-08-09T11:59:10.408717Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-07T11:58:40.561463Z","title":"Phi-4-mini technical report: Compact yet powerful multimodal language models via mixture- of-loras,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:40.561463Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:418cdf3d0ec2f2438298127204a0968d1e1c582af9f46faf4569c755a99acf50","observation_id":"cb7aac0f-dd7d-4a7b-b1c4-2e3a9c3bc669","resolution":{"observed_at":"2026-08-07T11:58:40.561463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-07T11:58:40.684392Z","title":"Qwen2-audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:40.684392Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:ea064cbb1a536cb7416792cb4b1a763df4af5c4f197b135048aaac002611eac7","observation_id":"4a70dcad-3b11-496f-98e0-1fda8883fab2","resolution":{"observed_at":"2026-08-07T11:58:40.684392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:40.810890Z","title":"Baichuan-omni-1.5 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:40.810890Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:a8f4ed2bd6f475d04a6e786f1ce8fb3538a4083fe7ce99c0a5fbbaab1518fa2e","observation_id":"631d0733-5633-44b9-8519-626565e9a63e","resolution":{"observed_at":"2026-08-07T11:58:40.810890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06666","last_updated":"2025-03-01T12:59:49Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:34:34Z","title":"LLaMA-Omni: Seamless Speech Interaction with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06666","snapshot_observed_at":"2026-08-07T11:58:40.924179Z","title":"Llama-omni: Seamless speech interaction with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:40.924179Z"},"links":{"cited_paper":"/paper/2409.06666","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:c8f3d02497ca65181a90cb0bf7ff4a6cdac3701e350792cc9b2c34497210703e","observation_id":"076e0b54-13c8-48fa-aa92-1a3b5b45342a","resolution":{"observed_at":"2026-08-07T11:58:40.924179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00774","last_updated":"2024-12-08T05:41:56Z","snapshot_observed_at":"2026-08-04T02:03:05.931925Z","submitted_at":"2024-11-01T17:59:51Z","title":"Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00774","snapshot_observed_at":"2026-08-07T11:58:41.015033Z","title":"Freeze-omni: A smart and low latency speech-to-speech dialogue model with frozen llm,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:41.015033Z"},"links":{"cited_paper":"/paper/2411.00774","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:496b6d675a17cb52a185bb9f40b4775721010de043089432167aa15fb69362a2","observation_id":"0e806ba7-755f-4f05-b107-ee54be2e91b8","resolution":{"observed_at":"2026-08-07T11:58:41.015033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00916","last_updated":"2024-05-28T14:26:28Z","snapshot_observed_at":"2026-07-06T16:13:34.788427Z","submitted_at":"2023-09-02T11:46:05Z","title":"BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00916","snapshot_observed_at":"2026-08-07T11:58:41.157874Z","title":"Blsp: Bootstrapping language-speech pre-training via behavior align- ment of continuation writing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:41.157874Z"},"links":{"cited_paper":"/paper/2309.00916","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:bf927f92b504c2719a64c7e29fb1f20d11a10a0bedfce3e26e32dfc38a222bc8","observation_id":"123184ec-ddfa-45d5-854a-097c2d554f96","resolution":{"observed_at":"2026-08-07T11:58:41.157874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02769","last_updated":"2025-06-04T08:53:07Z","snapshot_observed_at":"2026-08-07T17:29:58.036368Z","submitted_at":"2025-03-04T16:34:14Z","title":"InSerter: Speech Instruction Following with Unsupervised Interleaved Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02769","snapshot_observed_at":"2026-08-07T11:58:41.275667Z","title":"Inserter: Speech instruction following with unsupervised interleaved pre-training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:41.275667Z"},"links":{"cited_paper":"/paper/2503.02769","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:c9ce68a26e9f418a420db486389d3edaac0e5436b770ec317842b03227c431d8","observation_id":"bed4a7ab-c49e-4df2-8453-db75df57dc7e","resolution":{"observed_at":"2026-08-07T11:58:41.275667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02678","last_updated":"2024-10-03T17:04:48Z","snapshot_observed_at":"2026-08-07T07:21:28.700705Z","submitted_at":"2024-10-03T17:04:48Z","title":"Distilling an End-to-End Voice Assistant Without Instruction Training Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02678","snapshot_observed_at":"2026-08-07T11:58:41.386187Z","title":"Distilling an end-to-end voice assistant without instruction training data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:41.386187Z"},"links":{"cited_paper":"/paper/2410.02678","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:240e6e3f692f4783c2e481284806f35d1ea9600ec99ec59bbb0cce472409fe51","observation_id":"3fec8c50-3c76-4ff4-837a-7c90a0fa5985","resolution":{"observed_at":"2026-08-07T11:58:41.386187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17417","last_updated":"2025-05-23T03:05:47Z","snapshot_observed_at":"2026-08-10T04:48:50.903321Z","submitted_at":"2025-05-23T03:05:47Z","title":"Speechless: Speech Instruction Training Without Speech for Low Resource Languages","version":1},"cited_work":{"arxiv_id":"2505.17417","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17417","snapshot_observed_at":"2026-08-07T11:58:44.561636Z","title":"Speechless: Speech Instruction Training Without Speech for Low Resource Languages","venue":"eess.AS","work_id":"fb047d49-2daa-4f8f-83a6-13e06715a80c","year":2025},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:41.531921Z"},"links":{"cited_paper":"/paper/2505.17417","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:3ccd4986af4706a89e3e05ea2080ac22649938a45544b2ce0f6f746e282e1a01","observation_id":"6df42d5f-d314-4609-a221-5560619ae578","resolution":{"observed_at":"2026-08-07T11:58:44.627131Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07205","last_updated":"2022-05-24T08:18:31Z","snapshot_observed_at":"2026-08-09T22:54:40.370971Z","submitted_at":"2021-10-14T07:59:27Z","title":"SpeechT5: Unified-Modal Encoder-Decoder Pre-Training for Spoken Language Processing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07205","snapshot_observed_at":"2026-08-07T11:58:41.673699Z","title":"Speecht5: Unified-modal encoder-decoder pre-training for spoken language processing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:41.673699Z"},"links":{"cited_paper":"/paper/2110.07205","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:dfca73b7f80cadad26e244af95f4d8c589ce16d83107bdf25346e074018d2171","observation_id":"4e0f11e2-22a8-4db6-94d5-26769db66329","resolution":{"observed_at":"2026-08-07T11:58:41.673699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.10329","last_updated":"2021-10-20T00:59:36Z","snapshot_observed_at":"2026-07-06T11:59:43.025772Z","submitted_at":"2021-10-20T00:59:36Z","title":"SLAM: A Unified Encoder for Speech and Language Modeling via Speech-Text Joint Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.10329","snapshot_observed_at":"2026-08-07T11:58:41.805991Z","title":"Slam: A unified encoder for speech and language modeling via speech-text joint pre-training,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:41.805991Z"},"links":{"cited_paper":"/paper/2110.10329","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:29e600c553e778b275f097459ab3ba7cecd2ab3252960c93a4984bacd071dbf0","observation_id":"c6c26aea-4ace-4858-abee-3cebbce44cf4","resolution":{"observed_at":"2026-08-07T11:58:41.805991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.01374","last_updated":"2022-02-03T02:26:40Z","snapshot_observed_at":"2026-07-06T12:34:00.262764Z","submitted_at":"2022-02-03T02:26:40Z","title":"mSLAM: Massively multilingual joint pre-training for speech and text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.01374","snapshot_observed_at":"2026-08-07T11:58:41.929162Z","title":"mslam: Massively multilingual joint pre-training for speech and text,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:41.929162Z"},"links":{"cited_paper":"/paper/2202.01374","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:75847a0a586f224e068abd6e9b90652ed99b8fc1bc8b298e463cf2241b899aee","observation_id":"073b2990-7cce-476c-be3a-76ec126d729b","resolution":{"observed_at":"2026-08-07T11:58:41.929162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11596","last_updated":"2023-10-25T03:52:07Z","snapshot_observed_at":"2026-07-06T16:09:09.018523Z","submitted_at":"2023-08-22T17:44:18Z","title":"SeamlessM4T: Massively Multilingual & Multimodal Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11596","snapshot_observed_at":"2026-08-07T11:58:42.065571Z","title":"Seam- lessm4t: Massively multilingual & multimodal machine translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:42.065571Z"},"links":{"cited_paper":"/paper/2308.11596","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:c595cf3a10b84c57e4094e4b8481715d53e2e38a25f8fca1fe9f9110b9d31f17","observation_id":"7cc83ce2-6990-4d94-9e94-e5b4ad163fc3","resolution":{"observed_at":"2026-08-07T11:58:42.065571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-07T11:58:42.240760Z","title":"No language left behind: Scaling human-centered machine translation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:42.240760Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:9fb56760e2d2b73c884eb32b595f514833dfea146acb920db115b99844ef90c4","observation_id":"d1f7fc13-e024-4ffa-882b-2ba265f37872","resolution":{"observed_at":"2026-08-07T11:58:42.240760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:42.346892Z","title":"W2v-bert: Combining contrastive learning and masked language mod- eling for self-supervised speech pre-training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:42.346892Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:20df3360813cb870f2b9abc791ff3602a324ecf63ae713d3563b1ce16c8f878b","observation_id":"4e7d927f-2eff-4969-982b-308d2f6ec336","resolution":{"observed_at":"2026-08-07T11:58:42.346892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17196","last_updated":"2024-12-11T15:45:21Z","snapshot_observed_at":"2026-07-06T19:37:56.214143Z","submitted_at":"2024-10-22T17:15:20Z","title":"VoiceBench: Benchmarking LLM-Based Voice Assistants","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17196","snapshot_observed_at":"2026-08-07T11:58:42.482144Z","title":"V oicebench: Benchmarking llm-based voice assistants,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:42.482144Z"},"links":{"cited_paper":"/paper/2410.17196","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:a1ff5d04143a939eaa8f4c1d1f04f54fb0666d23480169ee4d05ffb15bb656d2","observation_id":"a3c87180-6074-434f-bc2e-2c9d23dd2acd","resolution":{"observed_at":"2026-08-07T11:58:42.482144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02612","last_updated":"2024-12-03T17:41:24Z","snapshot_observed_at":"2026-08-02T21:27:26.884251Z","submitted_at":"2024-12-03T17:41:24Z","title":"GLM-4-Voice: Towards Intelligent and Human-Like End-to-End Spoken Chatbot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02612","snapshot_observed_at":"2026-08-07T11:58:42.585526Z","title":"Glm-4-voice: Towards intelligent and human-like end-to-end spoken chatbot,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:42.585526Z"},"links":{"cited_paper":"/paper/2412.02612","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:590f27d08dadac886e05aa72ff0fd7c84e00e26f0ce53f470079fa5c6fd02cca","observation_id":"6ad31277-d93e-4068-a1cd-f9b30221ff29","resolution":{"observed_at":"2026-08-07T11:58:42.585526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05706","last_updated":"2024-11-28T01:10:49Z","snapshot_observed_at":"2026-07-31T16:59:06.271065Z","submitted_at":"2024-02-08T14:35:09Z","title":"Paralinguistics-Aware Speech-Empowered Large Language Models for Natural Conversation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05706","snapshot_observed_at":"2026-08-07T11:58:42.752950Z","title":"Paralinguistics-aware speech- empowered large language models for natural conversation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:42.752950Z"},"links":{"cited_paper":"/paper/2402.05706","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:a28aaec90186535ca2ac4ce776a26b0fbbb82780f0302e3d071cd2d4883c6e59","observation_id":"87aa7824-7b99-471b-86b6-de5acded7abb","resolution":{"observed_at":"2026-08-07T11:58:42.752950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:46.419027Z","title":"Spirit-lm: Interleaved spoken and written language model,","venue":null,"work_id":"5a7d7b05-2161-4913-a883-adda81382b94","year":2025},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:42.886123Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:8ba048ec72c4e0413a3c3adc6ded2c05ad5874b8277504e88df8ceb34fedc213","observation_id":"f8818343-d73f-4f41-966a-38e8a1e32526","resolution":{"observed_at":"2026-08-07T11:58:46.543567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:46.055107Z","title":"Dissecting learning and forgetting in language model finetuning,","venue":null,"work_id":"3bceb685-1080-4d43-9937-d3dadd773b9c","year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:43.012070Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:17e62ef8641591600696d60cadd4df67b3eea9c634262ed0e045e940c18231a7","observation_id":"cb7bff6c-c7a8-4840-8086-89d7b676e829","resolution":{"observed_at":"2026-08-07T11:58:46.248933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T11:58:43.136188Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:43.136188Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:2acd03a309a8a6304aaa43209625ceaf07e32df459775e09b961d768c04c4153","observation_id":"12c6ad8f-6c7b-484d-8d59-4e2841806b24","resolution":{"observed_at":"2026-08-07T11:58:43.136188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:45.788917Z","title":"Openwebtext corpus,","venue":null,"work_id":"4f50418a-26c5-435a-a3f5-bddb8ec502e7","year":2019},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:43.312559Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:dc46d179c9c525b25dae7873ac4c2eb99fb65f4a37e04d55f590c9c747fc04b7","observation_id":"e3aa62cf-f587-4f1a-a40b-15fce72d20b0","resolution":{"observed_at":"2026-08-07T11:58:45.929557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:45.507149Z","title":"Enhancing chat language models by scaling high-quality instructional conversations,","venue":null,"work_id":"d850f199-a9e0-4bfe-97d1-0187e7f677d9","year":2023},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:43.450637Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:99c661ee546263897c59ab8a5a4f189851870574a4231231eec79f885f7fbe5c","observation_id":"09a79cd4-a638-4dfc-a433-35c79d77fbd4","resolution":{"observed_at":"2026-08-07T11:58:45.639363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:45.260142Z","title":"Openhermes 2.5: An open dataset of synthetic data for generalist llm assistants,","venue":null,"work_id":"6e66bfd2-4ff4-4951-bcea-98032a8962b0","year":2023},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:43.579967Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:3cb36ff31abc0cb6425908021c88e14ce6d33ed01b9ea7d405dac44451a36508","observation_id":"46b02533-0f52-45e5-9613-d44a4c88cc04","resolution":{"observed_at":"2026-08-07T11:58:45.383713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:43.752110Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:43.752110Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:065fe32e619d7e4776d1308467fc0961daade5fa40d32d647ced4ee1f638e259","observation_id":"b10ec70f-cf80-4788-8a44-f29e9e14ff3e","resolution":{"observed_at":"2026-08-07T11:58:43.752110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:45.004595Z","title":"CommonsenseQA: A question answering challenge targeting commonsense knowledge,","venue":null,"work_id":"5b30c745-8e6d-49b2-97d0-0081db6ac79a","year":2019},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:43.896352Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:683661079ea78b569702765099c0e83f9c488b8d36b1bbada8386b07d283137a","observation_id":"dfadb9da-0797-43a0-b1b7-f9913edbc643","resolution":{"observed_at":"2026-08-07T11:58:45.100191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:58:44.064280Z","title":"Librispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:44.064280Z"},"links":{"citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:aa46081197203a9102964a5603c543482191267550f8a3078a056d510266629d","observation_id":"bb23e8f6-66ff-44a6-8976-98ff6d1c6755","resolution":{"observed_at":"2026-08-07T11:58:44.064280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.10310","last_updated":"2020-10-24T06:07:01Z","snapshot_observed_at":"2026-08-09T21:19:30.065131Z","submitted_at":"2020-07-20T17:53:35Z","title":"CoVoST 2 and Massively Multilingual Speech-to-Text Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.10310","snapshot_observed_at":"2026-08-07T11:58:44.194819Z","title":"Covost 2 and massively multilingual speech-to-text translation,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:58:44.194819Z"},"links":{"cited_paper":"/paper/2007.10310","citing_paper":"/paper/2506.06343"},"observation_digest":"sha256:5bb254c569a4aab279600504a123eaa622766cf6a3a154ba7a9dc133480f593c","observation_id":"2a8231c3-cc6a-4139-afe9-79d01fc0f81a","resolution":{"observed_at":"2026-08-07T11:58:44.194819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06343","last_updated":"2025-06-01T09:27:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T06:02:47.435740Z","submitted_at":"2025-06-01T09:27:55Z","title":"TESU-LLM: Training Speech-LLMs Without Speech via Unified Encoder Alignment"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":6},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 1 inbound Pith citation observation for arXiv:2506.06343."}