{"as_of":"2026-08-10T13:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f1b4d057d5d7ce14e808fd18b6f7baa85bd8617ebfe8603ffc83afc9b8f8339","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:41:57.488433Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:03:09.632009Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T20:59:47.893961Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"cited_work":{"arxiv_id":"2507.18119","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18119","snapshot_observed_at":"2026-08-05T20:59:47.893961Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","venue":"cs.CL","work_id":"58f461a8-b385-42cc-b7cf-1294e2d805a0","year":2025},"citing_paper":{"arxiv_id":"2508.09599","last_updated":"2026-05-23T09:18:10Z","snapshot_observed_at":"2026-08-07T16:58:22.699012Z","submitted_at":"2025-08-13T08:28:21Z","title":"BridgeTA: Bridging the Representation Gap in Knowledge Distillation via Teacher Assistant for Bird's Eye View Map Segmentation","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-05T20:59:43.785209Z"},"links":{"cited_paper":"/paper/2507.18119","citing_paper":"/paper/2508.09599"},"observation_digest":"sha256:267493e4bd05877351597f497a5bdc214a20d782abcd395aff7596ed52f744a3","observation_id":"114b1b5d-ca08-4e4f-99be-214cde165239","resolution":{"observed_at":"2026-08-05T20:59:47.953809Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18119","snapshot_observed_at":"2026-08-05T21:03:09.632009Z","title":"Language Resources and Evaluation (LREC), 42: 335–359","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09600","last_updated":"2025-09-03T13:33:34Z","snapshot_observed_at":"2026-08-10T11:32:29.120466Z","submitted_at":"2025-08-13T08:30:14Z","title":"OSUM-EChat: Enhancing End-to-End Empathetic Spoken Chatbot via Understanding-Driven Spoken Dialogue","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:09.632009Z"},"links":{"cited_paper":"/paper/2507.18119","citing_paper":"/paper/2508.09600"},"observation_digest":"sha256:554d07c725ebb99f0b71273b77beabf8e9adb0ea45e59745ca31068173599672","observation_id":"5affa23d-c094-4c16-896c-d006ce8796cc","resolution":{"observed_at":"2026-08-05T21:03:09.632009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18119/citation-record","integrity":"/paper/2507.18119/integrity","json":"/paper/2507.18119/citation-record.json","paper":"/paper/2507.18119"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.910354Z","title":"On the landscape of spoken language models: A comprehensive survey,","venue":null,"work_id":"635298b0-0316-44c9-9d94-a07e0b3889b9","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.365862Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:36f22b06c6a97244356162f38c7804b0ff009874e5b9842f08e3ada6eae1207f","observation_id":"eb64e32c-ff90-48d9-b9f2-575e4fb635e2","resolution":{"observed_at":"2026-08-06T14:41:57.914459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.897274Z","title":"Speechgpt: Empowering large language models with intrinsic cross-modal conversational abilities,","venue":null,"work_id":"7d9d1a5a-5e88-42cb-b308-792221fa23af","year":2023},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.371356Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:e720460b05b2113a589003e24a506725532f5c80e0a377356e294970b2d4f12b","observation_id":"68bbeba8-9c7c-467d-b81d-bd99ce2c822f","resolution":{"observed_at":"2026-08-06T14:41:57.901450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.884315Z","title":"Moshi: a speech-text foundation model for real-time dialogue,","venue":null,"work_id":"ad3aa688-3187-4ee2-bcae-9e1522ff1eb4","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.376159Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:66f46bd38792cc23e8abdf9aeafe468a390ebad420cbad802c4a8411f05695a2","observation_id":"24041366-a50b-40ad-a380-5a6e1234c62c","resolution":{"observed_at":"2026-08-06T14:41:57.888581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.871700Z","title":"Speechgpt 2.0-preview,","venue":null,"work_id":"5bd7e0ca-e9a0-47a3-8124-a77acc4dc533","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.381247Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:83a91234434b81f5e9fda48a57722842fce5e56d5fa0e4a9ddb956b3d658246b","observation_id":"72c5bfa6-bcc3-430b-a2bc-3d0e4a717200","resolution":{"observed_at":"2026-08-06T14:41:57.875689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.858647Z","title":"Llama-omni: Seamless speech interaction with large language models,","venue":null,"work_id":"02d4f530-a780-459b-9a2a-b56795b9014f","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.385844Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:21a707db6e4fc849f38c08115e65c165bf7b01f2d17b7b92b61ad5e7fb1610a0","observation_id":"938b6b44-702d-478d-a7f9-d18e29f44c28","resolution":{"observed_at":"2026-08-06T14:41:57.862931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.845155Z","title":"Freeze-omni: A smart and low latency speech-to-speech dialogue model with frozen LLM,","venue":null,"work_id":"299d8cd3-a4f1-4562-869e-f4ecd8a5f4cc","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.390739Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:c83afe311a11cf6d758d209d5edcfe2a75e86d3121da6857b7eb4a3cef0af919","observation_id":"e72106f9-554c-4ef0-8642-7a89c502a69f","resolution":{"observed_at":"2026-08-06T14:41:57.849408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.832172Z","title":"Slam-omni: Timbre-controllable voice interaction system with single-stage training,","venue":null,"work_id":"1ee058ad-4eea-4601-87d1-a39a142d5fc4","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.396459Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:796a91f7a44f3828432762fbb8914fba8c5d61043cd3edbec5fd9acba79a9a90","observation_id":"36bed796-faa9-4a2e-96fc-0c967461f38a","resolution":{"observed_at":"2026-08-06T14:41:57.836513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.819391Z","title":"Glm-4-voice: Towards intelligent and human-like end-to-end spoken chatbot,","venue":null,"work_id":"5df6bd38-58e0-440b-b09f-0e4888520128","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.400457Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:af5e29771a2198c9e1a4ddf31a2c638cc0626188b091d5a1cfd7b5fae9a79443","observation_id":"02c73c13-ce25-43d2-8f96-5a2a7c3f9521","resolution":{"observed_at":"2026-08-06T14:41:57.823488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.806421Z","title":"Minicpm-o 2.6: A gpt-4o level mllm for vision, speech, and multimodal live streaming on your phone,","venue":null,"work_id":"8db67662-7f36-447c-b06c-f230762d8ffa","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.404284Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:127b5aa1ba5caecf650e8c33478483743fed42ad228037e367e2efdaa4cb2d59","observation_id":"cc859baf-0b64-426d-a228-f8fba81a3694","resolution":{"observed_at":"2026-08-06T14:41:57.810776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.791773Z","title":"Baichuan-omni-1.5 technical report,","venue":null,"work_id":"b1502eec-0b06-419b-aed1-26ddd1629604","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.408621Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:32ffe3bb2f24362cbcbd21173328fc18d082ffa2bc5841ff8494d08588442379","observation_id":"cdb7173f-a781-48aa-8211-75e898235a4a","resolution":{"observed_at":"2026-08-06T14:41:57.796923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.778216Z","title":"Salmonn-omni: A codec-free LLM for full-duplex speech understanding and generation,","venue":null,"work_id":"ebed501b-8658-4df7-bb73-e7cbf0a79fc8","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.412961Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:215a17f813194ccf3d2e13aafdecddb7d1e3f986c6835491be476c4df1133de3","observation_id":"000ff57d-2b87-4200-8928-eda716400dae","resolution":{"observed_at":"2026-08-06T14:41:57.782628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.764579Z","title":"Minmo: A multimodal large language model for seamless voice interaction,","venue":null,"work_id":"a63d0ec1-7a4f-42e7-84da-888b68d5feae","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.417459Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:937a1039b2b4441435c22d84c68cd4180a321524c073194f63d3dd5180ac7269","observation_id":"d6181bd6-0b70-41ca-a7aa-c952f014718c","resolution":{"observed_at":"2026-08-06T14:41:57.768963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.751039Z","title":"Qwen2.5-omni technical report,","venue":null,"work_id":"0807b062-a066-4ece-8c03-e601ab1b660c","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.421720Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:3feb57cb1ff2a9167d594b6b45b3c1ea1d7956f72135e68a735df3a6575a84b6","observation_id":"9e6aff3e-aff5-4316-b407-9cb0517125a5","resolution":{"observed_at":"2026-08-06T14:41:57.755597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.737541Z","title":"Step-audio: Unified understanding and generation in intelligent speech interaction,","venue":null,"work_id":"c92a6f68-d5fc-4106-b33e-320cfbf3c962","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.426101Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:8cd33c46699d2e79caf37f1ad1461f5c1bead42149efc8905e1b58e2f1e578bc","observation_id":"b5cd58e1-1896-4480-91a6-0998d2991aa4","resolution":{"observed_at":"2026-08-06T14:41:57.742003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.722760Z","title":"Step-Audio-AQAA: a fully end-to-end expressive large audio language model,","venue":null,"work_id":"3b279e78-2bd3-4ea2-9f83-2170efc679ee","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.430435Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:c8d28461221db5e05bcf60059f11ace05b2d44921b6299febc6f94ea0b2835c0","observation_id":"b5606be8-d984-47f7-be92-d774c481c6c4","resolution":{"observed_at":"2026-08-06T14:41:57.727510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.709213Z","title":"Llama-omni2: Llm-based real-time spoken chatbot with autoregressive streaming speech synthesis,","venue":null,"work_id":"55a938d2-9441-4cee-8fbb-1af9eed2a7fa","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.435030Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:6a5caef56d0b2b8eb89e0521eba4c61196192f5079a009058c895c18d0b7d97f","observation_id":"7c8a943b-d78f-4531-92a9-a43779cb87a7","resolution":{"observed_at":"2026-08-06T14:41:57.713857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.694157Z","title":"Deeptalk: Towards seamless and smart speech interaction with adaptive modality-specific moe,","venue":null,"work_id":"46044d68-b64f-4788-81da-ea2e5ec30e67","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.439127Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:77372c2e4d014f7de8c5d0ecf0b28fc8f359abccb36001600be1846efc6a3b92","observation_id":"f7d4abe7-6ffa-4d74-8890-cef3efe68d10","resolution":{"observed_at":"2026-08-06T14:41:57.698773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.679792Z","title":"BoSS: Beyond-semantic speech,","venue":null,"work_id":"f44121cf-53e3-422a-9b35-3898521a3ed9","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.443222Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:6dcbd3a9b52f9bc44618ce9d6ab0ffcb01d059257d8c025f2d38263ff5d9405b","observation_id":"16f671c4-e59e-470c-aac9-dc8dc68bbab7","resolution":{"observed_at":"2026-08-06T14:41:57.685148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.665885Z","title":"V oila: V oice-language foundation models for real-time autonomous interaction and voice roleplay,","venue":null,"work_id":"e8823eb4-93d5-498a-9c58-4d3725da9d7e","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.447315Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:fd0d7c563d0f975d9332155c3214a8d5e8c92901e386d23db2c9a7ed1e5e75df","observation_id":"29a2c081-b8f8-430c-a9cf-a6f7328a828f","resolution":{"observed_at":"2026-08-06T14:41:57.670291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.653213Z","title":"Kimi-audio technical report,","venue":null,"work_id":"e04c06f2-8035-42bd-880c-398f85334da1","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.451156Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:0635c0065590dac62ccbb4f9700af64773779c8a18115c36118efb7333854f61","observation_id":"9f8af00c-cc09-4c45-bfea-071d41d386b0","resolution":{"observed_at":"2026-08-06T14:41:57.657231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.639108Z","title":"GOAT- TTS: llm-based text-to-speech generation optimized via A dual-branch architecture,","venue":null,"work_id":"5f27eb86-c033-4858-a316-2aa243839879","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.455369Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:37622d5e17bb2ffff0e31fddc691302547d6758dd7413c98be93313d01d7b00c","observation_id":"0243e4ed-6eda-4fc8-b4ab-4ada7e33f86d","resolution":{"observed_at":"2026-08-06T14:41:57.643553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.626186Z","title":"TELEV AL: A dynamic benchmark designed for spoken language models in chinese interactive scenarios,","venue":null,"work_id":"9213b859-d1f4-4bd7-9658-aa6409e1793e","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.459831Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:d8d512cae0324d6686df54a5d5b4c150de1f202648b8984885570ae9314eadc3","observation_id":"1bb63ac0-1f4d-412c-a07b-5700418282e0","resolution":{"observed_at":"2026-08-06T14:41:57.630056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.612030Z","title":"Qwen2-audio technical report,","venue":null,"work_id":"d0ea4ade-98f3-4f94-b0bf-4a8572c39e32","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.464545Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:078b27b1c128503752042d14a02ff7df740f0ad7bdb88b1073217abb74432f12","observation_id":"4b62431f-b158-4d8f-b63a-611371451226","resolution":{"observed_at":"2026-08-06T14:41:57.616374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.596867Z","title":"Baichuan-Audio: A unified framework for end-to-end speech interaction,","venue":null,"work_id":"1b151a8b-fc82-4a8d-9f30-408d0f1323ca","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.468284Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:86163cf58b9c916af5b26a39f0efb736ad45ec0d8fde8f64a925b6b043bca3aa","observation_id":"4385ee2b-2e76-42bf-8e1e-6c072eb367d2","resolution":{"observed_at":"2026-08-06T14:41:57.601830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.581770Z","title":"Telechat technical report,","venue":null,"work_id":"917c951c-095a-413d-a293-957dffd4f5aa","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.472468Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:5de1ef193beb29b775fb5e79552319d2af7e48cd5b102e0a454be12c4164995a","observation_id":"b846dc80-2c58-42c1-adda-536d03c04710","resolution":{"observed_at":"2026-08-06T14:41:57.586620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.567496Z","title":"Audiochatllama: Towards general-purpose speech abilities for llms,","venue":null,"work_id":"3f9bb336-1885-49e7-926e-f2104013c763","year":2024},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.476480Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:74d9d8e712ec2fefe2c0161a837afbf6a155e5c1ccb0ad8844e3c5426e6c87e7","observation_id":"a872b40c-1ecb-4efb-8603-fad8c29bbf85","resolution":{"observed_at":"2026-08-06T14:41:57.572007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.551879Z","title":"BLSP: bootstrapping language-speech pre-training via behavior alignment of continuation writing,","venue":null,"work_id":"911d3128-d649-4af7-9977-1f21fc273868","year":2023},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.480339Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:046db7463f2bf9526323fe26cd2d4aedc32114a007a8bc95a4c128b8d8eb603f","observation_id":"f5806a61-abdf-41cb-b52c-e4bb51384651","resolution":{"observed_at":"2026-08-06T14:41:57.557553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.537592Z","title":"Wav2prompt: End-to-end speech prompt learning and task-based fine-tuning for text-based llms,","venue":null,"work_id":"b8c5e5ce-b26e-44c0-89db-30e44b2ed72d","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.484253Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:2d354c06d1ce027388d00ba9e3a7a8920498f035ebf111f33c8ec6f99355fe57","observation_id":"6db03b0e-9444-4583-a2ec-65646a9a624d","resolution":{"observed_at":"2026-08-06T14:41:57.542387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:41:57.519737Z","title":"DeSTA2: Developing instruction-following speech language model without speech instruction-tuning data,","venue":null,"work_id":"af657a3f-f27d-4b1a-a19b-3a1131f97a8a","year":2025},"citing_paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:41:57.488433Z"},"links":{"citing_paper":"/paper/2507.18119"},"observation_digest":"sha256:7bb0ed3d042338dda63f17a8ff2c0f4d0018e473d9ac5e8233433cb557d994c8","observation_id":"3bac4abc-912c-46b0-87bb-31a4d20a8f0f","resolution":{"observed_at":"2026-08-06T14:41:57.527293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.18119","last_updated":"2025-07-25T08:25:27Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T15:20:59.352184Z","submitted_at":"2025-07-24T06:10:29Z","title":"GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 2 inbound Pith citation observations for arXiv:2507.18119."}