{"as_of":"2026-08-09T19:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4af1d721531fb55e30633ee75e81450ecaa0990abb604ca22fb570bcb582890","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:23:02.306051Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T13:18:12.799615Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-07T15:23:02.306051Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM // arXiv preprint arXiv:2305.15255","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15406","last_updated":"2025-05-21T11:47:47Z","snapshot_observed_at":"2026-08-07T15:16:06.018745Z","submitted_at":"2025-05-21T11:47:47Z","title":"Audio Jailbreak: An Open Comprehensive Benchmark for Jailbreaking Large Audio-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:23:02.306051Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2505.15406"},"observation_digest":"sha256:d6318b682406e1c7e22ccdddff03dbb25a62e62e4c5e549477733d94d1b63423","observation_id":"ca56d13a-6ae1-47f2-8bb2-cbfae82600fe","resolution":{"observed_at":"2026-08-07T15:23:02.306051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-07T14:55:01.447743Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17326","last_updated":"2025-05-22T22:42:40Z","snapshot_observed_at":"2026-08-09T10:52:16.235317Z","submitted_at":"2025-05-22T22:42:40Z","title":"VoxRAG: A Step Toward Transcription-Free RAG Systems in Spoken Question Answering","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:01.447743Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2505.17326"},"observation_digest":"sha256:788caec393e917f9b4e8ecd8d2ba8dc5202305f7b7f19a57387b4c792f7d8063","observation_id":"a9c77d13-2b1c-4e61-8113-7d64e9720542","resolution":{"observed_at":"2026-08-07T14:55:01.447743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-07T14:49:32.437237Z","title":"Spoken question answering and speech continuation using spectrogram-powered llm,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17496","last_updated":"2025-05-23T05:50:14Z","snapshot_observed_at":"2026-08-09T06:59:57.630838Z","submitted_at":"2025-05-23T05:50:14Z","title":"Analyzing Mitigation Strategies for Catastrophic Forgetting in End-to-End Training of Spoken Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:32.437237Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2505.17496"},"observation_digest":"sha256:59e4fca29f37df014af6acf6d7aa5f89a73e508663599674044c8e963d3d0e39","observation_id":"578e6321-953e-4e70-9458-bd1ed3843068","resolution":{"observed_at":"2026-08-07T14:49:32.437237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-07T11:58:37.901004Z","title":"J., and Ramanovich, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00975","last_updated":"2025-06-11T10:45:04Z","snapshot_observed_at":"2026-08-07T23:23:21.312419Z","submitted_at":"2025-06-01T12:01:40Z","title":"NTPP: Generative Speech Language Modeling for Dual-Channel Spoken Dialogue via Next-Token-Pair Prediction","version":4},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:58:37.901004Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2506.00975"},"observation_digest":"sha256:1d38f36d5493b2e478c782bdd5c02726d061495bf5f9edf422efc8aabd18fc7a","observation_id":"75dea8af-703c-4fbc-ad56-db0becf0e6c3","resolution":{"observed_at":"2026-08-07T11:58:37.901004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-07T11:37:29.500611Z","title":"Spoken question answering and speech continuation using spectrogram-powered llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01934","last_updated":"2025-06-02T17:53:10Z","snapshot_observed_at":"2026-08-09T09:09:21.347203Z","submitted_at":"2025-06-02T17:53:10Z","title":"RoboEgo System Card: An Omnimodal Model with Native Full Duplexity","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:37:29.500611Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2506.01934"},"observation_digest":"sha256:5067084aae80f3260c4c36c0050c502ea6ec2f7e00806858760ad6f7b8e13222","observation_id":"a82b8b51-06c7-4edb-8cc2-9f5c41cb3203","resolution":{"observed_at":"2026-08-07T11:37:29.500611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-07T11:28:54.440358Z","title":"Spoken question an- swering and speech continuation using spectrogram-powered llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02443","last_updated":"2025-06-03T05:02:14Z","snapshot_observed_at":"2026-08-09T15:38:03.456563Z","submitted_at":"2025-06-03T05:02:14Z","title":"Breaking the Barriers of Text-Hungry and Audio-Deficient AI","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T11:28:54.440358Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2506.02443"},"observation_digest":"sha256:a3cfbd1e00394dcc5611cfd83735e0c3e64ac8446761b5104ae80f98a6bfb2f2","observation_id":"5d30e757-ba22-422a-b20a-df145a1b26f0","resolution":{"observed_at":"2026-08-07T11:28:54.440358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2509.03526","last_updated":"2026-05-20T03:07:46Z","snapshot_observed_at":"2026-08-07T01:53:38.136292Z","submitted_at":"2025-08-25T07:31:48Z","title":"Enhancing Speech Large Language Models through Reinforced Behavior Alignment","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-21T22:23:52.392075Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2509.03526"},"observation_digest":"sha256:bd6172da5f8147010e0c4b5eb9883cadc30989c912ced24a785dc26e24c1c509","observation_id":"0c6d9238-9845-4a4d-85db-f2abf53711b6","resolution":{"observed_at":"2026-05-21T22:24:23.523554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-04T10:13:42.808724Z","title":"Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sas- try, Amanda Askell, Pamela Mishkin, Jack Clark, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.11098","last_updated":"2026-07-06T08:06:32Z","snapshot_observed_at":"2026-08-08T04:21:21.183477Z","submitted_at":"2025-10-13T07:45:52Z","title":"VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T10:13:42.808724Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2510.11098"},"observation_digest":"sha256:89c8fc047c219ab2c50acd213ecff357b796f62e8b079f9f535a6b32c140857a","observation_id":"0fdeb41d-e64d-44fc-b20b-615f62936534","resolution":{"observed_at":"2026-08-04T10:13:42.808724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2603.17837","last_updated":"2026-06-04T13:47:38Z","snapshot_observed_at":"2026-08-02T07:45:21.753896Z","submitted_at":"2026-03-18T15:30:29Z","title":"The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T08:34:56.898815Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2603.17837"},"observation_digest":"sha256:23aebe18dfc4ef7bd0a775deeb95b6ae228e82ddcc194b5ef08cdb36aa4286c6","observation_id":"a9cf42d6-53ed-4d9f-9519-77c0fc8aab83","resolution":{"observed_at":"2026-05-15T08:35:18.336465Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2603.17837","last_updated":"2026-06-04T13:47:38Z","snapshot_observed_at":"2026-08-02T07:45:21.753896Z","submitted_at":"2026-03-18T15:30:29Z","title":"The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoning","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T10:43:27.176535Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2603.17837"},"observation_digest":"sha256:2c784a1381e810a87deac360a1ee31c71bbe74546d9dac243f9c0f2c763dfd69","observation_id":"e36d694d-e081-4521-af19-311c41dca4b8","resolution":{"observed_at":"2026-05-21T10:44:07.731649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-13T22:57:11.059962Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.17837","last_updated":"2026-06-04T13:47:38Z","snapshot_observed_at":"2026-08-02T07:45:21.753896Z","submitted_at":"2026-03-18T15:30:29Z","title":"The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoning","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T22:57:11.059962Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2603.17837"},"observation_digest":"sha256:3fd174d198aedf40b5d1946ff5bfb88a232a2ae9b479729ecc2f6ad3f8b9f66c","observation_id":"f41ea930-1e84-4425-8d15-f62eaa6ab6c1","resolution":{"observed_at":"2026-07-13T22:57:11.059962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2605.06765","last_updated":"2026-05-07T17:59:56Z","snapshot_observed_at":"2026-08-08T18:16:48.532228Z","submitted_at":"2026-05-07T17:59:56Z","title":"VITA-QinYu: Expressive Spoken Language Model for Role-Playing and Singing","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-11T01:03:09.942984Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2605.06765"},"observation_digest":"sha256:d42944e82daec4079b3235c2b54290031fa149a7e2e225bfa2d132e513170ef2","observation_id":"c9855641-f6f8-4435-b6ac-d3fd4a17243b","resolution":{"observed_at":"2026-05-11T04:50:56.112480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2605.27190","last_updated":"2026-05-26T15:43:11Z","snapshot_observed_at":"2026-08-06T18:21:13.610239Z","submitted_at":"2026-05-26T15:43:11Z","title":"Learning When to Think While Listening in Large Audio-Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-29T18:37:34.409802Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2605.27190"},"observation_digest":"sha256:94faeccd52deb2bd867d7d58d21a42aae605cdd84482de3e39c33851b321217d","observation_id":"dd0c267f-3395-41ff-8ed8-11076ca15720","resolution":{"observed_at":"2026-06-29T18:43:50.740325Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2606.05121","last_updated":"2026-06-03T17:26:11Z","snapshot_observed_at":"2026-08-02T17:56:34.317060Z","submitted_at":"2026-06-03T17:26:11Z","title":"Audio Interaction Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:05.062465Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2606.05121"},"observation_digest":"sha256:44621959384497b8c1e575dcadab4ecac42d415156e5738f3ca13f46acf15988","observation_id":"5b065715-e004-4abb-b17d-6528a168b85c","resolution":{"observed_at":"2026-07-02T10:46:52.399346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2606.12199","last_updated":"2026-06-10T15:19:15Z","snapshot_observed_at":"2026-08-07T21:59:04.835770Z","submitted_at":"2026-06-10T15:19:15Z","title":"Which Speech Representation Better Matches Text-Native Reasoning? A Study of Speech-Text Alignment on Frame Rate and Representation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T08:18:23.182355Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2606.12199"},"observation_digest":"sha256:76bb25fd1fd759b488875e18d264a0479ab47092819ba49cf1fa2c867b7d5508","observation_id":"814d8f26-395c-4231-92d2-c67a346ae863","resolution":{"observed_at":"2026-07-03T13:18:12.801146Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":"2305.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-07-03T13:18:12.799615Z","title":"arXiv preprint arXiv:2305.15255 , year=","venue":null,"work_id":"2a4c2e8f-2b5d-41a4-9d28-de88a5029ce5","year":2023},"citing_paper":{"arxiv_id":"2606.30145","last_updated":"2026-06-29T11:22:50Z","snapshot_observed_at":"2026-08-08T07:29:41.174359Z","submitted_at":"2026-06-29T11:22:50Z","title":"FacePlex: Full-Duplex Joint Speech-Facial Motion Generation for Conversational Avatars","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T06:38:28.718164Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2606.30145"},"observation_digest":"sha256:b85ad5f7640760f3132114b0cdb0ad3a18567060a7701ee9671e192471664034","observation_id":"8974942b-412e-4800-887f-6fa99e2acc01","resolution":{"observed_at":"2026-06-30T06:44:19.396461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15255","snapshot_observed_at":"2026-08-01T11:20:17.845680Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-07-22T09:04:55Z","snapshot_observed_at":"2026-08-07T17:53:01.414682Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:17.845680Z"},"links":{"cited_paper":"/paper/2305.15255","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:6478ade2380603614fa9748795bb4a4aa687509e2f749b4f8851fd5f76d42626","observation_id":"bee2084b-cdfb-4f8b-9679-bb172797f891","resolution":{"observed_at":"2026-08-01T11:20:17.845680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.15255/citation-record","integrity":"/paper/2305.15255/integrity","json":"/paper/2305.15255/citation-record.json","paper":"/paper/2305.15255"},"outbound":[],"paper":{"arxiv_id":"2305.15255","last_updated":"2024-05-31T01:29:27Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T15:32:39.787935Z","submitted_at":"2023-05-24T15:39:43Z","title":"Spoken Question Answering and Speech Continuation Using Spectrogram-Powered LLM"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2305.15255."}