{"as_of":"2026-08-08T22:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5e5fbe9d8d7c3d68c10ad8570e70fc6d9960c1f85faf8604c1b41d7eeffc949","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:15:41.553345Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T20:41:13.541672Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-07T15:15:41.553345Z","title":"Language model can listen while speaking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15670","last_updated":"2025-07-25T15:07:10Z","snapshot_observed_at":"2026-08-07T15:10:49.347473Z","submitted_at":"2025-05-21T15:48:30Z","title":"SALM-Duplex: Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:41.553345Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2505.15670"},"observation_digest":"sha256:db7fde505ffab9d2212bff09c8709a8b41cb96932b636c713cbc54fbc419ee1d","observation_id":"6d69e0e4-cd4a-4954-91cd-920b36bfd365","resolution":{"observed_at":"2026-08-07T15:15:41.553345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-07T14:33:46.411149Z","title":"Language model can listen while speaking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18517","last_updated":"2025-05-24T05:28:22Z","snapshot_observed_at":"2026-08-08T15:41:54.286673Z","submitted_at":"2025-05-24T05:28:22Z","title":"LiSTEN: Learning Soft Token Embeddings for Neural Audio LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:46.411149Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2505.18517"},"observation_digest":"sha256:eb0648ceb0fc5992606c5818ade96d4f7591203abab1159c5aa07b033fe7345b","observation_id":"b210dfb8-1829-466d-9661-3d084b5f0f4f","resolution":{"observed_at":"2026-08-07T14:33:46.411149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-07T14:19:55.581577Z","title":"Language model can listen while speaking.ArXiv, abs/2408.02622, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19462","last_updated":"2025-05-31T22:36:04Z","snapshot_observed_at":"2026-08-07T16:55:50.852560Z","submitted_at":"2025-05-26T03:35:44Z","title":"VoiceStar: Robust Zero-Shot Autoregressive TTS with Duration Control and Extrapolation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:19:55.581577Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2505.19462"},"observation_digest":"sha256:fcc85c16d8a39e9d2aaf6663dae11a7c86c199d4f393469b2590733da3d57533","observation_id":"91447976-ac9f-4a61-9ca5-c61009dce3b5","resolution":{"observed_at":"2026-08-07T14:19:55.581577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-07T11:58:37.678428Z","title":"Language model can listen while speaking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00975","last_updated":"2025-06-11T10:45:04Z","snapshot_observed_at":"2026-08-07T23:23:21.312419Z","submitted_at":"2025-06-01T12:01:40Z","title":"NTPP: Generative Speech Language Modeling for Dual-Channel Spoken Dialogue via Next-Token-Pair Prediction","version":4},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:58:37.678428Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2506.00975"},"observation_digest":"sha256:8fb038d14f7b40a6e3c9e8934ce8986bacbe41aee64b16a995458bc2ab0cd920","observation_id":"d6e50ae6-0bd2-4ffe-89d5-8c9e59471355","resolution":{"observed_at":"2026-08-07T11:58:37.678428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-07T11:14:21.543096Z","title":"Language Model Can Listen While Speaking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.543096Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:011db2f91305c11c5af7341add831047f762824ec2be85ffe31cec1d9b4a9136","observation_id":"55676e28-45e8-4cf7-b2d0-689fce2729b4","resolution":{"observed_at":"2026-08-07T11:14:21.543096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-06T17:36:23.645457Z","title":"Language model can listen while speaking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10427","last_updated":"2025-07-14T16:16:12Z","snapshot_observed_at":"2026-08-06T17:28:59.842536Z","submitted_at":"2025-07-14T16:16:12Z","title":"Towards Emotion Co-regulation with LLM-powered Socially Assistive Robots: Integrating LLM Prompts and Robotic Behaviors to Support Parent-Neurodivergent Child Dyads","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:36:23.645457Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2507.10427"},"observation_digest":"sha256:8a371bcdd8a96e82f4e9f70dcd9162c0000f832048083aafe1eec892618232e1","observation_id":"5e649e6d-6f63-41f8-b5f9-763d810e26b8","resolution":{"observed_at":"2026-08-06T17:36:23.645457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-05T10:25:14.926547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04093","last_updated":"2025-09-04T10:49:51Z","snapshot_observed_at":"2026-08-06T07:24:35.825133Z","submitted_at":"2025-09-04T10:49:51Z","title":"Open-Source Full-Duplex Conversational Datasets for Natural and Interactive Speech Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:25:14.926547Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2509.04093"},"observation_digest":"sha256:d733bde13b03b5d39f336600403c9aaca1cab63f0e4b8012203872523f3bfdbe","observation_id":"983eb816-01c4-4e2b-8da2-113902adb740","resolution":{"observed_at":"2026-08-05T10:25:14.926547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":"2408.02622","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language model can listen while speaking","venue":null,"work_id":"1794126b-cb31-430f-928a-5fd231dfd595","year":2024},"citing_paper":{"arxiv_id":"2604.23295","last_updated":"2026-05-25T03:30:22Z","snapshot_observed_at":"2026-07-06T23:09:34.300163Z","submitted_at":"2026-04-25T13:18:40Z","title":"Human-1 by Josh Talks: A Full-Duplex Conversational Modeling Framework in Hindi using Real-World Conversations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T08:16:47.522489Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2604.23295"},"observation_digest":"sha256:7f17d81fcbad35eb499c6f92a269a0da976383fccaddb11f7da0828c76fe0912","observation_id":"f2ccd446-7b5b-4b38-9e07-97e6d96459d7","resolution":{"observed_at":"2026-05-11T20:41:13.547085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2408.02622/citation-record","integrity":"/paper/2408.02622/integrity","json":"/paper/2408.02622/citation-record.json","paper":"/paper/2408.02622"},"outbound":[],"paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2408.02622."}