{"as_of":"2026-08-10T20:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:06896ffd32c4db15f20c22f2602a3da2acd4fb2c970293c967bbeb7531297d95","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:06:13.943083Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.11224/citation-record","integrity":"/paper/2508.11224/integrity","json":"/paper/2508.11224/citation-record.json","paper":"/paper/2508.11224"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:09.863323Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:09.863323Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:47626ee9d9a2f1b4ef435c4af5e770e5a954eec23c3021691a08bf5d38e0384f","observation_id":"3ae87c19-a0b7-4e0f-809f-f48e0d002177","resolution":{"observed_at":"2026-08-05T20:06:09.863323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:09.959931Z","title":"q U -Z4H 6 z) Q! A@ A VX q f hCyZ] ꍏPP'&","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:09.959931Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:979970a0d6de7d39b60adc02abcb80d558fba64da611c7971df242121ff610b6","observation_id":"11e56f7e-751f-44c1-b47a-f7068f52a338","resolution":{"observed_at":"2026-08-05T20:06:09.959931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:22.530672Z","title":null,"venue":null,"work_id":"da69b84a-c6d2-4d6e-a3dc-111497d5abdc","year":2021},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.055389Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:661b80b32043dc0ffc09bd81dc760e865d74170804114fea22dba27171081e8b","observation_id":"ea52f117-2352-494e-a72a-87574a1c5104","resolution":{"observed_at":"2026-08-05T20:06:22.624429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:22.314577Z","title":"Baevski, Y","venue":null,"work_id":"c07365d9-931a-428b-9c40-ed48de1b7819","year":2020},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.175903Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:2f3e8ed43a5c9a6d116de9eaad40189bdc984c1e79a5d02ba065e7f771bcfbdb","observation_id":"8f5d77ad-1c3f-4272-a96c-95eb16384274","resolution":{"observed_at":"2026-08-05T20:06:22.406986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:22.039223Z","title":null,"venue":null,"work_id":"2d3eca91-d2f6-4667-8be8-3bed19d5a665","year":2021},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.234609Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:1a392df3b9376ee6db3cc9dadb3b98581e22c54f19e28448afff9b8c5b059f48","observation_id":"e97599b0-8321-4b12-9edf-265cf369063e","resolution":{"observed_at":"2026-08-05T20:06:22.199847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:21.834673Z","title":"Chung, Y","venue":null,"work_id":"1871412e-22c9-478b-a58e-f316282d86c5","year":2021},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.294278Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:a82a9a6e5963c65bc3d176c10c5b50d44b1a7bf571b930ffe8ef3de5be689d2f","observation_id":"7ff0f61b-590b-4623-b249-3383353b2bc0","resolution":{"observed_at":"2026-08-05T20:06:21.948192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:21.659970Z","title":"Mohamed, H.-y","venue":null,"work_id":"cb6795d8-19f8-45a5-a82a-79a3a5e1ebe1","year":2022},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.387580Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:06d75a3458dd3ed58dc1d7c8a9fdbd51ca3ea503898dad75620be160dbcac164","observation_id":"014fc0b7-2a40-4825-b82e-700e42297ea8","resolution":{"observed_at":"2026-08-05T20:06:21.751687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:10.448449Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.448449Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:375ee513a8c99c5f09d5165d69ebcbcfd038b18c89c05be180e772bf6a91971e","observation_id":"9b6c1f88-a118-4bb9-9faa-bddf9302f185","resolution":{"observed_at":"2026-08-05T20:06:10.448449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:21.365981Z","title":"Lakhotia, E","venue":null,"work_id":"7a72df4b-0ba4-4ad4-a5eb-c5ffbe6898ee","year":2021},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.544840Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:eeb95d4a6cf122b0a6098a793eee4497e9ecc86ea41bb99d730e837ddf3be045","observation_id":"687a8ac4-8c03-4531-89a6-b40e9b53f786","resolution":{"observed_at":"2026-08-05T20:06:21.445950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:21.191812Z","title":"Zhang, S","venue":null,"work_id":"d51e71e1-b8bb-4194-964f-301525bd924f","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.605385Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:6f216b3c924df3c7d6b72b969f450073d126416c65bc993065a26fa170c8eebc","observation_id":"bb51e18b-4c6e-4d18-9436-061aa1331365","resolution":{"observed_at":"2026-08-05T20:06:21.275284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32884","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:14.391858Z","title":"Borsos, R","venue":null,"work_id":"336458f4-24b3-4a67-929c-11f9023ef00a","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.662626Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:63451abceec25197e4a0308124260d35c284637840990394db1a31408073619f","observation_id":"3c89e151-a2ee-4509-837d-6292e8cb240f","resolution":{"observed_at":"2026-08-05T20:06:14.475045Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12925","last_updated":"2023-06-22T14:37:54Z","snapshot_observed_at":"2026-08-07T01:18:02.068918Z","submitted_at":"2023-06-22T14:37:54Z","title":"AudioPaLM: A Large Language Model That Can Speak and Listen","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12925","snapshot_observed_at":"2026-08-05T20:06:10.725892Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.725892Z"},"links":{"cited_paper":"/paper/2306.12925","citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:d84869a122d2bbea9ad62dab07b4156b1f4e9f1123a97ab2819dc86aa0e1f42b","observation_id":"eedfa662-a37a-4ac0-a140-639a312c0334","resolution":{"observed_at":"2026-08-05T20:06:10.725892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08528","last_updated":"2026-04-07T06:11:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-11T13:40:53Z","title":"On The Landscape of Spoken Language Models: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08528","snapshot_observed_at":"2026-08-05T20:06:10.809420Z","title":"Arora, K.-W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.809420Z"},"links":{"cited_paper":"/paper/2504.08528","citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:b155f83cf37e10d1def35d95383fcded85ab2848062162d3a3bbda43d98595cb","observation_id":"0cc4cc12-5cb7-4d8c-9e2c-214ee4c0b2b0","resolution":{"observed_at":"2026-08-05T20:06:10.809420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:20.965471Z","title":"Chang, J","venue":null,"work_id":"2961ba16-b28b-4abe-ad75-808566253d1a","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.870231Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:411b1b5397a26563e0065a95dc58d133175f967168cc5f4301b71a76e700ec81","observation_id":"e088c6ad-7546-444a-8d4d-b5265dcd5ef2","resolution":{"observed_at":"2026-08-05T20:06:21.088829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:20.745655Z","title":"Chang, B","venue":null,"work_id":"f37571cb-2f28-406b-87ac-54b5292e0559","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:10.955793Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:5f2ca0e6a12ff8ccd863e94fc21102bfe8c222893068ab0c9f92ba4dd9639578","observation_id":"e50b6e75-3727-4d55-a3af-897eda58309d","resolution":{"observed_at":"2026-08-05T20:06:20.838075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:20.595099Z","title":"Chang, B","venue":null,"work_id":"eb279164-b3de-4235-aff4-9ba38af820bb","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.045657Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:31028d369af182d0e0db4d0447c8482624372e2a2a4b38556058358022959450","observation_id":"7398b830-df6c-4d72-86ac-04656b0151f5","resolution":{"observed_at":"2026-08-05T20:06:20.658919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:20.385105Z","title":null,"venue":null,"work_id":"155ee335-3f3f-46fe-851f-afdfe0bd8df1","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.124696Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:9a8df98d68064f5186bd8c00a544075d6d831b6972f86cfae8ddda5ddeaf3266","observation_id":"b1f57717-c415-4891-9ac8-bea0135ade97","resolution":{"observed_at":"2026-08-05T20:06:20.519807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:20.129478Z","title":"Mousavi, J","venue":null,"work_id":"7d0b7382-30db-49fb-adeb-aeaaf9c8a013","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.213341Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:9c30ee422d79cef0b47c631e1214d0bf8d12a145ad49af02ebeeeb9ea2f41df6","observation_id":"6c285d4c-99f0-4e96-9298-90b33d1b4961","resolution":{"observed_at":"2026-08-05T20:06:20.216662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:19.944588Z","title":null,"venue":null,"work_id":"3e58f9a4-11f2-43fa-89ed-b79d229546ff","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.321500Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:5ac9d6c7111be9d0b9c22db3e543e98a130ad9fe965a0f9aefb134e7508535da","observation_id":"da6b734e-7cf3-4c3f-bdea-6778e82f3b4b","resolution":{"observed_at":"2026-08-05T20:06:20.039610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:19.646178Z","title":null,"venue":null,"work_id":"d0378d1b-73ad-4a9e-bfaa-01920065a6cf","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.427565Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:a3418320d6b1c2c97d89aded43278c6839360366b1cf14cc1269512a302a7823","observation_id":"294e61fe-9624-4ede-86b1-8de5661ca145","resolution":{"observed_at":"2026-08-05T20:06:19.808938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:19.465598Z","title":"Nakamura, K","venue":null,"work_id":"9f7e4635-5877-43cb-9426-63efebecc792","year":2025},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.568642Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:5071ef076854c62ccae98522d00bf6d122b3784483b0b95fd2400696f0af1d82","observation_id":"b72bacdf-c6c1-4da6-ae6d-610a6767ce0e","resolution":{"observed_at":"2026-08-05T20:06:19.526676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:19.410194Z","title":null,"venue":null,"work_id":"8b580da5-3a5f-4180-a3e6-a63f08275001","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.663120Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:f318f49dae3040f225e3c155762beca587e665b0babbc5900333a1fd83c97e43","observation_id":"c5b0432c-52b9-4e4c-8715-e52200fcc8ad","resolution":{"observed_at":"2026-08-05T20:06:19.458454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02384","last_updated":"2024-09-04T02:20:59Z","snapshot_observed_at":"2026-08-01T18:34:49.824481Z","submitted_at":"2024-09-04T02:20:59Z","title":"STAB: Speech Tokenizer Assessment Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02384","snapshot_observed_at":"2026-08-05T20:06:11.669948Z","title":"Vashishth, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.669948Z"},"links":{"cited_paper":"/paper/2409.02384","citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:def81223f20a124dabf6de10aabd1d3b69ade47a5de752e43f738a54420e914d","observation_id":"bd5cd77b-6a99-468f-80a5-ea67629758e7","resolution":{"observed_at":"2026-08-05T20:06:11.669948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:19.219838Z","title":"Yeh and H","venue":null,"work_id":"e398eb98-1172-454d-8c16-bacf20dc1dad","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.740122Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:546144203795a7a250f04d19b83f0628dcf57da878529dafd8a0b36f0b8ee812","observation_id":"b789f899-ee2c-466f-8fc8-5297b27daecb","resolution":{"observed_at":"2026-08-05T20:06:19.327043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:19.019006Z","title":"Zeghidour, A","venue":null,"work_id":"c6a1b603-44eb-4e5d-b2ed-a65af5ebb07b","year":2021},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.839274Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:6de125e0c46306ca63a8e44f8a27e4c84f25d462f78b1652aa1f712383adf54f","observation_id":"91db87c7-f25b-42f3-af35-9bf9535ffef2","resolution":{"observed_at":"2026-08-05T20:06:19.093242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:18.851939Z","title":"D \\'e fossez, J","venue":null,"work_id":"edfc8b32-454b-4a06-884b-bbc35096e1e2","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.915305Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:61a6bc97cb9ed1fe84eeac62ddff41dc3cd75a99b3a45ad1113f5fbd36ffaf55","observation_id":"8db03e8e-964b-4653-ba81-292e4f587b62","resolution":{"observed_at":"2026-08-05T20:06:18.934770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:18.685227Z","title":null,"venue":null,"work_id":"06172b3f-aac6-40a7-9edc-5066ff2badd0","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:11.999650Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:e413977ea87de821587745bdbca7fcce61642555c61223fb414794245bf8076c","observation_id":"0a498507-807c-4a84-81ca-5328c7aee6cf","resolution":{"observed_at":"2026-08-05T20:06:18.768131Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:18.456306Z","title":"Wu, H.-L","venue":null,"work_id":"98e55e98-1631-4d14-b2a8-e2dca2987672","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.090749Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:0d8dce85b563c7fdccadedc01ec5d9cbb4988270a2fc4dbd036b07d14e2a6aee","observation_id":"0a691aba-fef0-4917-a8a1-a6240280e859","resolution":{"observed_at":"2026-08-05T20:06:18.562520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01995","last_updated":"2025-05-24T13:50:34Z","snapshot_observed_at":"2026-07-06T19:09:50.836734Z","submitted_at":"2024-09-03T15:41:07Z","title":"vec2wav 2.0: Advancing Voice Conversion via Discrete Token Vocoders","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01995","snapshot_observed_at":"2026-08-05T20:06:12.178766Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.178766Z"},"links":{"cited_paper":"/paper/2409.01995","citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:c40292c985d8447dddd543d80433b1df2e821af416dcf2c5e3a973f4c2951b93","observation_id":"4596cdaa-dde8-4d0e-9182-ee98e6a4308d","resolution":{"observed_at":"2026-08-05T20:06:12.178766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19935","last_updated":"2024-10-25T19:13:25Z","snapshot_observed_at":"2026-07-06T19:39:59.961070Z","submitted_at":"2024-10-25T19:13:25Z","title":"Do Discrete Self-Supervised Representations of Speech Capture Tone Distinctions?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19935","snapshot_observed_at":"2026-08-05T20:06:12.267660Z","title":"Osakuade and S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.267660Z"},"links":{"cited_paper":"/paper/2410.19935","citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:4c29942ee5b1af213f3ee7066f0f4aad812b1d4d0f4a9a0d24418d43fc9a2ca5","observation_id":"24ea762f-6a48-4155-9391-8c8409352ac6","resolution":{"observed_at":"2026-08-05T20:06:12.267660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:18.260605Z","title":"Kharitonov, A","venue":null,"work_id":"ca81fa44-48e8-455b-b345-b052deeba97e","year":2022},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.357218Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:7b251ede2a96a74812ed3bbe68b85d0e7219e734647f1ab3ea6c16bba06c98b3","observation_id":"a7019bae-c0ce-456a-9929-a8f38ddb3f77","resolution":{"observed_at":"2026-08-05T20:06:18.376017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:18.071613Z","title":"Sicherman and Y","venue":null,"work_id":"dbc0ccd8-ce70-4b5e-b860-dd4eab4633c6","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.478123Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:840bd8a3013a0256bcb06f67d802864f83357f91b1f9f3f9150cbeab4855480f","observation_id":"bd02d360-2a6e-4c3a-b61a-9e4f5cce9b54","resolution":{"observed_at":"2026-08-05T20:06:18.145589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:17.917927Z","title":"de Seyssel , M","venue":null,"work_id":"b55be15d-c612-47f1-a309-5e45a299d8af","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.622059Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:e5f39272e96f5910ca9b655e55f24bf9c7687b781ccce19dec0ca4f385b43324","observation_id":"9fe25ee8-b9af-46ec-9b78-06ea73b42b62","resolution":{"observed_at":"2026-08-05T20:06:17.990173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:17.726592Z","title":"de Seyssel, A","venue":null,"work_id":"061863d1-a1ea-4014-b22a-0d367b18f5dd","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.686787Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:a05822306c0e7bee1c880586551ce924c9624d3e0bd7c5b427ca78ab9fb6bee1","observation_id":"5fe8cff6-67ec-4068-9698-c00bc99ab8ab","resolution":{"observed_at":"2026-08-05T20:06:17.834246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:17.523130Z","title":"Maimon, A","venue":null,"work_id":"abee6003-7dff-4d8a-bd25-19d4ba26a56f","year":2025},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.769837Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:def71955e132657bb1e54baa4bb985745ae63c60e2b7d00ffa2f014b001325d5","observation_id":"f73f6569-3e99-4cdb-b3c1-d33e39a4c46d","resolution":{"observed_at":"2026-08-05T20:06:17.644373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:17.207295Z","title":"Morise, F","venue":null,"work_id":"f129d0f6-e470-4d7b-953f-2731b0638ae4","year":2016},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.832550Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:6d4f04f9d575e1fb0d1bd70a50164fff2669a136c0f11eecc8e82cf093bc95c6","observation_id":"687ef65c-d0df-432e-b0be-3316ea1560d8","resolution":{"observed_at":"2026-08-05T20:06:17.351915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:17.028692Z","title":null,"venue":null,"work_id":"41b90c90-ad8c-47c0-b615-61ba11ff5527","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:12.916593Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:0d186e5c64ddd8447b6225c30861d509a191b1c65edbba996fbc638be54dd599","observation_id":"9898febf-ee15-41f9-a798-455abfb7a027","resolution":{"observed_at":"2026-08-05T20:06:17.079178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:16.822417Z","title":null,"venue":null,"work_id":"8ef1fda2-33d1-4ac9-ac36-9a9eb939dcd9","year":2022},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.060015Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:b44fbb53e42ccd5cc9ce36909779c7f4eae1eb647fcc142601b00fa00e3b98bc","observation_id":"84309fa6-0916-4344-8bd4-3ecff4420b94","resolution":{"observed_at":"2026-08-05T20:06:16.948871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:16.590594Z","title":"Baevski, W.-N","venue":null,"work_id":"d6315e38-9c6d-4fdc-b71a-aea00cacd4d6","year":2022},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.179659Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:5d7ab4e2245b39b376ed9cf022fe2bf02db70f97a951915edbec553a1c790f49","observation_id":"258628a3-9009-45e0-a874-5d256fb69bed","resolution":{"observed_at":"2026-08-05T20:06:16.723103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:16.372115Z","title":null,"venue":null,"work_id":"13416e5b-ea6c-4af4-a48d-e5bcf58be865","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.263862Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:6dfac5d47c3d03fe6845f695ee0cec5f3c3841459bc71babc7f1c9a578ea1718","observation_id":"0767a082-6057-4d90-a47c-08b6573966ed","resolution":{"observed_at":"2026-08-05T20:06:16.490696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:16.062705Z","title":null,"venue":null,"work_id":"4b6855bd-2236-41b6-9624-f3d1fdf72f1f","year":2024},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.351448Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:6222b99d0423ca486cba8a94b79e0df135d124c760fdab3e0682af59182df89e","observation_id":"153e6b93-171a-4027-a62e-6d6e7fcb33c8","resolution":{"observed_at":"2026-08-05T20:06:16.225460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:15.781191Z","title":"Panayotov, G","venue":null,"work_id":"06acf18a-3ad8-468b-8902-31735b7a9270","year":2015},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.412975Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:45e1016e0a874d82b1c55419af8c57f75b1435699dff638af5d20625d3a0a8de","observation_id":"96dfc4c7-5565-4a7d-aa67-3f56df625a0d","resolution":{"observed_at":"2026-08-05T20:06:15.905917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:15.570201Z","title":null,"venue":null,"work_id":"66fb2a71-5823-40ca-8afb-271e1df0669c","year":2025},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.471974Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:d7de371a18ab22f9f200ef76df35bd0d31f7fc83b9ac3168977bd2a97156f01c","observation_id":"cfd71ee4-4723-4896-b645-b00fb365fd74","resolution":{"observed_at":"2026-08-05T20:06:15.676850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-58589-1_42","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Lecture notes in computer science","work_id":"e18045bc-eb3e-4627-830d-06dd6e247d0a","year":2020},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.565455Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:201da88bc5b03630cd76da699a7d859dfa380734f883e7c65c34a0edb12a6fb1","observation_id":"7b8c0b19-8511-45f5-96ab-bc8e988f6128","resolution":{"observed_at":"2026-08-05T20:06:14.090547Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:15.330185Z","title":"Kando, Y","venue":null,"work_id":"bddfd900-b866-4c26-8e2e-43c70f3b5e1e","year":2025},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.676738Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:57f7f9a31cceaaac51877f5342f62be2a645f6fbab0cf8decf5fae910eb5cafd","observation_id":"00925dcb-2cfd-4c85-974b-03371e86a244","resolution":{"observed_at":"2026-08-05T20:06:15.422111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:15.174676Z","title":"Poeppel, ``The analysis of speech in different temporal integration windows: cerebral lateralization as ‘asymmetric sampling in time’,'' Speech Communication, vol","venue":null,"work_id":"fcc2e4e4-1b50-4417-ac15-65129e102353","year":2003},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.768464Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:724ee958997647d6c238a5960552a6e778565533077073b020c0c6220c1b9577","observation_id":"a24fd9fe-f6c0-4d22-a6b4-7a5f90f59de8","resolution":{"observed_at":"2026-08-05T20:06:15.235903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:14.995553Z","title":"Garofolo, L","venue":null,"work_id":"5796e520-9a20-405a-b688-94bc3e8caaa2","year":1992},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.827939Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:d4c18e3331333f855f1f6b32c462fd538d4058ae8326aa64dc4747dcbeb26012","observation_id":"dfe3ae7d-4861-4164-af42-39dc5239c6f4","resolution":{"observed_at":"2026-08-05T20:06:15.076350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:14.847030Z","title":null,"venue":null,"work_id":"b2d9c8d1-7899-4d20-b25f-81c26ce06837","year":2025},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.888261Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:7882167ae33cf6b3dd44547018f2f48e1ebed35317e273cac9a97da8a597e7d1","observation_id":"8530e476-3e33-4c42-ad44-fe7594e4a05c","resolution":{"observed_at":"2026-08-05T20:06:14.928957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:06:14.680699Z","title":null,"venue":null,"work_id":"5e55da49-df7b-433f-be4f-7c1b379bc841","year":2023},"citing_paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:13.943083Z"},"links":{"citing_paper":"/paper/2508.11224"},"observation_digest":"sha256:ab54df4614ccfac569cdbe69373da4b771a2587b82943f83701bee6949c4aab8","observation_id":"5c911fe8-1778-4e70-ab5e-26938795a502","resolution":{"observed_at":"2026-08-05T20:06:14.780903Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.11224","last_updated":"2025-08-15T05:11:16Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T23:33:39.139294Z","submitted_at":"2025-08-15T05:11:16Z","title":"Benchmarking Prosody Encoding in Discrete Speech Tokens"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2508.11224."}