{"as_of":"2026-08-09T11:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:70bb7e10d009555b63bea339fce70af7322409b417f6847183674f2157b7c10a","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:41:03.777818Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.02349/citation-record","integrity":"/paper/2509.02349/integrity","json":"/paper/2509.02349/citation-record.json","paper":"/paper/2509.02349"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1912.06670","last_updated":"2020-03-05T20:37:08Z","snapshot_observed_at":"2026-08-05T11:17:11.092255Z","submitted_at":"2019-12-13T19:22:44Z","title":"Common Voice: A Massively-Multilingual Speech Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06670","snapshot_observed_at":"2026-08-05T11:40:58.811779Z","title":"M.; and Weber, G","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:58.811779Z"},"links":{"cited_paper":"/paper/1912.06670","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:9735dd6c00b8270f4c8cd78ff04b355c2d2caa94f1fd1a1b00362ed75d78e87e","observation_id":"ea11c561-6f19-4e29-8379-56498d8eca7d","resolution":{"observed_at":"2026-08-05T11:40:58.811779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.833742Z","title":null,"venue":null,"work_id":"04bba168-8ba6-4e34-ab1c-4deb95b05be3","year":2014},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:58.883927Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:986fd68e21ef3beb065ee9c282549794195508a1977bbfd35fa0e6542e36f07b","observation_id":"b73e437e-4836-4129-8624-94d4837e629e","resolution":{"observed_at":"2026-08-05T11:41:04.836948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.824376Z","title":null,"venue":null,"work_id":"af2410a5-5ab4-4445-8f29-6e2dbdeb4954","year":2020},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:58.962367Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:9bf81468020333b1d3e61ce42b34eb5324b286c048bfb86222971f4be5a8f438","observation_id":"1d8f39dc-6812-4f5d-94d9-145f1d586d3f","resolution":{"observed_at":"2026-08-05T11:41:04.827589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.815063Z","title":null,"venue":null,"work_id":"7962afc4-5a11-414a-b2e2-3aa364c7904d","year":2019},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.031820Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:968e4a199be64aabcd4adea3c7d8f76e6d3c160340ba5997641e9916ebe2edaa","observation_id":"f0b19772-9bd0-4c8c-b6fa-3798f38c53e8","resolution":{"observed_at":"2026-08-05T11:41:04.818291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.805313Z","title":null,"venue":null,"work_id":"57ead8f4-8b82-4f46-9397-4fe34662edd8","year":2023},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.114242Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:05d20f6e6a7ad8c3b62d954e2cc8564c0d4faabf983364203f1ba4ef07e3c3f3","observation_id":"8998dfd4-14ec-4d28-b8ac-44f2664ce7a9","resolution":{"observed_at":"2026-08-05T11:41:04.808554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.581635Z","title":null,"venue":null,"work_id":"d4939ee8-05ee-48b1-8193-e067fa92bf6b","year":2022},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.184506Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:214ac0dd9e29a8291a589fe5de43ee52ab8e1df6871ed6a06334de77fb72eac3","observation_id":"fd30fb7c-e6c5-4d60-8719-bd1262fa8127","resolution":{"observed_at":"2026-08-05T11:41:04.721532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.550148Z","title":null,"venue":null,"work_id":"c4e7d8c7-199f-4e85-b0e3-01739e054419","year":2022},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.221384Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:7634532623e79572c3d5c12a2e042b3584d9e9c7530c1c6fb411dc8dfc7749a8","observation_id":"29bd1e02-1c3f-4244-8829-670082577ffd","resolution":{"observed_at":"2026-08-05T11:41:04.561131Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02357","last_updated":"2017-04-04T18:40:27Z","snapshot_observed_at":"2026-08-02T03:45:46.211131Z","submitted_at":"2016-10-07T17:51:51Z","title":"Xception: Deep Learning with Depthwise Separable Convolutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02357","snapshot_observed_at":"2026-08-05T11:40:59.307013Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.307013Z"},"links":{"cited_paper":"/paper/1610.02357","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:a8b3343a6d66b452f8400408f1577bd61e4f3052b8d66bcdcba8c719e23caf6a","observation_id":"9dff7353-4a52-46d0-98d6-1dc24d6050f7","resolution":{"observed_at":"2026-08-05T11:40:59.307013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-05T11:40:59.409987Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.409987Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:5dea1ccfc62b28690993dd541f500668dc1e8dd3f5efba987ef870202849bbaf","observation_id":"b5b4c207-af39-4609-8c9a-cece131cdb8b","resolution":{"observed_at":"2026-08-05T11:40:59.409987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-09T07:12:13.721596Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-05T11:40:59.501398Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.501398Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:07ef13f0dd4bc6e0fb3a4cca1e3076593cb61204015b66ea9144497ae51951f2","observation_id":"7f885b7a-3185-46b0-9a31-070a2d94f040","resolution":{"observed_at":"2026-08-05T11:40:59.501398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-05T11:40:59.536803Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.536803Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:a97f65021912efcac0e158a2511821f1093dfd5e8f6710eca38655a4af4b1cf4","observation_id":"1e95be2b-9f81-4772-80e0-c86d1cc8709b","resolution":{"observed_at":"2026-08-05T11:40:59.536803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.520592Z","title":null,"venue":null,"work_id":"bf84618f-caaa-4d4f-9c82-2a9bc7c1c12f","year":2017},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.620402Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:0bc0364bfb35893ce8061327c8cd162ca2e07cddfb4a874223b15a727c3ceefd","observation_id":"6e5365c5-a66e-416d-866c-4568db9fa306","resolution":{"observed_at":"2026-08-05T11:41:04.531099Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23325","last_updated":"2025-07-09T17:40:35Z","snapshot_observed_at":"2026-08-07T07:10:18.010065Z","submitted_at":"2025-06-29T16:51:50Z","title":"XY-Tokenizer: Mitigating the Semantic-Acoustic Conflict in Low-Bitrate Speech Codecs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23325","snapshot_observed_at":"2026-08-05T11:40:59.738880Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.738880Z"},"links":{"cited_paper":"/paper/2506.23325","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:8cc3a5d738514ed6b82878c7911b67b6fdad69d2e08dd015c0722659a1156581","observation_id":"827d65ca-cae9-4b43-9f3c-912e7370c341","resolution":{"observed_at":"2026-08-05T11:40:59.738880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.504351Z","title":null,"venue":null,"work_id":"7d14a6ef-6e27-4c64-ada2-b3fdf3c91a8a","year":2022},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.835584Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:0f1ab67483d64d8dad8f7d25caeb43b79d1fc8e18164ca023b2862db53af9875","observation_id":"4de85b31-6410-4e62-9e56-48d028d5a7fb","resolution":{"observed_at":"2026-08-05T11:41:04.509768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.491980Z","title":null,"venue":null,"work_id":"7d7a6b6f-87b6-450c-9a02-220eef26ed8b","year":2006},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.877431Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:33569c4a3f35646a8947a92b99b9a14a2d435745aabc54c29b6cbd9ddc9d2593","observation_id":"7765cfaa-3437-49f7-a19e-c979b5700bf5","resolution":{"observed_at":"2026-08-05T11:41:04.495940Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-08T15:18:32.322111Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-05T11:40:59.970746Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T11:40:59.970746Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:199544bb154aa1b7a105bff39002b0429724aee1ddf2c6b3a2654eb49026fb82","observation_id":"dd0b3353-cd8a-4cff-9ef2-c00dd16d36e1","resolution":{"observed_at":"2026-08-05T11:40:59.970746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05361","last_updated":"2024-09-07T15:08:24Z","snapshot_observed_at":"2026-08-07T13:19:22.496186Z","submitted_at":"2024-07-07T13:24:54Z","title":"Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05361","snapshot_observed_at":"2026-08-05T11:41:00.064681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:00.064681Z"},"links":{"cited_paper":"/paper/2407.05361","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:9a043b459ea69930039334571fe52c30a664350c5a83534d30df53328d383a22","observation_id":"8d757418-74ce-4c4a-bd83-d8a955f0829b","resolution":{"observed_at":"2026-08-05T11:41:00.064681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.481722Z","title":"H.; Lakhotia, K.; Salakhutdinov, R.; and Mohamed, A","venue":null,"work_id":"d2b70b3e-e3eb-45b6-9cc8-d670528a9262","year":2021},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:00.157776Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:04ae81412ab8176eeeb949ab63953ce67381cb435fc1cd90c5e48c92231f5f1a","observation_id":"b2582e68-d260-4600-8770-6b47f3d10432","resolution":{"observed_at":"2026-08-05T11:41:04.485146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.01507","last_updated":"2019-05-16T05:32:17Z","snapshot_observed_at":"2026-07-06T05:58:12.969533Z","submitted_at":"2017-09-05T17:42:13Z","title":"Squeeze-and-Excitation Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.01507","snapshot_observed_at":"2026-08-05T11:41:00.281986Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:00.281986Z"},"links":{"cited_paper":"/paper/1709.01507","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:5466c5b543fd3f028e78e2a810bfcde185b6c3da5e55e8e7420fd759f2e6bc1c","observation_id":"da836c31-0568-4b0f-b56e-8612af95f8f9","resolution":{"observed_at":"2026-08-05T11:41:00.281986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.472057Z","title":"o ck, S.; H \\","venue":null,"work_id":"26b899e2-dcd1-4c66-89ee-d1a9edd53ddf","year":2015},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:00.450908Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:683adcbb6c51e24443ae1de16bdbbd0728f17ce5d921e6aebfdc2fc60d75cf96","observation_id":"181683df-b548-4ad1-a8cb-2de12ef33497","resolution":{"observed_at":"2026-08-05T11:41:04.475066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.461195Z","title":null,"venue":null,"work_id":"8f8608de-3d11-4a0c-a839-f53282528954","year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:00.562950Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:90e938f2a27600c53e83def88b0fb74a6d609e65a0f97ea08f2de34c2ef7d8ce","observation_id":"92298073-b503-472c-b4a9-6d0809ef4958","resolution":{"observed_at":"2026-08-05T11:41:04.464587Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.448681Z","title":null,"venue":null,"work_id":"a3a5fa9f-4b85-4edb-ade4-c6ca984f1fbc","year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:00.768110Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:f91927f9bd9583e46a0938c4a14102909d8b4aa691719fa63c7aa4cb2351872f","observation_id":"7598e85d-0989-463d-9130-cf2418822e54","resolution":{"observed_at":"2026-08-05T11:41:04.452312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.436984Z","title":"I.; Bay, M.; and Downie, J","venue":null,"work_id":"f215d8d1-2187-41a8-987f-d611a752da12","year":2009},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:00.952687Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:486bc929ab29d68894adfe916d17e77b42daf91508b83ef5122dcb65c270e0c6","observation_id":"b2b153ca-9554-4fa5-aa8b-71d79ea7deac","resolution":{"observed_at":"2026-08-05T11:41:04.440527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-05T11:41:01.120061Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:01.120061Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:ce6aed32626f4618a4dc7a76b0e8d1aabf43f958b2ade6a990ee2b58255eb2a8","observation_id":"2416d860-a1c4-4b6a-a4c1-a1a0c0610095","resolution":{"observed_at":"2026-08-05T11:41:01.120061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.423730Z","title":null,"venue":null,"work_id":"fce6878e-31dd-49ad-b0a4-5bc71e3f6b0e","year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:01.284786Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:949e7343292c61d6ce05331ad17c6d03eba3baac68bc153e82fe2f4828a52df3","observation_id":"b6cdb7a0-e325-4e5d-bab3-a10e3d2a0935","resolution":{"observed_at":"2026-08-05T11:41:04.428315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15505","last_updated":"2023-10-12T07:55:05Z","snapshot_observed_at":"2026-07-06T16:24:17.829828Z","submitted_at":"2023-09-27T09:13:40Z","title":"Finite Scalar Quantization: VQ-VAE Made Simple","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15505","snapshot_observed_at":"2026-08-05T11:41:01.452471Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:01.452471Z"},"links":{"cited_paper":"/paper/2309.15505","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:e6fe1bb4932221a719f08eed440f5de4b6cc6379f181ebedfcfbf45e1cd01437","observation_id":"e2f641b2-818e-4b29-a5db-26ea9b363b2d","resolution":{"observed_at":"2026-08-05T11:41:01.452471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14294","last_updated":"2026-04-21T15:27:17Z","snapshot_observed_at":"2026-07-30T17:14:02.349402Z","submitted_at":"2024-06-20T13:23:27Z","title":"DASB - Discrete Audio and Speech Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14294","snapshot_observed_at":"2026-08-05T11:41:01.619120Z","title":"D.; Duret, J.; Ploujnikov, A.; Subakan, C.; and Ravanelli, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:01.619120Z"},"links":{"cited_paper":"/paper/2406.14294","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:4ff16fdf34ea24825feec1e9e6740089e7ae01ade5087eb0f28d297c4413a531","observation_id":"9f7dcdd6-2138-4130-9629-02d504a92f00","resolution":{"observed_at":"2026-08-05T11:41:01.619120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:01.713241Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:01.713241Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:22f1dd440c82f20088b3a66e2a4180796be0f3d2af45dea9b68f05b51ad4328d","observation_id":"189248fb-c4e0-45e2-b819-49fd010885af","resolution":{"observed_at":"2026-08-05T11:41:01.713241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.413339Z","title":null,"venue":null,"work_id":"0c7833f2-c96a-4831-a0e3-df0ebfab18f9","year":2025},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:01.831818Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:cb5f7493ccd44f1ee3c77a3c157d743a8d338d354663cc4e536ddbaf5b54bf48","observation_id":"6fe6b404-d112-4cd4-83ad-bb8825a9a7ca","resolution":{"observed_at":"2026-08-05T11:41:04.416593Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.403592Z","title":null,"venue":null,"work_id":"14d022e0-7f9b-4a3e-be8b-f1159aaa4a6a","year":2019},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:01.956643Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:af9e05c8512440451260ef918b05e648f08105721840cb494d15140d791f51e7","observation_id":"cc0f0c2b-a1dc-476b-b10c-03255ccb2970","resolution":{"observed_at":"2026-08-05T11:41:04.406690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-07-06T07:06:12.726165Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-05T11:41:02.074677Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.074677Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:772aaea889bf5fe3d1ea9dba7958359bd5f16e2586138ddca47c57632ff86445","observation_id":"de151e24-330f-45b9-866c-006bb4c8f4fc","resolution":{"observed_at":"2026-08-05T11:41:02.074677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.393157Z","title":null,"venue":null,"work_id":"0b33d894-c3c1-4f8c-b523-93d1d6c254d3","year":2001},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.138556Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:fc9853861a950cefb8c0139912a702b88720f2d988260137330a8b89330b8419","observation_id":"a453fb0d-3a67-440e-98f6-4fa9c9b0e1c8","resolution":{"observed_at":"2026-08-05T11:41:04.396470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17667","last_updated":"2025-03-27T03:50:10Z","snapshot_observed_at":"2026-08-04T18:12:22.604177Z","submitted_at":"2024-12-23T15:53:21Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","version":2},"cited_work":{"arxiv_id":"2412.17667","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17667","snapshot_observed_at":"2026-08-05T11:41:04.094259Z","title":"VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music","venue":"cs.SD","work_id":"82d2e034-d9ca-4484-8af3-96ba81acac25","year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.200360Z"},"links":{"cited_paper":"/paper/2412.17667","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:de9830669a872ef51e7e862eec7fe66d53fee7768839ac2148d603ef682d9eb8","observation_id":"b8806d74-13dd-4cc4-ba8a-076b351a8004","resolution":{"observed_at":"2026-08-05T11:41:04.098006Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.383583Z","title":"N.; Schmidt, E","venue":null,"work_id":"23dd84bd-f49c-4701-b68d-9590e1cb752b","year":2013},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.309545Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:d3b49dce295de110c43eac966c16a30073777b52a2a90d7bf812bcf9027e3c15","observation_id":"eff70ad0-7b96-40fc-bd37-35e17082d966","resolution":{"observed_at":"2026-08-05T11:41:04.386666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.373920Z","title":"H.; Hendriks, R","venue":null,"work_id":"65d4d954-8c72-4b08-b22e-570bdf69b6e5","year":2010},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.381565Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:ded284a769665c2b97b5780e2f341a4bf2df930568488e4c9769e0e0def065f8","observation_id":"8a463900-e011-4976-86e2-97d3c35378dc","resolution":{"observed_at":"2026-08-05T11:41:04.377070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-07T22:11:30.869700Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-05T11:41:02.518205Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.518205Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:6095deb11bd3dce35b49002793ac271f28a03e6f84b82bbf0cff2fa2a9f18a21","observation_id":"ce6b07cc-d5d2-4996-a763-d36c11704d54","resolution":{"observed_at":"2026-08-05T11:41:02.518205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08314","last_updated":"2020-01-01T23:22:00Z","snapshot_observed_at":"2026-08-02T22:36:40.076489Z","submitted_at":"2019-02-21T23:51:59Z","title":"The NIGENS General Sound Events Database","version":4},"cited_work":{"arxiv_id":"1902.08314","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.08314","snapshot_observed_at":"2026-08-05T11:41:04.066267Z","title":"The NIGENS General Sound Events Database","venue":"cs.SD","work_id":"025eaa66-3265-4bc4-bc63-f1239516bc6a","year":2019},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.601030Z"},"links":{"cited_paper":"/paper/1902.08314","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:b73a1162923f9ac54dcf60afd43fa59dbb591eaca63299f377ad23fb387ebab3","observation_id":"03b0a86c-cb85-473d-b780-520c321c6c11","resolution":{"observed_at":"2026-08-05T11:41:04.071637Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.363135Z","title":"R.; Raj, B.; Schuller, B","venue":null,"work_id":"7db18c6c-d8c5-4f80-9ea8-e1a545e4cec7","year":2022},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.666947Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:28ee8b10c02f48aedfb4f5b548cc45d3a0983a959f9e867e89e223eb643843bc","observation_id":"30d21b5d-1902-47af-9c0d-29ac0e1673e7","resolution":{"observed_at":"2026-08-05T11:41:04.366253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.351705Z","title":null,"venue":null,"work_id":"05698e93-ea59-4a2c-acb3-31612f69e6b4","year":2002},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.742122Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:c308d49bb9725dd337d7017e1e75ba3f3cd2e8b3c940d1aa1a755b4d3735ec61","observation_id":"fc303a4f-dcba-417d-b40a-bd6dd1ba35e5","resolution":{"observed_at":"2026-08-05T11:41:04.354887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.340568Z","title":null,"venue":null,"work_id":"06710e61-bf98-42cf-84c9-286964cdf737","year":2020},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.811772Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:3744116677030c8f1bcb544a6c68cb9d11f4db8be410508a54df7545a16de032","observation_id":"bc06e258-47b4-4404-95f8-06b431213ad2","resolution":{"observed_at":"2026-08-05T11:41:04.343975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.01051","last_updated":"2021-10-15T22:04:39Z","snapshot_observed_at":"2026-07-06T11:05:55.984799Z","submitted_at":"2021-05-03T17:51:09Z","title":"SUPERB: Speech processing Universal PERformance Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.01051","snapshot_observed_at":"2026-08-05T11:41:02.892997Z","title":"J.; Lakhotia, K.; Lin, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.892997Z"},"links":{"cited_paper":"/paper/2105.01051","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:dc957c6882505f18605c4460aa2beb8e4b877fc0745aec4e8bfbf5c221124899","observation_id":"5d9a2068-4691-4b0e-a7a7-c09ff5e2cc0c","resolution":{"observed_at":"2026-08-05T11:41:02.892997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.330926Z","title":null,"venue":null,"work_id":"d4366f20-61c8-4071-b961-4eac3fe5ac00","year":2018},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.970745Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:dc982d19bfe5c778b499d27f134b1ccdb6ca7fa71fba59bf016777539305ca50","observation_id":"15dd05fc-46da-4b25-b856-3a303dd80783","resolution":{"observed_at":"2026-08-05T11:41:04.333986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13071","last_updated":"2024-09-18T12:02:47Z","snapshot_observed_at":"2026-08-06T09:11:48.466453Z","submitted_at":"2024-02-20T15:13:38Z","title":"Codec-SUPERB: An In-Depth Analysis of Sound Codec Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13071","snapshot_observed_at":"2026-08-05T11:41:03.061958Z","title":"H.; and yi Lee, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.061958Z"},"links":{"cited_paper":"/paper/2402.13071","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:769058b1f6a0542b08786b2cfa48b05b027856e5a9e8f680c1e3f612e7b6c4c3","observation_id":"db1b1c6a-f73d-4258-9a08-7d2061a8b98d","resolution":{"observed_at":"2026-08-05T11:41:03.061958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10344","last_updated":"2025-04-14T15:51:56Z","snapshot_observed_at":"2026-08-07T16:05:50.273054Z","submitted_at":"2025-04-14T15:51:56Z","title":"ALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10344","snapshot_observed_at":"2026-08-05T11:41:03.148013Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.148013Z"},"links":{"cited_paper":"/paper/2504.10344","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:a07c78d727c0353c2081bf797456d62ca0ff976a9c096af3b999fc8dc3c9e744","observation_id":"b8e10872-b9b5-478e-acec-aa350f22d77d","resolution":{"observed_at":"2026-08-05T11:41:03.148013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-05T11:41:03.195908Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.195908Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:31260a275961dd627d1bd8e3d13e08b99720e7c25f3af5cc9e1bf8709261c08f","observation_id":"9e4cf411-10da-45fd-ad7f-82ba079270fc","resolution":{"observed_at":"2026-08-05T11:41:03.195908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.17175","last_updated":"2024-11-27T11:47:45Z","snapshot_observed_at":"2026-07-06T19:08:09.037019Z","submitted_at":"2024-08-30T10:24:07Z","title":"Codec Does Matter: Exploring the Semantic Shortcoming of Codec for Audio Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.17175","snapshot_observed_at":"2026-08-05T11:41:03.271092Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.271092Z"},"links":{"cited_paper":"/paper/2408.17175","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:40e5db3a9c4f090cbcb6b34ca357dbb8fd5c17d3553eb9cf37fafb5538a20f81","observation_id":"7faf283e-5a81-47c3-a261-f05c2c987f46","resolution":{"observed_at":"2026-08-05T11:41:03.271092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:03.379059Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.379059Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:1d0914f86a5938936bd706897a69bc289aef9cd0218607f1ff911b68ed038023","observation_id":"ce7f5422-a9ca-493f-9db5-40fd5858d125","resolution":{"observed_at":"2026-08-05T11:41:03.379059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:04.320420Z","title":null,"venue":null,"work_id":"48d48070-0faf-47f0-9fa0-f38482dd8213","year":2023},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.453458Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:65c049bed5148e74621ab1caf4f8cd4b0016da856778ff93aaf5eaf982ee8b18","observation_id":"8400f03c-743c-4c1e-9ea4-10d93974d056","resolution":{"observed_at":"2026-08-05T11:41:04.323654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03312","last_updated":"2021-07-07T15:45:42Z","snapshot_observed_at":"2026-08-09T07:05:32.492915Z","submitted_at":"2021-07-07T15:45:42Z","title":"SoundStream: An End-to-End Neural Audio Codec","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03312","snapshot_observed_at":"2026-08-05T11:41:03.517998Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.517998Z"},"links":{"cited_paper":"/paper/2107.03312","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:f99eba64eb2683225f73089d2f8813cd89755400ebc50d7a449a8b6090f0b34e","observation_id":"f7a8ed48-8e2f-4b77-985e-251722f8d049","resolution":{"observed_at":"2026-08-05T11:41:03.517998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-07T13:32:24.356336Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-05T11:41:03.583482Z","title":"J.; Jia, Y.; Chen, Z.; and Wu, Y","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.583482Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:1f0162c7e1058a8d1ef22b607535bb360fb9539676fba06e7a319c6e03dca04c","observation_id":"18c176e8-b0bb-48a0-8d2d-1410b95474e0","resolution":{"observed_at":"2026-08-05T11:41:03.583482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16692","last_updated":"2024-01-23T01:56:57Z","snapshot_observed_at":"2026-08-07T03:22:13.424379Z","submitted_at":"2023-08-31T12:53:09Z","title":"SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16692","snapshot_observed_at":"2026-08-05T11:41:03.627960Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.627960Z"},"links":{"cited_paper":"/paper/2308.16692","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:a9a67fccb07611019274fcf0be5ada16f3adca34d46589f6714df879cd23e2ab","observation_id":"6177a395-c42e-4f7b-b2fb-c50277146890","resolution":{"observed_at":"2026-08-05T11:41:03.627960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:03.703590Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.703590Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:31280050130d376a248350b768034ea95ccae4a122368e5d309bc77088bbc7bf","observation_id":"fa8d46de-6198-43ad-a040-000f71f1416b","resolution":{"observed_at":"2026-08-05T11:41:03.703590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:41:03.777818Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:03.777818Z"},"links":{"citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:685d05208e4e8ed911fbff2656ad9a24f12d52c9cacf41894e4d3e64140bf803","observation_id":"23bfc070-8601-48a9-8969-c57c37ac9e68","resolution":{"observed_at":"2026-08-05T11:41:03.777818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-09T00:24:32.254551Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":45,"verified_exact":1,"verified_fuzzy":6},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2509.02349."}