{"as_of":"2026-08-17T20:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cbf9652a44b233f29fe8b73a141da3724426e307753251138fb16e2238844b97","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:29:11.225870Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:20:18.032456Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T02:09:24.101764Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":"2505.15000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards spoken math- ematical reasoning: Benchmarking speech-based models over multi- faceted math problems","venue":null,"work_id":"e9b6f4a0-f512-4e81-982f-29a48a43e672","year":2025},"citing_paper":{"arxiv_id":"2510.09592","last_updated":"2026-05-10T15:21:35Z","snapshot_observed_at":"2026-08-12T12:52:03.560465Z","submitted_at":"2025-10-10T17:50:59Z","title":"Mind-Paced Speaking: A Dual-Brain Approach to Real-Time Reasoning in Spoken Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T07:43:23.913399Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2510.09592"},"observation_digest":"sha256:c801bdf3ede533a1a734d160849f3382c89111bb2f949316456465d15beb3dc8","observation_id":"5a02317f-104d-4e39-a2a5-766b072b0843","resolution":{"observed_at":"2026-05-18T07:46:03.523212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":"2505.15000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards spoken math- ematical reasoning: Benchmarking speech-based models over multi- faceted math problems","venue":null,"work_id":"e9b6f4a0-f512-4e81-982f-29a48a43e672","year":2025},"citing_paper":{"arxiv_id":"2604.25719","last_updated":"2026-05-31T23:35:54Z","snapshot_observed_at":"2026-08-16T02:24:16.699897Z","submitted_at":"2026-04-28T14:44:30Z","title":"Step-Audio-R1.5 Technical Report","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-07T14:12:56.278256Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2604.25719"},"observation_digest":"sha256:9db38aea7a0e445afa89196373a055f76507e00c30e976d2c075e238d5d593a3","observation_id":"1597cf4d-188a-4f55-802e-283e695a2adc","resolution":{"observed_at":"2026-05-12T00:46:13.579952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":"2505.15000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards spoken math- ematical reasoning: Benchmarking speech-based models over multi- faceted math problems","venue":null,"work_id":"e9b6f4a0-f512-4e81-982f-29a48a43e672","year":2025},"citing_paper":{"arxiv_id":"2605.21008","last_updated":"2026-05-20T10:44:56Z","snapshot_observed_at":"2026-08-15T09:30:05.500365Z","submitted_at":"2026-05-20T10:44:56Z","title":"A Survey of Audio Reasoning in Multimodal Foundation Models","version":1},"reference_index":127,"source":"pdf_text","source_observed_at":"2026-05-21T02:08:06.976461Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2605.21008"},"observation_digest":"sha256:a7258cce62bcd2eb8caecaaf9b97b6aff7b4e91ed04171dbcb64ba77204e7613","observation_id":"e831c21e-5c89-43e9-a2b8-e51abbb0ae8b","resolution":{"observed_at":"2026-05-21T02:09:24.104663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15000","snapshot_observed_at":"2026-08-01T11:20:18.032456Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19932","last_updated":"2026-08-07T08:39:15Z","snapshot_observed_at":"2026-08-14T00:00:01.957485Z","submitted_at":"2026-07-22T09:04:55Z","title":"Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T11:20:18.032456Z"},"links":{"cited_paper":"/paper/2505.15000","citing_paper":"/paper/2607.19932"},"observation_digest":"sha256:47811d533c0886a92854a017990c9c107c351aac40772ca009b9960c04a9db15","observation_id":"57d2b1d6-7214-482b-80b6-266c8d138531","resolution":{"observed_at":"2026-08-01T11:20:18.032456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15000/citation-record","integrity":"/paper/2505.15000/integrity","json":"/paper/2505.15000/citation-record.json","paper":"/paper/2505.15000"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:05.383707Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.383707Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:59b868a7306bfff540a6cf5e15e3547d05fed50c3ce787731ba3e6d3b656b06a","observation_id":"85c6914a-5e75-49ce-8570-921a040a7767","resolution":{"observed_at":"2026-08-07T15:29:05.383707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:05.492840Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.492840Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:7a83d52abd60997d35f0e8fd0260aeeb004fb1e233b4b1817f1b3ed95fb7c37f","observation_id":"75dc0901-1399-48a2-81e0-7de589607136","resolution":{"observed_at":"2026-08-07T15:29:05.492840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-08-15T22:57:45.773661Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-07T15:29:05.603798Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.603798Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:905c20bd6055865e48f329c1c17baafb2cc3b52b2673f7b0837618b47e7b03c7","observation_id":"266e389a-678d-4477-8ce9-a6f32b368a9a","resolution":{"observed_at":"2026-08-07T15:29:05.603798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04051","last_updated":"2024-07-11T02:08:35Z","snapshot_observed_at":"2026-08-16T13:36:59.551255Z","submitted_at":"2024-07-04T16:49:02Z","title":"FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04051","snapshot_observed_at":"2026-08-07T15:29:05.746864Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.746864Z"},"links":{"cited_paper":"/paper/2407.04051","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:2b4b351847a956d4aff20b146f333928077babf589dc86126d634f2da08822a0","observation_id":"a291c044-2852-4cb3-b259-d15d1708d90b","resolution":{"observed_at":"2026-08-07T15:29:05.746864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-07T15:29:05.891772Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.891772Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:94c5c365fd368d6764ec0a9eeae59d37b9aa31dde4efeb53e230aef407c891b0","observation_id":"e6c5dcdc-367a-46f6-a876-48e8e644b503","resolution":{"observed_at":"2026-08-07T15:29:05.891772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T15:29:05.982526Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:05.982526Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:8fd6597429bced311fd31bf9aec0096b5b9765309e404ba5806f223ee0bda4db","observation_id":"c528cbb1-192e-42ed-9ea7-6f26663486f2","resolution":{"observed_at":"2026-08-07T15:29:05.982526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T15:29:06.046164Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.046164Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:fb979d5d91c36519900d0aea7f8eb3994f8607173e332dc49665a378fcf14e9d","observation_id":"c9620cbb-0b11-4707-b5cd-91bcd36fbc23","resolution":{"observed_at":"2026-08-07T15:29:06.046164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04962","last_updated":"2025-05-27T16:14:30Z","snapshot_observed_at":"2026-08-17T03:02:03.416801Z","submitted_at":"2025-01-09T04:30:12Z","title":"VoxEval: Benchmarking the Knowledge Understanding Capabilities of End-to-End Spoken Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04962","snapshot_observed_at":"2026-08-07T15:29:06.156425Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.156425Z"},"links":{"cited_paper":"/paper/2501.04962","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:62e81e10847cb37f805cfdcae0d33b8562fae37f72ef8d595114bce3d5d3b211","observation_id":"3664a2fe-b193-4ef5-afd8-b995ec8f5b92","resolution":{"observed_at":"2026-08-07T15:29:06.156425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03751","last_updated":"2025-08-07T13:29:43Z","snapshot_observed_at":"2026-08-16T13:13:34.592774Z","submitted_at":"2024-10-01T21:48:12Z","title":"Recent Advances in Speech Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03751","snapshot_observed_at":"2026-08-07T15:29:06.241559Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.241559Z"},"links":{"cited_paper":"/paper/2410.03751","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:6bb5ea61d09a3dc238a46bcb98a8ead6c9ebc79476692beab2b8e8b7ca1bb709","observation_id":"776258d4-e59f-4fe8-a55e-cb813b7dfa3a","resolution":{"observed_at":"2026-08-07T15:29:06.241559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11768","last_updated":"2024-06-17T17:31:01Z","snapshot_observed_at":"2026-08-16T16:37:20.878280Z","submitted_at":"2024-06-17T17:31:01Z","title":"GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11768","snapshot_observed_at":"2026-08-07T15:29:06.347770Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.347770Z"},"links":{"cited_paper":"/paper/2406.11768","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:c60fc67feb3cf7f8b2aa291f399933a25dd7a163124596bced2fc377a5dacbb3","observation_id":"be7bd3bd-d8fd-4713-8ca7-15a84fd921ec","resolution":{"observed_at":"2026-08-07T15:29:06.347770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.511131Z","title":null,"venue":null,"work_id":"a2341e73-3e94-47e0-8c11-c8569998d61a","year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.447238Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d1dffdac4d70c8f04b28669b305b223928439d0232fc06c9da7a55440f49196f","observation_id":"b6743a7c-d15e-47ab-850a-7e2686a526c5","resolution":{"observed_at":"2026-08-07T15:29:14.642682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:29:06.506922Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.506922Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:667be59b7526b2329810c2dde97a7c680953c5956941eb73dcba38a0a9cab1e3","observation_id":"410a78f5-e00f-4e21-aee0-e7cd25e3da7c","resolution":{"observed_at":"2026-08-07T15:29:06.506922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:06.661963Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.661963Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:ca65c6280ee346e7cce2331c75239c78da0f5c12ed3b29724d61e0bf37ad7cd8","observation_id":"042367db-bc70-4ca2-9105-b29867ac3b75","resolution":{"observed_at":"2026-08-07T15:29:06.661963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11567","last_updated":"2023-12-04T20:55:53Z","snapshot_observed_at":"2026-08-16T14:41:57.340543Z","submitted_at":"2023-11-20T07:06:31Z","title":"InfiMM-Eval: Complex Open-Ended Reasoning Evaluation For Multi-Modal Large Language Models","version":3},"cited_work":{"arxiv_id":"2311.11567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.11567","snapshot_observed_at":"2026-08-07T15:29:12.054919Z","title":"InfiMM-Eval: Complex Open-Ended Reasoning Evaluation For Multi-Modal Large Language Models","venue":"cs.CV","work_id":"90939588-554c-48b5-b83c-ec54dc370de2","year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.752573Z"},"links":{"cited_paper":"/paper/2311.11567","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:00f8282c6bd025d95c373980be4cf23a9f20875dbd7d442167032efb0beb115e","observation_id":"e211f9c4-279c-4b75-8982-982754be555f","resolution":{"observed_at":"2026-08-07T15:29:12.179165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05444","last_updated":"2025-01-09T18:55:52Z","snapshot_observed_at":"2026-08-13T08:24:02.836306Z","submitted_at":"2025-01-09T18:55:52Z","title":"Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05444","snapshot_observed_at":"2026-08-07T15:29:06.836442Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.836442Z"},"links":{"cited_paper":"/paper/2501.05444","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:e3315d3b4e2204388501df8d6d78783b40efcf1519d464b85ca51504c2e65b9a","observation_id":"ca4d68d7-8604-484e-b562-19be0e03b0cf","resolution":{"observed_at":"2026-08-07T15:29:06.836442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09818","last_updated":"2025-01-16T03:29:23Z","snapshot_observed_at":"2026-08-15T13:23:21.388081Z","submitted_at":"2024-12-13T03:15:05Z","title":"MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09818","snapshot_observed_at":"2026-08-07T15:29:06.918057Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.918057Z"},"links":{"cited_paper":"/paper/2412.09818","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:9cd7fc2fa8a0b2c70f5f4f8acf7fc7dfe585a0f085b138676c691179928654e6","observation_id":"0aa76744-67c5-4a22-ae0c-6d7edda09bd1","resolution":{"observed_at":"2026-08-07T15:29:06.918057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:06.990799Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:06.990799Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:0ddcc3f173eb9b3b1e62c456b8e4c0bb88b8dfb42e2369dfaafe98a86aa7bbbc","observation_id":"afbdd6d7-55f5-4469-a78a-8f7fd1c431aa","resolution":{"observed_at":"2026-08-07T15:29:06.990799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:14.261576Z","title":null,"venue":null,"work_id":"5b25dc9f-5937-4b9f-8bb9-4d82c3bbcc29","year":2014},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.060061Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:14f050df5d74e809dfab3797446231d5cf6b897f5165ef5753a0bb9e9d288620","observation_id":"e6641d6b-4106-4342-8a7a-3cfd18529825","resolution":{"observed_at":"2026-08-07T15:29:14.372863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11946","last_updated":"2025-02-18T07:29:10Z","snapshot_observed_at":"2026-08-12T20:35:16.024701Z","submitted_at":"2025-02-17T15:58:56Z","title":"Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11946","snapshot_observed_at":"2026-08-07T15:29:07.130989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.130989Z"},"links":{"cited_paper":"/paper/2502.11946","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:043e26953b631287db72c4198d9544f27b10f85fefd3cc32633c978b61436ea4","observation_id":"c7bc4686-5ada-4b63-9ff4-27152db6d3f0","resolution":{"observed_at":"2026-08-07T15:29:07.130989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T15:29:07.276254Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.276254Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d7a6d39216c6474ca01b4e7ecd1385a93d6be32ee2074f73d27d716f38e531b5","observation_id":"9cf64359-b0d1-4418-8645-ae6f4fb80d1d","resolution":{"observed_at":"2026-08-07T15:29:07.276254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.992602Z","title":"Identifying and mitigating vulnerabilities in llm-integrated applications","venue":null,"work_id":"cbc94f94-7d87-4b21-a565-461138dcc628","year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.386967Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:4937ff8eaa80747178d421ca37586ea996e7f1665953128db71c000eb72e4220","observation_id":"9e65ca95-cf97-4614-a103-166d69d5f444","resolution":{"observed_at":"2026-08-07T15:29:14.146759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:07.575107Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.575107Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:267640f5c8b445ce1a059482850d8ef7e8178b7b378ff5f45d7b174cd4acc63d","observation_id":"c86d34b2-23f7-473a-b8d1-bc4262b5ef0d","resolution":{"observed_at":"2026-08-07T15:29:07.575107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:07.705019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.705019Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:9ad3dbc17b5169dd366f856260ced2d08c79c6af2075e397d6e133f6c57b1619","observation_id":"f5fd6abf-ca37-4e7b-a9ef-1b505acd5909","resolution":{"observed_at":"2026-08-07T15:29:07.705019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-07T15:29:07.815220Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.815220Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:37b732090568c471c7a217f532642db42a5831f14db506ddbbbaf4c962f14282","observation_id":"8a518f1d-38d9-4f42-a14c-d4df6cadc9e7","resolution":{"observed_at":"2026-08-07T15:29:07.815220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.777081Z","title":null,"venue":null,"work_id":"710b2324-dfeb-4023-a0b7-6ddde3e38939","year":2021},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:07.970827Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:ecfad7e4714cb55834e60610f2385d3add55eb36b88d8358aced89c9d00a43e0","observation_id":"45ab8b93-6c95-4f35-900e-c6b760657cf9","resolution":{"observed_at":"2026-08-07T15:29:13.850609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.458996Z","title":null,"venue":null,"work_id":"40698d22-c73d-4823-a098-cdb738c606fe","year":2022},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.140174Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:5d936c41c898fe04cefebccdf83a5512d6415a345f35d096670b1f478db95e7f","observation_id":"f57a2608-05d9-447f-a12f-d5f2eae2d3d4","resolution":{"observed_at":"2026-08-07T15:29:13.607467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:13.168506Z","title":null,"venue":null,"work_id":"82f37147-4f6b-4b4d-870b-b6372051313e","year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.269687Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:9aa8dccd2c5179400346e8b9d7ac73d9e3cdd8f8ad30c205c3e245792fa755ea","observation_id":"5b4d033c-4740-4584-9ebc-6f69d021e827","resolution":{"observed_at":"2026-08-07T15:29:13.299629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:08.439478Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.439478Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:482814efb74983cefcb49a176d9fbc375ef923e2695476789ac323b2ebfedb68","observation_id":"edf34150-7c3f-4609-aa30-344adb293b33","resolution":{"observed_at":"2026-08-07T15:29:08.439478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:08.670367Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.670367Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:26b2062c4fb8d298552657d9b4fc65a0e6a8be29a3e1d6aff1873aac050443b8","observation_id":"7b93e13b-f795-48cc-87b6-d2ceb4957420","resolution":{"observed_at":"2026-08-07T15:29:08.670367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01284","last_updated":"2024-07-01T13:39:08Z","snapshot_observed_at":"2026-08-12T06:11:26.786967Z","submitted_at":"2024-07-01T13:39:08Z","title":"We-Math: Does Your Large Multimodal Model Achieve Human-like Mathematical Reasoning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01284","snapshot_observed_at":"2026-08-07T15:29:08.761996Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.761996Z"},"links":{"cited_paper":"/paper/2407.01284","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:de7ade02a1a733e02f5cfd1dfe2e2181f67c8788427b9e7d30cf2e6d91300ea5","observation_id":"3eff4b52-9fde-4a5d-8613-7e369c6fd26b","resolution":{"observed_at":"2026-08-07T15:29:08.761996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:08.811385Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.811385Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:c922ef784ae94f32108099e87b1567f593e2cac5f4b502a5e6351caa3bd41435","observation_id":"7096508b-4efd-4f84-924d-279cddb03ad3","resolution":{"observed_at":"2026-08-07T15:29:08.811385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.911321Z","title":null,"venue":null,"work_id":"dfe95d15-b795-4f19-97d0-d1bb6f365681","year":2015},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.866273Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:2cf1f4e6558f9d3ff6345cf58d87d350a6ebc0a72b14992a1f36f0d28dd4063a","observation_id":"e4fc5f9c-95cc-4e26-884d-586c8bd12475","resolution":{"observed_at":"2026-08-07T15:29:13.025456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19168","last_updated":"2024-10-24T21:20:10Z","snapshot_observed_at":"2026-08-13T20:48:30.133767Z","submitted_at":"2024-10-24T21:20:10Z","title":"MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19168","snapshot_observed_at":"2026-08-07T15:29:08.907699Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.907699Z"},"links":{"cited_paper":"/paper/2410.19168","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:4615be5b275acf291a72718a414ff7c6132c6858b4a8011b8be8e99c71f85df5","observation_id":"11b05881-b78f-4b2b-9a64-cbcade8cdf47","resolution":{"observed_at":"2026-08-07T15:29:08.907699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13692","last_updated":"2023-07-28T03:31:08Z","snapshot_observed_at":"2026-08-16T15:13:21.359602Z","submitted_at":"2023-07-25T17:55:19Z","title":"ARB: Advanced Reasoning Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13692","snapshot_observed_at":"2026-08-07T15:29:08.957582Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:08.957582Z"},"links":{"cited_paper":"/paper/2307.13692","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:47de5817527733618b305bab5f62686b036602f8996a164b53cb036b8cff7e77","observation_id":"d217b324-4312-4423-b330-978c7bc4eca3","resolution":{"observed_at":"2026-08-07T15:29:08.957582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T15:29:09.009917Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.009917Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:2d82a296ce7b615a002c9b614649a186d5ad9af153acd9c0a50fa56cb58fa629","observation_id":"e4b22b5a-e1c1-4fbd-823c-6265b5be0127","resolution":{"observed_at":"2026-08-07T15:29:09.009917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-07T15:29:09.060214Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.060214Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:a3d166c6212f4ee5a2ed60e16ca62348ffbbbd87163cde9bc52fa82284eb413b","observation_id":"62377a18-2e9d-4fc0-9855-1509e8db42d4","resolution":{"observed_at":"2026-08-07T15:29:09.060214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-14T05:30:13.223510Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-07T15:29:09.112978Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.112978Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d379bf1e2dbc9b881f7066de2c19202280eedb8f9f223f44c58a72fa24d496e9","observation_id":"ae38544a-e1a5-4962-a735-e79322499815","resolution":{"observed_at":"2026-08-07T15:29:09.112978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.165431Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.165431Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:4a517e8d02e288d8b048b5d0ca3547ad076f4550d243366d5053bd07d71420fa","observation_id":"334d6059-03cd-458a-8931-d1168dcc0057","resolution":{"observed_at":"2026-08-07T15:29:09.165431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T15:29:09.231365Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.231365Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:6aa1ab6b1517178c00bee165e3286b141d2e1ed4d25e070724262694effddb82","observation_id":"bf90be1b-a9c8-48d5-ba24-832a9fcdf08e","resolution":{"observed_at":"2026-08-07T15:29:09.231365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06186","last_updated":"2025-01-10T18:59:51Z","snapshot_observed_at":"2026-08-16T12:59:16.590181Z","submitted_at":"2025-01-10T18:59:51Z","title":"LlamaV-o1: Rethinking Step-by-step Visual Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06186","snapshot_observed_at":"2026-08-07T15:29:09.303581Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.303581Z"},"links":{"cited_paper":"/paper/2501.06186","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:dafa11cd5231777a6352b9443ea57ef4f0bf42f87e6a115d6b14e26195db7b84","observation_id":"957facb3-f800-4cfd-a49b-e014d32d746e","resolution":{"observed_at":"2026-08-07T15:29:09.303581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10176","last_updated":"2024-11-03T03:48:02Z","snapshot_observed_at":"2026-08-16T17:24:49.433939Z","submitted_at":"2024-02-15T18:26:11Z","title":"OpenMathInstruct-1: A 1.8 Million Math Instruction Tuning Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10176","snapshot_observed_at":"2026-08-07T15:29:09.451527Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.451527Z"},"links":{"cited_paper":"/paper/2402.10176","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:aa284b7229fa357f02c9bac0798903a77b7365ae6316e08c7d6fe51ffa4f493c","observation_id":"1dfd7160-01e1-4910-accc-69f467d5916d","resolution":{"observed_at":"2026-08-07T15:29:09.451527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.630568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.630568Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:92d903882f0bca4b24d1999bd4508cc67a819458b19468719a4b5f363934b2db","observation_id":"6cb4693f-c41a-4568-9d0d-7b5c6e890d98","resolution":{"observed_at":"2026-08-07T15:29:09.630568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11699","last_updated":"2024-12-16T12:21:11Z","snapshot_observed_at":"2026-08-17T20:28:55.896193Z","submitted_at":"2024-12-16T12:21:11Z","title":"CoinMath: Harnessing the Power of Coding Instruction for Math LLMs","version":1},"cited_work":{"arxiv_id":"2412.11699","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11699","snapshot_observed_at":"2026-08-07T15:29:11.534622Z","title":"CoinMath: Harnessing the Power of Coding Instruction for Math LLMs","venue":"cs.CL","work_id":"69b30415-8118-46d2-be3d-1bc5c5f5aea1","year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.802739Z"},"links":{"cited_paper":"/paper/2412.11699","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:6a654367263159a90c80fcad6088e445e1a38e1f5eb2450caa98658bb4ee51f5","observation_id":"033c6da8-70f6-4ba8-87ce-e643a5b99b3a","resolution":{"observed_at":"2026-08-07T15:29:11.653822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:09.918646Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:09.918646Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:eb32492afbcfed7f70ca1f04f3d9bc8854e388cb07efe090778ee2613350940b","observation_id":"bf8e362f-a722-42c1-b9f2-df5b4b3d1c19","resolution":{"observed_at":"2026-08-07T15:29:09.918646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-15T17:00:20.282987Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-07T15:29:10.069369Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.069369Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:3ccca0d38f31846bf9e6d7765520b4a0e02010cb687bfba26150e3aa74477a7d","observation_id":"9f7fcb83-621b-48f1-8aa4-ea55d87c5f76","resolution":{"observed_at":"2026-08-07T15:29:10.069369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15279","last_updated":"2025-04-21T17:59:53Z","snapshot_observed_at":"2026-08-16T11:26:50.664277Z","submitted_at":"2025-04-21T17:59:53Z","title":"VisuLogic: A Benchmark for Evaluating Visual Reasoning in Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15279","snapshot_observed_at":"2026-08-07T15:29:10.165713Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.165713Z"},"links":{"cited_paper":"/paper/2504.15279","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:f6af60e3b606f038da0fc6a7a80b84575e82c46ea082f98bc17961991a39811f","observation_id":"2b724981-3f44-4de4-b84d-c906395ff3f3","resolution":{"observed_at":"2026-08-07T15:29:10.165713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-17T18:51:13.219936Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T15:29:10.500394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.500394Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:2db380c66b72dffb64caf1826d18b249154919d4036144b6a810f231e04b7cf8","observation_id":"05a65c43-edc5-4eb8-9042-f3dfef4010e6","resolution":{"observed_at":"2026-08-07T15:29:10.500394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07729","last_updated":"2024-07-26T06:30:47Z","snapshot_observed_at":"2026-08-16T14:19:18.351061Z","submitted_at":"2024-02-12T15:41:22Z","title":"AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07729","snapshot_observed_at":"2026-08-07T15:29:10.617952Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.617952Z"},"links":{"cited_paper":"/paper/2402.07729","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:90e9c5a0c0af5f35d7b195fa6601a97c5c57ec40d93a2399288b45dd72b5a0f6","observation_id":"2455d858-69a6-4ed7-b71c-3f6252576548","resolution":{"observed_at":"2026-08-07T15:29:10.617952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:10.696136Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.696136Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:dbb16650a6381e8e19d3c22901142510d6d2fc0de4069bc342ca124eec01dba8","observation_id":"3484289d-0fc8-4e26-9ec8-b14aca858f4e","resolution":{"observed_at":"2026-08-07T15:29:10.696136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13975","last_updated":"2024-12-20T12:52:00Z","snapshot_observed_at":"2026-08-17T12:59:24.069240Z","submitted_at":"2024-06-20T03:50:23Z","title":"MR-Ben: A Meta-Reasoning Benchmark for Evaluating System-2 Thinking in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13975","snapshot_observed_at":"2026-08-07T15:29:10.816937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.816937Z"},"links":{"cited_paper":"/paper/2406.13975","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:d7cdad9b6b354e9844bcc3dc086a6439b082ec58871d98ef46529b6408fee174","observation_id":"98cbffa3-3cc2-4f6b-8840-fc938a69a4b5","resolution":{"observed_at":"2026-08-07T15:29:10.816937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.643088Z","title":null,"venue":null,"work_id":"43400091-44ba-492d-8e63-cb5b5069c327","year":2023},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:10.988219Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:aee0ae02440fdbd9e0ee1df8b1e92961a23cb1d5926e7237e329041a4e863948","observation_id":"cca22b89-d645-42ee-b32b-5a6c2779d378","resolution":{"observed_at":"2026-08-07T15:29:12.749419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:29:12.402749Z","title":null,"venue":null,"work_id":"ad38232b-32ee-4214-940f-d9dd190ca201","year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:11.108727Z"},"links":{"citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:69efc5cc9e48366c11df2aca53cf972ee1b7c7aeb49f7f8e8b0d4ce08103240c","observation_id":"ba3d7663-9a9a-4344-af18-9833fe446361","resolution":{"observed_at":"2026-08-07T15:29:12.493642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08105","last_updated":"2025-04-07T21:05:50Z","snapshot_observed_at":"2026-08-16T13:10:37.696894Z","submitted_at":"2024-10-10T16:53:10Z","title":"What Makes Large Language Models Reason in (Multi-Turn) Code Generation?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08105","snapshot_observed_at":"2026-08-07T15:29:11.225870Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T15:29:11.225870Z"},"links":{"cited_paper":"/paper/2410.08105","citing_paper":"/paper/2505.15000"},"observation_digest":"sha256:afa8d51018ac5c2a5a1943f421e9dcf1ba76b6888d75a3171c05870a34da8b34","observation_id":"ea63c9ff-5161-465b-841f-43870f4dff29","resolution":{"observed_at":"2026-08-07T15:29:11.225870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.15000","last_updated":"2025-05-21T01:07:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T02:16:34.541286Z","submitted_at":"2025-05-21T01:07:00Z","title":"Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 4 inbound Pith citation observations for arXiv:2505.15000."}