{"as_of":"2026-08-09T09:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d19cf3240dbd59f37dcf92164c46558f8f60ffe535098eacd16f00d4be601a3","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:26:51.361777Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:26:48.588697Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T16:26:51.692001Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"cited_work":{"arxiv_id":"2507.13626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.13626","snapshot_observed_at":"2026-08-06T16:26:51.692001Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","venue":"eess.AS","work_id":"8816efb3-3de6-4dae-b6ba-98365598e62e","year":2025},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.588697Z"},"links":{"cited_paper":"/paper/2507.13626","citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:9ff4af1026eb95c1bd421976cdfb8f93f615e9a8345e95352d2870be4c97695c","observation_id":"024b4c23-8533-439a-9e2f-a0b93d9661a8","resolution":{"observed_at":"2026-08-06T16:26:51.750509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.13626/citation-record","integrity":"/paper/2507.13626/integrity","json":"/paper/2507.13626/citation-record.json","paper":"/paper/2507.13626"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"cited_work":{"arxiv_id":"2507.13626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.13626","snapshot_observed_at":"2026-08-06T16:26:51.692001Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","venue":"eess.AS","work_id":"8816efb3-3de6-4dae-b6ba-98365598e62e","year":2025},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.588697Z"},"links":{"cited_paper":"/paper/2507.13626","citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:9ff4af1026eb95c1bd421976cdfb8f93f615e9a8345e95352d2870be4c97695c","observation_id":"024b4c23-8533-439a-9e2f-a0b93d9661a8","resolution":{"observed_at":"2026-08-06T16:26:51.750509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:55.672944Z","title":"all listener","venue":null,"work_id":"e57f4615-c7dd-4032-9870-911260ccc122","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.669915Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:531d0ca92d7618eb1d89b18761473f56421db9b3cec25bca5185dc91a3af691b","observation_id":"91079d56-e74a-42d4-8969-77a7991f6e9f","resolution":{"observed_at":"2026-08-06T16:26:55.751403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:55.305159Z","title":"prefer- ence","venue":null,"work_id":"77861d4d-5475-41c4-8305-768f76128f36","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.881492Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:d575c41e649f1f11695271288d232fea8277ece9634aef67f56863433bcf883b","observation_id":"c7ab896f-ecfc-418c-b7c0-520a80252659","resolution":{"observed_at":"2026-08-06T16:26:55.379288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4100.9376","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.563422Z","title":"Datasets 4.1.1","venue":null,"work_id":"c064be8f-b260-4cbd-a4be-31e6f0d9375f","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.979981Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:8ed20eef0da297a845708d4ed36ca0fc2d12b65ac83c7a6f2df730bc1bf6d2cc","observation_id":"b227920a-fe9c-455a-b0ba-8464bea82671","resolution":{"observed_at":"2026-08-06T16:26:51.610345Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:55.141836Z","title":null,"venue":null,"work_id":"566793de-98ac-402f-8f14-02b163aff126","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.051701Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:cf4a43c99d75b7fd600927cd9bdd67458fcc01b8be26fa940a2aa9d8866aa7db","observation_id":"8041a287-d07d-4eae-b164-12d980ad1f12","resolution":{"observed_at":"2026-08-06T16:26:55.242333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.989384Z","title":null,"venue":null,"work_id":"9d9cb2e8-7366-48e1-a5f3-2fb52cdcad9d","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.101507Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:4b8b90f4170821be91cdd6cd019c533197d73db37804604fe3d8c53723ea4413","observation_id":"5b73d180-b75b-4cda-bb56-86a5a08bcc92","resolution":{"observed_at":"2026-08-06T16:26:55.056884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.152872Z","title":"Ef- fect of attentive listening robot on pleasure and arousal change in psychiatric daycare,","venue":null,"work_id":"26f7cbad-deae-46aa-81cd-5a03da6733d6","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.702767Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:0ccc97082174c602347c9e0189b3e547549d4b7aef3e8b5e0737d792a4e2e149","observation_id":"9400441c-ff38-4c1b-84d9-41e6e5c0f616","resolution":{"observed_at":"2026-08-06T16:26:54.228681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:49.234447Z","title":"Speech intelligibility prediction using a neurogram similarity index measure,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.234447Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:bc51efcafd22c03bb93f2e674aa725b637686c5577347eaab22e9f17f156d191","observation_id":"b2281349-9313-411d-8afa-6aea4de69d1b","resolution":{"observed_at":"2026-08-06T16:26:49.234447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.870836Z","title":"Glow-tts: A generative flow for text-to-speech via monotonic alignment search,","venue":null,"work_id":"b84f9987-8764-496f-a45b-7617e0df52e5","year":2020},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.295448Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:e50558e33c1e55c282fc157a605d10cf45b6fe9c44e8152fada8806bf14dcb21","observation_id":"a4971b68-2b9d-4dbe-bf7f-ae34b1a770d5","resolution":{"observed_at":"2026-08-06T16:26:54.936732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.752821Z","title":"Grad-tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":"ce9016db-bfca-4085-a243-3a602668e545","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.370049Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:a073dd06e6976121fdd3038be9a913696159e05df4e23817a39745bbc6b4b9d3","observation_id":"3b6befe2-68e2-47c6-83be-bb22088c76e4","resolution":{"observed_at":"2026-08-06T16:26:54.799858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.607880Z","title":"Low bit-rate speech coding with vq-vae and a wavenet decoder,","venue":null,"work_id":"1170ddcc-a6a0-4460-a6c3-45d7ae98a819","year":2019},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.452732Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:ec87af0938234d4175f2aef26daeda2d1ebba111f8314777c0130a7daf662adf","observation_id":"973c4d01-ffde-4ca5-a033-eba47b4ec345","resolution":{"observed_at":"2026-08-06T16:26:54.646174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.447833Z","title":"Lpcnet: Improving neural speech synthesis through linear prediction,","venue":null,"work_id":"194bc9b4-6dec-4b75-94f2-21ae28885197","year":2019},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.539155Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:5e98c93a9dfdfe88f1adf4de729a8986a190c7a215f9e429012e0640622496f0","observation_id":"28dbdaa2-52f8-43fa-a561-ddb5e892d01b","resolution":{"observed_at":"2026-08-06T16:26:54.514998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.308862Z","title":"Developing conversational virtual humans for social emotion elicitation based on large language models,","venue":null,"work_id":"d48fb36c-dce8-490d-8ed4-ca5103a8f54e","year":2024},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.623254Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:f4b772d108f79a2fea504c7e104b0d25ce0dd75a6fd38d3f2004b8756e0be5ed","observation_id":"13464c96-3e16-44fb-8120-8f5c1b331224","resolution":{"observed_at":"2026-08-06T16:26:54.372902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.101335Z","title":"Moslight: A lightweight data-efficient system for non-intrusive speech quality assessment,","venue":null,"work_id":"99ad6194-0f11-4cff-b79a-bf586fbf5fe6","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.297681Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:cae785e7dc8973809c8a00ea3f9b99009b2724480f29d00c661f92e1d6df22b9","observation_id":"738eba42-5ac5-48a8-9f10-6fc99e7fc947","resolution":{"observed_at":"2026-08-06T16:26:53.178914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.041509Z","title":"An evaluation of speech-based recognition of emotional and physiological markers of stress,","venue":null,"work_id":"90007370-f490-4b4b-a840-2377fe3bb204","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.806369Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:7972bd7b09b4b294f1b5c34042780b14826728e1658c7dfe0114bf213242c5a5","observation_id":"ccecc54c-2f2e-44fe-bbd7-aa37e6a4da82","resolution":{"observed_at":"2026-08-06T16:26:54.110573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.915601Z","title":"Mental health monitoring from speech and language,","venue":null,"work_id":"a6b85530-0b11-425d-a350-762c2aa12f37","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.881868Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:a87722e0e9ed82df81df41c590d9dbb6fdc604fb58a58e0a7f6d5a679c5e9b9d","observation_id":"2c478314-0935-4554-bdd3-566432591486","resolution":{"observed_at":"2026-08-06T16:26:53.971205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.738842Z","title":"Mining valence, arousal, and dominance: possibilities for de- tecting burnout and productivity?","venue":null,"work_id":"c7ab3fda-a28f-4fb1-abfc-bbd865c8e9ab","year":2016},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.960280Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:4ef47d7c273ac807f9d48095ca567ce1aa36c24df176af1c3aeb8fcbb1a4d0c4","observation_id":"080f8632-31f9-4cbc-916e-5d97be733cf8","resolution":{"observed_at":"2026-08-06T16:26:53.822880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.573022Z","title":"Ldnet: Uni- fied listener dependent modeling in mos prediction for synthetic speech,","venue":null,"work_id":"b0bb47c4-220b-45b0-b704-017271314c1d","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.059562Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:244fce98666a7ca87c22346d61c44b744892f2d4003e15a22f6c8bed10684662","observation_id":"3f8bdec2-8d2b-4eb1-9e62-96a2efe9a2b4","resolution":{"observed_at":"2026-08-06T16:26:53.661813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.420293Z","title":"UTMOS: UTokyo-SaruLab System for V oice- MOS Challenge 2022,","venue":null,"work_id":"6b947e60-26bd-44cb-8ce0-3bb5970bca1a","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.145017Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:b5ea811e7fac5a4c57b7da1edeee05752144037abed555fa3d2d43ba789c446c","observation_id":"bb1680f6-8c02-44fc-8f4c-c2d0e5c9789d","resolution":{"observed_at":"2026-08-06T16:26:53.506604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.254393Z","title":"Sqat- ld: Speech quality assessment transformer utilizing listener de- pendent modeling for zero-shot out-of-domain mos prediction,","venue":null,"work_id":"afdf9542-c621-471d-aedb-c4fef15d9056","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.247411Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:fa998237de0d18cfd6fa3792e189060588f4c803770b37d7f5566494a3c1acfd","observation_id":"a47a948c-e10f-4883-9866-472e431baea5","resolution":{"observed_at":"2026-08-06T16:26:53.354590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:50.792739Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.792739Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:7649829aec69e2c084c308b2b396c69d23d4d853e6c158d85aae350368145c07","observation_id":"ab00940d-82bb-406f-960a-19d05ffd7508","resolution":{"observed_at":"2026-08-06T16:26:50.792739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.947204Z","title":"Meaningless statistics,","venue":null,"work_id":"32c1d7bb-4753-48f8-994b-caf079aa686c","year":1987},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.365122Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:83e70b849564029ffec2e87568816249da6408bd8c691d7cf379dd3d09401f77","observation_id":"2376936c-ce4a-4965-9135-aab2cd323a23","resolution":{"observed_at":"2026-08-06T16:26:53.008495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.794946Z","title":"Preference-based training framework for automatic speech quality assessment using deep neural network,","venue":null,"work_id":"4e6b5b1a-8fa6-439b-bd8a-86d6b6d61cd3","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.448142Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:36d746e6f9eb2a85acf30a2560ee38fd688e42ae3f75dcab7aeb6859dc7a6285","observation_id":"e1f49513-ed02-4119-884b-daca928a07a5","resolution":{"observed_at":"2026-08-06T16:26:52.871378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:50.533280Z","title":"Dawn of the trans- former era in speech emotion recognition: closing the valence gap,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.533280Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:47657cd70bc28fb770f31c1c3b61f867c67b3fbe074023b3d6bbc03e55bca4a9","observation_id":"1b78adf0-8afa-4a83-bf21-4b6bf100e934","resolution":{"observed_at":"2026-08-06T16:26:50.533280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.656001Z","title":"Speech emotion recognition based on listener-dependent emotion perception mod- els,","venue":null,"work_id":"ddd30c70-df73-4221-8d41-62ba956fb692","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.597515Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:f92603a8d240d1c9f61d85e5a94e9563927b30193b1925bef74b328669433df2","observation_id":"56647c9b-b61b-4419-8390-5dc3c4c21fe8","resolution":{"observed_at":"2026-08-06T16:26:52.729633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.497265Z","title":"Multi-task conformer with multi-feature com- bination for speech emotion recognition,","venue":null,"work_id":"ce7970b0-792e-4faa-bbb1-24745388227a","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.667652Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:9835068ebea1f5d5cefbf1db73008c7b8ef2f2641d05b729c2fc054b9d738a3e","observation_id":"21fe2704-2215-4ca3-b4f8-f9dc23432ca2","resolution":{"observed_at":"2026-08-06T16:26:52.529387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.338715Z","title":"Mbnet: Mos prediction for synthesized speech with mean-bias network,","venue":null,"work_id":"e018f1ea-f962-4868-9300-f19807acf678","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.728821Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:de1710c1509c6da2b56b8ad1b81b94a4e3337db5d078d8daaa0a17adadc2a70a","observation_id":"6b6aeeb4-d352-4d24-9d7e-290c1d5a7d65","resolution":{"observed_at":"2026-08-06T16:26:52.424912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.294187Z","title":"Iemocap: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.294187Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:7dfe59cf7893827f206101d443727e22280d2311dd2bf24ceedf10150513ab22","observation_id":"bf5b91ca-025f-4d6b-af0c-53e2ec9c753b","resolution":{"observed_at":"2026-08-06T16:26:51.294187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11680","last_updated":"2021-09-23T22:50:32Z","snapshot_observed_at":"2026-08-02T00:37:53.191869Z","submitted_at":"2021-09-23T22:50:32Z","title":"Simple and Effective Zero-shot Cross-lingual Phoneme Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11680","snapshot_observed_at":"2026-08-06T16:26:50.889367Z","title":"Simple and effective zero-shot cross-lingual phoneme recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.889367Z"},"links":{"cited_paper":"/paper/2109.11680","citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:4895d7fceaa46327dfccdc4e057f9d9fca336884f820633b534ad5e70ee6a9eb","observation_id":"9ec44357-d726-4598-b4c3-b813b7740c46","resolution":{"observed_at":"2026-08-06T16:26:50.889367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.200929Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise","venue":null,"work_id":"f547b741-f96a-4ecc-9bf4-5b30005fcfb6","year":1996},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.960938Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:b37838be8a242e270b96c38ab2a818a45be1252096a0c3bcc6d3395306578ac4","observation_id":"4b99fca8-1b4e-41dc-9a98-350610c70159","resolution":{"observed_at":"2026-08-06T16:26:52.263749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.068323Z","title":"Robust wav2vec 2.0: Analyzing domain shift in self- supervised pre-training,","venue":null,"work_id":"c473dd88-95a4-4845-b292-31520d81c3a7","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.030162Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:67e312b3d9934a6f910c3c9adbaa1f5f718ff4e804c29ca51688a11bf191f870","observation_id":"98e896c7-7cc8-4649-aa96-71a76ea22aa0","resolution":{"observed_at":"2026-08-06T16:26:52.134863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.089994Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.089994Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:7d93295991949660d1edf94aa64bc6ce2b9725df740cbc464e45edfc8eddb357","observation_id":"5a79dae9-feb6-4da1-971a-32a6e3b9d5e0","resolution":{"observed_at":"2026-08-06T16:26:51.089994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T16:26:51.167162Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.167162Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:781da9d51115e6c292534be232f21ae32fe03e02ad80f0aef93cdc4f53b93a73","observation_id":"3652ca6e-da39-4ee9-86da-b04ff8d13132","resolution":{"observed_at":"2026-08-06T16:26:51.167162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.938304Z","title":"The V oiceMOS Challenge 2022,","venue":null,"work_id":"128c70bb-312c-4dd7-b294-d5a68a08e375","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.225829Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:ac36d1997ffcd32f2377b0b2abe31bc7b470089f0ca19bdb42452a8c68261a14","observation_id":"3afd3b3c-00c1-43b1-babe-b48ebced884e","resolution":{"observed_at":"2026-08-06T16:26:51.989354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.810807Z","title":"Exploring wav2vec 2.0 fine tuning for improved speech emotion recognition,","venue":null,"work_id":"1e923d2d-2540-4476-ab03-c37e827a9db3","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.361777Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:4c5064159c7530c887d1d9781e525c43842b4f44cebef9c5f15ea12794e1d31a","observation_id":"d2638599-23ee-49b6-8c86-ff9e51d517ac","resolution":{"observed_at":"2026-08-06T16:26:51.856641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:55.469562Z","title":"Due to its robust performance and relevance, the UTP model serves as the baseline for our proposed approach","venue":null,"work_id":"938f578f-2221-4a1d-8b56-8ff0aae3c155","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.776779Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:2cc02c07feb6fad7fa445ed50a15ae6386f55f4e5dc6ad3cad27ac5db2bb19d0","observation_id":"11c2779a-ce3b-4ae3-a81c-ae3e5878de59","resolution":{"observed_at":"2026-08-06T16:26:55.559246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2507.13626."}