{"as_of":"2026-08-13T23:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b0e330d6bf1d6db52542221086d561a73dc9ef4360f0376d5cd3d78d01dd389","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:10:00.349207Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.19335/citation-record","integrity":"/paper/2506.19335/integrity","json":"/paper/2506.19335/citation-record.json","paper":"/paper/2506.19335"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:05.247615Z","title":"Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"72ba4ea2-ff0b-41b4-b979-08eaf4a3d94f","year":2001},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:57.866160Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b8841a585df768f4ca41ec3f6bbb2a206c2443bf21889129bbb0486408f2771b","observation_id":"d96e89fb-35c7-4d42-a8c8-b3b92d4a957d","resolution":{"observed_at":"2026-08-06T23:10:05.311086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:05.015221Z","title":"MOSNet: Deep learning based objective assessment for voice conversion,","venue":null,"work_id":"39f388f8-57f5-4d52-86cc-f552106c204c","year":2019},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:57.948058Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:df6fcf8a5ed14c147bcd3887b8019f98d6ff4a7e67be9025a0463f55b724bf1e","observation_id":"262f80f0-d3e2-43f7-be0a-17c5b67f2e4d","resolution":{"observed_at":"2026-08-06T23:10:05.083770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.872225Z","title":"Speech quality assessment through MOS using non-matching references,","venue":null,"work_id":"8f187470-b8f6-4d69-baa1-bbc71fcd527c","year":2022},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.041595Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:0ae5a4cfbbdda7ad22083528613efaa5010a66eeda6ecc9c31ce2ae8973dbfbd","observation_id":"9197a5b9-9b9b-4b0f-a38b-03d1f8d1b5be","resolution":{"observed_at":"2026-08-06T23:10:04.937579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08130","last_updated":"2023-02-16T07:49:06Z","snapshot_observed_at":"2026-08-13T12:43:35.514541Z","submitted_at":"2023-02-16T07:49:06Z","title":"Personalized Audio Quality Preference Prediction","version":1},"cited_work":{"arxiv_id":"2302.08130","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.08130","snapshot_observed_at":"2026-08-06T23:10:01.104968Z","title":"Personalized Audio Quality Preference Prediction","venue":"cs.SD","work_id":"512b308b-e065-47f5-bcf5-b96dd1c2ffcb","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.213212Z"},"links":{"cited_paper":"/paper/2302.08130","citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b0bd02cd9ae0b265fcc264d13de519ec506b2a583ccd6c5f8e4cf8c72768307c","observation_id":"c71ca7bc-4267-44f2-96c7-18c5e3a5d0ac","resolution":{"observed_at":"2026-08-06T23:10:01.234200Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.699294Z","title":"Generalization ability of MOS prediction networks,","venue":null,"work_id":"bff5797f-58b1-4785-8ca8-3937217e6a31","year":2022},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.324453Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:1bd767914ac7b9ef7d09609798e133731b6c0da91047b19b2c1687cd00844c9f","observation_id":"c9dc12f4-5eaa-40d3-9fc9-b9c2258de40f","resolution":{"observed_at":"2026-08-06T23:10:04.760945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.525454Z","title":"Methods for subjective determination of transmis- sion quality,","venue":null,"work_id":"0c313783-84d2-47a1-b901-50842516bb9a","year":1996},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.506366Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:693635ef759bc2a3a34bae2b351b6c2bddc5a6012bc1e0982d40b642d055c891","observation_id":"a444f8f2-56f9-41b9-9de1-a780a0da43ce","resolution":{"observed_at":"2026-08-06T23:10:04.607970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.325442Z","title":"Here or There: Preference Judgments for Relevance,","venue":null,"work_id":"76b81e1b-aa3f-4ae5-9c0e-2658a31974d6","year":2008},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.613893Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:c233f57d7a417a6237bfac9bc327fc937efadc7bdae608f52e8b1d6277cc80a4","observation_id":"2fdcfd3d-ae4a-410a-a07b-185dccbf09a9","resolution":{"observed_at":"2026-08-06T23:10:04.409339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.051744Z","title":"Comparison of four subjective methods for image quality assessment,","venue":null,"work_id":"12d4b10a-04e2-4a21-991e-57b910550499","year":2012},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.685104Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:5faeb0e4502534d0225e5622a8cbe9495f93d9e711c6f0b469b46d06c58e6ad2","observation_id":"1429e2b7-19db-4dc4-b468-5c013be32caf","resolution":{"observed_at":"2026-08-06T23:10:04.190441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:03.687518Z","title":"AutoMOS: Learning a non-intrusive assessor of naturalness- of-speech,","venue":null,"work_id":"a44bba52-8ba0-4c09-94b8-38692e2e76d8","year":2016},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.865820Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b388d910894124d3735387b2eb3038ab68ff5227dc08dd475522d324c2528723","observation_id":"51f76f08-d07f-4565-8f2d-209e8ab3c64d","resolution":{"observed_at":"2026-08-06T23:10:03.860825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:03.332984Z","title":"MBNet: MOS prediction for synthesized speech with mean-bias network,","venue":null,"work_id":"fab05ccc-ecc3-42ae-9a61-ae4312e41d19","year":2021},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.010942Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:2143a9b88784f48c1478a8cfe3660cbd272a5ab6340b243688d2cade55e09fa2","observation_id":"ba7e165e-7bdd-4f0f-a75e-f85a7a98d38e","resolution":{"observed_at":"2026-08-06T23:10:03.533531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:03.053548Z","title":"LDNet: Unified listener dependent modeling in MOS prediction for synthetic speech,","venue":null,"work_id":"50ffd979-e025-4a41-bec4-c813221a180f","year":2022},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.103562Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b668ad0a6be3b681833cac86e4af43ada83e2d0ce2b875b2fa6e824ea2c744b3","observation_id":"2de4dc13-b3f0-4cf9-8a48-df0ab51f6b60","resolution":{"observed_at":"2026-08-06T23:10:03.158797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.844449Z","title":"UTMOS: Utokyo-Sarulab System for V oiceMOS Challenge 2022,","venue":null,"work_id":"fe46c399-4ce2-4325-bc5b-bfe2940e0c4c","year":2022},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.192461Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:3c5731588c6690fded289bf3748080a3f0c9396f82dc95af26b33196cee90dc1","observation_id":"59604e28-9040-4c68-8248-2930bb71ed10","resolution":{"observed_at":"2026-08-06T23:10:02.936281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10493","last_updated":"2023-06-18T07:38:17Z","snapshot_observed_at":"2026-08-13T14:43:39.477932Z","submitted_at":"2023-06-18T07:38:17Z","title":"MOSPC: MOS Prediction Based on Pairwise Comparison","version":1},"cited_work":{"arxiv_id":"2306.10493","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10493","snapshot_observed_at":"2026-08-06T23:10:00.884033Z","title":"MOSPC: MOS Prediction Based on Pairwise Comparison","venue":"cs.SD","work_id":"3eb42dc9-5a84-4a94-88fb-2685345222d6","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.313257Z"},"links":{"cited_paper":"/paper/2306.10493","citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:12ec6db9f4367a226d462b2e92c16542572edd7e501fc659c36aea600accdc3d","observation_id":"1eee25eb-1344-468e-a8cf-923af492cc87","resolution":{"observed_at":"2026-08-06T23:10:00.978345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15203","last_updated":"2023-08-29T10:40:57Z","snapshot_observed_at":"2026-08-13T10:25:05.163186Z","submitted_at":"2023-08-29T10:40:57Z","title":"Preference-based training framework for automatic speech quality assessment using deep neural network","version":1},"cited_work":{"arxiv_id":"2308.15203","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.15203","snapshot_observed_at":"2026-08-06T23:10:00.662159Z","title":"Preference-based training framework for automatic speech quality assessment using deep neural network","venue":"eess.AS","work_id":"295dbb5c-6b02-4d82-af91-670a05fdc286","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.405444Z"},"links":{"cited_paper":"/paper/2308.15203","citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:8f164fedab635b3a81408886671857877bc3ef8caf011d4c95115e1f322f2ccf","observation_id":"34ae232f-92cb-447d-804e-8a70f2590be9","resolution":{"observed_at":"2026-08-06T23:10:00.733577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.614053Z","title":"PromptTTS: Controllable text-to-speech with text descriptions,","venue":null,"work_id":"b7b43da8-d425-4ad9-a75d-c656ad25b6c1","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.511569Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:4f4a14b457c3bc1bbf63820a83ee58363cc98b84a8ad24716c07d13458b6d36b","observation_id":"a6e6c00c-2fd0-4445-952f-19e1d1445ba3","resolution":{"observed_at":"2026-08-06T23:10:02.731247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.369364Z","title":"Coco-Nut: Corpus of Japanese Utterance and V oice Characteristics Description for Prompt-Based Control,","venue":null,"work_id":"265ee824-3931-4499-8faa-a36007f882a7","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.627219Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:357c36d01e26b626aa76ccd4ca36fb81366f596abac77dabca542317863b08eb","observation_id":"89174a89-7a4d-48b7-b6cf-0bfd5d10d5d8","resolution":{"observed_at":"2026-08-06T23:10:02.481922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16509","last_updated":"2023-12-27T14:41:23Z","snapshot_observed_at":"2026-08-13T05:15:46.145809Z","submitted_at":"2023-11-28T04:49:17Z","title":"StyleCap: Automatic Speaking-Style Captioning from Speech Based on Speech and Language Self-supervised Learning Models","version":2},"cited_work":{"arxiv_id":"2311.16509","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.16509","snapshot_observed_at":"2026-08-06T23:10:00.460568Z","title":"StyleCap: Automatic Speaking-Style Captioning from Speech Based on Speech and Language Self-supervised Learning Models","venue":"cs.CL","work_id":"4d09d021-5208-44de-a6b2-dd645f374284","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.709627Z"},"links":{"cited_paper":"/paper/2311.16509","citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:00bc53643f704b7f638dbd3e8c1da5adc5be4cb1667129763e08118b64ebcf39","observation_id":"b5b8105c-6099-402a-9b54-081f6bd5f2b6","resolution":{"observed_at":"2026-08-06T23:10:00.557403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.179904Z","title":"Extraction of everyday expression associated with voice quality of normal utterance,","venue":null,"work_id":"2816589b-effe-4e78-8caf-bab8ae79ce2a","year":1999},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.805380Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b75521c37b65fbc844629496adb363f27556f06e1598df8998f6c6adf0ada653","observation_id":"3d6d22b9-29ff-4752-8d14-4e86aded1b4f","resolution":{"observed_at":"2026-08-06T23:10:02.309847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.043932Z","title":"A dendrite method for cluster analysis,","venue":null,"work_id":"3c0c265f-21e4-4603-8cb0-78d7c8e05454","year":1974},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.886900Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:2e9104c0f6a29e8c28aa31373d55e8a9d8d4ed4caf87035bda147cdf08c29bbf","observation_id":"0d89aa07-e4b8-4a9f-acd3-708bbe064cec","resolution":{"observed_at":"2026-08-06T23:10:02.088948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:09:59.945984Z","title":"The proof and measurement of association between two things.,","venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.945984Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:e84e149746abf42d8e4d251c94a327524857ad502fffe75e5f12cba04837734f","observation_id":"54f76ea7-9a2b-42e1-81b5-ed6fb5f4cde5","resolution":{"observed_at":"2026-08-06T23:09:59.945984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:01.863496Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"64d55494-b9fc-402c-bf02-848f57ae4dc0","year":2020},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:00.053354Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:0cc08d91a6f7e7d1997f4c80ccfa68fbbbb8ae4523715a770acd768ac4853694","observation_id":"544b8d65-f418-40db-aeaa-8a74c35c7970","resolution":{"observed_at":"2026-08-06T23:10:01.967506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:01.673374Z","title":"Librispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":"303cc2fd-4431-42cd-9b44-cec6ba2d8899","year":2015},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:00.166955Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:329b7205f094cb61451dc78a9da80d7a494e461ebfc2ab4d79d32d9c94e1e045","observation_id":"4684b367-d441-405f-b124-5ef639da91f3","resolution":{"observed_at":"2026-08-06T23:10:01.734546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:01.514089Z","title":"fairseq: A fast, extensible toolkit for sequence modeling,","venue":null,"work_id":"a39b0a62-1abe-41e2-bbe2-28e4246435b1","year":2019},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:00.253399Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:8a33fc08735da634bde34f2472fa4b64f725e18c6903246fdc936dbfec4adeea","observation_id":"d7366710-805f-4dfc-a18a-9a09bff9b422","resolution":{"observed_at":"2026-08-06T23:10:01.587812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:01.333944Z","title":"Learning to Rank Using Gradient Descent,","venue":null,"work_id":"c80eb322-3b1a-404c-bffe-f36402041aff","year":2005},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:00.349207Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:7ba1ee51f3aaf3b1aa007b21c62e34637291263ab7afba814396328fad5d89df","observation_id":"f5d662b7-3175-4958-95e7-8bf15dad5fee","resolution":{"observed_at":"2026-08-06T23:10:01.402685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-13T10:50:09.287492Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":4,"verified_fuzzy":19},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2506.19335."}