{"as_of":"2026-08-14T08:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e95698cb12d7c61fe166955e90e7797a0b701cd3c457ae9f292ab31fc16144a2","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T03:16:39.283647Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T03:16:39.283647Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T14:39:57.492094Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"cited_work":{"arxiv_id":"2606.26903","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.26903","snapshot_observed_at":"2026-07-04T14:39:57.492094Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","venue":"eess.AS","work_id":"a7d743a2-14ce-4e9a-b3b7-753d7b93254c","year":2026},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"cited_paper":"/paper/2606.26903","citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:02fd1cd21282f19ef6dd211674218c5d5d9ed2f2a61f9e5db049dca85d612b14","observation_id":"9fdf7a4c-ae54-4fff-b73e-f89e38891a57","resolution":{"observed_at":"2026-07-04T14:39:57.493359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.26903/citation-record","integrity":"/paper/2606.26903/integrity","json":"/paper/2606.26903/citation-record.json","paper":"/paper/2606.26903"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"quality manifold,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:ff51e3f29762c86abaa23ecf34629198a48760956217dd87663fced1f6fb5ae6","observation_id":"50c2a6d9-5000-47ca-9f14-2f4627e0dd5c","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"cited_work":{"arxiv_id":"2606.26903","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.26903","snapshot_observed_at":"2026-07-04T14:39:57.492094Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","venue":"eess.AS","work_id":"a7d743a2-14ce-4e9a-b3b7-753d7b93254c","year":2026},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"cited_paper":"/paper/2606.26903","citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:02fd1cd21282f19ef6dd211674218c5d5d9ed2f2a61f9e5db049dca85d612b14","observation_id":"9fdf7a4c-ae54-4fff-b73e-f89e38891a57","resolution":{"observed_at":"2026-07-04T14:39:57.493359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"quality manifold","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:ce94a6bfb78fcb2b9539787e2ab9504c77efe3e48ff713f16349f33ac0eeafd0","observation_id":"e85d9ab2-bfb7-44f2-8ab9-43ad02fe0e12","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:11e2da2605b0cf9032a8296f3ed958ce388d0ddc9cf53884bf4ab30f493485e6","observation_id":"41f558f7-752c-4840-b87d-110301a94282","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"The computations were enabled by re- sources provided by Chalmers e-Commons at Chalmers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:c0ca251a7306c61ec752d3913e3aa8c2925755e7a8f7a3febf3b4649fdbaeb23","observation_id":"e4e25b0c-8955-4f37-a384-e40519c5950d","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"The authors carefully reviewed and edited all AI-generated sugges- tions and assume full responsibility for the final content of the paper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:c4c6ecefe0316c1273809f7c84f005964ab4f2e943196f6065362eedfe8e5e09","observation_id":"ed14a400-f863-4432-b254-7b0b8b787b91","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Generaliza- tion ability of mos prediction networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:0113ff26d3ef464be2f6a454c38e8a8e68b6273cd74de5e1f031bcb91fb91cb3","observation_id":"ef3b8b10-26e4-4c0f-aa04-db87f41e448d","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Utmos: Utokyo-sarulab system for voicemos challenge 2022,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:ac58b6120cfb656a60261d7bd98d6b0855f5181ed432d1172492c732c2a845e4","observation_id":"9ee83406-c0a4-4291-97af-db2b41dc35f9","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08962","last_updated":"2025-08-12T14:25:55Z","snapshot_observed_at":"2026-08-07T05:14:55.078958Z","submitted_at":"2025-08-12T14:25:55Z","title":"Selection of Layers from Self-supervised Learning Models for Predicting Mean-Opinion-Score of Speech","version":1},"cited_work":{"arxiv_id":"2508.08962","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.08962","snapshot_observed_at":"2026-07-04T14:39:57.477580Z","title":"K., Schuldt, C., and Chatterjee, S","venue":null,"work_id":"835869ec-d7e5-436b-b75a-65b632f9990d","year":2025},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"cited_paper":"/paper/2508.08962","citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:0e927aa5e5560c652c6b04b0ad04ae4dcf10f059a49d242c5fc2d83df5dd4142","observation_id":"351c0156-72ac-445f-810c-d331a3266d6b","resolution":{"observed_at":"2026-07-04T14:39:57.479305Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Multivariate probabilistic assessment of speech quality,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:e89971ca4d867adfec4c71ac70f71b558fcdf0a1f41a371be26c65e3b302b9d4","observation_id":"11297d0e-a3c5-4e9f-b424-b841dcb9bcee","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Enabling auditory large language models for automatic speech quality evaluation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:8dcd1a37adf8b9be6b67204b4e8636e52dceccf8e739ad31254abebc73b7d078","observation_id":"7899c9bf-5a74-4f1e-9e0e-d61d902c8d7c","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"MOSNet: Deep learning-based ob- jective assessment for voice conversion,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:b2ffe1b620fbceb599bc4bf11e7d87089fdc554d722e6f6c8c76c7d5f345d067","observation_id":"92bdf941-ba09-451f-8ac2-d80e32f69267","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Deepmos: Deep posterior mean-opinion-score of speech,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:d13f1176c24a3952fc01836572ed4ffcb16cdd76a6aa1e9e8bb39c78348a635d","observation_id":"374a7244-b581-4bad-a800-ccab6aaa6728","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"NISQA: A deep CNN-self-attention model for multidimensional speech quality prediction with crowdsourced datasets,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:557f9c0e581332d20df442605cb068f1be8c70685af2fab68e976cb961b79cdb","observation_id":"3c5f2b94-d656-491b-8801-82c9248157bb","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"LDNet: Unified listener dependent modeling in MOS prediction for syn- thetic speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:54a57ae7aeb827305c270edbedb742126e19de24f495a0771fc444beaa9ae982","observation_id":"7d26a1fa-ff3f-48ed-ab68-8c27794b8073","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"DNSMOS: A non-intrusive perceptual objective speech quality metric to evaluate noise sup- pressors,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:82c43618c8a6124103155258ae01fb96a53d7f9eac7001a52423195f85ad4273","observation_id":"0f333c60-74fa-4800-b828-c24b19e1fed3","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Dnsmos pro: A reduced-size dnn for probabilistic mos of speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:692a41eb09efec38f672a8256b33195ae16a8d064b70b77d7add56bf77cccc20","observation_id":"5afaa1fb-abec-4213-9a69-96d7cee59a5a","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Generalization ability of end-to-end non-intrusive speech quality models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:53d8acb8501da2301acd88d5d364e40df5d603201b7259345973154919e4d953","observation_id":"eb69b205-3273-4edc-a134-b3a49a4e7381","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-04T09:19:45.912586Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":"1703.07737","doi":null,"metadata_source":"pith","pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-07-04T14:39:57.480607Z","title":"In Defense of the Triplet Loss for Person Re-Identification","venue":"cs.CV","work_id":"a72dd8f5-38f0-4656-b761-3af761bac9ef","year":2017},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:7da8349abd6ebc1b7b5693e7f9de0f0b84cb82b84396f1dc245b7f4569727bec","observation_id":"9da38ca3-be1d-438f-a1d1-bb36c829d372","resolution":{"observed_at":"2026-07-04T14:39:57.482006Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Learning contrastive embedding in low-dimensional space,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:239643f348af8ca417c62e2242d641ed1495589394d609615f42b3b04d3ecc72","observation_id":"d00813c7-5bb0-4699-8bc3-1583fa3845b9","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03292","last_updated":"2025-09-03T13:19:56Z","snapshot_observed_at":"2026-08-13T15:47:58.625184Z","submitted_at":"2025-09-03T13:19:56Z","title":"Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings","version":1},"cited_work":{"arxiv_id":"2509.03292","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.03292","snapshot_observed_at":"2026-07-04T14:39:57.486114Z","title":"Improving perceptual audio aesthetic assessment via triplet loss and self-supervised embeddings,","venue":null,"work_id":"f0473862-44b3-4e02-8bcb-d6b59a79ee70","year":2025},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"cited_paper":"/paper/2509.03292","citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:75caf43c847f346e4113f8818b333bf92738956e818da7269fb3fb89311c62fc","observation_id":"5ed07b03-18c9-470d-8a5c-1519df88cac1","resolution":{"observed_at":"2026-07-04T14:39:57.487688Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Scoreq: Speech qual- ity assessment with contrastive regression,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:da8d51c88ea76d5639d0752ddb505044ec4761eb31423d7cc2881f09d9c5880e","observation_id":"96118273-5c43-4205-aa49-cab1cf54f4df","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Deepmos-b: Deep posterior mean-opinion-score using beta distribution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:6ed2a6ebc461ecc20603dd2c2de11fa52dd92c9800cc24488152aca9adc319fc","observation_id":"012e831b-106d-479e-b026-25472591f28e","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11389","last_updated":"2022-07-04T01:13:01Z","snapshot_observed_at":"2026-08-13T16:18:24.234935Z","submitted_at":"2022-03-21T23:32:08Z","title":"The VoiceMOS Challenge 2022","version":3},"cited_work":{"arxiv_id":"2203.11389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.11389","snapshot_observed_at":"2026-07-04T14:39:57.488878Z","title":"arXiv:2203.11389 (2022)","venue":null,"work_id":"0eeb6e1f-dda0-4165-8a88-1321cfdad64a","year":2022},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"cited_paper":"/paper/2203.11389","citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:ca5ed30d256006f045d7105ded7ac4ded04e49ea6cc9e2951ce8aa362fbead37","observation_id":"a9182275-2441-4e59-a5cd-a7da4b362878","resolution":{"observed_at":"2026-07-04T14:39:57.490601Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Conferencingspeech 2022 challenge: Non-intrusive objective speech quality assessment (nisqa) challenge for online conferencing applications,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:3cef9445c53de48e9174bd17f6dbeb6951880eb3b07b059b043e00948e99868b","observation_id":"543dae17-0a98-4dc9-bc4e-fc6ed1c3233a","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Tcd-voip, a research database of degraded speech for assessing quality in voip applications,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:b3320311aa8509a69dd3b4ea39f6efbcbb7d6e982617f7556968dfe437d2cc7c","observation_id":"bda20948-1596-455c-b6a3-1c41b21dac29","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Impairments are clustered in latents of deep neu- ral network-based speech quality models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:2693fc77d79a834baf9ca598391ae6af4b29661a8cf8439865d592e8a9082ee6","observation_id":"40f59c3f-f1f1-498a-82fc-5521ce611b7c","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Esc: Dataset for environmental sound classifica- tion,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:7d232dbd42f8cab770505f583a12e6940fab94a0fd55a6a63f634dcdc7a64fe0","observation_id":"4634ce61-67ec-4bb3-955c-8375bdb5569c","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:5d89c80e8391221efb70c61d7d3fb3c0b2585e20f5592d709ada285556739740","observation_id":"ac933bfa-7789-46f5-b9b0-ce2d520e01ef","resolution":{"observed_at":"2026-07-04T14:39:57.484557Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"Notes on the history of correlation,","venue":null,"work_id":null,"year":1920},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:562de4358d0c2434fd4cfa66d9d6db467355ea49f45d887c566864fbc1d4c017","observation_id":"942b27a9-7a49-48ab-9054-8c43583f441b","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T03:16:39.283647Z","title":"The proof and measurement of association be- tween two things,","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T03:16:39.283647Z"},"links":{"citing_paper":"/paper/2606.26903"},"observation_digest":"sha256:c666e7201cc97cbcfe0cc40e907f436865ca2b5609676364a9b8d19868c2a84e","observation_id":"b0bffff0-0832-45b8-b67c-7aa4bb04a1aa","resolution":{"observed_at":"2026-06-26T03:16:39.283647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.26903","last_updated":"2026-06-25T11:35:12Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T03:19:55.751164Z","submitted_at":"2026-06-25T11:35:12Z","title":"DNSMOS-C: Improving End-to-end Speech Quality Models via Contrastive Learning"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":25,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2606.26903."}