{"as_of":"2026-08-21T04:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:370e4a2d6fe1f45a184a4e948766918d7f8b10be615b4b4fdf6cf1ad86c63207","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:19:43.008072Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.02915/citation-record","integrity":"/paper/2509.02915/integrity","json":"/paper/2509.02915/citation-record.json","paper":"/paper/2509.02915"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.260343Z","title":"Abouelenin, A","venue":null,"work_id":"3242963e-0666-455a-bdd0-ef3726d841c2","year":null},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.939406Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:2231f75a5c4795e1ae19e2487f3657b345d4a3622f92e85858c587b59ed28442","observation_id":"933c7434-5c48-4e1c-b2fb-716fac5c4960","resolution":{"observed_at":"2026-08-05T11:19:43.263206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:42.945902Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.945902Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:529f311e261ebd236f7dbb3ff30a11a7f055fc710b2c963dce1cd0ab9601f6e9","observation_id":"c5cd4442-4ad9-44f4-9a5f-b1a2f3d80c6a","resolution":{"observed_at":"2026-08-05T11:19:42.945902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.251982Z","title":"Baevski, Y","venue":null,"work_id":"63386f8b-3794-4666-8eeb-9a3195af071a","year":2020},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.948635Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:eee24633f70b14b70a7d5f0609843792db5bfe27bed03509958ece282b8354cc","observation_id":"53cb387e-cf11-4d78-8680-efc97a8c4af4","resolution":{"observed_at":"2026-08-05T11:19:43.254788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.243674Z","title":"Bernstein, M","venue":null,"work_id":"4c12ef4e-135d-4f17-a9a2-cf1a3867f6d7","year":1990},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.951625Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:90065cd6db5b7cd24e70b38d0f1f8dd809af3e536d85b52f4672658b7ab47de9","observation_id":"e1b17751-3e27-4e7d-9c69-e6f31f8430a7","resolution":{"observed_at":"2026-08-05T11:19:43.246369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:42.954345Z","title":"Conneau, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.954345Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:1e62ebb21350710afb92b9395b9e5bda4c8c1306ff2992df467be53fb67cbc66","observation_id":"cc2b9817-7863-40c5-a02e-19a4fef45703","resolution":{"observed_at":"2026-08-05T11:19:42.954345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.235405Z","title":"Eskenazi","venue":null,"work_id":"35b1de5c-36d0-4c7f-aebd-66c96b26f2a5","year":2009},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.957213Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:07b95b1666def69de64651e5f3e2bb6c4dc95bf58e74f807890ce07c92966479","observation_id":"7cc9ca8c-5c95-49d0-9a00-26db1bd323f1","resolution":{"observed_at":"2026-08-05T11:19:43.238262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.226678Z","title":null,"venue":null,"work_id":"4cc370c1-3e0e-4bfb-8f65-fb5b29aa9683","year":2020},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.959913Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:e990ef547354df0445092b1017e471fd44c3f55d5320f5b57d5c5dec282b8f71","observation_id":"94c094bd-be2f-4c2b-b002-d9315a1a33d0","resolution":{"observed_at":"2026-08-05T11:19:43.230019Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.218566Z","title":"Fouz-González","venue":null,"work_id":"afd592fd-05e6-43c6-8ade-520c9bc0077d","year":2015},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.962417Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:dd28dd1f1765b16ad84c9ceec90076d5671183f4e54e4f7e2bde4f0b01c7ad62","observation_id":"2f9871f2-3186-46df-bb7a-1723c7646c33","resolution":{"observed_at":"2026-08-05T11:19:43.221266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.210048Z","title":"Franco, V","venue":null,"work_id":"630b7b88-5556-45a7-9567-aaf920056e39","year":2000},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.965085Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:872bbc98384e34d2cc1df39be072fde95fc47f71e795194f5f8bc061953fc933","observation_id":"67458fb0-2126-4758-993e-6e5f33a6da42","resolution":{"observed_at":"2026-08-05T11:19:43.212713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.200968Z","title":"Franco, L","venue":null,"work_id":"4c36cd1f-d40f-4197-bb8c-0eeb909e830b","year":2000},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.967618Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:ced9394aabea8208617a017608b6ea721d3d3f8f9637b0432b264e5e0ba9ff31","observation_id":"c7f09170-62b8-4e54-9f81-50fe93b75989","resolution":{"observed_at":"2026-08-05T11:19:43.204163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09209","last_updated":"2024-07-18T13:09:20Z","snapshot_observed_at":"2026-08-16T13:34:47.143580Z","submitted_at":"2024-07-12T12:16:14Z","title":"Pronunciation Assessment with Multi-modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2407.09209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.09209","snapshot_observed_at":"2026-08-05T11:19:43.087061Z","title":"Pronunciation Assessment with Multi-modal Large Language Models","venue":"cs.CL","work_id":"2c14d0e8-c1a4-4119-84f8-aa8f9393f5f8","year":2024},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.970390Z"},"links":{"cited_paper":"/paper/2407.09209","citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:9da2811fcc2c27819f4f80e44df088c394c554802b47a7923ff715ac90a318bc","observation_id":"03e4ed73-c35c-41d2-9c80-719bee1377e2","resolution":{"observed_at":"2026-08-05T11:19:43.091517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.191969Z","title":"Getman, R","venue":null,"work_id":"c14a0131-e1ba-4601-8a51-841c7f8c3e63","year":2022},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.973448Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:9f192d1c0c5c344f85d2b4d3379da03bfda249cb297c9ee7957e89e7401ee1cf","observation_id":"0ad21643-f4e1-4ecc-9341-f221a8c4375e","resolution":{"observed_at":"2026-08-05T11:19:43.194685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.182789Z","title":null,"venue":null,"work_id":"9dfb3277-8a7c-407b-b4f2-088f9d22c7d6","year":2022},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.975939Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:3a0036d07a935de5715ebdbf70bebf8698e115a8b13ad15c25782bc8a0e7e8d1","observation_id":"48fbda38-b138-4c1d-a56f-e7848578c5a2","resolution":{"observed_at":"2026-08-05T11:19:43.185853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.174014Z","title":null,"venue":null,"work_id":"a67f9301-7110-460e-b23b-4e02c5e820f9","year":2024},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.978322Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:7114815d1a2082ab7c929533d487fd5b16e3eda11eb90015529cf895d06c8f72","observation_id":"e48d234a-2f67-479e-8def-0c9de5e6a379","resolution":{"observed_at":"2026-08-05T11:19:43.176968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.164951Z","title":null,"venue":null,"work_id":"341b10c5-704a-4b88-8513-d92f0cebacae","year":2021},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.981074Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:1c9ae234ec59da7f7a2ff19565f620223da4ce70fb6ddc4bf73712de59f4ca04","observation_id":"c170b657-fb4b-4a1b-ba98-cda5ae411607","resolution":{"observed_at":"2026-08-05T11:19:43.168192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T11:19:42.983831Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.983831Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:28d84229d0712fccc61f44c92589971bb158ddfa21e97897d539a31e4fbc4f80","observation_id":"94bc5f7f-2469-444f-a3b4-47523633c03c","resolution":{"observed_at":"2026-08-05T11:19:42.983831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.155592Z","title":null,"venue":null,"work_id":"8663ddce-aca3-4c5a-860b-5d8301c8c444","year":2025},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.986680Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:d3786d9f47419d29de2790687fe835a58b0f7c3da545498edf29501c85c1aac6","observation_id":"7e25da7d-42f0-40b5-b84f-ea0368222193","resolution":{"observed_at":"2026-08-05T11:19:43.158656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.146176Z","title":null,"venue":null,"work_id":"b56fd4ea-b8ce-4158-8b1e-45f43e3a2226","year":2021},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.989341Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:835a5a8ffb379fb7ab1ae2b9fef82100b6dfbc292626cbfc883eb919e76d5afd","observation_id":"6ef86a96-0233-41a3-b558-84ca7011a1dc","resolution":{"observed_at":"2026-08-05T11:19:43.148928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.136683Z","title":null,"venue":null,"work_id":"db7b3c51-fd99-4cb2-94f5-dcd7fb05b248","year":2010},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.991812Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:3b676a49c21231a4aa753172f3d40ead4fb6f2a948c4e925156275f592a331f7","observation_id":"310c6971-548f-4364-a96b-64e524bff2ac","resolution":{"observed_at":"2026-08-05T11:19:43.139712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2023-337","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"ee6be301-281c-4a8a-9124-d7c0f4307ee7","year":2023},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.994481Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:10b40d19486997a824d8c82a2170bfad911c4e1a54c93b3a40873cd0a2d6e99c","observation_id":"2cd42ff9-4b04-498b-9310-b44bbd21033d","resolution":{"observed_at":"2026-08-05T11:19:43.036601Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11229","last_updated":"2025-03-14T09:26:07Z","snapshot_observed_at":"2026-08-16T12:50:05.107322Z","submitted_at":"2025-03-14T09:26:07Z","title":"Exploring the Potential of Large Multimodal Models as Effective Alternatives for Pronunciation Assessment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11229","snapshot_observed_at":"2026-08-05T11:19:42.997161Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.997161Z"},"links":{"cited_paper":"/paper/2503.11229","citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:8b39ad144bc25a8554004d3c6ebbc80d66a74d70d9f0824ab8e99599b3c183e7","observation_id":"34b6fc64-f4c1-47d2-8035-6e1bd1ce09d3","resolution":{"observed_at":"2026-08-05T11:19:42.997161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.126725Z","title":"Weide et al","venue":null,"work_id":"f200083a-6f84-41f5-ab08-16f92245a02a","year":1998},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.999977Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:41ad2e21b05109e7b4b0230c1a57bf34a3c18e80c574f5fb0d2ac362200ec18f","observation_id":"853bce83-c81d-4f38-8d57-6f14d0c25070","resolution":{"observed_at":"2026-08-05T11:19:43.130641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.117331Z","title":null,"venue":null,"work_id":"7ded1036-d4b3-452a-8daf-8fd2f153af23","year":2000},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:43.002766Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:b879a563839ba56ac1f648fdbae60394c930d2387dfa4fb9a27d5997b2519006","observation_id":"eae5dddd-d3b7-491c-a6c8-cbadcf245cef","resolution":{"observed_at":"2026-08-05T11:19:43.120454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:19:43.108176Z","title":null,"venue":null,"work_id":"3f072a24-c2ac-4013-8698-0d1ac6226c44","year":2022},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:43.005410Z"},"links":{"citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:f13b01059e061026e957abced7f81aa08bae280049d8f7cb427491862348cf0c","observation_id":"f4239a25-43cb-4218-8a5b-8fa0b5390ee2","resolution":{"observed_at":"2026-08-05T11:19:43.110819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01378","last_updated":"2021-06-02T13:12:02Z","snapshot_observed_at":"2026-08-16T18:34:05.761886Z","submitted_at":"2021-04-03T11:31:59Z","title":"speechocean762: An Open-Source Non-native English Speech Corpus For Pronunciation Assessment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01378","snapshot_observed_at":"2026-08-05T11:19:43.008072Z","title":"Zhang, Z","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:43.008072Z"},"links":{"cited_paper":"/paper/2104.01378","citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:9bd3753a743fd3012d81701cc6a660c2993a74757e28f121effd1bde98d8bafd","observation_id":"157c7e08-a52c-420b-b212-4bc73558c90e","resolution":{"observed_at":"2026-08-05T11:19:43.008072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-08-15T22:57:45.773661Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-05T11:19:42.942707Z","title":"arXiv preprint arXiv:2503.01743 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T11:19:42.942707Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2509.02915"},"observation_digest":"sha256:0c00944cbcc849c58503eccde5c8ba7970c9e95d5147f9dfc784f20f65a5c806","observation_id":"a4dc714a-680e-4c93-bfc8-6ee9cb9f5593","resolution":{"observed_at":"2026-08-05T11:19:42.942707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.02915","last_updated":"2025-09-03T00:56:18Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T19:34:55.109980Z","submitted_at":"2025-09-03T00:56:18Z","title":"English Pronunciation Evaluation without Complex Joint Training: LoRA Fine-tuned Speech Multimodal LLM"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":9},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2509.02915."}