{"as_of":"2026-08-18T00:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a8169edfa899d9101e276e589aa0971225f38353f8d0896c8d17670568f801b","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T20:40:22.043187Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.05170/citation-record","integrity":"/paper/2606.05170/integrity","json":"/paper/2606.05170/citation-record.json","paper":"/paper/2606.05170"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"Beyond accuracy: Measuring the severity of LLM hallucinations.Findings of the 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP Findings),","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:dd04247d02bbc25919919d85c87ca6fd15628ad240bac912f5e47b1c4b68a2af","observation_id":"a4911c00-4557-4639-b149-41d5ba070bb7","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"Lost in tran- scription, found in distribution shift: Demystifying hallucination in speech foundation models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:8be39ee3a06c0a68c091ea3491d79bf407f3fcb3e7dc7ab109b7d5277879eb7a","observation_id":"60fddd3c-71ac-4c75-9e29-a060c8b301ab","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02157","last_updated":"2025-03-04T00:40:09Z","snapshot_observed_at":"2026-08-16T12:53:23.902245Z","submitted_at":"2025-03-04T00:40:09Z","title":"MedHEval: Benchmarking Hallucinations and Mitigation Strategies in Medical Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02157","snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"Aofei Chang, Le Huang, Parminder Bhatia, Taha Kass-Hout, Fenglong Ma, and Cao Xiao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"cited_paper":"/paper/2503.02157","citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:80ecd31ffad06057b68fa0296130b815093d5a4ae51b1d948676ac3bb438e800","observation_id":"2ea54fda-b07b-457e-8118-6a44826b5be9","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"Overview of the ClinIQLink 2025 shared task on medical question-answering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:5ad79b798defe25d64311488c0b3cb9a56a7e32ebd6aa2bce82b835170cf842c","observation_id":"a3263dd9-704d-4909-ac4d-52917315e976","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:944fc10972f5ba0e52f4d7acfde39cbd1597f139c9274f3957c50b372951f2a3","observation_id":"4b3e4af2-0ca1-494b-b2e5-83225a8d7edc","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"Language models (mostly) know what they know.arXiv preprint arXiv:2207.05221,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:ae11771f504078a58f7f471cb72fb8e801f4aa0d24c583d0da16c8f15975cab3","observation_id":"19380e45-05b4-4af7-9b00-c4063181e08a","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:8fc9d711c144bf64ccea82b7e1eb8d7de2fe9bdc0d025e4ff3c8e823107c3453","observation_id":"4b37c6ea-ff45-431e-9613-97fc45cb776a","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"HaluEval: A large- scale hallucination evaluation benchmark for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:23b7835bb4b8d13c7f2c495036351cad829050fd73017cab58534c0501446fd6","observation_id":"ee516dd6-88b7-41bf-80ea-00bb804b0177","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"Teaching models to express their uncertainty in words.Transactions on Machine Learning Research, 2022a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:9561b7d65ec9e5af9def9c71533533829fd38971c5969fa3ba80b060d73b89d7","observation_id":"cd9bb82f-2779-4149-b9bb-b86d719790f6","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20622","last_updated":"2025-03-13T23:10:24Z","snapshot_observed_at":"2026-08-17T02:53:35.352535Z","submitted_at":"2024-12-29T23:56:01Z","title":"Towards a Systematic Evaluation of Hallucinations in Large-Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20622","snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"Towards a systematic evaluation of hallucinations in large-vision language models (HALLUCINOGEN).arXiv preprint arXiv:2412.20622,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"cited_paper":"/paper/2412.20622","citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:f4aeb5fb70d60db589bb76c751aad852c10d003a15eef98584530743a694696f","observation_id":"1bc3ecaf-75e3-4dcb-a42f-b1443d67e200","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18947","last_updated":"2025-03-28T23:37:45Z","snapshot_observed_at":"2026-08-13T06:20:44.384461Z","submitted_at":"2024-12-25T16:51:29Z","title":"MedHallBench: A New Benchmark for Assessing Hallucination in Medical Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18947","snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"MedHallBench: A new benchmark for assessing hallucination in medical large language models.arXiv preprint arXiv:2412.18947,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"cited_paper":"/paper/2412.18947","citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:6f233a47d4f315b2532d7025ef7ef6b3a2e3298cbdd9966e178b78b4aa663c0b","observation_id":"1e92785f-c4af-4572-bda8-1688b7c71bfa","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T20:40:22.043187Z","title":"verbose hedge","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T20:40:22.043187Z"},"links":{"citing_paper":"/paper/2606.05170"},"observation_digest":"sha256:c404f73092bde7cacb4e8bcd3d00d9e3eda3cdfbce45d195a41416b60934d885","observation_id":"73086346-b225-46c2-a7e4-180a95dcdc40","resolution":{"observed_at":"2026-07-12T20:40:22.043187Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.05170","last_updated":"2026-04-15T09:22:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T21:06:44.373617Z","submitted_at":"2026-04-15T09:22:46Z","title":"ERRORQUAKE: Heavy-Tailed Error Severity Distributions in Open-Weight Large Language Models"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2606.05170."}