{"as_of":"2026-08-20T08:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08d76d87e67ffa35f50b687d5282974239bbdc4f50e966d7327cf4138b723abf","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:54:19.613972Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.03788/citation-record","integrity":"/paper/2505.03788/integrity","json":"/paper/2505.03788/citation-record.json","paper":"/paper/2505.03788"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.02794","last_updated":"2019-04-11T19:59:37Z","snapshot_observed_at":"2026-08-18T06:26:59.039019Z","submitted_at":"2019-04-04T21:12:37Z","title":"VQD: Visual Query Detection in Natural Scenes","version":2},"cited_work":{"arxiv_id":"1904.02794","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.02794","snapshot_observed_at":"2026-08-16T04:54:19.990998Z","title":"VQD: Visual Query Detection in Natural Scenes","venue":"cs.CV","work_id":"b2a6fbc0-1b52-49c4-94dc-80e242122700","year":2019},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.476383Z"},"links":{"cited_paper":"/paper/1904.02794","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:a97ffa74476b155b6b8eb523a3efeafa814968dd6eb459f81865a519a8aff78a","observation_id":"f106cfc3-b819-4af6-af64-c11baf4ed319","resolution":{"observed_at":"2026-08-16T04:54:19.995191Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08433","last_updated":"2023-10-12T15:56:24Z","snapshot_observed_at":"2026-08-16T14:52:39.111753Z","submitted_at":"2023-10-12T15:56:24Z","title":"A Confederacy of Models: a Comprehensive Evaluation of LLMs on Creative Writing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08433","snapshot_observed_at":"2026-08-16T04:54:19.503477Z","title":"A confederacy of models: A comprehensive evaluation of llms on creative writing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.503477Z"},"links":{"cited_paper":"/paper/2310.08433","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:cff6fc9effaa1cca8ee057a4af23a3c76548545703bc289a799749dac792555b","observation_id":"53d7e6cc-7bdc-4f73-9b7d-05b76929ab4f","resolution":{"observed_at":"2026-08-16T04:54:19.503477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02917","last_updated":"2024-05-05T12:51:38Z","snapshot_observed_at":"2026-08-16T13:55:18.261813Z","submitted_at":"2024-05-05T12:51:38Z","title":"Overconfidence is Key: Verbalized Uncertainty Evaluation in Large Language and Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02917","snapshot_observed_at":"2026-08-16T04:54:19.511692Z","title":"Overconfidence is key: Verbalized uncertainty evaluation in large language and vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.511692Z"},"links":{"cited_paper":"/paper/2405.02917","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:7e56c626885ddcae8b8b2233344c82ddd2a626baeb717d23dcfd1c4139cbb67e","observation_id":"528858d6-e646-40af-aa2d-851d24f2d46f","resolution":{"observed_at":"2026-08-16T04:54:19.511692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-08-16T13:36:21.119762Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-16T04:54:19.515277Z","title":"Deberta: Decoding-enhanced bert with disentangled attention","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.515277Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:feba4bcdc8de76174a351bf68e9fa6ac9c890c4fd0b5927075ba6d56efe0571b","observation_id":"7d986630-f109-4611-ab01-d4dad73997ea","resolution":{"observed_at":"2026-08-16T04:54:19.515277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T04:54:19.519231Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.519231Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:dd68071988eee2b2722560968e600c0006bf04471e2c1fac3f07f5d2828e020b","observation_id":"a7369a8e-c3f8-462f-9775-2e96ae9140ba","resolution":{"observed_at":"2026-08-16T04:54:19.519231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-13T08:58:47.096400Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-16T04:54:19.531484Z","title":"Triviaqa: A large scale distantly supervised challenge dataset for reading comprehension","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.531484Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:793f570050c4b70373838db73afdb45ada94a59214619dc15bfc6961765eb837","observation_id":"7791a210-2eb7-4b48-9bc5-d29c874b9e13","resolution":{"observed_at":"2026-08-16T04:54:19.531484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-16T04:54:19.535260Z","title":"Language models (mostly) know what they know","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.535260Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:f360a98407f923903e6e083210860b4a951db1b2f484e05919ca0764ef6fffa8","observation_id":"1a2ed9a4-8718-42b1-8f1c-92b4be223a2b","resolution":{"observed_at":"2026-08-16T04:54:19.535260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14418","last_updated":"2024-02-24T12:30:40Z","snapshot_observed_at":"2026-08-16T14:16:18.299665Z","submitted_at":"2024-02-22T10:04:17Z","title":"Uncertainty-Aware Evaluation for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14418","snapshot_observed_at":"2026-08-16T04:54:19.542896Z","title":"Uncertainty-aware evaluation for vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.542896Z"},"links":{"cited_paper":"/paper/2402.14418","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:7643195ab9ba83f8e7db8484d25c36cb91278c3950de9a30b6b8c8d5ad7040c8","observation_id":"2a47baca-48bd-4ff6-b2c7-bced60e43cbc","resolution":{"observed_at":"2026-08-16T04:54:19.542896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09664","last_updated":"2023-04-15T12:55:45Z","snapshot_observed_at":"2026-07-06T14:53:27.667483Z","submitted_at":"2023-02-19T20:10:07Z","title":"Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09664","snapshot_observed_at":"2026-08-16T04:54:19.546731Z","title":"Semantic uncertainty: Linguistic invariances for uncertainty estimation in natural language generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.546731Z"},"links":{"cited_paper":"/paper/2302.09664","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:db41fc777d872b6faf017991518b336323528db3c9702d967c184a50b867ee9f","observation_id":"29909f85-0646-46b3-92da-cef124afc3d8","resolution":{"observed_at":"2026-08-16T04:54:19.546731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00890","last_updated":"2023-06-01T16:50:07Z","snapshot_observed_at":"2026-08-09T05:23:28.778360Z","submitted_at":"2023-06-01T16:50:07Z","title":"LLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00890","snapshot_observed_at":"2026-08-16T04:54:19.550795Z","title":"Llava-med: Training a large language-and-vision assistant for biomedicine in one day","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.550795Z"},"links":{"cited_paper":"/paper/2306.00890","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:e8bbc5c69b2c62e7541876091cd5c698c0ee6c6adcce8bf3ea3bc2399d5b75d1","observation_id":"8bd506f9-05b4-4273-b90b-7d7cbb7fc6a2","resolution":{"observed_at":"2026-08-16T04:54:19.550795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.028237Z","title":"Slake: A semantically- labeled knowledge-enhanced dataset for medical visual question answering","venue":null,"work_id":"0c8fbd9c-ad67-4f83-8d92-bbe511f2dc62","year":2021},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.558629Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:777da8a6b947bb10380fd63feb448265bb90cd6ce7ac6a4dbffdd5007425c3d6","observation_id":"71cb0814-b590-4b44-a6c2-ec3922f90705","resolution":{"observed_at":"2026-08-16T04:54:20.032176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-16T04:54:19.566442Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.566442Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:94021b8e07373d95bf83266e463bee80adf502403cb452a97fc988c93d48bc7a","observation_id":"3f3a41b2-4a8a-4cf1-a2d4-157447258a67","resolution":{"observed_at":"2026-08-16T04:54:19.566442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02352","last_updated":"2024-10-29T01:09:44Z","snapshot_observed_at":"2026-08-19T16:25:07.872339Z","submitted_at":"2024-07-02T15:17:44Z","title":"Pelican: Correcting Hallucination in Vision-LLMs via Claim Decomposition and Program of Thought Verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02352","snapshot_observed_at":"2026-08-16T04:54:19.570695Z","title":"Pelican: Correcting hallucination in vision-llms via claim decomposition and program of thought verification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.570695Z"},"links":{"cited_paper":"/paper/2407.02352","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:7450dfb8e45c17572ffc04aa9eaef1b01b0c7d0862745b11da8ce011181262fd","observation_id":"638672cf-8d23-4acb-8333-8d2a41af96bf","resolution":{"observed_at":"2026-08-16T04:54:19.570695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05563","last_updated":"2025-07-01T22:08:39Z","snapshot_observed_at":"2026-08-16T14:41:18.143042Z","submitted_at":"2024-12-07T06:56:01Z","title":"A Survey on Uncertainty Quantification of Large Language Models: Taxonomy, Open Research Challenges, and Future Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05563","snapshot_observed_at":"2026-08-16T04:54:19.575021Z","title":"A survey on uncertainty quantification of large language models: Taxonomy, open research challenges, and future directions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.575021Z"},"links":{"cited_paper":"/paper/2412.05563","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:5e638a5835afa280bc17368368b65b2f46e936cf4844457928be65dc7cb62bcd","observation_id":"51c01721-af72-4fab-947e-c88201bc642a","resolution":{"observed_at":"2026-08-16T04:54:19.575021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.015736Z","title":"Just ask for calibration: Strategies for eliciting calibrated confidence scores from language models fine-tuned with human feedback","venue":null,"work_id":"bdd0fdfe-87df-490c-8746-a93279555a7d","year":2023},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.578972Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:27199be58e7e7c4d959f2056895760cfdd4ce9be238d0dd5169563769e45b548","observation_id":"cac051d6-62b7-483d-b6cb-f32efad5cfd1","resolution":{"observed_at":"2026-08-16T04:54:20.020196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-16T04:54:19.583631Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.583631Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:7341d3a1e595bd84ee2af35cab919544a9f8a104f13c9343c52582f27e3a4e00","observation_id":"d7b9fc1e-b139-4d0d-b2d9-c9771d613f93","resolution":{"observed_at":"2026-08-16T04:54:19.583631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-16T04:54:19.588230Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.588230Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:c4272b216d06c2a8bd74630ee503c55dfcf4031284b06d796493ed5b27697cd1","observation_id":"f82b17f6-5445-4319-8d61-3e5b7b7ee5c3","resolution":{"observed_at":"2026-08-16T04:54:19.588230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12601","last_updated":"2025-04-08T02:39:57Z","snapshot_observed_at":"2026-07-06T20:38:25.164930Z","submitted_at":"2025-02-18T07:25:12Z","title":"COPU: Conformal Prediction for Uncertainty Quantification in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12601","snapshot_observed_at":"2026-08-16T04:54:19.593315Z","title":"Copu: Conformal prediction for uncertainty quantification in natural language generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.593315Z"},"links":{"cited_paper":"/paper/2502.12601","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:5202b8d631aea98515e290a1581f1775d64eb4db46a6728705f4d4b5f3f83e27","observation_id":"3b18bc8a-730c-4733-be3f-46de5b383a73","resolution":{"observed_at":"2026-08-16T04:54:19.593315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12794","last_updated":"2024-10-31T16:58:51Z","snapshot_observed_at":"2026-08-16T14:25:11.494628Z","submitted_at":"2024-01-23T14:29:17Z","title":"Benchmarking LLMs via Uncertainty Quantification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12794","snapshot_observed_at":"2026-08-16T04:54:19.601232Z","title":"Benchmarking llms via uncertainty quantification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.601232Z"},"links":{"cited_paper":"/paper/2401.12794","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:39a9f4081fa1da219ef51645e15b3c32130381a7204ce3f995776d37f82e8668","observation_id":"17d5fe97-a88f-4836-a1f3-21295eb71081","resolution":{"observed_at":"2026-08-16T04:54:19.601232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00915","last_updated":"2025-01-08T22:58:51Z","snapshot_observed_at":"2026-08-18T14:56:57.492279Z","submitted_at":"2023-03-02T02:20:04Z","title":"BiomedCLIP: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00915","snapshot_observed_at":"2026-08-16T04:54:19.609432Z","title":"Biomedclip: a multimodal biomedical foundation model pretrained from fifteen million scientific image-text pairs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.609432Z"},"links":{"cited_paper":"/paper/2303.00915","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:212b3367420bef3d8aae3a8cc366940be4481aa9b4623938a8275684750ba150","observation_id":"c0cde35f-4ca5-41ba-a5a8-911a5e0c6d3c","resolution":{"observed_at":"2026-08-16T04:54:19.609432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.003564Z","title":"Distribution Statement “A” (Approved for Public Release, Distribution Unlimited)","venue":null,"work_id":"7bf6ea05-9b72-4456-a0c2-0349ed8858b2","year":1904},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.613972Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:47e2197e334bdba1cf51e97f2fb35b2a40982572289cb6b7dd465af1fb4dd90d","observation_id":"b358de03-1109-43a6-8241-d12fe5e8937a","resolution":{"observed_at":"2026-08-16T04:54:20.008092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-16T04:54:19.523675Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":1957,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.523675Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:dde0e7790e1b2bae4a37f21110727ebadb5f21d9af7418eced5d0fdbd0df564c","observation_id":"32cc1297-6605-44c2-848d-53dda7029126","resolution":{"observed_at":"2026-08-16T04:54:19.523675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-16T04:54:19.494769Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":1983,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.494769Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:fbbacfd1a02fca203eed4c4ff117c343c5fba0306c0d74bf5e562eb0137ab2a6","observation_id":"692e433c-3f85-4f85-aae9-54704f0f2517","resolution":{"observed_at":"2026-08-16T04:54:19.494769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19187","last_updated":"2024-05-20T01:53:36Z","snapshot_observed_at":"2026-08-18T09:28:29.473363Z","submitted_at":"2023-05-30T16:31:26Z","title":"Generating with Confidence: Uncertainty Quantification for Black-box Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19187","snapshot_observed_at":"2026-08-16T04:54:19.554640Z","title":"Generating with confidence: Uncertainty quantifica- tion for black-box large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.554640Z"},"links":{"cited_paper":"/paper/2305.19187","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:a839488d80b9ef71eb851802a76e8830b4ff63c7439337d4af636874e1ea0ac1","observation_id":"df4fe64c-34cf-4d44-bc53-2f24566d212f","resolution":{"observed_at":"2026-08-16T04:54:19.554640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19930","last_updated":"2025-08-27T15:21:58Z","snapshot_observed_at":"2026-08-16T14:04:42.156678Z","submitted_at":"2024-11-29T18:42:28Z","title":"On Domain-Adaptive Post-Training for Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19930","snapshot_observed_at":"2026-08-16T04:54:19.486637Z","title":"On domain-specific post-training for multimodal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.486637Z"},"links":{"cited_paper":"/paper/2411.19930","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:3f7259a0dd7bd74a108d13f35c4e132c347aff8be7534e6b3d3dabef4dd75949","observation_id":"cafcb103-ce07-40fa-a1de-bc41e1b5a059","resolution":{"observed_at":"2026-08-16T04:54:19.486637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10193","last_updated":"2024-06-01T21:40:33Z","snapshot_observed_at":"2026-08-16T15:23:12.630691Z","submitted_at":"2023-06-16T21:55:08Z","title":"Conformal Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10193","snapshot_observed_at":"2026-08-16T04:54:19.562429Z","title":"Conformal language modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.562429Z"},"links":{"cited_paper":"/paper/2306.10193","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:b8b56397bfa07a44f57dd85d88ca0972daa63d06cfb9791ec37a45fcf5b1bdb1","observation_id":"d07cf3de-7c63-405a-aa0a-66cfdf7a456d","resolution":{"observed_at":"2026-08-16T04:54:19.562429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T04:54:19.507486Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.507486Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:de4880603e04e9d449658ddb945d81b454a76acfc03c468c65f3865b5f061472","observation_id":"594b804e-8065-447c-bece-24fc9fe9d047","resolution":{"observed_at":"2026-08-16T04:54:19.507486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11919","last_updated":"2024-11-28T13:35:56Z","snapshot_observed_at":"2026-08-19T18:40:51.414039Z","submitted_at":"2024-11-18T04:06:04Z","title":"VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11919","snapshot_observed_at":"2026-08-16T04:54:19.605281Z","title":"Vl-uncertainty: Detecting hallucination in large vision-language model via uncertainty estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.605281Z"},"links":{"cited_paper":"/paper/2411.11919","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:8109c6b7ecbc4e06fb615304753ba6a53fb456c5dbc4bddf093ad5ca72ee0d7a","observation_id":"e93b0ff0-392b-4232-a1bb-64d78e2c2c84","resolution":{"observed_at":"2026-08-16T04:54:19.605281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T04:54:19.481765Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.481765Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:87d0efdfb122816a315a83e505e79b06fe2c2e349aab75844a17f90385b95206","observation_id":"4abc8c8f-6f97-486d-ac07-1cb83fbc2002","resolution":{"observed_at":"2026-08-16T04:54:19.481765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14612","last_updated":"2024-05-28T11:18:20Z","snapshot_observed_at":"2026-08-16T13:50:10.893128Z","submitted_at":"2024-05-23T14:24:23Z","title":"Explaining Multi-modal Large Language Models by Analyzing their Vision Perception","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14612","snapshot_observed_at":"2026-08-16T04:54:19.499010Z","title":"Explaining multi-modal large language models by analyzing their vision perception","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.499010Z"},"links":{"cited_paper":"/paper/2405.14612","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:6ac0faf20672b20c0f0a46792e605eae749d6d0c62c101d0a7b3af60459b6548","observation_id":"98f50b02-9378-4573-9b5b-31142428528c","resolution":{"observed_at":"2026-08-16T04:54:19.499010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.040350Z","title":"Ad- dressing uncertainty in llms to enhance reliability in generative ai","venue":null,"work_id":"f5cc5bf5-8c3f-446d-b2e6-91c8e80f9a08","year":2024},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.539111Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:397be5b5d770a28d2c0c35dcd3446a788513f54ee471aa8eee2e852d8cdb2cbb","observation_id":"32ec6484-02e9-4d69-8de1-1209c021b0fc","resolution":{"observed_at":"2026-08-16T04:54:20.044723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07002","last_updated":"2025-05-13T14:13:13Z","snapshot_observed_at":"2026-08-16T13:11:02.912755Z","submitted_at":"2024-10-09T15:45:52Z","title":"CursorCore: Assist Programming through Aligning Anything","version":3},"cited_work":{"arxiv_id":"2410.07002","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07002","snapshot_observed_at":"2026-08-16T04:54:19.857310Z","title":"CursorCore: Assist Programming through Aligning Anything","venue":"cs.CL","work_id":"9ad22a4b-b17b-4ca9-8d79-581090d2d8da","year":2024},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.527763Z"},"links":{"cited_paper":"/paper/2410.07002","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:d89fcdc9feebe62e0c4d14515ba63504c9dc9f1375de71c59b8ddeaef539df4c","observation_id":"3b910364-32d7-4efa-8944-546d2bfa3e16","resolution":{"observed_at":"2026-08-16T04:54:19.864090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:54:20.052963Z","title":"An empirical study of in-context learning in llms for machine translation","venue":null,"work_id":"95001036-a5aa-4113-8fa7-fe76d4f731a2","year":2024},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.490997Z"},"links":{"citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:f67a9f606b858d029fd7d0cb9bb729a11eeb807836390d87b1764040b9b68f46","observation_id":"f93fe253-2eaf-422f-b3b9-3b892a1b1d04","resolution":{"observed_at":"2026-08-16T04:54:20.058355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-16T04:54:19.597151Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T04:54:19.597151Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.03788"},"observation_digest":"sha256:dd4a389d5819028d287d1361437fe4c6e63f1d2a2fd353972a3b61651f311bfa","observation_id":"08139543-4f96-4fb7-97f1-2b8cc04c518d","resolution":{"observed_at":"2026-08-16T04:54:19.597151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.03788","last_updated":"2025-04-30T19:19:21Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T02:18:06.101023Z","submitted_at":"2025-04-30T19:19:21Z","title":"Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":2,"verified_fuzzy":5},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2505.03788."}