{"as_of":"2026-08-09T18:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c7df8bcd8209b5d9a43da658b3860c1d1fb2ea554333aa02da3433e151f0fd8","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T04:22:42.241077Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:46:58.368000Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T10:27:56.148889Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-05-11T12:33:32.631346Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2404.18930"},"observation_digest":"sha256:3d30cdfe926d95d616bb233e3cdbeff9484306f2ec18c7a3402f9d72a7fb18cd","observation_id":"4ae29dc1-ff06-4d7b-86d6-39e9960412c2","resolution":{"observed_at":"2026-05-11T12:33:33.958049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-08-07T12:46:58.368000Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23558","last_updated":"2025-05-30T07:37:34Z","snapshot_observed_at":"2026-08-09T11:44:25.696575Z","submitted_at":"2025-05-29T15:34:15Z","title":"Qwen Look Again: Guiding Vision-Language Reasoning Models to Re-attention Visual Information","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:58.368000Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2505.23558"},"observation_digest":"sha256:527a8ebc42f328716cd67be2c18ef0b7e3b9fa9c95de6da99a4f8a55fd21f98b","observation_id":"a6b90a7f-732c-47cb-b351-cabaff831831","resolution":{"observed_at":"2026-08-07T12:46:58.368000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-08-06T18:09:07.147109Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-08T09:49:36.566537Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:07.147109Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:4ff44188ba99efadb9a0d22f38304d6e3297ab309e7c5425be11a412a2067faf","observation_id":"e6114f00-c053-4fb8-a6a2-cc4b806b3095","resolution":{"observed_at":"2026-08-06T18:09:07.147109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2511.10292","last_updated":"2026-05-19T09:24:10Z","snapshot_observed_at":"2026-08-03T13:28:59.205168Z","submitted_at":"2025-11-13T13:29:38Z","title":"Adaptive Residual-Update Steering for Low-Overhead Hallucination Mitigation in Large Vision Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-21T18:47:28.768554Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2511.10292"},"observation_digest":"sha256:e8649ecc402fc3de6dc05c2bb11cfcf6c67d8fcf9cfcc5d369090ae2d000547a","observation_id":"b9af43e8-bee4-4209-b5f7-5a00dc274fbc","resolution":{"observed_at":"2026-05-21T18:50:30.071256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2604.14090","last_updated":"2026-04-15T17:06:25Z","snapshot_observed_at":"2026-07-06T23:01:55.698452Z","submitted_at":"2026-04-15T17:06:25Z","title":"From Weights to Activations: Is Steering the Next Frontier of Adaptation?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T12:52:58.193141Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2604.14090"},"observation_digest":"sha256:828849a201c8730d51e1415ad7e7b801d321b2cb0677e13cbc78dca36fc97d74","observation_id":"b06e4a9a-2ee2-41a2-9e3a-d265978b9ab9","resolution":{"observed_at":"2026-05-10T12:55:24.636940Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2604.25642","last_updated":"2026-04-28T13:42:27Z","snapshot_observed_at":"2026-07-06T23:11:30.068819Z","submitted_at":"2026-04-28T13:42:27Z","title":"Prefill-Time Intervention for Mitigating Hallucination in Large Vision-Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T16:50:26.044591Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2604.25642"},"observation_digest":"sha256:0153b8471d71880b7ff3120f8b67614a5ae68545003b7d05fdea30b673041e07","observation_id":"b72afbc3-3a9b-497c-b602-12149dc3d6bf","resolution":{"observed_at":"2026-05-11T23:31:16.411697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.01733","last_updated":"2026-06-11T12:49:38Z","snapshot_observed_at":"2026-08-01T11:41:15.711922Z","submitted_at":"2026-05-03T06:09:04Z","title":"GEASS: Gated Evidence-Adaptive Selective Caption Trust for Vision-Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:34:59.318997Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.01733"},"observation_digest":"sha256:fc88ef6163aae366e069291e7fdd841242d6c07a93676dd9cc234df35f90209b","observation_id":"81729e34-700d-4312-a1ca-63362b5c890d","resolution":{"observed_at":"2026-05-11T10:11:15.305337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.01733","last_updated":"2026-06-11T12:49:38Z","snapshot_observed_at":"2026-08-01T11:41:15.711922Z","submitted_at":"2026-05-03T06:09:04Z","title":"GEASS: Gated Evidence-Adaptive Selective Caption Trust for Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T00:41:58.198403Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.01733"},"observation_digest":"sha256:cf8d826b3b50672db59e4f6a80d403781ec72f4fcfd85882d8d61443d868e153","observation_id":"aa5d5dfd-891b-48ef-a30b-4f00a89928a0","resolution":{"observed_at":"2026-05-21T00:43:53.569076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.01733","last_updated":"2026-06-11T12:49:38Z","snapshot_observed_at":"2026-08-01T11:41:15.711922Z","submitted_at":"2026-05-03T06:09:04Z","title":"GEASS: Gated Evidence-Adaptive Selective Caption Trust for Vision-Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T00:32:49.666202Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.01733"},"observation_digest":"sha256:7d10c04f7a9c533723e2cf8532700deda683146a8fa85420f99e56b5ec74f7b5","observation_id":"4525dd70-ab25-4201-932f-a114488f34af","resolution":{"observed_at":"2026-07-01T00:35:10.169759Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.08245","last_updated":"2026-06-23T03:14:15Z","snapshot_observed_at":"2026-08-03T01:46:27.665738Z","submitted_at":"2026-05-07T10:09:18Z","title":"When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T00:50:06.234399Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.08245"},"observation_digest":"sha256:4ed3c5570190ba4b2c45d345c21473dd90013736c1e40af4d514b981e398d8b4","observation_id":"15b62387-9e85-40c5-8b4e-099a5930f65d","resolution":{"observed_at":"2026-05-12T00:51:15.365180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.08245","last_updated":"2026-06-23T03:14:15Z","snapshot_observed_at":"2026-08-03T01:46:27.665738Z","submitted_at":"2026-05-07T10:09:18Z","title":"When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T21:21:37.185232Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.08245"},"observation_digest":"sha256:743301836d92b0077133fa60457046cc208a8e64213579ca60939f1f54bec40c","observation_id":"e188070b-23db-4e67-a368-dd00da79d83d","resolution":{"observed_at":"2026-05-14T21:22:58.978250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.08245","last_updated":"2026-06-23T03:14:15Z","snapshot_observed_at":"2026-08-03T01:46:27.665738Z","submitted_at":"2026-05-07T10:09:18Z","title":"When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T17:06:03.483247Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.08245"},"observation_digest":"sha256:e0aa37d167a50a607be27bdbd57c2690f497ea0f37112618bd8a18c5fa9f8158","observation_id":"df9bdc51-18a9-489a-b902-1848f86ec933","resolution":{"observed_at":"2026-05-19T17:07:41.699515Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.08245","last_updated":"2026-06-23T03:14:15Z","snapshot_observed_at":"2026-08-03T01:46:27.665738Z","submitted_at":"2026-05-07T10:09:18Z","title":"When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T23:41:36.199099Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.08245"},"observation_digest":"sha256:01ab9f1b215ab0e38a7b5bab5c715eeaa9706d1d3747d79a70e5a120568d7882","observation_id":"8d571455-fc7c-4e9f-97dd-87755810bfa9","resolution":{"observed_at":"2026-06-30T23:45:08.099607Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.10676","last_updated":"2026-05-11T14:55:59Z","snapshot_observed_at":"2026-08-03T00:16:34.271882Z","submitted_at":"2026-05-11T14:55:59Z","title":"Not Blind but Silenced: Rebalancing Vision and Language via Adversarial Counter-Commonsense Equilibrium","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-12T04:48:21.798287Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.10676"},"observation_digest":"sha256:108d0cfb40830acef9c57579b4eb61e2851179ab0d2db7dbeca0b6ab8cd533aa","observation_id":"d12f69c8-ed66-49a3-8d9e-13f6c7f50613","resolution":{"observed_at":"2026-05-12T05:56:25.166065Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2605.24957","last_updated":"2026-05-24T09:14:49Z","snapshot_observed_at":"2026-08-08T13:45:49.052172Z","submitted_at":"2026-05-24T09:14:49Z","title":"Mitigating Object Hallucinations in Vision-Language Models through Region-Aware Attention Recalibration","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T11:35:59.397767Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2605.24957"},"observation_digest":"sha256:ba0e40db495ced6181675c0f0bf2196fd7c272bfe677e32dac89ebf8833fbacc","observation_id":"af99778c-aaff-419d-8d9a-33ad658df0af","resolution":{"observed_at":"2026-06-30T11:44:38.759704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2606.07647","last_updated":"2026-06-02T08:23:28Z","snapshot_observed_at":"2026-07-06T23:47:15.041928Z","submitted_at":"2026-06-02T08:23:28Z","title":"Steer Where It Matters: Token-Level Visual-Sensitivity Steering for LVLMs Hallucination Mitigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:40.055153Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2606.07647"},"observation_digest":"sha256:d760bca4426c29dbfb98abc4101594580426f81e31c62d822d95bc0eaeec9ef5","observation_id":"c69ca4e3-3d89-43ed-b3ea-69562b425b7f","resolution":{"observed_at":"2026-07-02T03:06:29.681408Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2606.11792","last_updated":"2026-06-11T05:33:10Z","snapshot_observed_at":"2026-08-05T06:18:17.353570Z","submitted_at":"2026-06-10T08:25:09Z","title":"MultiToP: Learning to Patch Visual Tokens to Mitigate Hallucinations in Video Large Multimodal Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T10:02:58.341050Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2606.11792"},"observation_digest":"sha256:bdf1ae089e50fbc9fc930daee9c98aa2dd6a86f03159dbd537c746c24d5cbff8","observation_id":"7b3976ba-56ce-4ec4-85e4-3d48aca48249","resolution":{"observed_at":"2026-07-03T10:27:56.150307Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2606.29431","last_updated":"2026-07-07T03:19:40Z","snapshot_observed_at":"2026-08-02T13:30:27.757596Z","submitted_at":"2026-06-28T14:48:08Z","title":"FADE: Mitigating Hallucinations by Reducing Language-Prior Dominance in Large Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-30T07:07:00.265141Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2606.29431"},"observation_digest":"sha256:f9ee34b696584f503d271ced39dab7c9c40462d9f9bc7041fb05d9dfd7194da5","observation_id":"a32aa892-fdc7-482e-9a4c-24a01abb9b86","resolution":{"observed_at":"2026-06-30T07:14:21.522578Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":"2502.03628","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-07-03T10:27:56.148889Z","title":"The hidden life of tokens: Reducing hallucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628","venue":null,"work_id":"e2b4fb54-9ac8-4b7f-a085-6436ff5b71ee","year":2025},"citing_paper":{"arxiv_id":"2606.29431","last_updated":"2026-07-07T03:19:40Z","snapshot_observed_at":"2026-08-02T13:30:27.757596Z","submitted_at":"2026-06-28T14:48:08Z","title":"FADE: Mitigating Hallucinations by Reducing Language-Prior Dominance in Large Vision-Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-02T20:46:16.298898Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2606.29431"},"observation_digest":"sha256:3c93b9eac35f80f6d404a3cd86db0dea587e917603678ab7a42a933fc199e147","observation_id":"e42ce6cb-66cc-4d37-840d-916e48dcf2cb","resolution":{"observed_at":"2026-07-02T20:47:22.345284Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03628","snapshot_observed_at":"2026-08-01T23:15:28.935620Z","title":"The hidden life of tokens: Reducing hal- lucination of large vision-language models via visual information steering.arXiv preprint arXiv:2502.03628, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15495","last_updated":"2026-07-16T22:54:30Z","snapshot_observed_at":"2026-08-07T08:22:43.917790Z","submitted_at":"2026-07-16T22:54:30Z","title":"Verbalizable Representations Form a Global Workspace in Language Models","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-01T23:15:28.935620Z"},"links":{"cited_paper":"/paper/2502.03628","citing_paper":"/paper/2607.15495"},"observation_digest":"sha256:04275ce2d557b4b5bbebde4db77b5fcef78043a0300337c48b5dafaa6b29f800","observation_id":"a950bf1c-3c40-4b49-a8c0-077d3819523a","resolution":{"observed_at":"2026-08-01T23:15:28.935620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03628/citation-record","integrity":"/paper/2502.03628/integrity","json":"/paper/2502.03628/citation-record.json","paper":"/paper/2502.03628"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.091786Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.091786Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:63137a9f7dd0ed6d9c083727ff0d905f59a09a6b21409cf9af93d6145c1406b6","observation_id":"449cdd78-bb9c-45d5-a9b0-b7c3f4507880","resolution":{"observed_at":"2026-08-09T04:22:42.091786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-09T04:22:42.096309Z","title":"Qwen-vl: A frontier large vision-language model with versatile abilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.096309Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:6565c0b1d04e464539c76eb87c60b5f39f9f08b497e8fe4f87520828c1588b9c","observation_id":"682142d1-2c17-4132-b4a0-e1fe3c0ff599","resolution":{"observed_at":"2026-08-09T04:22:42.096309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-09T04:22:42.100110Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.100110Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:8b8fb18258fb751966cd79e1aae9686b621fa40d70534985fc11e76085f5539e","observation_id":"3a742f65-4b7d-419b-9455-ebb3e0ce7e12","resolution":{"observed_at":"2026-08-09T04:22:42.100110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-07-06T15:47:07.545213Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-09T04:22:42.103850Z","title":"Shikra: Unleashing multimodal llm's referential dialogue magic","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.103850Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:6d7aa2d8a3b67ff8d226c9056f7fccdcc5d7603ec9676ddd2158ff7a4d66370f","observation_id":"7df8a6ac-e2b1-46a7-be7c-5b79f6890974","resolution":{"observed_at":"2026-08-09T04:22:42.103850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00425","last_updated":"2024-06-10T15:21:41Z","snapshot_observed_at":"2026-08-07T09:16:51.378562Z","submitted_at":"2024-03-01T10:21:52Z","title":"HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00425","snapshot_observed_at":"2026-08-09T04:22:42.108062Z","title":"Halc: Object hallucination reduction via adaptive focal-contrast decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.108062Z"},"links":{"cited_paper":"/paper/2403.00425","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:d9547badbc0cc403c733f71769a7132a8ce3a02ff6f3976c0952d3040f2d0b32","observation_id":"5fbbfe92-65a8-417c-9000-5d34ef872bc8","resolution":{"observed_at":"2026-08-09T04:22:42.108062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.580247Z","title":"R., and He, P","venue":null,"work_id":"5538f30a-6241-4f5d-95b4-25d82d64209b","year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.111556Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:611435724cfc002f73ca11c47597b7701a5e8f102fcc543008e5283454f12d3b","observation_id":"cd33e61c-2ade-416c-823f-f97149a2cde4","resolution":{"observed_at":"2026-08-09T04:22:42.583240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.115130Z","title":"Knowledge neurons in pretrained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.115130Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:7a29fd3f3faaeb50ed351eda87c7dfcf4eea364756b215ab0e3932c517c5f606","observation_id":"70426efc-5aab-4e4a-b70a-6c8be09de357","resolution":{"observed_at":"2026-08-09T04:22:42.115130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.572002Z","title":"Instruct BLIP : Towards general-purpose vision-language models with instruction tuning","venue":null,"work_id":"e5396c50-2602-4a6b-8149-ab5c1e08bc99","year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.118779Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:0f498067c2c1ebe6b7bcaee68f05315eca5a7c7ce1125e10e8c13d4db694370c","observation_id":"1b758b05-c7a9-480c-a1d9-aa449f828b66","resolution":{"observed_at":"2026-08-09T04:22:42.575051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.562972Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":"d87ceafc-3533-4b51-9370-3146636b1138","year":2021},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.121930Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:16d22ee0e954a3d7336b459a21f96ef80e3a34d004e99d59c8bfbdd05a091fdc","observation_id":"46552345-c61f-44bb-8093-350fb5333e32","resolution":{"observed_at":"2026-08-09T04:22:42.566220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.554401Z","title":"Multi-modal hallucination control by visual information grounding","venue":null,"work_id":"15f4da80-06c9-4eda-927a-742fe00d23ae","year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.125656Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:cb3194252f9d74fb2adab404a9d6bd6a6b3edce693b894df19c4c45881f4b146","observation_id":"4c18adf8-bd6e-4ce7-a8cc-d474cd3c32f8","resolution":{"observed_at":"2026-08-09T04:22:42.557550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-09T04:22:42.128733Z","title":"Mme: A comprehensive evaluation benchmark for multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.128733Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:ed50ca3112961dc5d91a0c611e185b6023a089b139d1dd4faad2482d5f9fee68","observation_id":"22bc6db8-7b5c-4070-9b3a-771c45a8197a","resolution":{"observed_at":"2026-08-09T04:22:42.128733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.132094Z","title":"Transformer feed-forward layers are key-value memories","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.132094Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:5b2c8e36134855929ef615f6fa0b695ce6d5b51ca27af356fd26eb87f468603e","observation_id":"40c6cd49-8306-4d74-8058-b1da80c86801","resolution":{"observed_at":"2026-08-09T04:22:42.132094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.545719Z","title":"Interpreting gpt: The logit lens","venue":null,"work_id":"c48c6c97-6cfc-4058-9f54-a12e3740bbc0","year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.135234Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:bea2cbd3199f842463cee2f933d4217c150512f91a3fa8f031de9390835af5ba","observation_id":"6a4dbc48-2817-4731-80a0-42ce95e7a635","resolution":{"observed_at":"2026-08-09T04:22:42.549005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.138294Z","title":"Opera: Alleviating hallucination in multi-modal large language models via over-trust penalty and retrospection-allocation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.138294Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:39ca6b170cf5c67f7fcab48544e5ed5b679e96a92f252544d87f7e51b79eb80f","observation_id":"13438085-51ae-4510-ba29-22bc49bc1a78","resolution":{"observed_at":"2026-08-09T04:22:42.138294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-09T04:22:42.141110Z","title":"P., Perelman, A., Ramesh, A., Clark, A., Ostrow, A., Welihinda, A., Hayes, A., Radford, A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.141110Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:8145aafbe6d414085397e676e7fb0a3b23b0b4a9657c5e9da28be8066c4ad487","observation_id":"53529a46-a1bd-4cd1-9230-8f908f057b7f","resolution":{"observed_at":"2026-08-09T04:22:42.141110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.532495Z","title":"Hallucination augmented contrastive learning for multimodal large language model","venue":null,"work_id":"3a14ff63-eab5-4db7-809e-030beea07f66","year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.144318Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:8c7f2878170a8a4f937c5fefa320795dcab13805a6748c8ff94ad3154b525f0d","observation_id":"5c03ddb0-6068-40e7-956b-85e3d0af41c2","resolution":{"observed_at":"2026-08-09T04:22:42.535618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.147436Z","title":"Lisa: Reasoning segmentation via large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.147436Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:04aa737d02c67af3cc381f64e9d9376a96c46119555d6b291d051bd05263fbe6","observation_id":"9e9e13f9-5e81-42cb-9dd5-57c8ec44f552","resolution":{"observed_at":"2026-08-09T04:22:42.147436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.519073Z","title":"Mitigating object hallucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"ee165ee9-a872-4d52-b7c6-3d8c1b02855c","year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.150577Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:11338d9935dee98b09f753bea6eb1d99e2f56a8b8f6643ac31665283752b37d9","observation_id":"a34196b8-10ed-4f25-a6ea-6f18bfd966dc","resolution":{"observed_at":"2026-08-09T04:22:42.522196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.153577Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.153577Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:396fdf3ee44c70cefa026db860eb722efdc4515f6ffd24244bb82b7b92e8b775","observation_id":"dd5e82ea-0019-45ef-8def-cea952efb46f","resolution":{"observed_at":"2026-08-09T04:22:42.153577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.15097","last_updated":"2023-07-10T06:08:55Z","snapshot_observed_at":"2026-07-06T14:10:59.567758Z","submitted_at":"2022-10-27T00:58:21Z","title":"Contrastive Decoding: Open-ended Text Generation as Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.15097","snapshot_observed_at":"2026-08-09T04:22:42.156954Z","title":"L., Holtzman, A., Fried, D., Liang, P., Eisner, J., Hashimoto, T., Zettlemoyer, L., and Lewis, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.156954Z"},"links":{"cited_paper":"/paper/2210.15097","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:7c97f4ddb912c67a69bfb09fe7110dfb013c54d67dc1ff54773ce83223c0ed31","observation_id":"cb83a348-ec6d-4243-9c6c-37c7e7017a3c","resolution":{"observed_at":"2026-08-09T04:22:42.156954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.160081Z","title":"Evaluating object hallucination in large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.160081Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:45476622cd70379707da22344b37a03b6551d23b0d4a2c208912a89f0633cf3f","observation_id":"5f7e489d-4bc4-4e52-abde-9ee34439335b","resolution":{"observed_at":"2026-08-09T04:22:42.160081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14660","last_updated":"2025-02-25T14:49:33Z","snapshot_observed_at":"2026-08-07T17:44:12.906195Z","submitted_at":"2024-05-23T14:57:52Z","title":"Implicit In-context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14660","snapshot_observed_at":"2026-08-09T04:22:42.163022Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.163022Z"},"links":{"cited_paper":"/paper/2405.14660","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:5b32cebafe7b7b1bdc4a0fcfba43da7d30c66a48ad6000b97ff297f72f63c864","observation_id":"32431c63-1315-40da-ac57-6dee84ecf1c0","resolution":{"observed_at":"2026-08-09T04:22:42.163022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10122","last_updated":"2024-10-01T12:07:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-16T10:59:44Z","title":"Video-LLaVA: Learning United Visual Representation by Alignment Before Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10122","snapshot_observed_at":"2026-08-09T04:22:42.166126Z","title":"Video-llava: Learning united visual representation by alignment before projection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.166126Z"},"links":{"cited_paper":"/paper/2311.10122","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:04b2efa19a00e1e50152734a513faf32cd8c8f2a20939813f8070e82c0266abb","observation_id":"a8ef7579-b719-4aaa-8ed8-aa47afbc8d3d","resolution":{"observed_at":"2026-08-09T04:22:42.166126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.169644Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.169644Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:9c53bc8f7e98e0710d85b7f94bbe939862e8df2df7181c47266646d488e027d4","observation_id":"edec0eb2-37d3-4f3a-ae26-d0212dc031fb","resolution":{"observed_at":"2026-08-09T04:22:42.169644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.501136Z","title":"Mitigating hallucination in large multi-modal models via robust instruction tuning","venue":null,"work_id":"0df57acb-390f-48a7-85df-061d63c2870d","year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.173185Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:70024a0721d429f850d339b94ec6b7057b6fc0548474909489cf0bc5b6324f4b","observation_id":"705165c3-21d7-4734-9772-bde810516c1c","resolution":{"observed_at":"2026-08-09T04:22:42.504457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.176283Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.176283Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:9312de7b48d835ed33d6cd714a49c8997773548dae96acf04270ed00e6f60246","observation_id":"51bee77d-f5cf-4203-bd63-5aaecef73b1b","resolution":{"observed_at":"2026-08-09T04:22:42.176283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.179539Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.179539Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:3f9c56c81addb5d6e6304bdc570601fabdbd8f909f501c44887cdbd2e1c2a483","observation_id":"76abc818-1e22-43f4-8bad-9c4c6245d27e","resolution":{"observed_at":"2026-08-09T04:22:42.179539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.483189Z","title":null,"venue":null,"work_id":"0d22a7a6-315c-4006-8d9e-5bc9c42a2e8b","year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.182707Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:fb71f5c2e1459cd662b27f990c4b17b7cd266e8845e2eef404d7773f87b25232","observation_id":"09a41f75-0609-413f-9b9d-2414dbca91c8","resolution":{"observed_at":"2026-08-09T04:22:42.486201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-09T04:22:42.185522Z","title":"A survey on hallucination in large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.185522Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:159acbb8ff301015cf24d262d8170c4817352fe9bf798f737d545a9b46120ecb","observation_id":"bdb0a944-8673-4343-a040-b9b198a06b8c","resolution":{"observed_at":"2026-08-09T04:22:42.185522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.473739Z","title":"In-context vectors: Making in context learning more effective and controllable through latent space steering, 2024 e","venue":null,"work_id":"ea248177-09d4-4b75-8b4a-97c3c6cbecb5","year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.188720Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:6910dfbcd4a8e9bc0f6f1b11864b1ca4c85350429390ed5562e56996b25122ff","observation_id":"3cead33f-0ac6-4d55-b72a-29989f9cd232","resolution":{"observed_at":"2026-08-09T04:22:42.477468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15778","last_updated":"2024-10-22T05:01:28Z","snapshot_observed_at":"2026-07-06T19:36:54.626904Z","submitted_at":"2024-10-21T08:42:30Z","title":"Reducing Hallucinations in Vision-Language Models via Latent Space Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15778","snapshot_observed_at":"2026-08-09T04:22:42.191488Z","title":"Reducing hallucinations in vision-language models via latent space steering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.191488Z"},"links":{"cited_paper":"/paper/2410.15778","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:8ff1eb391d859c198ee402c3b14e7ae6f307c671500a34b1643efc1f89a56eb1","observation_id":"1344e082-9a89-4420-94c6-341bad502e53","resolution":{"observed_at":"2026-08-09T04:22:42.191488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21771","last_updated":"2024-07-31T17:46:57Z","snapshot_observed_at":"2026-08-06T11:42:03.713360Z","submitted_at":"2024-07-31T17:46:57Z","title":"Paying More Attention to Image: A Training-Free Method for Alleviating Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21771","snapshot_observed_at":"2026-08-09T04:22:42.194580Z","title":"Paying more attention to image: A training-free method for alleviating hallucination in lvlms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.194580Z"},"links":{"cited_paper":"/paper/2407.21771","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:8695a9d3726f87727019d535d9ec91db7083bcf6d32e3ce5ac1c05223589a616","observation_id":"8e52a971-563a-45ea-a508-3f3e3db598c1","resolution":{"observed_at":"2026-08-09T04:22:42.194580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02156","last_updated":"2019-03-29T23:48:52Z","snapshot_observed_at":"2026-08-04T05:57:07.163978Z","submitted_at":"2018-09-06T18:25:18Z","title":"Object Hallucination in Image Captioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02156","snapshot_observed_at":"2026-08-09T04:22:42.197795Z","title":"A., Burns, K., Darrell, T., and Saenko, K","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.197795Z"},"links":{"cited_paper":"/paper/1809.02156","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:714777617ef7132e287e4ad46403dfa84ab43c4db46d4c64026e91c05b2922de","observation_id":"c6d4e582-1ea7-4835-9dd0-06e4f6809d03","resolution":{"observed_at":"2026-08-09T04:22:42.197795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15998","last_updated":"2025-03-02T23:41:37Z","snapshot_observed_at":"2026-07-06T19:07:16.252072Z","submitted_at":"2024-08-28T17:59:31Z","title":"Eagle: Exploring The Design Space for Multimodal LLMs with Mixture of Encoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15998","snapshot_observed_at":"2026-08-09T04:22:42.200920Z","title":"Eagle: Exploring the design space for multimodal llms with mixture of encoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.200920Z"},"links":{"cited_paper":"/paper/2408.15998","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:29876c15ea17ea2c5783e55ceba8d3b69f44534c4971fcf17b227b0fb6e29761","observation_id":"b173ffc3-2fd3-4803-a360-30bbb851d192","resolution":{"observed_at":"2026-08-09T04:22:42.200920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14739","last_updated":"2023-05-24T05:19:15Z","snapshot_observed_at":"2026-08-09T11:43:43.156153Z","submitted_at":"2023-05-24T05:19:15Z","title":"Trusting Your Evidence: Hallucinate Less with Context-aware Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14739","snapshot_observed_at":"2026-08-09T04:22:42.204650Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.204650Z"},"links":{"cited_paper":"/paper/2305.14739","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:3882d1de9f439c1ac6d74fa2198edfff72ca100682702df1f18c67d7ffbfad55","observation_id":"3b14ea5c-1999-4031-9ab0-4c52e4ccdfd9","resolution":{"observed_at":"2026-08-09T04:22:42.204650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-09T04:22:42.207737Z","title":"Aligning large multimodal models with factually augmented rlhf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.207737Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:21923da9bf29b0221880fc85745ecf950c612cc7284887500793fa87c614b49e","observation_id":"3507cd6d-6f75-4d28-ad4d-fe7c63742cbf","resolution":{"observed_at":"2026-08-09T04:22:42.207737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.211058Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.211058Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:49170cc4df5c8b3f682c91b06f9f6685e377200ef0727d76a9b2e540d0769a45","observation_id":"d2f18d62-6c80-4bee-95f2-0ddd855c6b11","resolution":{"observed_at":"2026-08-09T04:22:42.211058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.460409Z","title":"M., Thiergart, L., Udell, D., Leech, G., Mini, U., and MacDiarmid, M","venue":null,"work_id":"6c2de77b-fc89-41d3-bc37-a2d0ba5502db","year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.214015Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:30a8c1fa674c0f5eb96af6425e9a33eb3178d74693a9e732766581c7c6763750","observation_id":"315c1aa6-e23b-4fd0-a01e-1b97d33ec9f5","resolution":{"observed_at":"2026-08-09T04:22:42.463401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.216796Z","title":"Label words are anchors: An information flow perspective for understanding in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.216796Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:15017771fba5f659d90f04ad23cb054be87964762cb8dc5728d62dbc08590d6c","observation_id":"2b7510ae-d2e8-498b-8740-6b8cbaebe4c1","resolution":{"observed_at":"2026-08-09T04:22:42.216796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17820","last_updated":"2025-05-31T02:41:34Z","snapshot_observed_at":"2026-08-08T02:36:07.552587Z","submitted_at":"2024-05-28T04:40:57Z","title":"Don't Miss the Forest for the Trees: Attentional Vision Calibration for Large Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17820","snapshot_observed_at":"2026-08-09T04:22:42.219746Z","title":"Don't miss the forest for the trees: Attentional vision calibration for large vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.219746Z"},"links":{"cited_paper":"/paper/2405.17820","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:31f0a93ce375bb661b943cf466741b4c77fa312ea68800671dbef27ae68791de","observation_id":"c3fe9bdc-7764-4723-9f88-6a177a0ba57a","resolution":{"observed_at":"2026-08-09T04:22:42.219746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.451255Z","title":"Gpt4tools: Teaching large language model to use tools via self-instruction","venue":null,"work_id":"4e087491-31a2-4cc8-8d0d-7d279f88b206","year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.222855Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:9f06022a80dd4852cfe5c5d23b4fb8c7cedbba0091af8d6cb8d65d6812f583f0","observation_id":"44d7267e-7686-4b17-9200-8ad85171ec12","resolution":{"observed_at":"2026-08-09T04:22:42.454651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16045","last_updated":"2024-12-11T02:46:29Z","snapshot_observed_at":"2026-08-08T00:11:31.801569Z","submitted_at":"2023-10-24T17:58:07Z","title":"Woodpecker: Hallucination Correction for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16045","snapshot_observed_at":"2026-08-09T04:22:42.225880Z","title":"Woodpecker: Hallucination correction for multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.225880Z"},"links":{"cited_paper":"/paper/2310.16045","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:565a4ce523e501d131aa68c3a4fa7fbf9525c878881f35f42b38842e5c6409f8","observation_id":"33e46bb6-e6ef-426e-88e6-f66ccd5cfa33","resolution":{"observed_at":"2026-08-09T04:22:42.225880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.441710Z","title":"Hallucidoctor: Mitigating hallucinatory toxicity in visual instruction data","venue":null,"work_id":"14c8cd34-1249-465d-b5df-4c18958c5ac6","year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.229068Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:adc06c094bdbdb9ca997703acffd91aa6efbdb1b3f6a9ebee59554b462e8c2c3","observation_id":"ce541731-2e9d-4be7-967e-fc90fdfc5afa","resolution":{"observed_at":"2026-08-09T04:22:42.445309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14545","last_updated":"2024-05-29T05:55:09Z","snapshot_observed_at":"2026-08-09T02:22:19.607073Z","submitted_at":"2024-02-22T13:33:13Z","title":"Less is More: Mitigating Multimodal Hallucination from an EOS Decision Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14545","snapshot_observed_at":"2026-08-09T04:22:42.231785Z","title":"Less is more: Mitigating multimodal hallucination from an eos decision perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.231785Z"},"links":{"cited_paper":"/paper/2402.14545","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:fe3c14d933ff990c8029c109aaac0b2da74b1e075c33969bbffa0c3f806d289b","observation_id":"49b428f6-1ddf-4784-ac33-00a6dcfe5255","resolution":{"observed_at":"2026-08-09T04:22:42.231785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00754","last_updated":"2024-03-16T19:28:08Z","snapshot_observed_at":"2026-08-02T06:11:56.496482Z","submitted_at":"2023-10-01T18:10:53Z","title":"Analyzing and Mitigating Object Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00754","snapshot_observed_at":"2026-08-09T04:22:42.234781Z","title":"Analyzing and mitigating object hallucination in large vision-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.234781Z"},"links":{"cited_paper":"/paper/2310.00754","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:e8bb5d8e076bbd407fb209513d2bbd1208bf1f1d978a4af4bab58b2f1afa235f","observation_id":"b61e4a89-7847-4cfe-8ada-448be55228e6","resolution":{"observed_at":"2026-08-09T04:22:42.234781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-09T04:22:42.238032Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.238032Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:f7db5310d6ceb4f674b78c2a338e13b416e8e3e25e7237eee2c9aa66ec3618de","observation_id":"19397833-7fcb-4513-888d-72aa595ab732","resolution":{"observed_at":"2026-08-09T04:22:42.238032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:22:42.430619Z","title":"J., Wang, Z., Mallen, A., Basart, S., Koyejo, S., Song, D., Fredrikson, M., Kolter, J","venue":null,"work_id":"2ff82829-bce6-44c1-acf3-73ec5445676e","year":2023},"citing_paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:42.241077Z"},"links":{"citing_paper":"/paper/2502.03628"},"observation_digest":"sha256:f1428271c7355f41f463cfbe308a625ed482f5b5ab013ffe0858cfaa397e6b0f","observation_id":"5a85bd13-6f2a-41c3-8ba6-874d5c84985c","resolution":{"observed_at":"2026-08-09T04:22:42.435420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.03628","last_updated":"2025-07-01T16:02:21Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T11:44:14.633025Z","submitted_at":"2025-02-05T21:34:02Z","title":"The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 20 inbound Pith citation observations for arXiv:2502.03628."}