{"as_of":"2026-08-17T16:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5318f171c58d3e13b4635ab7c7153f4e68063f6665e78d64b6dd2096fd5f356d","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:36:03.857380Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:14:16.972880Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T20:16:12.001782Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":"2501.01282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-07-01T20:16:12.001782Z","title":"Culturevlm: Characterizing and improving cultural understanding of vision-language models for over 100 countries","venue":null,"work_id":"4fae4a5a-5bf3-41be-b688-f4533eb7de16","year":2025},"citing_paper":{"arxiv_id":"2503.21460","last_updated":"2025-03-27T12:50:17Z","snapshot_observed_at":"2026-07-06T20:59:35.694800Z","submitted_at":"2025-03-27T12:50:17Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","version":1},"reference_index":248,"source":"pdf_text","source_observed_at":"2026-05-22T21:51:34.309870Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2503.21460"},"observation_digest":"sha256:0ac71b10dbea0aa086d5d12f39b17eef844dbb2f83a25d909f4816a6b367ca36","observation_id":"56f58a89-accb-4087-82a8-e4c9fb06670e","resolution":{"observed_at":"2026-05-22T21:52:10.327270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-08-15T20:14:16.972880Z","title":"Wong, Qingsong Wen, Lichao Sun, Haipeng Chen, Xing Xie, and Jindong Wang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14729","last_updated":"2025-07-31T06:24:39Z","snapshot_observed_at":"2026-08-16T23:20:30.434816Z","submitted_at":"2025-05-20T02:04:09Z","title":"Uncovering Cultural Representation Disparities in Vision-Language Models","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:14:16.972880Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2505.14729"},"observation_digest":"sha256:738247e80691fd5183017507ea3b09d8146cb360a4a7e6c9b4f6e50aa16a7a62","observation_id":"e6761127-d27f-4325-8902-ba931b0491e7","resolution":{"observed_at":"2026-08-15T20:14:16.972880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-08-07T13:03:12.692200Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22793","last_updated":"2025-08-14T14:00:41Z","snapshot_observed_at":"2026-08-15T22:26:33.827899Z","submitted_at":"2025-05-28T19:04:04Z","title":"Evaluation of Cultural Competence of Vision-Language Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T13:03:12.692200Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2505.22793"},"observation_digest":"sha256:056814b1edfadc287f7d9bdff44e34759d0ecac9c4ebcd5a273e0bddddf09af1","observation_id":"f7677043-799b-4883-b148-6e8915e789c8","resolution":{"observed_at":"2026-08-07T13:03:12.692200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-08-07T00:39:42.056277Z","title":"Liu, et al., Culturevlm: Characterizing and improving cultural understanding of vision-language models for over 100 countries, arXiv (Jan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12958","last_updated":"2025-06-20T15:52:06Z","snapshot_observed_at":"2026-08-14T16:54:29.059569Z","submitted_at":"2025-06-15T20:42:45Z","title":"Domain Specific Benchmarks for Evaluating Multimodal Large Language Models","version":2},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-08-07T00:39:42.056277Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2506.12958"},"observation_digest":"sha256:b8bc4856c44ecd08e61a981ae547fc9eeaf4bb6c1b628a5fbea953fd5174bbf0","observation_id":"2bb404bc-4269-4214-adb8-0f5493d8c35a","resolution":{"observed_at":"2026-08-07T00:39:42.056277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-08-06T19:26:58.410428Z","title":"Culturevlm: Characterizing and improving cultural understanding of vision-language models for over 100 countries","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05633","last_updated":"2025-07-08T03:29:09Z","snapshot_observed_at":"2026-08-17T05:19:49.700474Z","submitted_at":"2025-07-08T03:29:09Z","title":"SARA: Selective and Adaptive Retrieval-augmented Generation with Context Compression","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T19:26:58.410428Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2507.05633"},"observation_digest":"sha256:98e369e644206ae59fc16361e3515be3f144220090da75770ea466cacf8185aa","observation_id":"5dcde609-893b-456c-be9d-dd3b74187c34","resolution":{"observed_at":"2026-08-06T19:26:58.410428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":"2501.01282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-07-01T20:16:12.001782Z","title":"Culturevlm: Characterizing and improving cultural understanding of vision-language models for over 100 countries","venue":null,"work_id":"4fae4a5a-5bf3-41be-b688-f4533eb7de16","year":2025},"citing_paper":{"arxiv_id":"2604.07338","last_updated":"2026-04-08T17:53:26Z","snapshot_observed_at":"2026-08-11T12:41:43.815777Z","submitted_at":"2026-04-08T17:53:26Z","title":"Appear2Meaning: A Cross-Cultural Benchmark for Structured Cultural Metadata Inference from Images","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T17:49:25.227568Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2604.07338"},"observation_digest":"sha256:1c5f368adeb4345eda1d209f4ac28806486668dd489e45fc96192db2ada32c38","observation_id":"6274f23e-47bc-47da-96b8-c796c8ca706b","resolution":{"observed_at":"2026-05-11T06:05:55.519801Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":"2501.01282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-07-01T20:16:12.001782Z","title":"Culturevlm: Characterizing and improving cultural understanding of vision-language models for over 100 countries","venue":null,"work_id":"4fae4a5a-5bf3-41be-b688-f4533eb7de16","year":2025},"citing_paper":{"arxiv_id":"2604.18423","last_updated":"2026-04-20T15:41:05Z","snapshot_observed_at":"2026-07-06T23:05:17.639285Z","submitted_at":"2026-04-20T15:41:05Z","title":"BhashaSutra: A Task-Centric Unified Survey of Indian NLP Datasets, Corpora, and Resources","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T04:22:34.046014Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2604.18423"},"observation_digest":"sha256:5cd929650014ec997c0c285f61d650b029c953e4ec2a69164fb5fe5dcd459e59","observation_id":"bcf456a2-4aa1-49a2-a39a-e0dff11e04d2","resolution":{"observed_at":"2026-05-11T12:01:02.085493Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":"2501.01282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-07-01T20:16:12.001782Z","title":"Culturevlm: Characterizing and improving cultural understanding of vision-language models for over 100 countries","venue":null,"work_id":"4fae4a5a-5bf3-41be-b688-f4533eb7de16","year":2025},"citing_paper":{"arxiv_id":"2605.16716","last_updated":"2026-07-19T13:03:10Z","snapshot_observed_at":"2026-08-16T03:05:37.972350Z","submitted_at":"2026-05-16T00:01:18Z","title":"When Cultures Move: Measuring and Improving Multicultural Text-to-Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T21:59:44.030267Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2605.16716"},"observation_digest":"sha256:5cb2090763f0f1bad3ce78d8bdbf16107ba7c93241309246de293e24147faf97","observation_id":"bb620059-7136-4826-96eb-ad34ac4750f1","resolution":{"observed_at":"2026-05-19T22:02:49.023392Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":"2501.01282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-07-01T20:16:12.001782Z","title":"Culturevlm: Characterizing and improving cultural understanding of vision-language models for over 100 countries","venue":null,"work_id":"4fae4a5a-5bf3-41be-b688-f4533eb7de16","year":2025},"citing_paper":{"arxiv_id":"2605.16716","last_updated":"2026-07-19T13:03:10Z","snapshot_observed_at":"2026-08-16T03:05:37.972350Z","submitted_at":"2026-05-16T00:01:18Z","title":"When Cultures Move: Measuring and Improving Multicultural Text-to-Video Generation","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T19:36:43.654439Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2605.16716"},"observation_digest":"sha256:f13fef4f3c21959dd1a01650f3e51486bacbd3bfdadc668d570edbacc9d2114c","observation_id":"2cf76168-110d-4e89-85ec-9599d1807bef","resolution":{"observed_at":"2026-06-30T19:45:01.074023Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-08-02T13:52:47.550786Z","title":"CoRR, abs/2501.01282","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.16716","last_updated":"2026-07-19T13:03:10Z","snapshot_observed_at":"2026-08-16T03:05:37.972350Z","submitted_at":"2026-05-16T00:01:18Z","title":"When Cultures Move: Measuring and Improving Multicultural Text-to-Video Generation","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T13:52:47.550786Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2605.16716"},"observation_digest":"sha256:448b1a2f83adc3fb0155800f5eccd7400358d3d24caf84e76f01256bf781f7cd","observation_id":"528c4356-9aa1-47be-8658-c2530d7ab751","resolution":{"observed_at":"2026-08-02T13:52:47.550786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":"2501.01282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-07-01T20:16:12.001782Z","title":"Culturevlm: Characterizing and improving cultural understanding of vision-language models for over 100 countries","venue":null,"work_id":"4fae4a5a-5bf3-41be-b688-f4533eb7de16","year":2025},"citing_paper":{"arxiv_id":"2605.30800","last_updated":"2026-05-29T03:42:22Z","snapshot_observed_at":"2026-08-13T08:25:31.388907Z","submitted_at":"2026-05-29T03:42:22Z","title":"Computer-Aided Tagging on Wikimedia Commons: Designing for Human-AI Collaboration in Open Knowledge Work","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T21:23:51.431142Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2605.30800"},"observation_digest":"sha256:13997d6fe1072635b86d9cfc85218056f04f0ab942413eaebaf8665fe0f3361e","observation_id":"6ab89fc6-1078-4da3-9d4e-e256b772702b","resolution":{"observed_at":"2026-07-01T20:16:12.003355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-07-11T15:14:25.526254Z","title":"Kenneth Marino, Mohammad Rastegari, Ali Farhadi, and Roozbeh Mottaghi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04683","last_updated":"2026-08-04T11:53:54Z","snapshot_observed_at":"2026-08-17T10:13:52.470866Z","submitted_at":"2026-07-06T05:11:45Z","title":"Failing to See or Failing to Know? Attributing Errors in Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T15:14:25.526254Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2607.04683"},"observation_digest":"sha256:13da06ce26735aa35d98d98bbfd385e0cc37a1d7bcc373903adc0e0e28eaf7f4","observation_id":"d1674364-8765-43a4-b7d2-96e63035fddd","resolution":{"observed_at":"2026-07-11T15:14:25.526254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-07-13T06:57:34.446788Z","title":"Kenneth Marino, Mohammad Rastegari, Ali Farhadi, and Roozbeh Mottaghi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04683","last_updated":"2026-08-04T11:53:54Z","snapshot_observed_at":"2026-08-17T10:13:52.470866Z","submitted_at":"2026-07-06T05:11:45Z","title":"Failing to See or Failing to Know? Attributing Errors in Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T06:57:34.446788Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2607.04683"},"observation_digest":"sha256:5b562fa0bd08614dc948a68b6701e61d69d37fd78e1fd157abce2655ad8f25c8","observation_id":"6c6ff0e7-d50f-4986-a70c-519d5ecad198","resolution":{"observed_at":"2026-07-13T06:57:34.446788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01282","snapshot_observed_at":"2026-08-04T04:32:12.656115Z","title":"Kenneth Marino, Mohammad Rastegari, Ali Farhadi, and Roozbeh Mottaghi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04683","last_updated":"2026-08-04T11:53:54Z","snapshot_observed_at":"2026-08-17T10:13:52.470866Z","submitted_at":"2026-07-06T05:11:45Z","title":"Failing to See or Failing to Know? Attributing Errors in Vision-Language Models","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T04:32:12.656115Z"},"links":{"cited_paper":"/paper/2501.01282","citing_paper":"/paper/2607.04683"},"observation_digest":"sha256:389e3d99a13b171858ab80d7f06c56a19848cdd877bc23754fefa863eb7044b9","observation_id":"dfd18ba2-00b5-49c3-a827-a3932a04772f","resolution":{"observed_at":"2026-08-04T04:32:12.656115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.01282/citation-record","integrity":"/paper/2501.01282/integrity","json":"/paper/2501.01282/citation-record.json","paper":"/paper/2501.01282"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.15713","last_updated":"2023-12-25T12:48:55Z","snapshot_observed_at":"2026-08-16T14:31:45.556730Z","submitted_at":"2023-12-25T12:48:55Z","title":"PersianLLaMA: Towards Building First Persian Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15713","snapshot_observed_at":"2026-08-10T22:36:03.693690Z","title":"Persianllama: Towards building first persian large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.693690Z"},"links":{"cited_paper":"/paper/2312.15713","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:bc1915d51cd19a43d4dd0af70ccaf9bd6f40a4de09315f1856eeb84887e2d45d","observation_id":"b703a96a-d32e-49ea-8089-693a395cc08c","resolution":{"observed_at":"2026-08-10T22:36:03.693690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-08-10T22:36:03.709739Z","title":"Pixtral 12b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.709739Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:47ef5c21fa131f3501af78eaa1277daf3c013af2e7e288099afcdc01159f05af","observation_id":"36eab720-581d-4f61-951b-e5d6ca9d659d","resolution":{"observed_at":"2026-08-10T22:36:03.709739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00263","last_updated":"2024-06-28T23:28:28Z","snapshot_observed_at":"2026-08-16T13:38:36.796513Z","submitted_at":"2024-06-28T23:28:28Z","title":"From Local Concepts to Universals: Evaluating the Multicultural Understanding of Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00263","snapshot_observed_at":"2026-08-10T22:36:03.719534Z","title":"From local concepts to universals: Evaluating the multicultural understanding of vision-language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.719534Z"},"links":{"cited_paper":"/paper/2407.00263","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:89250f0e5ddd15a0ad913b137ee8706bc95a841c973384ec316d2d5635c006a6","observation_id":"ce6f9271-f9d7-4c54-a8b5-bdf1c7f639d9","resolution":{"observed_at":"2026-08-10T22:36:03.719534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02401","last_updated":"2024-11-05T22:33:52Z","snapshot_observed_at":"2026-08-16T14:37:40.370339Z","submitted_at":"2023-12-05T00:11:09Z","title":"Enhancing Content Moderation with Culturally-Aware Models","version":2},"cited_work":{"arxiv_id":"2312.02401","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.02401","snapshot_observed_at":"2026-08-10T22:36:04.381594Z","title":"Enhancing Content Moderation with Culturally-Aware Models","venue":"stat.ML","work_id":"40589485-9bd0-459a-b9d8-03844b6b4b39","year":2023},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.724985Z"},"links":{"cited_paper":"/paper/2312.02401","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:b5ca6ec53eeae38b603f344e3e3a722d6d0356ad14e4b094e0ef576daf4a020b","observation_id":"392d0ad3-7e2c-4496-83b9-877c86c47305","resolution":{"observed_at":"2026-08-10T22:36:04.389465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14238","last_updated":"2024-01-15T15:23:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-21T18:59:31Z","title":"InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14238","snapshot_observed_at":"2026-08-10T22:36:03.729584Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.729584Z"},"links":{"cited_paper":"/paper/2312.14238","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:64bf61b341aa32bc763f85ea7f1260f2e014ed0c077a73d6095c65b0630e3bf4","observation_id":"bde0b0d4-b8f4-447c-8b5b-2ef91d4ace20","resolution":{"observed_at":"2026-08-10T22:36:03.729584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02677","last_updated":"2025-06-03T01:56:26Z","snapshot_observed_at":"2026-08-16T13:12:53.158265Z","submitted_at":"2024-10-03T17:04:31Z","title":"CulturalBench: A Robust, Diverse, and Challenging Cultural Benchmark by Human-AI CulturalTeaming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02677","snapshot_observed_at":"2026-08-10T22:36:03.733945Z","title":"Culturalbench: a robust, diverse and challenging benchmark on measuring the (lack of) cultural knowledge of llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.733945Z"},"links":{"cited_paper":"/paper/2410.02677","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:4062ef1175c37e7968c951805ad8b083be62cc5eb09643ae6560a9d6809d7f8a","observation_id":"de06cbaf-44cd-4d74-883f-421f3ea58a90","resolution":{"observed_at":"2026-08-10T22:36:03.733945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05392","last_updated":"2024-10-21T07:08:11Z","snapshot_observed_at":"2026-08-16T13:44:57.427678Z","submitted_at":"2024-06-08T07:55:01Z","title":"Deconstructing The Ethics of Large Language Models from Long-standing Issues to New-emerging Dilemmas: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05392","snapshot_observed_at":"2026-08-10T22:36:03.738526Z","title":"Deconstructing the ethics of large language models from long-standing issues to new-emerging dilemmas.arXiv:2406.05392,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.738526Z"},"links":{"cited_paper":"/paper/2406.05392","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:e1468e16c548c9d3e54c0e588b9f512bb9d3006436af616bddec65825228bea2","observation_id":"d191fd92-d47c-420a-a4a5-9ebb1c42763c","resolution":{"observed_at":"2026-08-10T22:36:03.738526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09369","last_updated":"2024-02-14T18:16:54Z","snapshot_observed_at":"2026-08-16T14:18:33.211736Z","submitted_at":"2024-02-14T18:16:54Z","title":"Massively Multi-Cultural Knowledge Acquisition & LM Benchmarking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09369","snapshot_observed_at":"2026-08-10T22:36:03.743295Z","title":"Massively multi-cultural knowledge acquisition & lm benchmarking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.743295Z"},"links":{"cited_paper":"/paper/2402.09369","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:14b71c7c325e5907d85739e99f8892d460cc64cd8164119223f2d54fcd5d58f6","observation_id":"d369c2e0-6756-4eb1-8657-c2133cfdc502","resolution":{"observed_at":"2026-08-10T22:36:03.743295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.08604","last_updated":"2024-01-13T22:46:01Z","snapshot_observed_at":"2026-08-16T16:23:45.797565Z","submitted_at":"2022-10-16T18:30:05Z","title":"NormSAGE: Multi-Lingual Multi-Cultural Norm Discovery from Conversations On-the-Fly","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.08604","snapshot_observed_at":"2026-08-10T22:36:03.748211Z","title":"Normsage: Multi-lingual multi-cultural norm discovery from conversations on-the-fly","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.748211Z"},"links":{"cited_paper":"/paper/2210.08604","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:81202059126916820fa8f0d947fbb7599d3e84550f364f0aadcded2b31a8e0c3","observation_id":"500688a7-7ccd-4040-9855-d84822e0db39","resolution":{"observed_at":"2026-08-10T22:36:03.748211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-10T22:36:03.753017Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.753017Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:04db62852d1e402ab05ff7d0fecb42fb97524dac28ae1cb3a686d8376559b74f","observation_id":"c6236d50-2e70-44d7-9fbc-f7e4e07ff15d","resolution":{"observed_at":"2026-08-10T22:36:03.753017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.07785","last_updated":"2022-03-15T11:06:54Z","snapshot_observed_at":"2026-08-16T17:14:28.596121Z","submitted_at":"2022-03-15T11:06:54Z","title":"The Ghost in the Machine has an American accent: value conflict in GPT-3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.07785","snapshot_observed_at":"2026-08-10T22:36:03.757481Z","title":"Better to ask in english: Cross-lingual evaluation of large language models for healthcare queries","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.757481Z"},"links":{"cited_paper":"/paper/2203.07785","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:3e0da1bd4333419c531205614f8f7b096ea4ba3390ca99716dfc17558d6d291c","observation_id":"bd6dc3eb-49ad-400d-bb0b-94673e49f68b","resolution":{"observed_at":"2026-08-10T22:36:03.757481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-10T22:36:03.762120Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.762120Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:01b523a6be35050e0d16385f48f01f958be358e9dd0af8a96ca66fc4907cc4e1","observation_id":"ced4e771-125b-4515-b76e-0d3ba48b78d7","resolution":{"observed_at":"2026-08-10T22:36:03.762120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08591","last_updated":"2024-03-30T17:13:58Z","snapshot_observed_at":"2026-08-16T15:00:19.666776Z","submitted_at":"2023-09-15T17:45:28Z","title":"Are Multilingual LLMs Culturally-Diverse Reasoners? An Investigation into Multicultural Proverbs and Sayings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08591","snapshot_observed_at":"2026-08-10T22:36:03.766605Z","title":"Are multilingual llms culturally-diverse reasoners? an investigation into multicultural proverbs and sayings","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.766605Z"},"links":{"cited_paper":"/paper/2309.08591","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:517a6a13892d57dbb56b452977cad4835404dc297f71694de067830f7eef5d2e","observation_id":"28d21c31-08ca-4e28-96c2-d6c8549d8dd3","resolution":{"observed_at":"2026-08-10T22:36:03.766605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:36:04.506948Z","title":"The 2012 stein rokkan lecture: Three decades of popu list radical right parties in western europe: so what? In The Populist Radical Right, pages 545–558","venue":null,"work_id":"2fe49e18-88b1-4815-bf25-32845e4df960","year":2012},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.780912Z"},"links":{"citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:319cd2752b7cc9c622ab20698b6b6dda2da61d85b42e2989f2d4fff9c9f291c2","observation_id":"d7edca81-f066-49dd-aff0-161460eca7de","resolution":{"observed_at":"2026-08-10T22:36:04.511847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14456","last_updated":"2024-03-20T17:16:37Z","snapshot_observed_at":"2026-08-16T15:30:28.811496Z","submitted_at":"2023-05-23T18:27:51Z","title":"Having Beer after Prayer? Measuring Cultural Bias in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14456","snapshot_observed_at":"2026-08-10T22:36:03.790331Z","title":"Readme++: Benchmarking multilingual language models for multi-domain readability assessment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.790331Z"},"links":{"cited_paper":"/paper/2305.14456","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:c4950ff0f2f938c7edfd8f81f33d6f22734e58921d64960ab6d0e9420b1fd852","observation_id":"23b6f6d1-9bf4-4278-a6f6-00c57d8ccf17","resolution":{"observed_at":"2026-08-10T22:36:03.790331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00738","last_updated":"2024-07-01T05:52:31Z","snapshot_observed_at":"2026-08-16T14:38:24.064753Z","submitted_at":"2023-12-01T17:17:56Z","title":"SeaLLMs -- Large Language Models for Southeast Asia","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00738","snapshot_observed_at":"2026-08-10T22:36:03.794935Z","title":"Extracting cultural commonsense knowledge at scale","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.794935Z"},"links":{"cited_paper":"/paper/2312.00738","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:dd83c2bd91ba15f626ea8c8374657ec90fe3a257766331cfcf90a792ee964a47","observation_id":"0c3c998a-2872-4efc-903c-f08a9a740455","resolution":{"observed_at":"2026-08-10T22:36:03.794935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13951","last_updated":"2023-12-21T15:38:41Z","snapshot_observed_at":"2026-08-16T14:32:32.955703Z","submitted_at":"2023-12-21T15:38:41Z","title":"Typhoon: Thai Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13951","snapshot_observed_at":"2026-08-10T22:36:03.799848Z","title":"Gpt-4o, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.799848Z"},"links":{"cited_paper":"/paper/2312.13951","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:92f66aae83e8ca250fda42bf6bfce11274bd1c078872cd1e5f5737477a3af6a1","observation_id":"004f5fa0-8949-4286-8d76-d5817565537d","resolution":{"observed_at":"2026-08-10T22:36:03.799848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12464","last_updated":"2025-07-08T20:56:42Z","snapshot_observed_at":"2026-08-16T13:59:39.004083Z","submitted_at":"2024-04-18T18:48:50Z","title":"NormAd: A Framework for Measuring the Cultural Adaptability of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12464","snapshot_observed_at":"2026-08-10T22:36:03.804437Z","title":"Normad: A benchmark for measuring the cultural adaptability of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.804437Z"},"links":{"cited_paper":"/paper/2404.12464","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:112ad4f05672b0482bb670415c47f4dc87a21274a6f9f449fe1ee645f7e5f4f6","observation_id":"60af69ee-f49b-41e6-a5a8-e70b951bdf37","resolution":{"observed_at":"2026-08-10T22:36:03.804437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05967","last_updated":"2024-11-04T07:55:31Z","snapshot_observed_at":"2026-08-16T13:44:42.394406Z","submitted_at":"2024-06-10T01:59:00Z","title":"CVQA: Culturally-diverse Multilingual Visual Question Answering Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05967","snapshot_observed_at":"2026-08-10T22:36:03.809020Z","title":"Cvqa: Culturally-diverse multilingual visual question answering benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.809020Z"},"links":{"cited_paper":"/paper/2406.05967","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:641dc40cad9f07d635a7c3f6c56942843792b1709f547c9e0623f39b9c8d1430","observation_id":"a91608e1-9925-42b6-a46b-87b2041d3e67","resolution":{"observed_at":"2026-08-10T22:36:03.809020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-10T22:36:03.823476Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.823476Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:e4210df73cccf9aeb87ce00b10f6450758472402b04770624148c95fdb2b01b4","observation_id":"c84d5bb1-a7f7-4bee-8637-4272a4afa976","resolution":{"observed_at":"2026-08-10T22:36:03.823476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01313","last_updated":"2024-01-08T16:19:17Z","snapshot_observed_at":"2026-08-15T22:25:16.598230Z","submitted_at":"2024-01-02T17:56:30Z","title":"A Comprehensive Survey of Hallucination Mitigation Techniques in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01313","snapshot_observed_at":"2026-08-10T22:36:03.828161Z","title":"A comprehensive survey of hallucination mitigation techniques in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.828161Z"},"links":{"cited_paper":"/paper/2401.01313","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:b3ad8f9e4a23177c5f4769aeac827778bd06dd0b9e2921092129b7728c82931d","observation_id":"91faec6d-c017-4908-b5a4-826b0d003bcc","resolution":{"observed_at":"2026-08-10T22:36:03.828161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-10T22:36:03.832979Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.832979Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:4a21d5f0aa8af19687f91d4896a6289ce84c6ef5432e797b743974fa0167210c","observation_id":"189d4403-aaf3-447c-9264-f3e4c5d66c22","resolution":{"observed_at":"2026-08-10T22:36:03.832979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12481","last_updated":"2024-02-16T14:06:41Z","snapshot_observed_at":"2026-08-16T14:50:50.707317Z","submitted_at":"2023-10-19T05:38:23Z","title":"Not All Countries Celebrate Thanksgiving: On the Cultural Dominance in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12481","snapshot_observed_at":"2026-08-10T22:36:03.838421Z","title":"Not all countries celebrate thanksgiving: On the cultural dominance in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.838421Z"},"links":{"cited_paper":"/paper/2310.12481","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:60c1e5719211534c597c5bd4cdf0f016cdae8aa5abfeb753cceb1bc31196b7ca","observation_id":"4c6f1a82-d5dc-4afd-8d50-1c907be07ddc","resolution":{"observed_at":"2026-08-10T22:36:03.838421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12705","last_updated":"2025-05-08T08:46:59Z","snapshot_observed_at":"2026-08-16T13:08:44.618950Z","submitted_at":"2024-10-16T16:11:49Z","title":"WorldCuisines: A Massive-Scale Benchmark for Multilingual and Multicultural Visual Question Answering on Global Cuisines","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12705","snapshot_observed_at":"2026-08-10T22:36:03.843224Z","title":"Worldcuisines: A massive-scale benchmark for multilingual and multicultural visual question answering on global cuisines","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.843224Z"},"links":{"cited_paper":"/paper/2410.12705","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:f7f147a84728116a3c17b8321055112793f1c56a7bd5b2cfd42064ea312db7ef","observation_id":"0db2fc3e-8a23-45be-90ea-9913216c4481","resolution":{"observed_at":"2026-08-10T22:36:03.843224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-10T22:36:03.847783Z","title":"Minicpm-v: A gpt-4v level mllm on your phone","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.847783Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:0d55e9c12986bda33de3f03680a85e7b5f2b7e094b7521300df91003a5f4a4ed","observation_id":"e9e8297b-fb45-4ee4-8ef3-3a56a86f5e7e","resolution":{"observed_at":"2026-08-10T22:36:03.847783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:36:04.492017Z","title":"14 B.2 Detailed Main Results","venue":null,"work_id":"db8c89c1-7c71-47e7-8f4a-bddd7117721e","year":2023},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.857380Z"},"links":{"citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:8f845b4cdfd627dc85efb8d76c09920d0cef095f2e15ce2c19c94f72e04d7c55","observation_id":"7c5b56fa-ee0f-4cc7-b964-f6bd97b56429","resolution":{"observed_at":"2026-08-10T22:36:04.496808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-10T22:36:03.714782Z","title":"Hallucination of multimodal large language models: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":1996,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.714782Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:34bee54dd0402879dfca9fcbd30795ba0b464b4c867361c3ffb8a8dec6cf0399","observation_id":"62c4e83c-4910-4e1d-9a20-d9afa2e9fa68","resolution":{"observed_at":"2026-08-10T22:36:03.714782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16308","last_updated":"2024-04-25T03:23:28Z","snapshot_observed_at":"2026-08-16T13:58:02.003132Z","submitted_at":"2024-04-25T03:23:28Z","title":"WorldValuesBench: A Large-Scale Benchmark Dataset for Multi-Cultural Value Awareness of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16308","snapshot_observed_at":"2026-08-10T22:36:03.852041Z","title":"Worldvaluesbench: A large-scale benchmark dataset for multi-cultural value awareness of language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.852041Z"},"links":{"cited_paper":"/paper/2404.16308","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:5ece7de56cc88f4d26adb3f9bef825b336b7d10355fccf43fea4d733e668280d","observation_id":"acb73a92-2334-4750-be28-3d3978e2a2ea","resolution":{"observed_at":"2026-08-10T22:36:03.852041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09948","last_updated":"2025-01-16T01:41:48Z","snapshot_observed_at":"2026-08-17T01:36:16.821459Z","submitted_at":"2024-06-14T11:48:54Z","title":"BLEnD: A Benchmark for LLMs on Everyday Knowledge in Diverse Cultures and Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09948","snapshot_observed_at":"2026-08-10T22:36:03.785654Z","title":"Blend: A benchmark for llms on everyday knowledge in diverse cultures and languages","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.785654Z"},"links":{"cited_paper":"/paper/2406.09948","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:2b35ce153571eed869e2657c28c3976d3e9ea401711a7b49d449781a0f948cb8","observation_id":"6fb93bf7-e972-492f-ba2f-57d05f129b30","resolution":{"observed_at":"2026-08-10T22:36:03.785654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:36:04.521828Z","title":"Llama 3.2","venue":null,"work_id":"3f0af595-cf58-4054-8bff-c95e6bb76d48","year":2024},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.776122Z"},"links":{"citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:4e3adcf153b537d74eb8fd042517aa05c48164d6a8282283422084b469a8bd69","observation_id":"9ed418d1-e707-44fb-a72d-58467dea94dd","resolution":{"observed_at":"2026-08-10T22:36:04.526513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12342","last_updated":"2024-05-08T14:48:39Z","snapshot_observed_at":"2026-08-16T15:05:46.820312Z","submitted_at":"2023-08-25T14:50:13Z","title":"Cultural Alignment in Large Language Models: An Explanatory Analysis Based on Hofstede's Cultural Dimensions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12342","snapshot_observed_at":"2026-08-10T22:36:03.771478Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.771478Z"},"links":{"cited_paper":"/paper/2309.12342","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:d23d789b313c22f40097dce14ebe35aa0487a2f97b512f679f3ec7ebff351fe2","observation_id":"f17c16cb-fc39-45d4-9665-d1ffa17ed9ee","resolution":{"observed_at":"2026-08-10T22:36:03.771478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15238","last_updated":"2024-04-23T17:16:08Z","snapshot_observed_at":"2026-08-16T13:58:27.119487Z","submitted_at":"2024-04-23T17:16:08Z","title":"CultureBank: An Online Community-Driven Knowledge Base Towards Culturally Aware Language Technologies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15238","snapshot_observed_at":"2026-08-10T22:36:03.818665Z","title":"Culturebank: An online community-driven knowledge base towards culturally aware language technologies","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.818665Z"},"links":{"cited_paper":"/paper/2404.15238","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:5d031e7d49fc35c194eaa1618a70d7cca343dc6d38fc6ab31a9c8dfc76ea3a50","observation_id":"b0dfbc3c-30b0-46af-93e2-3f087f194d85","resolution":{"observed_at":"2026-08-10T22:36:03.818665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-10T22:36:03.699532Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.699532Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:9b922e7bc14c74353cdbc9cd51b9c11b60a140a56f480c62aae7aef28540cfe0","observation_id":"b1d9945c-355c-4f40-a0f8-dbe3d1360e60","resolution":{"observed_at":"2026-08-10T22:36:03.699532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15412","last_updated":"2024-09-04T05:12:54Z","snapshot_observed_at":"2026-08-16T14:12:45.198274Z","submitted_at":"2024-03-05T08:29:36Z","title":"Towards Measuring and Modeling \"Culture\" in LLMs: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15412","snapshot_observed_at":"2026-08-10T22:36:03.704833Z","title":"culture","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T22:36:03.704833Z"},"links":{"cited_paper":"/paper/2403.15412","citing_paper":"/paper/2501.01282"},"observation_digest":"sha256:9e03ae9212ecf7a8e17b30e9956fe9aab28acee0071f887c90d5ba4c0f6cf973","observation_id":"1c4fc194-ecd0-431a-9fba-5a23b6b5ea51","resolution":{"observed_at":"2026-08-10T22:36:03.704833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.01282","last_updated":"2025-01-02T14:42:37Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T22:25:54.905660Z","submitted_at":"2025-01-02T14:42:37Z","title":"CultureVLM: Characterizing and Improving Cultural Understanding of Vision-Language Models for over 100 Countries"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 14 inbound Pith citation observations for arXiv:2501.01282."}