{"as_of":"2026-08-11T16:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d73c2b368b324a1824f59333783eb1aba7a2b2b9b7027b45fe43910555e60652","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:36:10.316754Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20326/citation-record","integrity":"/paper/2505.20326/integrity","json":"/paper/2505.20326/citation-record.json","paper":"/paper/2505.20326"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.945902Z","title":"See it from my perspective: How language affects cultural bias in image understanding","venue":null,"work_id":"00d93d12-603b-4eb6-a985-edaf57f9dd92","year":null},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:07.947602Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:02ced065ffb9a56765dd573aef8e023fff99cbdbb9ece175202a915651072681","observation_id":"b4c60a33-7f56-4687-9741-3da9ceba5bc4","resolution":{"observed_at":"2026-08-07T14:36:14.010711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.744101Z","title":"From local concepts to universals: Evaluating the multicultural understanding of vision-language models","venue":null,"work_id":"5dcb8721-6cc6-47b2-8572-5846c778c61e","year":2024},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.069947Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:381a188d015dd218ecf21480104043181df3c07de5f35a788a20a9aa471e478c","observation_id":"f2ee2149-dd70-43c6-912f-65f7ba6ec18c","resolution":{"observed_at":"2026-08-07T14:36:13.866511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.01963","last_updated":"2021-10-05T11:47:27Z","snapshot_observed_at":"2026-07-06T11:54:31.182477Z","submitted_at":"2021-10-05T11:47:27Z","title":"Multimodal datasets: misogyny, pornography, and malignant stereotypes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.01963","snapshot_observed_at":"2026-08-07T14:36:08.190528Z","title":"Multimodal datasets: misogyny, pornog- raphy, and malignant stereotypes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.190528Z"},"links":{"cited_paper":"/paper/2110.01963","citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:8fe4f099768bd3cf8f69ce0578bbc654b988aec8950fc2cc0ab08044529d5466","observation_id":"672c9ce1-be5e-4c62-91f4-05776827600b","resolution":{"observed_at":"2026-08-07T14:36:08.190528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.635848Z","title":"Reproducible scaling laws for contrastive language-image learning","venue":null,"work_id":"32ddfb1a-1796-40f6-8769-9f3a08ab707d","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.347830Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:1066874ae88ba37f786b6e2d4c942f8b9a03f84a5bf30369ca184b69bb5f45f6","observation_id":"0fbfc8cb-a62e-411d-9732-de5a978ad00d","resolution":{"observed_at":"2026-08-07T14:36:13.689491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.517494Z","title":"Improving clip training with language rewrites","venue":null,"work_id":"2be006ea-60eb-4687-9298-1ae47846acc9","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.451457Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:d9f790d66d0c3dbb08b3cd480e29390c75a222af8d12a37a1927a7bc7bcb39c7","observation_id":"aba5acc2-313e-4d58-ad3d-e986de495b8d","resolution":{"observed_at":"2026-08-07T14:36:13.575096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.322816Z","title":"Uncurated image-text datasets: Shedding light on demographic bias","venue":null,"work_id":"d4c15e97-4311-4c1d-ade8-8c8f9f1463e2","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.578379Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:95108ab09a5822165a6efce53ccc9fd560081dab414df4a2e660be6e0bb40550","observation_id":"875c2967-d629-41ed-bd75-fcf873b27611","resolution":{"observed_at":"2026-08-07T14:36:13.429559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11100","last_updated":"2023-01-26T13:44:31Z","snapshot_observed_at":"2026-08-04T12:33:42.854725Z","submitted_at":"2023-01-26T13:44:31Z","title":"Vision-Language Models Performing Zero-Shot Tasks Exhibit Gender-based Disparities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11100","snapshot_observed_at":"2026-08-07T14:36:08.709859Z","title":"Vision-language models per- forming zero-shot tasks exhibit gender-based disparities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.709859Z"},"links":{"cited_paper":"/paper/2301.11100","citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:1997ce7cbf032f3aa1163635969dae1a1323eda5d4b34b5fc3256fbf22f3b32b","observation_id":"49dff444-765f-485c-b439-18341c3c9e9a","resolution":{"observed_at":"2026-08-07T14:36:08.709859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.180293Z","title":"So- cialcounterfactuals: Probing and mitigating intersectional social biases in vision-language models with counterfac- tual examples","venue":null,"work_id":"7936d9c4-e680-459e-90bb-735ab33a087a","year":2024},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.827202Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:467ea15dda39f9dc5aa92def5b1e9e8b3e23f7ccd0bd768329a9ff8f75aad932","observation_id":"a93a818f-9e02-4233-ada9-f29db1604257","resolution":{"observed_at":"2026-08-07T14:36:13.255658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:13.002421Z","title":"Multi-modal bias: Introducing a framework for stereotypical bias as- sessment beyond gender and race in vision–language models","venue":null,"work_id":"d6a2859b-6795-4215-8b1a-54666bb136a6","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:08.971057Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:f2ea17b693444f38c364e38af9ece9d4ecff7d4d0a283f524c2cc291c16c5f4c","observation_id":"6ae4aef5-1ad9-429d-98df-d3474c6356a9","resolution":{"observed_at":"2026-08-07T14:36:13.078675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.857785Z","title":"Fairface: Face attribute dataset for balanced race, gender, and age for bias measurement and mitigation","venue":null,"work_id":"3f018415-5739-4eb6-9a5c-4a5ff22ae5b3","year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.074492Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:d6039a6be9c7506ff6bdc4ce4ec5b1d68d3a2bbd3834a1365a648238945919fd","observation_id":"66a858ac-b506-4da0-89a3-ef8ecfaab1eb","resolution":{"observed_at":"2026-08-07T14:36:12.916295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.698919Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"98da908f-aeff-40cc-8851-afb432d7cba6","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.170988Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:37c6b25b8d9906e798baafd79dc7215c7a29f403dc699999a7b27fad37ba16cc","observation_id":"a99deb3b-dc10-4aab-9199-b8c9fc650123","resolution":{"observed_at":"2026-08-07T14:36:12.778598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.542872Z","title":"Visually grounded reasoning across languages and cultures","venue":null,"work_id":"485a2f54-ee62-4681-8dd9-6f3732b70695","year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.257226Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:936d79034c0a52dba443d52098ba9dc25fafc76cf452b278b501ab851e7d1be7","observation_id":"bd59e4a6-5791-4817-9caf-8cebb9cb6e12","resolution":{"observed_at":"2026-08-07T14:36:12.622095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.313922Z","title":"Stable bias: Evaluating societal rep- resentations in diffusion models","venue":null,"work_id":"3535423f-ec3b-4338-bd8f-0ac7836ce7af","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.356163Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:e8860744b430ff07cfbb314fde4793adc047b0514c29bef046645ee62c4d9fe0","observation_id":"09bf5613-7cf8-4fc2-87ab-809f4086dbce","resolution":{"observed_at":"2026-08-07T14:36:12.442475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:12.121631Z","title":"Benchmarking vision language models for cultural understanding","venue":null,"work_id":"fd819be1-93fe-4567-8fe0-ec44602d7633","year":2024},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.429879Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:7edcd1124a68add59943e8e59ad568ae938ff192c84ab4c5baa2ed82a233a9db","observation_id":"93b2f634-8e35-4eb9-8fdc-6228ed4275ca","resolution":{"observed_at":"2026-08-07T14:36:12.205596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.938428Z","title":"Bridging the digital divide: Performance variation across socio- economic factors in vision-language models","venue":null,"work_id":"a8d25fc2-827d-4c15-860d-e9877e02ef98","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.495642Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:71017cc4e844a397242480b0f43f840dcfac6cdb92fd0cfe7e490f813dd1a39a","observation_id":"41aee9e0-fa81-4a31-89e0-307cabb2db91","resolution":{"observed_at":"2026-08-07T14:36:12.034537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.830737Z","title":"No filter: Cultural and socioe- conomic diversity in contrastive vision-language models","venue":null,"work_id":"c692bade-2ea0-4e44-aa10-1bec3d90e15c","year":2024},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.622623Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:8804c80876b69d2b1c880c5313b7ea118802ec6ed25c4a322169cea58a89079a","observation_id":"27a485d5-36fe-4aaa-b178-73cc59c9cb77","resolution":{"observed_at":"2026-08-07T14:36:11.881040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.698279Z","title":"Learn- ing transferable visual models from natural language su- pervision","venue":null,"work_id":"2bc02351-fee8-4309-b5d2-c5f6fcaa7abd","year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.746770Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:3aa776ceb906558ae16ffdba8b6e11b4760f45f95e826af91efd8d6d6f163396","observation_id":"863fa5a8-08ff-407a-b40a-991eebaf593d","resolution":{"observed_at":"2026-08-07T14:36:11.790036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.474412Z","title":"No classification without representation: Assessing geodiversity issues in open data sets for the developing world","venue":null,"work_id":"3464d98b-34d4-4031-8983-638b7d53e151","year":null},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.855946Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:b8c3b756131d6918cc6c1e5fb510f3997cc611b08060d4f461409c0fa6ce5a83","observation_id":"8062d537-4532-4e6a-9aae-1a40e44f497c","resolution":{"observed_at":"2026-08-07T14:36:11.565500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.356468Z","title":"Flava: A foundational language and vision alignment model","venue":null,"work_id":"9c3fd0a7-6879-4d28-ba5d-5eab3fb14fef","year":2022},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:09.944434Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:0c7a371be4e88eff3bcfcf56153ca7709db3a2a1393cd9e56c5bd100d9956811","observation_id":"618a87bd-bf6b-4019-8fb3-8b327c68a165","resolution":{"observed_at":"2026-08-07T14:36:11.402018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:11.160985Z","title":"Alip: Adaptive language-image pre-training with synthetic cap- tion","venue":null,"work_id":"6372c5f1-ef43-41b2-bd10-c7a71856070e","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.007745Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:5b68cf133c3c8ff0f7d6719bc2eedbab1f556eb20b3bc0b6e7ab3a53124fa9ac","observation_id":"e0fefdb2-cd97-43fb-9550-7ac6a37fb2be","resolution":{"observed_at":"2026-08-07T14:36:11.285790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:10.970265Z","title":"Sigmoid loss for language image pre- training","venue":null,"work_id":"9c82453d-e721-48b1-bdc1-e8caab50c537","year":2023},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.054381Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:a1306c35ad924ab31196b44046e0920c2622aeb2c98f8e6faf3e1b1ce33388be","observation_id":"9524fd64-c689-4cba-a25d-c17c2e2b02cb","resolution":{"observed_at":"2026-08-07T14:36:11.068510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:10.804367Z","title":"Un- derstanding and evaluating racial biases in image cap- tioning","venue":null,"work_id":"02074a87-f030-4f29-862a-102026fc1e7d","year":2021},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.123995Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:db871bdcd965c0dd7f6c112517d5d2d4f58c992971f7b3c00fcce4bce3a6664e","observation_id":"44745be6-ea90-4bd3-8361-4d68574a849a","resolution":{"observed_at":"2026-08-07T14:36:10.907644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:10.644897Z","title":"Vlstereoset: A study of stereotypical bias in pre-trained vision-language models","venue":null,"work_id":"f414aba9-1310-42ed-b5ee-89a7bf202f0c","year":2022},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.225139Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:6360fa347ff4dc233fab84fa5d205c3cb713db9ecfb98a96f1a52d7025a12b9b","observation_id":"4e4235ff-6de7-4f05-bebb-aa905c4edfa6","resolution":{"observed_at":"2026-08-07T14:36:10.738277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:36:10.456787Z","title":null,"venue":null,"work_id":"be3a4d2d-6899-44d6-9c57-7eb8227defc4","year":null},"citing_paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:36:10.316754Z"},"links":{"citing_paper":"/paper/2505.20326"},"observation_digest":"sha256:56fe6dff484a90427d1aac05401c2c87793430e2e493932b1b92c12ea772dd43","observation_id":"66a0e14e-41df-46b5-ae18-8e3a047ed7a5","resolution":{"observed_at":"2026-08-07T14:36:10.533939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20326","last_updated":"2025-05-23T18:47:52Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-07T14:31:32.813906Z","submitted_at":"2025-05-23T18:47:52Z","title":"Cultural Awareness in Vision-Language Models: A Cross-Country Exploration"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2505.20326."}