{"as_of":"2026-08-10T03:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0671dd2037c65a94c0f60226133fa3439c9d33d6e196621ea6b22cdfd4ae69d5","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:48:33.976690Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07274/citation-record","integrity":"/paper/2507.07274/integrity","json":"/paper/2507.07274/citation-record.json","paper":"/paper/2507.07274"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:28.313729Z","title":"The multilingual mind: A survey of multilingual reasoning in language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.313729Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:a7733626130b317ff2c2527daeb2b4bee8f2b61c9ab4e690bf836575779d4e0f","observation_id":"277c9638-a88a-4a02-87e7-9deb261c118b","resolution":{"observed_at":"2026-08-06T18:48:28.313729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16508","last_updated":"2025-05-01T03:41:42Z","snapshot_observed_at":"2026-07-06T19:56:39.115630Z","submitted_at":"2024-11-25T15:44:42Z","title":"All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16508","snapshot_observed_at":"2026-08-06T18:48:28.390103Z","title":"All languages matter: Evaluating lmms on culturally diverse 100 languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.390103Z"},"links":{"cited_paper":"/paper/2411.16508","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:2470818381a438ffb89f3e2ad4cd4b62415dbeff7ee013d42a10ff88d25ca734","observation_id":"8a75e55a-b008-4d3b-ab5f-4bb173f0d609","resolution":{"observed_at":"2026-08-06T18:48:28.390103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.769842Z","title":"VQA: Visual question answering,","venue":null,"work_id":"8126bb40-fec3-4b01-911b-281da18dda37","year":2015},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.536181Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:0d3d19fa6a03d38369fc6a94c1c277c71eaa506041dd4badb8d6eed7ba1c92c0","observation_id":"c551ffdf-920a-4161-849c-5baf8f99d96f","resolution":{"observed_at":"2026-08-06T18:48:37.875503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.535540Z","title":"A-okvqa: A benchmark for visual question answering using world knowledge,","venue":null,"work_id":"5c6f0004-fcd1-482a-8a9e-769316b1e0db","year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.728590Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:4873ca8dadeb766eb24ce382a74a01dfbeefecd34e7753eb099ae1e882e3e003","observation_id":"929370b6-b0f7-4d9a-b377-fd99cf095e72","resolution":{"observed_at":"2026-08-06T18:48:37.669043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.342693Z","title":"Clevr: A diagnostic dataset for compositional language and elementary visual reasoning,","venue":null,"work_id":"f317209e-d188-4d0c-b2a7-216c0936c1d8","year":2016},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:28.912093Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:d947b0a1630aa7f85a073d41d067911fae34f637a2eb1ac09c0b0a71172ff395","observation_id":"279c0d45-01b8-4d56-ad4e-8c6d8bfe1cdd","resolution":{"observed_at":"2026-08-06T18:48:37.443250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:29.118002Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.118002Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:4e86e80c6cf812a145f4e7f8bee592790ad76c7454c316232900ea28d8451d66","observation_id":"5fa37962-cbec-4b83-88b5-d0861fca06e5","resolution":{"observed_at":"2026-08-06T18:48:29.118002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:37.090095Z","title":"From recognition to cognition: Visual commonsense reasoning,","venue":null,"work_id":"30685655-470e-4585-8cd9-ad8dedb24180","year":2019},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.289604Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:ed77146e8b327bba250b7b0612496b09852bbb9562813a591d08107d0de5d8c1","observation_id":"a7e782d7-faa7-460d-bf21-1d92d0e59f42","resolution":{"observed_at":"2026-08-06T18:48:37.183254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09095","last_updated":"2021-01-27T03:39:20Z","snapshot_observed_at":"2026-08-09T01:07:21.765684Z","submitted_at":"2020-04-20T07:19:22Z","title":"The State and Fate of Linguistic Diversity and Inclusion in the NLP World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09095","snapshot_observed_at":"2026-08-06T18:48:29.532259Z","title":"The state and fate of linguistic diversity and inclusion in the nlp world,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.532259Z"},"links":{"cited_paper":"/paper/2004.09095","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:4e7f8640a35bd1510cc29ee15cf7f308c26a15cfa3c3d9cf16d82155e37d8dbc","observation_id":"15c61380-9922-4123-9e5e-d741028ebd3e","resolution":{"observed_at":"2026-08-06T18:48:29.532259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-08T03:31:37.699253Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-06T18:48:29.760086Z","title":"Mm-vet: Evaluating large multimodal models for integrated capabilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.760086Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:a834ada73821c3daea60fe3b0bf34a06ebc264fed043c74c6e8934c687b426d2","observation_id":"51094169-c967-4b44-a7fb-770020cd3348","resolution":{"observed_at":"2026-08-06T18:48:29.760086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09295","last_updated":"2025-06-04T07:53:00Z","snapshot_observed_at":"2026-08-10T03:12:54.860311Z","submitted_at":"2024-06-13T16:30:14Z","title":"AlignMMBench: Evaluating Chinese Multimodal Alignment in Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09295","snapshot_observed_at":"2026-08-06T18:48:29.912325Z","title":"Alignmmbench: Evaluating chinese multimodal alignment in large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:29.912325Z"},"links":{"cited_paper":"/paper/2406.09295","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:58694edd9b39e1882e1a644cf32e493f298e7f8a1d214d98f2e789f4664eb011","observation_id":"50918f8a-5ef0-4397-819a-e86829ef4563","resolution":{"observed_at":"2026-08-06T18:48:29.912325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:36.822539Z","title":"Seed-bench: Benchmarking multimodal large language models,","venue":null,"work_id":"93923c66-9be0-475e-9272-87143185e117","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.108019Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:74f31f7f6f7e23ce7b797e7c6aa565a1eeb8afd226795f02a77226f8e3904701","observation_id":"c3f09204-2769-4efa-899e-0c4db9ea4ec5","resolution":{"observed_at":"2026-08-06T18:48:36.936844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10378","last_updated":"2024-03-15T15:08:39Z","snapshot_observed_at":"2026-07-06T17:45:19.668165Z","submitted_at":"2024-03-15T15:08:39Z","title":"EXAMS-V: A Multi-Discipline Multilingual Multimodal Exam Benchmark for Evaluating Vision Language Models","version":1},"cited_work":{"arxiv_id":"2403.10378","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.10378","snapshot_observed_at":"2026-08-06T18:48:34.542416Z","title":"EXAMS-V: A Multi-Discipline Multilingual Multimodal Exam Benchmark for Evaluating Vision Language Models","venue":"cs.CL","work_id":"10f351f4-596f-4cb2-9faa-105461d88b9e","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.265910Z"},"links":{"cited_paper":"/paper/2403.10378","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:4b3e208522f3df10131890073fd94fdd996157e81167b346bf1de338e91b0702","observation_id":"63ac98c7-6851-4384-b7b9-b667751a7308","resolution":{"observed_at":"2026-08-06T18:48:34.631964Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12852","last_updated":"2025-02-18T13:40:05Z","snapshot_observed_at":"2026-08-07T18:08:48.348615Z","submitted_at":"2025-02-18T13:40:05Z","title":"MVL-SIB: A Massively Multilingual Vision-Language Benchmark for Cross-Modal Topical Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12852","snapshot_observed_at":"2026-08-06T18:48:30.486100Z","title":"Mvl-sib: A massively multilingual vision-language benchmark for cross-modal topical matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.486100Z"},"links":{"cited_paper":"/paper/2502.12852","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:c3e3a6e2e9085428b3566e512d219e2ae5bf33e3467127fd64df0261ef759fe0","observation_id":"7e1ac5e5-6ef0-4e24-b8ba-ba45e928ebd4","resolution":{"observed_at":"2026-08-06T18:48:30.486100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07346","last_updated":"2025-04-20T12:19:46Z","snapshot_observed_at":"2026-08-10T02:37:11.776879Z","submitted_at":"2025-02-11T08:17:19Z","title":"BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07346","snapshot_observed_at":"2026-08-06T18:48:30.633186Z","title":"Benchmax: A comprehensive multilingual evaluation suite for large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.633186Z"},"links":{"cited_paper":"/paper/2502.07346","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:99c2ab2f7f5c576263d28283fba365617feea4a0dada8370279ee6edb454257b","observation_id":"2b3083bb-29df-47a1-8522-a90132a8fb6a","resolution":{"observed_at":"2026-08-06T18:48:30.633186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:36.584875Z","title":"Humanibench: A human-centric framework for large multimodal models evaluation,","venue":null,"work_id":"eaad4704-9f6a-45f2-a4ee-8269c94c2a8b","year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:30.840522Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:4b20f955012ab97a5e253dbedd1c20c241a0de3462c44631557513b495ce0d07","observation_id":"0d53b239-64c7-46f8-a2f4-8e6176809506","resolution":{"observed_at":"2026-08-06T18:48:36.702934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:36.380197Z","title":"Multimodal large language models: A survey,","venue":null,"work_id":"0d04015f-4a5e-4c17-a63a-526894337acd","year":2023},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.046214Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:7c70f19360f6d3b8de5e093859c6e30f24c2bd06012ff3c031e89d858e3cb19e","observation_id":"62b2fd80-270e-4193-8b53-625b0e05961d","resolution":{"observed_at":"2026-08-06T18:48:36.463234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.06561","last_updated":"2021-07-08T13:56:05Z","snapshot_observed_at":"2026-07-06T10:48:55.513059Z","submitted_at":"2021-03-11T09:39:49Z","title":"WenLan: Bridging Vision and Language by Large-Scale Multi-Modal Pre-Training","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.06561","snapshot_observed_at":"2026-08-06T18:48:31.198006Z","title":"Wenlan: Bridging vision and language by large-scale multi-modal pre-training,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.198006Z"},"links":{"cited_paper":"/paper/2103.06561","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:23c80c4fa9134df484a0e520ef8861e3b21964760eafcb4a536c257968cf3ef6","observation_id":"ad48293e-7269-4dea-b663-5e103da3bdea","resolution":{"observed_at":"2026-08-06T18:48:31.198006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15562","last_updated":"2021-09-10T06:48:03Z","snapshot_observed_at":"2026-08-03T00:44:38.607700Z","submitted_at":"2020-12-31T11:37:28Z","title":"UNKs Everywhere: Adapting Multilingual Language Models to New Scripts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15562","snapshot_observed_at":"2026-08-06T18:48:31.347093Z","title":"Unks everywhere: Adapting multilingual language models to new scripts,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.347093Z"},"links":{"cited_paper":"/paper/2012.15562","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:b1675a183813be10d3da5d4c3b0c0f9d5deded29c85f606f7365e8651f4e047c","observation_id":"7b16a71d-6410-4603-b61d-8ef28a8d5853","resolution":{"observed_at":"2026-08-06T18:48:31.347093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:36.146983Z","title":"Afriberta: Towards viable multilingual language models for low-resource languages,","venue":null,"work_id":"113c464b-dd3a-4fef-a4bb-fc84616eda46","year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.503521Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:47d14bacbb0dc91669b89150e81dafc0ec795cc5bf7aa29e7684ba06f509ecfa","observation_id":"81a3cdb7-2380-4b82-9951-46950f8a72c6","resolution":{"observed_at":"2026-08-06T18:48:36.237205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.893472Z","title":"mgpt: Few-shot learners go multilingual,","venue":null,"work_id":"f182ce32-c23f-4031-b648-1320874b0f84","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.652320Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:4cf4850a90a9baa04e49d9390ff7e337752a3cb93706124b48f085a6a29f61a6","observation_id":"d9d8502c-ae0f-46f7-bd65-750a500d16f6","resolution":{"observed_at":"2026-08-06T18:48:36.028517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07412","last_updated":"2021-10-07T09:51:04Z","snapshot_observed_at":"2026-08-03T17:43:44.785835Z","submitted_at":"2021-04-15T12:26:12Z","title":"XTREME-R: Towards More Challenging and Nuanced Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":"2104.07412","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.07412","snapshot_observed_at":"2026-08-06T18:48:34.249311Z","title":"XTREME-R: Towards More Challenging and Nuanced Multilingual Evaluation","venue":"cs.CL","work_id":"34fda9ea-b07e-4abb-85a5-9e9eda0d54de","year":2021},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.805743Z"},"links":{"cited_paper":"/paper/2104.07412","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:6dcba2154971c78d8e9a54e131368c556d5827202eb4de96ed4040a2de6d704e","observation_id":"4b4ece51-957f-4b4f-aebf-f8ab015fc60d","resolution":{"observed_at":"2026-08-06T18:48:34.349496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-08-09T14:26:53.957065Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-06T18:48:31.924231Z","title":"Global mmlu: Understanding and addressing cultural and linguistic biases in multilingual evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:31.924231Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:3abedb27dccc803c0b87f3e188816d6b19c2af2ac6f2d5de38b22345809d9601","observation_id":"97df9763-0cb6-4173-82f6-1a58a82dd509","resolution":{"observed_at":"2026-08-06T18:48:31.924231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-08-09T15:35:16.785011Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-06T18:48:32.084674Z","title":"Massive: A 1m-example multilingual natural language understanding dataset with 51 typologically-diverse languages,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.084674Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:c3c88a1e7149ba3499187ff8175bb63695031c77db50a4afee45d2e4a6a8ebf0","observation_id":"c44afdc6-6ba8-410d-b38b-c7bc0dac977e","resolution":{"observed_at":"2026-08-06T18:48:32.084674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13707","last_updated":"2023-05-23T05:46:45Z","snapshot_observed_at":"2026-07-06T15:31:09.320113Z","submitted_at":"2023-05-23T05:46:45Z","title":"Do All Languages Cost the Same? Tokenization in the Era of Commercial Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13707","snapshot_observed_at":"2026-08-06T18:48:32.230138Z","title":"Do all languages cost the same? tokenization in the era of commercial language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.230138Z"},"links":{"cited_paper":"/paper/2305.13707","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:2d8bc71311652e18e59ad355729855743bb69689de6eb6e8792061514551d80a","observation_id":"2e76ae1f-5719-4e86-980d-ff8d5620f2bf","resolution":{"observed_at":"2026-08-06T18:48:32.230138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.731149Z","title":"Parameter-efficient fine-tuning in large language models: a survey of methodologies,","venue":null,"work_id":"b59416b6-b43f-4578-b962-bfdf232b6f55","year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.433330Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:07a58bdaf08c3bbbdd7b46f3d3b714822bd78cced6d62482fd98ed55bd3e0459","observation_id":"3c6900d3-dca9-4623-ba67-affddec11ae2","resolution":{"observed_at":"2026-08-06T18:48:35.797361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.569551Z","title":"A review on fairness in machine learning,","venue":null,"work_id":"fff1629e-0030-43ae-8fd6-179e3963f93b","year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.589250Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:58947f2d10666fb9d949e16191e07697264d52df948be21641fe75304da0af2d","observation_id":"3a3271ef-5442-4a65-90a4-b237afed50c9","resolution":{"observed_at":"2026-08-06T18:48:35.640672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-06T18:48:32.730725Z","title":"Gemma 3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.730725Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:f9f9b6513467a960ee5e4c47f19e2be859e85c82985d9a0e2ef0bd63ead83a5a","observation_id":"fd0a7165-9efb-49c7-9d8a-056d88e9b548","resolution":{"observed_at":"2026-08-06T18:48:32.730725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T18:48:32.885857Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.885857Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:2e909f040df024a7a8bb08b33107c76213a764db193d6a00c4a6982b367e8cda","observation_id":"7a09bfa7-79ce-44c4-a1aa-8db432405174","resolution":{"observed_at":"2026-08-06T18:48:32.885857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T18:48:33.031590Z","title":"Phi-4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.031590Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:7125b8bdb81560acb9300e3500e29f188ad761513de29277f76651474f71e828","observation_id":"fc151baf-d6ea-45d1-a5f8-7f3a888f11ba","resolution":{"observed_at":"2026-08-06T18:48:33.031590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T18:48:33.174897Z","title":"Qwen-vl: A versatile vision-language model for un- derstanding, localization, text reading, and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.174897Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:9b48c6ea1aa98ed72a792510851abea109bb5ee9f4fda74d786bd37bc8aa7101","observation_id":"ad2a30f7-53b3-495d-8165-c3099d406ff4","resolution":{"observed_at":"2026-08-06T18:48:33.174897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.398987Z","title":"GPT-4o System Card,","venue":null,"work_id":"fdcf41b5-3d85-4fe7-963d-78b3ecba8db4","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.376013Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:8b32ab6a629e2459e78357e3c7ad4f31515480aa866856926f2fd7ef5e21712d","observation_id":"e3cf893e-f8fd-41ba-a380-45c3befcdc7f","resolution":{"observed_at":"2026-08-06T18:48:35.474644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.231306Z","title":"Gemini 2.0 Flash,","venue":null,"work_id":"cb96f08a-7df5-4092-9eb9-e8e7db720953","year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.532411Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:6c5a59f22fcc10f3cce8e18f5d3c38be391b97e8c87cb9a9e957b4e33d81ba3b","observation_id":"c1f2bc30-1a1b-4b2e-a0b4-9a2a90ac7962","resolution":{"observed_at":"2026-08-06T18:48:35.306649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:35.013615Z","title":"Aya vision: Expanding the worlds ai can see,","venue":null,"work_id":"bd351d39-a153-4fe0-8f28-c5aa6fa95262","year":2025},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.719480Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:dff68ea3bf6e3b12e01a785f0b904b0379d07250c7a1bcf4a7b567230aca8a6a","observation_id":"b9938523-afee-4aa7-8a1f-c75efda0c47a","resolution":{"observed_at":"2026-08-06T18:48:35.127169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T18:48:33.851895Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.851895Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:eb8c382d0036467e63f84f66ad14ee83943405b24d99f48e1948b31e842dc15f","observation_id":"8d0f73e4-1e86-497a-a4e2-4b586011f8e9","resolution":{"observed_at":"2026-08-06T18:48:33.851895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:48:34.839291Z","title":"Fair enough: Develop and assess a fair-compliant dataset for large language model training?,","venue":null,"work_id":"a3b93bbd-31c1-4ee1-a0c3-543ef8e88002","year":2024},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:33.976690Z"},"links":{"citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:cee0786c1e67b52b00ac096a118c45897cee4f9b18b592088ab6abe8560fc6d9","observation_id":"d96814f0-2dc5-4d6c-89b7-f4da3d6dc835","resolution":{"observed_at":"2026-08-06T18:48:34.920942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T12:42:36.949284Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.07274."}