{"as_of":"2026-08-12T13:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38f062c4f918e994abb0f9798e4b726107365ce1e25b027320878d50160bc344","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:24:55.454935Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:28:47.251903Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T15:28:50.433641Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"cited_work":{"arxiv_id":"2412.14304","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14304","snapshot_observed_at":"2026-08-06T15:28:50.433641Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","venue":"cs.CL","work_id":"84474afb-4c08-4b6d-8f3f-a01455efdd23","year":2024},"citing_paper":{"arxiv_id":"2507.15717","last_updated":"2025-07-21T15:27:32Z","snapshot_observed_at":"2026-08-09T18:16:25.173548Z","submitted_at":"2025-07-21T15:27:32Z","title":"BEnchmarking LLMs for Ophthalmology (BELO) for Ophthalmological Knowledge and Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:28:47.251903Z"},"links":{"cited_paper":"/paper/2412.14304","citing_paper":"/paper/2507.15717"},"observation_digest":"sha256:89517030c628b0f392bce27cf9463ca46476d101e774eb662212ae0430366fdd","observation_id":"793f4a7b-ebd2-484d-b992-0539ba088dbf","resolution":{"observed_at":"2026-08-06T15:28:50.529350Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.14304/citation-record","integrity":"/paper/2412.14304/integrity","json":"/paper/2412.14304/citation-record.json","paper":"/paper/2412.14304"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.199665Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.199665Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:2963404a6d110c4265ceb9262987d8693138279dd6296ac55a59c4bb67fd7c14","observation_id":"c073a8f4-34e9-4c37-9cf6-444f2ddfd861","resolution":{"observed_at":"2026-08-11T12:24:55.199665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.204281Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.204281Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:96caf0ff5310ae1ec40deedbba6530b57c81c06ea06cce91057196b2280e7fbb","observation_id":"70a5bc6c-f429-4de9-97f7-7ec1cd088450","resolution":{"observed_at":"2026-08-11T12:24:55.204281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.327977Z","title":null,"venue":null,"work_id":"4cc890ae-0430-4312-8eb5-280ba5239ceb","year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.209638Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:74ddd541b95adec5ce323746e9370c3ab13bdfe7a811a01bb3736c4afe769a07","observation_id":"28cef0d5-13ef-4261-96d8-df95534d4ef8","resolution":{"observed_at":"2026-08-11T12:24:56.332203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11511","last_updated":"2023-10-17T18:18:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T18:18:32Z","title":"Self-RAG: Learning to Retrieve, Generate, and Critique through Self-Reflection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11511","snapshot_observed_at":"2026-08-11T12:24:55.213677Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.213677Z"},"links":{"cited_paper":"/paper/2310.11511","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:8a5bbe1bc62e033bf642a7a11eab85a767a9e369670c6a0e1788f00d8a2852c1","observation_id":"fe3ccb6d-aede-43fd-9617-2d0761b822be","resolution":{"observed_at":"2026-08-11T12:24:55.213677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.313828Z","title":null,"venue":null,"work_id":"6bf11c4a-6230-49ed-9b98-fd2d92c79704","year":2013},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.218972Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:87c91cd3e341f031549ef894d10baa3bc962f42d03f0869167ae2f1be23db357","observation_id":"a4384a71-3329-4cdf-8fa1-670311adee38","resolution":{"observed_at":"2026-08-11T12:24:56.319359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07037","last_updated":"2024-01-13T10:53:53Z","snapshot_observed_at":"2026-07-06T17:15:06.300682Z","submitted_at":"2024-01-13T10:53:53Z","title":"xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07037","snapshot_observed_at":"2026-08-11T12:24:55.222874Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.222874Z"},"links":{"cited_paper":"/paper/2401.07037","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:5a8599fd7abb6f3033c36e9cfd8cff85943483fddf577b2cac9d2f5c610cb715","observation_id":"229eac94-34b3-4467-8cbd-96401248e1cb","resolution":{"observed_at":"2026-08-11T12:24:55.222874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.300446Z","title":"H.; Chen, J.; Zhang, H.; Jianquan, L.; Xiang, W.; and Wang, B","venue":null,"work_id":"c56db72e-d0bb-4b8e-9f9d-ede1f2fd6641","year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.227336Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:8da4f6bd4b92dbca6a22dee93d9bf8ab120727f86190cf7c7549fddfe106b84f","observation_id":"332c56b2-15de-441d-8543-843e33981665","resolution":{"observed_at":"2026-08-11T12:24:56.304824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.288979Z","title":"K.; Hanna, K.; and Anandan, P","venue":null,"work_id":"53bbd749-593f-4eb9-ae14-ec48ada702ea","year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.231541Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:420a1cdcbb07f005b72359a8503982a09093b3e5f8808b697aa664bfb690d651","observation_id":"e9b31f07-1062-46c3-823b-282d20b7087a","resolution":{"observed_at":"2026-08-11T12:24:56.292909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.276879Z","title":null,"venue":null,"work_id":"f243586e-08a6-4490-83fc-f58c679bc5fc","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.236206Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:b4643561627d889e00afac6d33cf88f303f6e8d579b6f01ccbaae5c5734af204","observation_id":"d0fbe112-a79b-4f2c-8621-70e2a8600437","resolution":{"observed_at":"2026-08-11T12:24:56.280867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04585","last_updated":"2024-09-14T03:19:10Z","snapshot_observed_at":"2026-07-06T18:58:30.942582Z","submitted_at":"2024-08-08T16:54:40Z","title":"Towards Resilient and Efficient LLMs: A Comparative Study of Efficiency, Performance, and Adversarial Robustness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04585","snapshot_observed_at":"2026-08-11T12:24:55.240309Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.240309Z"},"links":{"cited_paper":"/paper/2408.04585","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:7aad2bfd456f3a564f1de80430f61bcdce9709941f8184f4d3cf08864a3cdc54","observation_id":"df377489-4c31-4608-b229-65b32e940be8","resolution":{"observed_at":"2026-08-11T12:24:55.240309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11040","last_updated":"2024-05-17T18:31:38Z","snapshot_observed_at":"2026-08-09T20:52:04.893424Z","submitted_at":"2024-05-17T18:31:38Z","title":"From Generalist to Specialist: Improving Large Language Models for Medical Physics Using ARCoT","version":1},"cited_work":{"arxiv_id":"2405.11040","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.11040","snapshot_observed_at":"2026-08-11T12:24:55.968101Z","title":"From Generalist to Specialist: Improving Large Language Models for Medical Physics Using ARCoT","venue":"cs.CL","work_id":"73d3e29e-14be-4abd-967d-84b7cfad9f19","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.244631Z"},"links":{"cited_paper":"/paper/2405.11040","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:fc20d7c0db55b3961a9b16b4c2eb8210abcc5477ff2365d7c2d30eb044915776","observation_id":"78edf111-b1ed-46c7-8851-ceb5f8db3b63","resolution":{"observed_at":"2026-08-11T12:24:55.972346Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.264891Z","title":null,"venue":null,"work_id":"86340e0c-14ca-4b3b-bdd1-4c47da33d271","year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.248946Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:9a85ce56143e0cbac10c719a2fd09a5a4844167204110852e3ea42901e93d4c7","observation_id":"4f6849b9-000a-4984-b4d4-99cfc9ab7f34","resolution":{"observed_at":"2026-08-11T12:24:56.268790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.252634Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.252634Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:bc61af501e8955105afe6d01e2a94834e133d027d2fd0042ee2ee6b752ba8f61","observation_id":"16b7333e-c2c6-43fd-b21f-cff103cdea94","resolution":{"observed_at":"2026-08-11T12:24:55.252634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18373","last_updated":"2024-05-05T16:01:40Z","snapshot_observed_at":"2026-08-04T12:18:11.588991Z","submitted_at":"2023-10-26T17:05:40Z","title":"Can LLMs Grade Short-Answer Reading Comprehension Questions : An Empirical Study with a Novel Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18373","snapshot_observed_at":"2026-08-11T12:24:55.256327Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.256327Z"},"links":{"cited_paper":"/paper/2310.18373","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:7a52af40b205acbb75c4bd998cd6ebca78bc9482fa73c472503d9684d3a0f4cf","observation_id":"1bc806b9-a09c-4fbe-be02-51e0af3287cd","resolution":{"observed_at":"2026-08-11T12:24:55.256327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07004","last_updated":"2023-10-22T13:43:27Z","snapshot_observed_at":"2026-08-11T02:56:22.364568Z","submitted_at":"2023-05-11T17:44:17Z","title":"Not All Languages Are Created Equal in LLMs: Improving Multilingual Capability by Cross-Lingual-Thought Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07004","snapshot_observed_at":"2026-08-11T12:24:55.260976Z","title":"X.; Song, T.; Xia, Y.; and Wei, F","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.260976Z"},"links":{"cited_paper":"/paper/2305.07004","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:c252d136b30bf6bf186b9a9743c949d27a2589fb2bc0ac3abf5990c853fad71b","observation_id":"26306b06-1458-41dd-a437-fb5526346afb","resolution":{"observed_at":"2026-08-11T12:24:55.260976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04792","last_updated":"2024-03-04T14:01:11Z","snapshot_observed_at":"2026-07-06T17:41:14.805521Z","submitted_at":"2024-03-04T14:01:11Z","title":"Breaking the Language Barrier: Can Direct Inference Outperform Pre-Translation in Multilingual LLM Applications?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04792","snapshot_observed_at":"2026-08-11T12:24:55.265100Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.265100Z"},"links":{"cited_paper":"/paper/2403.04792","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:b0733ad5220dbdc683633325c5cb67faf17854960da96b0fae71c12201d99bc0","observation_id":"d3e78651-47a4-4fd6-bea2-40adac353ad9","resolution":{"observed_at":"2026-08-11T12:24:55.265100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.269535Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.269535Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:a5310528e14164374bd19ca74d1834000a7dfca6a93c7528c02e1e889108ce09","observation_id":"70496f40-8189-49b0-ac00-cd11291deb6c","resolution":{"observed_at":"2026-08-11T12:24:55.269535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.273080Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.273080Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:bad7a53909239c46270665ade80f0cf737376e69df0c96a18b1daa233f55ac1c","observation_id":"50004dba-dea3-4ebb-aa9b-6bf4be51d928","resolution":{"observed_at":"2026-08-11T12:24:55.273080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.232023Z","title":"C.; Yeganova, L.; Wilbur, W","venue":null,"work_id":"208e0867-38cb-4282-9a4a-21a0fd90c989","year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.277123Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:d7dc53a0e04a1f9d4a6f0e522e304632b4f51534c6189312fe12301389895ccc","observation_id":"ae5271e2-9079-42c7-9602-7320f9ea9558","resolution":{"observed_at":"2026-08-11T12:24:56.236118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.219158Z","title":null,"venue":null,"work_id":"8574486e-893f-416b-8209-449db70a3550","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.280915Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:dcf2e5946654473c6bc7edc43a7d070e8f3447c925935aa839af1f7539833a30","observation_id":"6d568bbc-5223-430d-adb2-0c7b037cd083","resolution":{"observed_at":"2026-08-11T12:24:56.223584Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04280","last_updated":"2023-04-09T16:57:40Z","snapshot_observed_at":"2026-08-06T03:19:29.903119Z","submitted_at":"2023-04-09T16:57:40Z","title":"FrenchMedMCQA: A French Multiple-Choice Question Answering Dataset for Medical domain","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04280","snapshot_observed_at":"2026-08-11T12:24:55.284493Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.284493Z"},"links":{"cited_paper":"/paper/2304.04280","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:65f8ab5537717ba2716e1a266f0803b1918fb72331e8911bca2afc43d6127360","observation_id":"2af9b1b4-b57b-41b6-bbf8-68d6a0448180","resolution":{"observed_at":"2026-08-11T12:24:55.284493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01771","last_updated":"2024-06-03T20:25:12Z","snapshot_observed_at":"2026-08-10T01:38:21.893626Z","submitted_at":"2024-06-03T20:25:12Z","title":"LLMs Beyond English: Scaling the Multilingual Capability of LLMs with Cross-Lingual Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01771","snapshot_observed_at":"2026-08-11T12:24:55.289010Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.289010Z"},"links":{"cited_paper":"/paper/2406.01771","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:f9fcde37772d3d9b76034f082509c275273764498e041764d1b79dfb452d7969","observation_id":"4bbb3c24-454d-459b-aa0f-fd97f59535f5","resolution":{"observed_at":"2026-08-11T12:24:55.289010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.293184Z","title":"u ttler, H.; Lewis, M.; Yih, W.-t.; Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.293184Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:976d9d6f68afd64f23a1aaada27510480479bffa733b3efae4746074980e343c","observation_id":"87baa109-c12d-4d38-a848-be841efbad40","resolution":{"observed_at":"2026-08-11T12:24:55.293184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18027","last_updated":"2024-11-15T02:07:34Z","snapshot_observed_at":"2026-08-04T12:07:01.456214Z","submitted_at":"2024-06-26T02:49:28Z","title":"Automated Clinical Data Extraction with Knowledge Conditioned LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18027","snapshot_observed_at":"2026-08-11T12:24:55.296910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.296910Z"},"links":{"cited_paper":"/paper/2406.18027","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:306da735c6bc4bc56d4b833a156f16db27cdff94c2e7c1734a8be44fc5c8583d","observation_id":"db93df2c-e65b-429f-8e18-70e32494a692","resolution":{"observed_at":"2026-08-11T12:24:55.296910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-11T12:24:55.300973Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.300973Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:8a4bec37449a29087f8ae92385c972cfbfa984f4491f1e27c2b5af6e525adb75","observation_id":"9769240a-c9e0-4f9c-9d6e-cf2858d16a06","resolution":{"observed_at":"2026-08-11T12:24:55.300973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08743","last_updated":"2025-03-02T17:33:03Z","snapshot_observed_at":"2026-08-12T03:05:41.887648Z","submitted_at":"2024-03-13T17:46:28Z","title":"Prompting Fairness: Integrating Causality to Debias Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08743","snapshot_observed_at":"2026-08-11T12:24:55.304928Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.304928Z"},"links":{"cited_paper":"/paper/2403.08743","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:3f84e6ecd14b17e71fbc7d0ac0fa20845efab583430c18f26376d1497dad4278","observation_id":"b73f1792-defd-4397-9a01-f5272f0986dd","resolution":{"observed_at":"2026-08-11T12:24:55.304928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.199663Z","title":null,"venue":null,"work_id":"47f3b315-ffaa-4b57-8c3d-e51243c64f01","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.309536Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:3fedd9a250e67416db8ce56b87f5ced4bf21320c9ac59899915b4a250a351f1a","observation_id":"ab5e8c79-2c57-4373-8ef6-f1f6b217ae88","resolution":{"observed_at":"2026-08-11T12:24:56.203477Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12761","last_updated":"2023-05-22T06:31:29Z","snapshot_observed_at":"2026-07-06T15:30:30.381545Z","submitted_at":"2023-05-22T06:31:29Z","title":"Enhancing Cross-lingual Natural Language Inference by Soft Prompting with Multilingual Verbalizer","version":1},"cited_work":{"arxiv_id":"2305.12761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12761","snapshot_observed_at":"2026-08-11T12:24:55.847665Z","title":"Enhancing Cross-lingual Natural Language Inference by Soft Prompting with Multilingual Verbalizer","venue":"cs.CL","work_id":"413efd67-165f-4421-b074-d907b7f94f9b","year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.313632Z"},"links":{"cited_paper":"/paper/2305.12761","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:b0ff55e4bd79c66709a058bd2ce87f77d6aeee772d35725f73dd02a366f39327","observation_id":"5129acc8-a6e4-4e5b-8ee0-d0af9219e9f5","resolution":{"observed_at":"2026-08-11T12:24:55.853583Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.187501Z","title":"S.; Chiang, M","venue":null,"work_id":"62c1301f-d442-4dae-aa8f-05a9325f8981","year":2020},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.317586Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:94d991a39f251a80314748b4ea2a359202e8c6b779b3dfa8b0ca3ff51a148c82","observation_id":"02717245-c387-4b63-8bc0-354ba67a0f60","resolution":{"observed_at":"2026-08-11T12:24:56.191624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03030","last_updated":"2023-10-23T02:55:08Z","snapshot_observed_at":"2026-08-10T17:48:59.990298Z","submitted_at":"2023-06-05T16:48:41Z","title":"Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03030","snapshot_observed_at":"2026-08-11T12:24:55.321468Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.321468Z"},"links":{"cited_paper":"/paper/2306.03030","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:724d1bc0b8b6b941fb79e42b6b75ced2dc8da1f628eb1856661bff4e4ebf0cb1","observation_id":"44299186-3f18-4f88-a963-14ea16cd9813","resolution":{"observed_at":"2026-08-11T12:24:55.321468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.175243Z","title":"K.; and Andrade, R","venue":null,"work_id":"45f82791-5da3-490f-b3d2-05eace0d75de","year":2022},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.325522Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:5acc8902cfe3b6da59f3c6d96425124e538f1ee4c2c95c13c8f8574bafb28b9f","observation_id":"96dbe664-1a08-4223-b2d9-2ad2b6a6dc72","resolution":{"observed_at":"2026-08-11T12:24:56.179252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20052","last_updated":"2025-04-03T19:31:53Z","snapshot_observed_at":"2026-08-11T00:37:56.123219Z","submitted_at":"2024-06-28T17:03:51Z","title":"Understanding and Mitigating Language Confusion in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20052","snapshot_observed_at":"2026-08-11T12:24:55.329144Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.329144Z"},"links":{"cited_paper":"/paper/2406.20052","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:72974e77e14bbe235889d3fb4887fefe419dc08645d478d6a43c8ae26d2a9470","observation_id":"be11fd03-b005-4ab5-9c65-415bb985625d","resolution":{"observed_at":"2026-08-11T12:24:55.329144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.163382Z","title":"B.; Quao, N","venue":null,"work_id":"3b95b929-fa71-473e-9917-623d73dd8a2a","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.333598Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:ad4214a345ae79011b807f640c3d9a658acc299e52e4cba3608e21fd9b4a6868","observation_id":"cfa877b2-709d-4d40-aaa7-d53992e4f9e9","resolution":{"observed_at":"2026-08-11T12:24:56.167262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.151612Z","title":null,"venue":null,"work_id":"d9a8cd3a-462b-4feb-b7fa-697a35804da3","year":2022},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.337555Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:1a9d8a0efda827e4e33179e5545f7a2a84d1aa817918a3c2ea33d09c765111b7","observation_id":"4e80785b-7450-44cd-bfdf-f3dffe5fcaa8","resolution":{"observed_at":"2026-08-11T12:24:56.155259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.341803Z","title":"K.; and Sankarasubbu, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.341803Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:3d805b8feabd2abb5d38f875da3395a8706fd1eff3e1dbe9f9a4037595c46345","observation_id":"e0a7f75c-7d2d-494f-a935-e46e8fdf4d8a","resolution":{"observed_at":"2026-08-11T12:24:55.341803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17789","last_updated":"2024-05-28T11:13:40Z","snapshot_observed_at":"2026-08-04T12:15:04.358786Z","submitted_at":"2024-05-28T11:13:40Z","title":"Spanish and LLM Benchmarks: is MMLU Lost in Translation?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17789","snapshot_observed_at":"2026-08-11T12:24:55.345851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.345851Z"},"links":{"cited_paper":"/paper/2406.17789","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:cef20150c4892e0b42937ba8fbc370fc94ad3b9ad0e62a2e9749604bb119e72c","observation_id":"f66a8e5d-4d78-436e-b6ec-668d2c6ab906","resolution":{"observed_at":"2026-08-11T12:24:55.345851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15149","last_updated":"2024-04-23T15:52:52Z","snapshot_observed_at":"2026-08-05T17:11:13.833217Z","submitted_at":"2024-04-23T15:52:52Z","title":"Bias patterns in the application of LLMs for clinical decision support: A comprehensive study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15149","snapshot_observed_at":"2026-08-11T12:24:55.350149Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.350149Z"},"links":{"cited_paper":"/paper/2404.15149","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:030c4d6cd7821b34284063a693dfd355d2435f25fefd4d43b8170488ce8201af","observation_id":"1cd0401b-6e0b-4f12-8d1a-b99f222f3446","resolution":{"observed_at":"2026-08-11T12:24:55.350149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13408","last_updated":"2024-02-20T22:26:35Z","snapshot_observed_at":"2026-08-10T08:58:13.547136Z","submitted_at":"2024-02-20T22:26:35Z","title":"Healthcare Copilot: Eliciting the Power of General LLMs for Medical Consultation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13408","snapshot_observed_at":"2026-08-11T12:24:55.354225Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.354225Z"},"links":{"cited_paper":"/paper/2402.13408","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:9eccd5c543348a801945c164d4b720248866c0b9169f6064316db563115590b0","observation_id":"5ffc39fa-6d0d-4304-9fff-166a3fd37ba1","resolution":{"observed_at":"2026-08-11T12:24:55.354225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.132066Z","title":"M.; Do Carmo Novaes, F.; Azevedo Costa, I","venue":null,"work_id":"7afbd501-923b-4bf3-a874-cd093367ba92","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.358298Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:b00b4f8dfe27871b095ef0529c9fb1a7d0a51c3aba4584c9c06357a55e95b954","observation_id":"492194a8-8620-4e29-a0db-0fb207925ca5","resolution":{"observed_at":"2026-08-11T12:24:56.136684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.119318Z","title":null,"venue":null,"work_id":"ec35e418-9b02-45ab-8865-c2c3aa0c3f6c","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.362376Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:480c11017a5b3f92087b37035070012fb5d8b86ea6463268acf1406ff3e4b912","observation_id":"c201de10-b339-4eee-8128-c01e53db3523","resolution":{"observed_at":"2026-08-11T12:24:56.123375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.106941Z","title":"L.; Cifuentes-Gonz \\'a lez, C.; Wei, Y","venue":null,"work_id":"f84c1582-f4ca-427d-9c3a-3cef3b1785a8","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.366367Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:e82ab680a8456da53711393fc96474dc354e15e2a0d0bdba137f717d5f0bdb69","observation_id":"cc666570-b976-4073-b3c6-9c815476c7de","resolution":{"observed_at":"2026-08-11T12:24:56.111148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07412","last_updated":"2021-10-07T09:51:04Z","snapshot_observed_at":"2026-08-03T17:43:44.785835Z","submitted_at":"2021-04-15T12:26:12Z","title":"XTREME-R: Towards More Challenging and Nuanced Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07412","snapshot_observed_at":"2026-08-11T12:24:55.370697Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.370697Z"},"links":{"cited_paper":"/paper/2104.07412","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:fd27253fa70d94cc373381af8ba558bbd3bc4ec44b1c510278fa63219acb57b7","observation_id":"477ac4f3-18b6-4be5-a8f8-4c380a64ec16","resolution":{"observed_at":"2026-08-11T12:24:55.370697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.095451Z","title":null,"venue":null,"work_id":"70becb3b-15fa-4a14-9c4a-30564b05cb4c","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.376341Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:14264230147c815b440e17f0f08bce4161ac276f362f2c7a103925144b3098a5","observation_id":"a8310f65-8557-4903-a360-92dd65d7236f","resolution":{"observed_at":"2026-08-11T12:24:56.099085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18045","last_updated":"2024-10-03T14:44:44Z","snapshot_observed_at":"2026-08-12T03:09:14.428103Z","submitted_at":"2024-02-28T04:43:46Z","title":"Multi-FAct: Assessing Factuality of Multilingual LLMs using FActScore","version":3},"cited_work":{"arxiv_id":"2402.18045","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.18045","snapshot_observed_at":"2026-08-11T12:24:55.748552Z","title":"Multi-FAct: Assessing Factuality of Multilingual LLMs using FActScore","venue":"cs.CL","work_id":"7ce392d8-2f7b-4ba6-bd38-0abcf5ed8aee","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.380067Z"},"links":{"cited_paper":"/paper/2402.18045","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:f30abbeac6c99a52688e2924f1ecd972476d27c9fadd9a5c4ce0c7fd7189eec1","observation_id":"1f699b58-a433-4637-86d7-ec02fde69ec9","resolution":{"observed_at":"2026-08-11T12:24:55.753255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-11T12:24:55.383752Z","title":"W.; Tay, Y.; Ruder, S.; Zhou, D.; et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.383752Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:b9305be90a2bff97850bf50cd4933b0a43aca0f1a3847425ea78ee3eed6f4800","observation_id":"3fe24d54-a41a-4147-bd14-9ba590dea124","resolution":{"observed_at":"2026-08-11T12:24:55.383752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10670","last_updated":"2024-07-15T12:35:00Z","snapshot_observed_at":"2026-08-12T07:18:48.940011Z","submitted_at":"2024-07-15T12:35:00Z","title":"Enhancing Retrieval and Managing Retrieval: A Four-Module Synergy for Improved Quality and Efficiency in RAG Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10670","snapshot_observed_at":"2026-08-11T12:24:55.387840Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.387840Z"},"links":{"cited_paper":"/paper/2407.10670","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:83f3244914eca72965a534b92747e21bc8a2a3eea1ba60769f4379fdba0be060","observation_id":"5ec17cb5-bd17-419b-aa34-e02df9fd0858","resolution":{"observed_at":"2026-08-11T12:24:55.387840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03314","last_updated":"2023-06-05T23:55:37Z","snapshot_observed_at":"2026-08-11T04:53:44.472967Z","submitted_at":"2023-06-05T23:55:37Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03314","snapshot_observed_at":"2026-08-11T12:24:55.391696Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.391696Z"},"links":{"cited_paper":"/paper/2306.03314","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:c85ecaf4e9a315c31d3fe57a86af00e1f472631810b7ae9cf76ab635cb25347d","observation_id":"a3c34593-2b9a-4a36-91ca-42aefcc75bcd","resolution":{"observed_at":"2026-08-11T12:24:55.391696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.082909Z","title":"J.; Selva, D.; and Chan, W","venue":null,"work_id":"b11f9c20-0420-4bff-9c81-b9e092d15889","year":2020},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.395535Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:a357063a620c8bf84151d797b06268de519a672bed687ab9abb1e32a2c3d8dbd","observation_id":"7402b38c-1dcd-44c7-8afa-787d5a24ac99","resolution":{"observed_at":"2026-08-11T12:24:56.087946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11703","last_updated":"2024-09-18T04:56:52Z","snapshot_observed_at":"2026-07-06T19:17:23.847280Z","submitted_at":"2024-09-18T04:56:52Z","title":"Harnessing LLMs for API Interactions: A Framework for Classification and Synthetic Data Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11703","snapshot_observed_at":"2026-08-11T12:24:55.399204Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.399204Z"},"links":{"cited_paper":"/paper/2409.11703","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:87cfc0e25daf1636c5cd039b9f89734e9ebd519e41d499272f064009891d9886","observation_id":"4a220c92-704d-453d-a1d5-5ecfc5b5fdc7","resolution":{"observed_at":"2026-08-11T12:24:55.399204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.071381Z","title":null,"venue":null,"work_id":"a09a0cad-7fde-40e7-a611-6e26c4b867bb","year":2019},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.403364Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:2350cc5337a90024572f93d215745248ae820e23e9cd36b187be9177ad474b28","observation_id":"e70e6107-a52d-4733-9857-8d646cd8ab47","resolution":{"observed_at":"2026-08-11T12:24:56.075363Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.407569Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.407569Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:aec40ad623e200163459c1ca699353dfbe49d6689a73829289a465cee33fb89c","observation_id":"28c445dc-d995-4329-a243-e95ba1509d1a","resolution":{"observed_at":"2026-08-11T12:24:55.407569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03214","last_updated":"2023-11-22T07:28:19Z","snapshot_observed_at":"2026-08-09T12:11:40.572385Z","submitted_at":"2023-10-05T00:04:12Z","title":"FreshLLMs: Refreshing Large Language Models with Search Engine Augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03214","snapshot_observed_at":"2026-08-11T12:24:55.411307Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.411307Z"},"links":{"cited_paper":"/paper/2310.03214","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:bca8467888396e6853de76f34f51d937cafde5dfbfc09671e26bcd16a3ab0741","observation_id":"c171b1ad-6e5e-48d1-8b60-296cc2113752","resolution":{"observed_at":"2026-08-11T12:24:55.411307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13229","last_updated":"2024-06-19T05:31:59Z","snapshot_observed_at":"2026-08-01T19:25:25.159124Z","submitted_at":"2024-06-19T05:31:59Z","title":"Probing the Emergence of Cross-lingual Alignment during LLM Training","version":1},"cited_work":{"arxiv_id":"2406.13229","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13229","snapshot_observed_at":"2026-08-11T12:24:55.671869Z","title":"Probing the Emergence of Cross-lingual Alignment during LLM Training","venue":"cs.CL","work_id":"24fd2aca-42b4-4633-a069-df6b9e1f515b","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.415271Z"},"links":{"cited_paper":"/paper/2406.13229","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:0065c68488930e8e77589902972a6327f87da315a78efeb1c4465d8256dbf044","observation_id":"3aa39d76-d5f9-401d-babe-1125f985f451","resolution":{"observed_at":"2026-08-11T12:24:55.678378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:55.419920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.419920Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:752217fa339bb039fc5ac70e9c521731843d03332670eeece8016b956f69a9dc","observation_id":"5b80a2c8-5e59-4b05-800e-bc5b5395e744","resolution":{"observed_at":"2026-08-11T12:24:55.419920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.052396Z","title":"J.; Goetz, L.; Watson, D.; and van der Schaar, M","venue":null,"work_id":"043d10a0-6958-4b36-b96a-47b5ed19b742","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.424072Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:0ece88d49256a6a418b803d9ad6a7777beec2bc4c152c831c0857e2180274385","observation_id":"fe189e72-0180-421e-a913-53e1b3b2242c","resolution":{"observed_at":"2026-08-11T12:24:56.056336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.040870Z","title":null,"venue":null,"work_id":"9e16e17d-e7ff-4a7c-aef3-3565a2785382","year":2023},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.427842Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:60204a37546706b3d94b26bfd345bbc198478d3907697cc97093e58c7e32916a","observation_id":"cde0c8c8-1521-4139-bcd4-c61e5cbb391e","resolution":{"observed_at":"2026-08-11T12:24:56.044760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00929","last_updated":"2024-12-09T14:30:11Z","snapshot_observed_at":"2026-07-06T17:53:51.988186Z","submitted_at":"2024-04-01T05:13:56Z","title":"A Survey on Multilingual Large Language Models: Corpora, Alignment, and Bias","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00929","snapshot_observed_at":"2026-08-11T12:24:55.431533Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.431533Z"},"links":{"cited_paper":"/paper/2404.00929","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:c48b2da7029a1f89d14d7c1f31d8777bd8c13cd32debd1e1676383779a84faf6","observation_id":"a42e1ff8-bcd7-44d5-a487-e35e6dbb5585","resolution":{"observed_at":"2026-08-11T12:24:55.431533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-11T12:24:55.435751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.435751Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:7c3d3a27613a35b02c95f98eb83e4b66cef8d3aa507146db0e87a9e6aa8d5cba","observation_id":"0545cf8b-f82b-42b5-97ea-c3fdf7104daf","resolution":{"observed_at":"2026-08-11T12:24:55.435751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.029257Z","title":"T.; et al","venue":null,"work_id":"3e9ce0ef-d4c0-49ae-bc2e-39b54d780ee1","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.440092Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:0e562d0ea5c711d1c1dce40469ad236a7f5e1d8805e26fbb670a94006b8d6e32","observation_id":"d4c2680a-546d-4a29-97aa-9329de440438","resolution":{"observed_at":"2026-08-11T12:24:56.033308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:24:56.016447Z","title":null,"venue":null,"work_id":"0a810e6f-cd67-4eb4-baed-7ccd8a9c9ebd","year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.443718Z"},"links":{"citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:bccda917d323e837afd5152ea32552e4afbe9ecbe2b49bd8c7e59ac898b85aa7","observation_id":"34163fe3-f0ed-4c1a-9650-5e90428c11f7","resolution":{"observed_at":"2026-08-11T12:24:56.020638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00277","last_updated":"2024-03-01T04:47:16Z","snapshot_observed_at":"2026-08-09T17:15:47.132642Z","submitted_at":"2024-03-01T04:47:16Z","title":"Gender Bias in Large Language Models across Multiple Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00277","snapshot_observed_at":"2026-08-11T12:24:55.447272Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.447272Z"},"links":{"cited_paper":"/paper/2403.00277","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:afea2a10f8dd91f55d013e1e897833cf754a612d80983705a6ea1d75cfdfcc88","observation_id":"3062bfe4-5e62-481e-b393-0fd05782e009","resolution":{"observed_at":"2026-08-11T12:24:55.447272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01055","last_updated":"2024-01-12T08:14:12Z","snapshot_observed_at":"2026-08-09T18:15:24.506370Z","submitted_at":"2024-01-02T06:29:02Z","title":"LLaMA Beyond English: An Empirical Study on Language Capability Transfer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01055","snapshot_observed_at":"2026-08-11T12:24:55.451156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.451156Z"},"links":{"cited_paper":"/paper/2401.01055","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:38e268b51f990e0083eeb3e2aaf90e475e2a3716eff762a6f06fc6544312dc0d","observation_id":"52c69fc9-e1c6-4230-bc61-10c3b2334bfb","resolution":{"observed_at":"2026-08-11T12:24:55.451156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00858","last_updated":"2024-02-01T18:55:29Z","snapshot_observed_at":"2026-08-11T13:28:19.001506Z","submitted_at":"2024-02-01T18:55:29Z","title":"Can Large Language Models Understand Context?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00858","snapshot_observed_at":"2026-08-11T12:24:55.454935Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T12:24:55.454935Z"},"links":{"cited_paper":"/paper/2402.00858","citing_paper":"/paper/2412.14304"},"observation_digest":"sha256:0c2c869c460e5e2529799a11e59e24b97375418282328f0dc179e4bb1da1f47a","observation_id":"c47ed60e-75df-41b9-a340-e8e44c2be3ff","resolution":{"observed_at":"2026-08-11T12:24:55.454935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.14304","last_updated":"2024-12-18T20:18:03Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T03:05:52.808939Z","submitted_at":"2024-12-18T20:18:03Z","title":"Multi-OphthaLingua: A Multilingual Benchmark for Assessing and Debiasing LLM Ophthalmological QA in LMICs"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":4,"verified_fuzzy":11},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2412.14304."}