{"as_of":"2026-08-17T18:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c9a8ce27b387e24b98c193c561c8956ef3eb49d5745b6af5aa080039a90ca13d","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:36:35.996643Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:17:10.649943Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"cited_work":{"arxiv_id":"2506.19468","doi":"10.48550/arxiv.2506.19468","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19468","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Md Nesarul Hoque, Umme Salma, Md Jamal Uddin, Md Martuza Ahamad, and Sakifa Aktar","venue":"ArXiv.org","work_id":"7ad4a42b-4b57-4753-ba4c-06f827538377","year":2025},"citing_paper":{"arxiv_id":"2602.17469","last_updated":"2026-04-30T06:55:12Z","snapshot_observed_at":"2026-07-06T22:46:26.082843Z","submitted_at":"2026-02-19T15:35:13Z","title":"Cross-Lingual Sentiment Misalignment: Auditing Multilingual Language Models for Inversion Risk, Dialectal Representation, and Affective Stability","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T20:59:59.582440Z"},"links":{"cited_paper":"/paper/2506.19468","citing_paper":"/paper/2602.17469"},"observation_digest":"sha256:b2254db3a22471b25923ccdefd2753b5ccbf770907e19cb493150623470b7081","observation_id":"d7d670b6-74af-4249-82d0-ad4de16c1c5c","resolution":{"observed_at":"2026-05-15T21:00:17.818057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"cited_work":{"arxiv_id":"2506.19468","doi":"10.48550/arxiv.2506.19468","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19468","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Md Nesarul Hoque, Umme Salma, Md Jamal Uddin, Md Martuza Ahamad, and Sakifa Aktar","venue":"ArXiv.org","work_id":"7ad4a42b-4b57-4753-ba4c-06f827538377","year":2025},"citing_paper":{"arxiv_id":"2605.29637","last_updated":"2026-05-28T09:06:59Z","snapshot_observed_at":"2026-08-04T12:08:55.488032Z","submitted_at":"2026-05-28T09:06:59Z","title":"Evaluating Cross-lingual Knowledge Consistency in Code-Mixed vis-a-vis Indian Languages using IndicKLAR","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T08:04:01.791491Z"},"links":{"cited_paper":"/paper/2506.19468","citing_paper":"/paper/2605.29637"},"observation_digest":"sha256:f6dc69a857b20bec8ff0eac12926ce97e2bf2dfacf0ba0989a6a91ac46998d84","observation_id":"730fd3d8-a5e0-4074-bf2d-508a7376e0bb","resolution":{"observed_at":"2026-06-29T08:13:15.958889Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"cited_work":{"arxiv_id":"2506.19468","doi":"10.48550/arxiv.2506.19468","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19468","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Md Nesarul Hoque, Umme Salma, Md Jamal Uddin, Md Martuza Ahamad, and Sakifa Aktar","venue":"ArXiv.org","work_id":"7ad4a42b-4b57-4753-ba4c-06f827538377","year":2025},"citing_paper":{"arxiv_id":"2606.19640","last_updated":"2026-06-17T22:36:06Z","snapshot_observed_at":"2026-08-16T16:02:54.515493Z","submitted_at":"2026-06-17T22:36:06Z","title":"Creating Multilingual Mental Health Dialogue Datasets: Limits of Persona-Based Localization via Nationality and Language","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-26T20:27:41.561992Z"},"links":{"cited_paper":"/paper/2506.19468","citing_paper":"/paper/2606.19640"},"observation_digest":"sha256:94fea5ec0f8760018bab258cadf8f80e23028ad4bee85fb2b1349fbd57c97ffb","observation_id":"9c82c7c9-5200-4e50-86b9-ee767e5aaa4f","resolution":{"observed_at":"2026-06-26T20:29:57.635151Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"cited_work":{"arxiv_id":"2506.19468","doi":"10.48550/arxiv.2506.19468","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.19468","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Md Nesarul Hoque, Umme Salma, Md Jamal Uddin, Md Martuza Ahamad, and Sakifa Aktar","venue":"ArXiv.org","work_id":"7ad4a42b-4b57-4753-ba4c-06f827538377","year":2025},"citing_paper":{"arxiv_id":"2606.28057","last_updated":"2026-06-26T13:03:29Z","snapshot_observed_at":"2026-08-13T10:06:24.387011Z","submitted_at":"2026-06-26T13:03:29Z","title":"MultiHashFormer: Hash-based Generative Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-29T04:13:05.082903Z"},"links":{"cited_paper":"/paper/2506.19468","citing_paper":"/paper/2606.28057"},"observation_digest":"sha256:fefd2623cd90a29bb6c3e803641ec68d16a84fea4e8a7a02d7a56350cfafcdd8","observation_id":"7e5a3f42-0bc6-4992-9fde-7ea61cbf2cbc","resolution":{"observed_at":"2026-06-29T04:23:05.535623Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.19468","snapshot_observed_at":"2026-08-06T00:17:10.649943Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01395","last_updated":"2026-08-02T17:20:01Z","snapshot_observed_at":"2026-08-17T17:52:48.319710Z","submitted_at":"2026-08-02T17:20:01Z","title":"Language Equality has a Price: A Systematic Investigation of Multi-turn LLM Performance for EU-24+","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:17:10.649943Z"},"links":{"cited_paper":"/paper/2506.19468","citing_paper":"/paper/2608.01395"},"observation_digest":"sha256:0a0b6c5a49ef6bfeaebdb8f533f321ecdd03bd6a7b4983c5f0b60e18680ebc56","observation_id":"9720bdf5-582d-4673-9979-f8b6660a096c","resolution":{"observed_at":"2026-08-06T00:17:10.649943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.19468/citation-record","integrity":"/paper/2506.19468/integrity","json":"/paper/2506.19468/citation-record.json","paper":"/paper/2506.19468"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.584511Z","title":"https://www.anthropic.com/news/claude-3-7- sonnet","venue":null,"work_id":"33491452-9aee-4b48-bc70-086a873e3439","year":null},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.798449Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:fdd3a2cd7ff3fdf9ea9454ed5e1af2b1b9d7f3a167e1ae792bf7f988db0076b8","observation_id":"98b03044-3a20-4beb-b15a-d62e21f70207","resolution":{"observed_at":"2026-08-15T18:36:36.590000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.571566Z","title":"https://openai.com/index/hello-gpt-4o/","venue":null,"work_id":"1e2a7d62-349e-4fa9-90b7-12dd8d9247b6","year":null},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.805740Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:0b5e049fbbbe4ea9c6b11a26e6a45cee59c1778fa86a6d6a92734d5482b1d331","observation_id":"1d06bff1-adb1-4c2a-b536-8652fb2e3d64","resolution":{"observed_at":"2026-08-15T18:36:36.575647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.556715Z","title":"https://docs.anthropic.com/en/docs/build-with-claude/multilingual- support","venue":null,"work_id":"632d2cd7-d599-4026-928c-e2648629047e","year":null},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.810385Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:71b9e91e8466080947d0f1a4283264401f7c78a2ee3492ecc8c7fef04a92cba3","observation_id":"e170ba35-2370-4d50-a6e5-7ee71e86fa26","resolution":{"observed_at":"2026-08-15T18:36:36.561102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.544750Z","title":"https://qwenlm.github.io/blog/qwen3/","venue":null,"work_id":"a82e0feb-5fce-47aa-a822-8620d7ad9c83","year":null},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.815557Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:0263ca5f352ccf72a360ba78a61db8ff1a6d9a6f6767e0e4dcd14268535551f6","observation_id":"43d641cb-caf4-4ffe-a21d-ee96087d40b8","resolution":{"observed_at":"2026-08-15T18:36:36.548739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.533178Z","title":"https://www.cerebras.ai/blog/slimpajama-a-627b-token-cleaned-and-deduplicated-version-of- redpajama","venue":null,"work_id":"4e7d79ce-9888-4b79-a9e0-0bd9f361d98f","year":null},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.821291Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:e200ec7d6594fb8c08c2c7e735132b00ceebd52d329bf1b4e2843ecf35320007","observation_id":"f2f3377b-0996-43bf-9a82-71b2c8a32d5b","resolution":{"observed_at":"2026-08-15T18:36:36.537022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.517833Z","title":null,"venue":null,"work_id":"e03771d1-e65d-4803-82f6-5f533c2ba7e9","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.826438Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:745e49b0ba7b75c68444aaac603796c27c80303963603f5ff7b0044c168c4345","observation_id":"2b33e47f-0555-4ddd-b267-a19c28153346","resolution":{"observed_at":"2026-08-15T18:36:36.524255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.502786Z","title":"When Benchmarks are Targets: Revealing the Sensitivity of Large Language Model Leaderboards","venue":null,"work_id":"9018d089-2fca-4266-8380-60c684304697","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.831683Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:08bb3c6809fd09cebd45497b9414f60f919c2d6389a8c6dc0287e49d3552101b","observation_id":"fa721713-73e3-40e9-8e7f-58e2af6ec58a","resolution":{"observed_at":"2026-08-15T18:36:36.508957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:35.836435Z","title":"Bowman, Gabor Angeli, Christopher Potts, and Christopher D","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.836435Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:2c155f895c9d82b5a0518f669ccab57ba962887021e675971ab59e402ff24e34","observation_id":"ec99d56b-849a-4789-8fa6-08cc4a8293a5","resolution":{"observed_at":"2026-08-15T18:36:35.836435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.478221Z","title":"Crosslingual Capabilities and Knowledge Barriers in Multilingual Large Language Models, March 2025","venue":null,"work_id":"50c36a70-4e56-4c35-a278-a81c27ae9374","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.840727Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:a89a04d74b551a65432428738edf711575680061ac4ae924ae00b0881489be68","observation_id":"9bd3a764-b1b7-4488-bc5e-ca2cec99fe8d","resolution":{"observed_at":"2026-08-15T18:36:36.482994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.465552Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge, March 2018","venue":null,"work_id":"0f0c1224-80ae-4535-b179-2179fbb276e1","year":2018},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.846889Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:db9d2abbeb58c6265caab37fb67306bc3d4bb622961bb321f2f3bda59a580853","observation_id":"b85ca9f9-e540-43a0-8c2d-7041d9e25d95","resolution":{"observed_at":"2026-08-15T18:36:36.469955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.452619Z","title":"Emerging Cross-lingual Structure in Pretrained Language Models","venue":null,"work_id":"313e3598-a823-4469-aabf-8a4e29b1fd8e","year":2020},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.852194Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:c07b0f4481ea1d732dd6abf8f6f86c7e43c6dacf051d04a007679d1f14c9cefc","observation_id":"a29e9fc7-b056-4f24-b63f-28f04e968567","resolution":{"observed_at":"2026-08-15T18:36:36.456891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.438442Z","title":"Tran, Mike Zhang, Shiqi Chen, Tianyu Pang, Chao Du, Xinyi Wan, Wei Lu, and Min Lin","venue":null,"work_id":"5a462791-7429-4753-97e0-7d9a3a2f66cf","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.857111Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:1a0e867538ed48f5ba79cf1fb0a78b346ba8ebe2f1302682e2b00360f0b0b9c9","observation_id":"f04a8942-0535-47b0-aa16-f701872a2cd8","resolution":{"observed_at":"2026-08-15T18:36:36.442754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:35.861228Z","title":"Measuring Massive Multitask Language Understanding, January 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.861228Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:b783fea5734a80186e37455d3a9c098382250a1259186b247752ab97268620d5","observation_id":"ab1e1922-a584-4e3d-bd47-2d85e3875240","resolution":{"observed_at":"2026-08-15T18:36:35.861228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.415645Z","title":"BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models, February 2025","venue":null,"work_id":"732bcfd6-0fc6-41a6-83f0-0923ccb5ad2c","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.865204Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:411f11ac25e8bb9cc5c4789347d922b65c0e89d5e9a18f560e8e2e0438acd831","observation_id":"7e9b682f-6662-4a3a-88f3-bc2b4059c93e","resolution":{"observed_at":"2026-08-15T18:36:36.419675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.399684Z","title":"Evaluating Code- Switching Translation with Large Language Models","venue":null,"work_id":"12d5051c-7867-4d26-b7e9-bffe5462ce5f","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.869258Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:5c06249ba4c4293e575ede01ea4f007d9ab69bc389da325d18e2d1ac26075fdb","observation_id":"246c5349-1ce6-4dd4-874f-5a5cbe828057","resolution":{"observed_at":"2026-08-15T18:36:36.404649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.386388Z","title":"ArabicMMLU: Assessing Massive Multitask Language Understanding in Arabic","venue":null,"work_id":"3fd98e94-901a-4ec1-bd50-506a3640ceed","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.875617Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:d6c0d012de7f7b034d55649b4a50314a1029f80aecc66786f4615bea89256d60","observation_id":"fe10d072-5651-429b-9f32-826fae534430","resolution":{"observed_at":"2026-08-15T18:36:36.389923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.373254Z","title":"Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback","venue":null,"work_id":"0cd3e063-cb87-4638-9479-b04b71c23626","year":2023},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.880406Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:085cac7ea7285ce01abb05c2ca4cfbb2376e28fae60902760ec2984fcbbea1fc","observation_id":"99bf655d-ca07-4eac-9bd6-792c4bd608be","resolution":{"observed_at":"2026-08-15T18:36:36.377679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.360969Z","title":"Cross-lingual Language Model Pretraining, January 2019","venue":null,"work_id":"69389cd3-61a3-4978-af82-744824bfade4","year":2019},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.884827Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:32bac92ac48f98b8432fcf25bbb35429f002f1a122faa9152e50eeb94d84f80d","observation_id":"23f05cb1-4611-48e0-aab3-35eaf884a8f7","resolution":{"observed_at":"2026-08-15T18:36:36.365539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.348335Z","title":"The Winograd Schema Challenge","venue":null,"work_id":"8391cd8a-1c54-4e75-9f3a-e0a66f68c532","year":null},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.890993Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:f0d4ccdba1357bff195cf1519e4f7b9d4de9870849e098d46a2126f5559e7b71","observation_id":"25ef6dd0-ac2e-42af-8422-ef5f55bfed11","resolution":{"observed_at":"2026-08-15T18:36:36.352897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.335555Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese, January 2024","venue":null,"work_id":"61bc9025-5d68-4c42-9049-ab2ec5a79c12","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.903785Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:7467cae8ff007cdd089d75dad47fd5c164e28a74554a8c0babe0c736d913fdb9","observation_id":"c65a92f0-4b1e-4118-83e8-6240f5cc6671","resolution":{"observed_at":"2026-08-15T18:36:36.339722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.322191Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods, May 2022","venue":null,"work_id":"9185614a-2588-4bc2-b216-0b9317de718f","year":2022},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.910190Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:2221681d81286ecfbc74bd1b545c8c3eae3f543899129d5de6716573f659d437","observation_id":"874ebfe6-2074-419e-af6b-165b3c29fbca","resolution":{"observed_at":"2026-08-15T18:36:36.327265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.302794Z","title":"Few-shot Learning with Multilingual Language Models, November 2022","venue":null,"work_id":"86ac7e15-e031-4381-a8fc-7bda6b10c536","year":2022},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.915621Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:dd071ccb531174343ec0ab5fdc50dcd08f87be3fdbbbbee8144553ffa92906d3","observation_id":"548ab402-ab86-40fe-b10d-3515435425f6","resolution":{"observed_at":"2026-08-15T18:36:36.309882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.289661Z","title":"A Corpus and Evaluation Framework for Deeper Understanding of Commonsense Stories, April 2016","venue":null,"work_id":"9c4196f8-54ef-472e-b787-a450b917a0dc","year":2016},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.921919Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:b6f17d37902c10440b0e7c98b5ecd09dd12f82d2c4d34bd310c40663d0f1c3e2","observation_id":"6c13d83f-24ab-4403-b131-a2a595cd01d1","resolution":{"observed_at":"2026-08-15T18:36:36.294228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.278546Z","title":"The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale, October 2024","venue":null,"work_id":"337e6297-60ad-4399-9ee7-3a1d7c51de81","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.926421Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:0b43552fe4b06ac20c8ecb91d33ca240213e5410dd49847030af6e786366018a","observation_id":"de2a2721-bf5d-42af-8d45-bcf48bca2370","resolution":{"observed_at":"2026-08-15T18:36:36.282353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.267695Z","title":"Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models","venue":null,"work_id":"fedd648c-0def-4f92-988f-47d71d88eec1","year":2023},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.930581Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:47c9614bef788edff7bb0500e140a0cca33a53d6efb90a4b2582562e83937c00","observation_id":"14ab9f1e-bf65-4baf-88ce-68e172d531e5","resolution":{"observed_at":"2026-08-15T18:36:36.271759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.256010Z","title":"Qwen2.5 Technical Report, January 2025","venue":null,"work_id":"185e83bf-af6c-4389-90c5-d8ae8e81512b","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.934717Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:3cb2a07fa85c29e2068cddc3f96bc27d58988d74889745da1df54dcaebd3ffbe","observation_id":"741cad5f-2805-429d-bf59-a6dbd667b067","resolution":{"observed_at":"2026-08-15T18:36:36.259326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.245819Z","title":"Farinha, and Alon Lavie","venue":null,"work_id":"f5460fc0-1cef-46e0-98de-4da70dc6c440","year":2020},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.938458Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:79c6107f1a68a897e99c4e7771a06da8abf2f10d923b6c6e833afc5f234d25eb","observation_id":"0cfd18b6-c0a0-4d3b-8a3e-e94a2ce4cd38","resolution":{"observed_at":"2026-08-15T18:36:36.249062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-16T07:06:07.822225Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-15T18:36:35.942564Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.942564Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:0e8696e682b6abfb83f552e26600f5b2e15f0d1cb8287c3e667ba6cf3d274768","observation_id":"069a478c-ba85-46ba-8347-31de6d7836c3","resolution":{"observed_at":"2026-08-15T18:36:35.942564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.235037Z","title":null,"venue":null,"work_id":"20a73fa6-e458-4658-97ff-429a8e1fe5ff","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.948255Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:bdc82d5df7dfa494bf856eb33e36b8a51c100664a98199ea561faa87ef5efdf1","observation_id":"14f09d0d-5100-400d-9409-b8029b4a278b","resolution":{"observed_at":"2026-08-15T18:36:36.238669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-08-16T10:42:13.725165Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-15T18:36:35.953037Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.953037Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:1df5b120c0868eee132e277a3f80dea1c419b90b18c33afc42c29c8151a98a54","observation_id":"a20afbec-4b23-4406-a544-717165232b95","resolution":{"observed_at":"2026-08-15T18:36:35.953037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.223250Z","title":null,"venue":null,"work_id":"67470462-9ca9-4119-af77-83a840fda513","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.959420Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:b850a919995b9dcf5c2eb560379d1602af598d8033b6dc76fb0b13ff20df6a08","observation_id":"837d2353-93f2-4ac1-b566-a7bcce497b62","resolution":{"observed_at":"2026-08-15T18:36:36.226925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.208260Z","title":"Gemini: A Family of Highly Capable Multimodal Models, June 2024","venue":null,"work_id":"e2990ecb-ece0-4313-a2f6-0485253033ca","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.963708Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:66f5bbd06559926d616ee08539b1fc41cca7cc00a3a72d724bf32f12196b2284","observation_id":"3f149561-8e70-44f8-b7e7-7377b1b9afe6","resolution":{"observed_at":"2026-08-15T18:36:36.213558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.193057Z","title":"Gemma 2: Improving Open Language Models at a Practical Size, July 2024","venue":null,"work_id":"28e25a62-b1f2-40eb-8e09-f5a41350bc4e","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.968257Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:75d5094c321dffea1825df32b8fcd4b5575728987cbb49118fc44f5f2fc8ee54","observation_id":"ed20dbda-5be2-435e-a163-eb61afd3a5d1","resolution":{"observed_at":"2026-08-15T18:36:36.197316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.178176Z","title":"Gemma 3 Technical Report, March 2025","venue":null,"work_id":"677d1ea0-dfb3-4d9d-b7cb-133482870015","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.972572Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:84cd9978b85a2ff07de5e6d06ce2f9e7faeb470c6b19b22fdbcb179a79879731","observation_id":"ac3a7651-b3d9-4f04-92a1-ff7ae8ee86f8","resolution":{"observed_at":"2026-08-15T18:36:36.182932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.161957Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark, November 2024","venue":null,"work_id":"8b9d4e91-337b-4f57-85f4-8c8308175ae8","year":2024},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.976323Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:b78dc0dbd30a7a96b333fd9cfc3ad81b098f84c894a06876a35bda48795cbba2","observation_id":"6a2718dd-310a-4da3-9463-c30a86374681","resolution":{"observed_at":"2026-08-15T18:36:36.167618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.149121Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference","venue":null,"work_id":"aaeef17f-e3fa-48f7-8a59-beeeaf0de554","year":2018},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.980383Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:8964e311b9183e5713628a127e90e670ad55b8d77eb9f43b6bc44cdd7d4e42e5","observation_id":"01178922-80db-4fee-a5f3-525d8e439acf","resolution":{"observed_at":"2026-08-15T18:36:36.153180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.136316Z","title":"MMLU-ProX: A Multilingual Benchmark for Advanced Large Language Model Evaluation, March 2025","venue":null,"work_id":"4edc76ec-0a34-477e-8f71-17105daa4b73","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.984421Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:17f3c558d62d7d040c414286d3459cb4e295035610b20a11e4aa7547c7cca001","observation_id":"f531ad6d-2fd4-4cfd-9853-d90bb11031b2","resolution":{"observed_at":"2026-08-15T18:36:36.140870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.118243Z","title":"GeoM- LAMA: Geo-Diverse Commonsense Probing on Multilingual Pre-Trained Language Models","venue":null,"work_id":"33d56c7d-351e-4f90-a525-ea53ef55180d","year":2022},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.988736Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:108ce504bf0d6df4ab9160c73d4bc0c52c86453531db744165f3f7c349316127","observation_id":"a86a4da5-b507-4506-8c1b-6af4e12c5808","resolution":{"observed_at":"2026-08-15T18:36:36.124851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.099902Z","title":null,"venue":null,"work_id":"80cc438f-c171-458c-b5f8-bbce5bc01b5c","year":2019},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.992934Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:59094b97432be499eea5adf2cff6826f301dc8dcf8b2bd1a6c941d00f6ffbe33","observation_id":"e89d369c-9f7d-466d-8b69-4a16717cde6b","resolution":{"observed_at":"2026-08-15T18:36:36.105733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:36.077421Z","title":"imitative falsehoods,","venue":null,"work_id":"e337a5ac-0362-46fa-9b37-68869c590d11","year":2025},"citing_paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:36:35.996643Z"},"links":{"citing_paper":"/paper/2506.19468"},"observation_digest":"sha256:c991a77736068d80bc0402a3773966a76d8162ee9107807df1215480dd84d34c","observation_id":"d708062e-4b90-4a7e-a6c4-3de2a5f2c57e","resolution":{"observed_at":"2026-08-15T18:36:36.083545Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.19468","last_updated":"2025-06-24T09:53:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T18:29:50.005489Z","submitted_at":"2025-06-24T09:53:00Z","title":"MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 5 inbound Pith citation observations for arXiv:2506.19468."}