{"as_of":"2026-08-14T00:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9361616e641b411a3cac7c7374cffcd5344aec77641077903fdf118b4e73a702","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:36:00.280571Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T19:03:03.350371Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T23:30:52.664737Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"cited_work":{"arxiv_id":"2507.22603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"org/abs/2507.22603","venue":null,"work_id":"755edd51-9ad6-4e31-a4a6-ac5ba92ca571","year":null},"citing_paper":{"arxiv_id":"2604.06456","last_updated":"2026-04-07T20:54:19Z","snapshot_observed_at":"2026-08-03T01:37:14.543340Z","submitted_at":"2026-04-07T20:54:19Z","title":"Context-Aware Dialectal Arabic Machine Translation with Interactive Region and Register Selection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:03:03.350371Z"},"links":{"cited_paper":"/paper/2507.22603","citing_paper":"/paper/2604.06456"},"observation_digest":"sha256:bb3ee9505f72fe780982448fec85a9ad3c15a2a3b188e0bba7f07588ab3d5718","observation_id":"d292673a-38ce-4876-b9e2-315e12e1b824","resolution":{"observed_at":"2026-05-10T23:30:52.671051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.22603/citation-record","integrity":"/paper/2507.22603/integrity","json":"/paper/2507.22603/citation-record.json","paper":"/paper/2507.22603"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.475808Z","title":null,"venue":null,"work_id":"00c30cea-ae04-43b5-b67b-264f00bfcbd0","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.259136Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:e9f9bf6303810267b675ca5fc3a74549d8447c0031bd5b4d5b566b9b42e797c7","observation_id":"01da45ee-27e7-4952-83a4-46425ac1fb33","resolution":{"observed_at":"2026-08-06T11:36:00.480710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.458511Z","title":null,"venue":null,"work_id":"b6ae91df-ad8d-4a4d-b812-68b1444d7ad5","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.264374Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:be8c362a3aa23c627e1868558db2f82d1b9b7185ef1e195eabc14c28e71fe312","observation_id":"e06ab83d-1c55-4735-8fea-d57a18341fac","resolution":{"observed_at":"2026-08-06T11:36:00.463511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.533750Z","title":"Dan Hendrycks, Collin Burns, Steven Basart, Andy Zou, Mantas Mazeika, Dawn Song, and Jacob Steinhardt","venue":null,"work_id":"49e9b3e1-136e-42dd-8d07-75ad1d967356","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.228330Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:618e24083759e9c79e95f49c29b7bfcdfd38239802e0741d15caadb0253445e3","observation_id":"ac4e2a38-4a84-45c0-83f9-18e31d69a0b2","resolution":{"observed_at":"2026-08-06T11:36:00.539955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10627","last_updated":"2024-07-15T11:26:07Z","snapshot_observed_at":"2026-08-13T06:52:25.956995Z","submitted_at":"2024-07-15T11:26:07Z","title":"Arena Learning: Build Data Flywheel for LLMs Post-training via Simulated Chatbot Arena","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10627","snapshot_observed_at":"2026-08-06T11:36:00.239773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.239773Z"},"links":{"cited_paper":"/paper/2407.10627","citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:0499e80cf5613ed88df5d8781dd51b8ae154c3105b9af1a89abd43faba41b90b","observation_id":"157a8e67-c6f6-40ac-8138-da5596c037cc","resolution":{"observed_at":"2026-08-06T11:36:00.239773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.440333Z","title":"Evaluate the generated output by comparing it to the ground truth, considering how well it addresses the original prompt","venue":null,"work_id":"68d1fff2-4696-4e21-8465-85f337cf9364","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.269899Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:6adfc24517e4911fbb02f800db8f0aef2437e67e2d689bb6056f98a598b47521","observation_id":"1afaefda-ccae-4945-b94e-a2e33ff066bd","resolution":{"observed_at":"2026-08-06T11:36:00.445382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.423045Z","title":null,"venue":null,"work_id":"6587ed7c-4541-4dfb-aa8a-4e5bacc44f63","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.275656Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:12ee039172fa1fb7dd972030d9eba0268d855ba689ae2e5306ba813788d9902a","observation_id":"2e23c6ce-d51d-4c64-8042-f66350784495","resolution":{"observed_at":"2026-08-06T11:36:00.427852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.403558Z","title":"score\": 3,","venue":null,"work_id":"68379abc-d1a4-49df-91c5-209c3490d374","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.280571Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:3352d3d3df4d779650c905d445e5fbbd2bb60d403f5b9d2789f9381b6f08ba3a","observation_id":"a1be0072-2efd-47be-8c2d-b37fd6a6c9bc","resolution":{"observed_at":"2026-08-06T11:36:00.410565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.515173Z","title":"In International Conference on Learning Representations","venue":null,"work_id":"02e5444a-3620-46fa-8042-70029b735e06","year":2024},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.233976Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:3bf94c582017885b76766a1ac866a56a3d985e4dd97d1afeb5c38531413dfbe1","observation_id":"32a637dc-4852-47fd-a38b-a61e37a53dee","resolution":{"observed_at":"2026-08-06T11:36:00.521004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-06T11:36:00.215303Z","title":"arXiv preprint arXiv:2204.05862","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.215303Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:f06cba479a7b44d23dae5cee196e0c3547ce7bbc96b7c42741498a4d135dcddf","observation_id":"9c55c0a3-d89c-49d2-82b3-628f3da1c94d","resolution":{"observed_at":"2026-08-06T11:36:00.215303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16149","last_updated":"2023-09-29T11:51:51Z","snapshot_observed_at":"2026-08-13T10:24:03.359877Z","submitted_at":"2023-08-30T17:07:17Z","title":"Jais and Jais-chat: Arabic-Centric Foundation and Instruction-Tuned Open Generative Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16149","snapshot_observed_at":"2026-08-06T11:36:00.250729Z","title":"In Findings of the Associa- tion for Computational Linguistics: EMNLP 2023 , pages 1404–1422, Singapore","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.250729Z"},"links":{"cited_paper":"/paper/2308.16149","citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:4a4871a7395d20929ef492f8e2979c3f34dac3cbca3daf1cc74b4547815a63c3","observation_id":"bd0921df-52e8-440c-92f8-00ef16da9de4","resolution":{"observed_at":"2026-08-06T11:36:00.250729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05882","last_updated":"2024-08-12T00:46:39Z","snapshot_observed_at":"2026-08-12T23:05:15.158860Z","submitted_at":"2024-08-12T00:46:39Z","title":"Creating Arabic LLM Prompts at Scale","version":1},"cited_work":{"arxiv_id":"2408.05882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.05882","snapshot_observed_at":"2026-08-06T11:36:00.358868Z","title":"Creating Arabic LLM Prompts at Scale","venue":"cs.CL","work_id":"8479839f-9894-4c5c-a208-5a7f8dc89536","year":2024},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.222651Z"},"links":{"cited_paper":"/paper/2408.05882","citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:b65533739aec9b1b34c9c4c0d7ff5a6a9c2f60e91ab6564aa1d6d29d022981e8","observation_id":"d3f97aaa-4e76-433a-8eda-725ae6fffd57","resolution":{"observed_at":"2026-08-06T11:36:00.366212Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.494765Z","title":"In Proceedings of the 31st International Conference on Computational Lin- guistics, pages 4186–4218, Abu Dhabi, UAE","venue":null,"work_id":"736a256d-1888-408a-a544-271f051c989a","year":2023},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.245539Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:e17703416a2753bdba5241cd4ccab9a56bf4477f7e55d2e70c8f9db2732f522c","observation_id":"06ffc0bd-6a50-4701-a2e3-efbf85ba8cfe","resolution":{"observed_at":"2026-08-06T11:36:00.500643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T22:56:33.177084Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 1 inbound Pith citation observation for arXiv:2507.22603."}