{"as_of":"2026-08-20T14:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1a80c7d1fe8e951e2d3cf178ec01caf3c5a8eb9bdb1149df836b4548f55eada","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:09:01.006991Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T11:22:16.624253Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-11T16:59:49.490088Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09569","last_updated":"2025-06-10T17:54:35Z","snapshot_observed_at":"2026-08-19T07:55:18.217348Z","submitted_at":"2024-12-12T18:51:13Z","title":"JuStRank: Benchmarking LLM Judges for System Ranking","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:49.490088Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2412.09569"},"observation_digest":"sha256:2098f3b814a652f3e94197d4de780c9042e933483382d6da9fb557367869c85b","observation_id":"3f7a2503-723d-48c2-989a-e7ec16c32645","resolution":{"observed_at":"2026-08-11T16:59:49.490088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-11T12:54:54.513004Z","title":"Angela Fan, Yacine Jernite, Ethan Perez, David Grang- ier, Jason Weston, and Michael Auli","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13746","last_updated":"2024-12-18T11:28:05Z","snapshot_observed_at":"2026-08-19T14:35:59.035199Z","submitted_at":"2024-12-18T11:28:05Z","title":"RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment","version":1},"reference_index":158,"source":"pdf_text","source_observed_at":"2026-08-11T12:54:54.513004Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2412.13746"},"observation_digest":"sha256:6f5a080b14ea497576583dff7c080bbbc19594db651f8dfd710f38699c49de6d","observation_id":"b82689fd-1e95-4763-a268-884fda411c31","resolution":{"observed_at":"2026-08-11T12:54:54.513004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-11T11:43:59.596163Z","title":"Thomas Hartvigsen, Saadia Gabriel, Hamid Palangi, Maarten Sap, Dipankar Ray, and Ece Kamar","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15035","last_updated":"2025-06-23T11:45:09Z","snapshot_observed_at":"2026-08-18T12:44:07.573125Z","submitted_at":"2024-12-19T16:46:54Z","title":"LLMs Lost in Translation: M-ALERT uncovers Cross-Linguistic Safety Inconsistencies","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T11:43:59.596163Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2412.15035"},"observation_digest":"sha256:b71c093d0cc5296c00d64623442e9122e12133fc193e02d4e027c9ca7d98fdce","observation_id":"5daeb795-2c92-485c-bbf4-c56d8c29c6b2","resolution":{"observed_at":"2026-08-11T11:43:59.596163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-10T17:18:40.289337Z","title":"M-RewardBench : Evaluating reward models in multilingual settings","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12368","last_updated":"2025-05-20T11:36:34Z","snapshot_observed_at":"2026-08-17T21:21:26.500724Z","submitted_at":"2025-01-21T18:47:32Z","title":"InternLM-XComposer2.5-Reward: A Simple Yet Effective Multi-Modal Reward Model","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T17:18:40.289337Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2501.12368"},"observation_digest":"sha256:d7d157e0749c06f743a9884919c289c8c237b65a6a74daf6441329bf5e00476c","observation_id":"0af39565-f021-4e93-8634-6d84e6b00ba6","resolution":{"observed_at":"2026-08-10T17:18:40.289337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-15T21:09:01.006991Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10775","last_updated":"2025-05-16T01:27:03Z","snapshot_observed_at":"2026-08-15T21:01:35.130546Z","submitted_at":"2025-05-16T01:27:03Z","title":"A Systematic Analysis of Base Model Choice for Reward Modeling","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T21:09:01.006991Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2505.10775"},"observation_digest":"sha256:f1dc8c5427c8e51b1762f3d84fed31c52aab3398176f1303702c5c3b2f57f5f4","observation_id":"b42ebc1d-4433-42cb-aa60-b979887cf0d4","resolution":{"observed_at":"2026-08-15T21:09:01.006991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-07T13:22:42.658486Z","title":"arXiv preprint arXiv:2410.15522","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21941","last_updated":"2025-05-28T03:50:19Z","snapshot_observed_at":"2026-08-13T14:50:54.534755Z","submitted_at":"2025-05-28T03:50:19Z","title":"Test-Time Scaling with Repeated Sampling Improves Multilingual Text Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:22:42.658486Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2505.21941"},"observation_digest":"sha256:fdcbcf70ab51a02a69f0afa6cf49cecafe57eaba01fa52cfd620a97a2eb83081","observation_id":"95536eae-6b54-4d11-bdc8-9f8ea417005d","resolution":{"observed_at":"2026-08-07T13:22:42.658486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":"2410.15522","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M-rewardbench: Evaluating reward models in multilingual settings","venue":null,"work_id":"bb531d9e-8fb5-42c8-b569-c0e5095717c2","year":2024},"citing_paper":{"arxiv_id":"2506.01937","last_updated":"2026-04-23T14:42:19Z","snapshot_observed_at":"2026-07-06T21:35:12.872021Z","submitted_at":"2025-06-02T17:54:04Z","title":"RewardBench 2: Advancing Reward Model Evaluation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T11:18:03.965711Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2506.01937"},"observation_digest":"sha256:ce12478d6905cde72040c7ba5224ed6db016872100e80dc6b7c5fd2f31534e33","observation_id":"17804e35-3018-44c5-ac0e-db440a1576e1","resolution":{"observed_at":"2026-05-19T11:22:16.627485Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-07T04:25:12.734104Z","title":"doi: 10.18653/v1/D19-1141","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10766","last_updated":"2025-06-12T14:47:13Z","snapshot_observed_at":"2026-08-15T10:34:26.341703Z","submitted_at":"2025-06-12T14:47:13Z","title":"One Tokenizer To Rule Them All: Emergent Language Plasticity via Multilingual Tokenizers","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T04:25:12.734104Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2506.10766"},"observation_digest":"sha256:48a5fb192a1ff49d14b117cfaa3189dc210d4a4f025d8543d9373c3e54da4841","observation_id":"96fd7ad5-8105-406f-b63c-6d9872513cd8","resolution":{"observed_at":"2026-08-07T04:25:12.734104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-15T19:32:11.789138Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.789138Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:1dfe5e4870cc62bba7134f6c142a4003b5ec33a568f3d868db0dd2ed8d68b88e","observation_id":"0ca32232-0d4a-4190-bdd2-eca796c144e0","resolution":{"observed_at":"2026-08-15T19:32:11.789138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-06T21:02:42.374334Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01368","last_updated":"2025-07-02T05:10:29Z","snapshot_observed_at":"2026-08-19T15:33:39.402884Z","submitted_at":"2025-07-02T05:10:29Z","title":"Activation Reward Models for Few-Shot Model Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:02:42.374334Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2507.01368"},"observation_digest":"sha256:f846e4a1caabb10c6ad35d12c5e437fc17e6882c48e20d9ba84d9f366ecf9327","observation_id":"7b27f7cc-25e1-485c-9580-29ab4868c157","resolution":{"observed_at":"2026-08-06T21:02:42.374334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.15522/citation-record","integrity":"/paper/2410.15522/integrity","json":"/paper/2410.15522/citation-record.json","paper":"/paper/2410.15522"},"outbound":[],"paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2410.15522."}