{"as_of":"2026-08-19T09:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2cf3af0f9322f47ed37e5bb59f03ff1a5148273cb3b70273f8eed56f14135c2","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:32:11.937637Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:56:37.830725Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T15:56:38.199131Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"cited_work":{"arxiv_id":"2506.16502","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.16502","snapshot_observed_at":"2026-08-15T15:56:38.199131Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","venue":"cs.CL","work_id":"0f2f3ca2-0879-4b8e-a82b-3f9736279477","year":2025},"citing_paper":{"arxiv_id":"2509.15676","last_updated":"2026-06-02T19:02:15Z","snapshot_observed_at":"2026-08-18T14:35:16.640707Z","submitted_at":"2025-09-19T06:50:03Z","title":"KITE: Kernelized and Information Theoretic Exemplars for In-Context Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T15:56:37.830725Z"},"links":{"cited_paper":"/paper/2506.16502","citing_paper":"/paper/2509.15676"},"observation_digest":"sha256:59c866cd2ce33eb6235c9b3aa244192fcd646a6c822a314620735479545371fb","observation_id":"90a6251f-0d35-46a7-b5e2-e83a82c0372f","resolution":{"observed_at":"2026-08-15T15:56:38.205237Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.16502","snapshot_observed_at":"2026-08-12T14:10:44.838327Z","title":"arXiv preprint arXiv:2506.16502 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10928","last_updated":"2026-08-11T13:58:07Z","snapshot_observed_at":"2026-08-17T15:17:05.825896Z","submitted_at":"2026-08-11T13:58:07Z","title":"ThinkRetrieve: Retrieval-Augmented Reasoning Traces for Test-Time Scaling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T14:10:44.838327Z"},"links":{"cited_paper":"/paper/2506.16502","citing_paper":"/paper/2608.10928"},"observation_digest":"sha256:52f91cb544db4c43d902d8a028499f8f6c14013c812b990560bf32adaebac3db","observation_id":"ca950d40-fd9e-466d-8e8e-98abd231a52f","resolution":{"observed_at":"2026-08-12T14:10:44.838327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.16502/citation-record","integrity":"/paper/2506.16502/integrity","json":"/paper/2506.16502/citation-record.json","paper":"/paper/2506.16502"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.596418Z","title":null,"venue":null,"work_id":"4a096a96-cf00-49d7-affb-3c48fceebe68","year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.739023Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:b1f179e99094aee155f0fb176dae0bd643be6149ac1496a248a20b55a5b48ce5","observation_id":"3411b552-7d78-4b50-8f2f-13165cda20fb","resolution":{"observed_at":"2026-08-15T19:32:12.599739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-15T19:32:11.743474Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.743474Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:bee983907fec7ddbfc5db534529e68055573ed2233af90ee435ccb02fdebcddc","observation_id":"764c1502-3618-4431-8a58-a2911c000026","resolution":{"observed_at":"2026-08-15T19:32:11.743474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.584952Z","title":null,"venue":null,"work_id":"daaf6e1c-3f06-4a0e-960e-96ce09125a1b","year":1952},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.748110Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:755a245410e580a6af0515397ebec639c3bc2aaa08fc3bc43c5e890932744a5e","observation_id":"84969ef0-3d80-4039-a056-05d5a0126a99","resolution":{"observed_at":"2026-08-15T19:32:12.588817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.574754Z","title":null,"venue":null,"work_id":"6cbd0e40-f84b-47fa-9b46-8562a74b616f","year":1952},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.751765Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:a78f46c6e19d085e1da159e540efa98732fa18e77f93febc563c854abbef6517","observation_id":"488c373c-3df0-46fe-af88-42b72f2552ee","resolution":{"observed_at":"2026-08-15T19:32:12.578242Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.564433Z","title":null,"venue":null,"work_id":"be90fafb-c649-4a06-bad0-483e303b8a18","year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.755622Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:628cef49b105f13e75f773e626b75b22f835c7a423a01ba1e92895aeee19bf97","observation_id":"95a6e0de-ed81-4630-9034-31d94df0312c","resolution":{"observed_at":"2026-08-15T19:32:12.568043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.759675Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.759675Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:96e99689b690f4480779899443dfbb03bd342cbd556dfb859f17aa8825370dae","observation_id":"d7e515b1-00ff-4d90-be37-ed11db09d41a","resolution":{"observed_at":"2026-08-15T19:32:11.759675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.548365Z","title":null,"venue":null,"work_id":"610e5142-b98a-43d0-b488-b36dae28bcc5","year":2019},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.763571Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:af3802489b5a82ee3f452ae5d90d4387c7172f749b486d0efc41acb60d10604e","observation_id":"f5243754-830f-46a4-85a3-ca8b0b7fa075","resolution":{"observed_at":"2026-08-15T19:32:12.551944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.767201Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.767201Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:172ef06c2145ceaab9c5b0c45d667895816f620a58fbc57776193af6ba9a0d28","observation_id":"14160182-1e8d-46c7-baa0-d82b89732e4b","resolution":{"observed_at":"2026-08-15T19:32:11.767201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T19:32:11.770791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.770791Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:59e87195d15eb2ee4f0cb638301fab97044380e143cd8784b56d67fbfb2d5760","observation_id":"cc96c2ea-3e5b-45b4-bcbc-12358130eac9","resolution":{"observed_at":"2026-08-15T19:32:11.770791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01223","last_updated":"2023-08-02T15:29:22Z","snapshot_observed_at":"2026-08-17T05:45:27.973501Z","submitted_at":"2023-08-02T15:29:22Z","title":"Do Multilingual Language Models Think Better in English?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01223","snapshot_observed_at":"2026-08-15T19:32:11.774410Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.774410Z"},"links":{"cited_paper":"/paper/2308.01223","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:8ecb788a6ad4de4bedc249e5cc603cde627ee418ff198300d5a4e519d6057ac0","observation_id":"68ee76c4-02d7-474f-83cd-2fc326cc2a84","resolution":{"observed_at":"2026-08-15T19:32:11.774410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.532060Z","title":null,"venue":null,"work_id":"68fcaffb-efa9-4d85-9864-3bb3db2dc81b","year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.778412Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:b1ebe9205bbcd750265f5ea071bee022e81ebab15a4bd0c77d2a0e6161838a0c","observation_id":"ea4c87c6-d982-46fd-9a1f-15b499a956fa","resolution":{"observed_at":"2026-08-15T19:32:12.535403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.521459Z","title":null,"venue":null,"work_id":"a338e251-07dc-45af-80e7-bdaa60add685","year":2025},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.782011Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:9301cd81fef5a40870eb5ee0578854e43484735e5838361dddd47d56dccd1f43","observation_id":"399d44eb-c32b-4a8e-99ae-424d3d556f03","resolution":{"observed_at":"2026-08-15T19:32:12.524968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.785620Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.785620Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:41813cc9cb49e537dbe7fa9ac623dbee2f023cdb284bf9706318dadd071a1931","observation_id":"9bd516a1-ca96-470e-881b-abe8575a89f7","resolution":{"observed_at":"2026-08-15T19:32:11.785620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15522","last_updated":"2025-05-20T06:23:39Z","snapshot_observed_at":"2026-08-16T13:07:36.883796Z","submitted_at":"2024-10-20T22:09:44Z","title":"M-RewardBench: Evaluating Reward Models in Multilingual Settings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15522","snapshot_observed_at":"2026-08-15T19:32:11.789138Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.789138Z"},"links":{"cited_paper":"/paper/2410.15522","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:1dfe5e4870cc62bba7134f6c142a4003b5ec33a568f3d868db0dd2ed8d68b88e","observation_id":"0ca32232-0d4a-4190-bdd2-eca796c144e0","resolution":{"observed_at":"2026-08-15T19:32:11.789138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18027","last_updated":"2025-01-23T13:20:41Z","snapshot_observed_at":"2026-08-16T13:06:32.801668Z","submitted_at":"2024-10-23T17:00:13Z","title":"Cross-lingual Transfer of Reward Models in Multilingual Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18027","snapshot_observed_at":"2026-08-15T19:32:11.793202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.793202Z"},"links":{"cited_paper":"/paper/2410.18027","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:2455f7c9d0230ac771db3cb09fcb4b7013c58569ee2715be179be7a1204ff886","observation_id":"e26a29f3-ea8f-45dd-8b7e-f368bddd1892","resolution":{"observed_at":"2026-08-15T19:32:11.793202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07004","last_updated":"2023-10-22T13:43:27Z","snapshot_observed_at":"2026-08-16T15:33:46.511961Z","submitted_at":"2023-05-11T17:44:17Z","title":"Not All Languages Are Created Equal in LLMs: Improving Multilingual Capability by Cross-Lingual-Thought Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07004","snapshot_observed_at":"2026-08-15T19:32:11.797060Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.797060Z"},"links":{"cited_paper":"/paper/2305.07004","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:a349d06e7384b3cd4e2aa13f6ab31b1a65ed60191465d7f8f8b32116e2e2d48d","observation_id":"0c45b1f9-a716-4917-9e63-89bfc0352111","resolution":{"observed_at":"2026-08-15T19:32:11.797060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-16T13:40:57.893955Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-15T19:32:11.801146Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.801146Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:03759490e6ffcff74b9a187ca5c0b67eebff2da924609041599843e7047b9743","observation_id":"eda1e4c2-d2fb-449e-b7a7-bf446442c1ca","resolution":{"observed_at":"2026-08-15T19:32:11.801146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.804836Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.804836Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:c6482c5c7a5d4adacded960e3e5a29d8f4a6f01459a9248d617361702d9e6c50","observation_id":"8e487703-f22f-4fb3-b883-5e3dbfd5df76","resolution":{"observed_at":"2026-08-15T19:32:11.804836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01694","last_updated":"2024-01-23T23:42:41Z","snapshot_observed_at":"2026-08-18T11:13:23.191794Z","submitted_at":"2024-01-23T23:42:41Z","title":"ARGS: Alignment as Reward-Guided Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01694","snapshot_observed_at":"2026-08-15T19:32:11.808816Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.808816Z"},"links":{"cited_paper":"/paper/2402.01694","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:fd93667bbe282b463e6c1815cfd16ec895b7b64002378d3a4219bb04fee7b09c","observation_id":"ba331d66-217c-4371-a38e-96c144afed5f","resolution":{"observed_at":"2026-08-15T19:32:11.808816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-17T18:23:08.323051Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-15T19:32:11.812895Z","title":"Smith, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.812895Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:b625b7df096a51bacfe4c05e9b309bd81c689b02c7f4c0169e6fa3ab3c228dd9","observation_id":"7afad6b3-a730-4eba-9cf4-3ea917026af6","resolution":{"observed_at":"2026-08-15T19:32:11.812895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.00300","last_updated":"2019-06-27T21:06:12Z","snapshot_observed_at":"2026-08-16T14:19:32.455632Z","submitted_at":"2019-06-01T22:02:39Z","title":"Latent Retrieval for Weakly Supervised Open Domain Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.00300","snapshot_observed_at":"2026-08-15T19:32:11.816847Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.816847Z"},"links":{"cited_paper":"/paper/1906.00300","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:6b9cd5743ecebce9032fd9c3a88bcca49d18dda1c5303c3cd01379f8aa3b1ee0","observation_id":"9d4df4e7-98f4-4707-91fb-cdaabc0197b2","resolution":{"observed_at":"2026-08-15T19:32:11.816847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06800","last_updated":"2023-06-24T15:49:31Z","snapshot_observed_at":"2026-08-16T16:08:54.917798Z","submitted_at":"2022-12-13T18:34:15Z","title":"Diverse Demonstrations Improve In-context Compositional Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06800","snapshot_observed_at":"2026-08-15T19:32:11.820835Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.820835Z"},"links":{"cited_paper":"/paper/2212.06800","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:09fab0a66d4fa2a1956d901020f7ed003036f86df76b7b5ca9314e10b0407866","observation_id":"8cdc7d59-315d-4dfa-8ad1-a48bdeaf99de","resolution":{"observed_at":"2026-08-15T19:32:11.820835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04320","last_updated":"2023-05-16T05:59:25Z","snapshot_observed_at":"2026-08-16T15:34:58.082295Z","submitted_at":"2023-05-07T16:07:11Z","title":"Unified Demonstration Retriever for In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04320","snapshot_observed_at":"2026-08-15T19:32:11.824656Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.824656Z"},"links":{"cited_paper":"/paper/2305.04320","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:22fdffaa11efd24da156d45df293ab14ce139494d42eb2c31ecdc78adc7ad8ab","observation_id":"37f9f294-f4a8-4061-971a-865ad207cbde","resolution":{"observed_at":"2026-08-15T19:32:11.824656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13539","last_updated":"2023-10-09T02:39:04Z","snapshot_observed_at":"2026-08-16T15:52:32.876197Z","submitted_at":"2023-02-27T06:32:45Z","title":"Finding Support Examples for In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13539","snapshot_observed_at":"2026-08-15T19:32:11.828577Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.828577Z"},"links":{"cited_paper":"/paper/2302.13539","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:c3ad13486eccf7f7bc283eca633d79cf4236a2c8918baea0325340185694c8af","observation_id":"4760f9f9-c7ec-4f4e-bc6f-5d42208e1fee","resolution":{"observed_at":"2026-08-15T19:32:11.828577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05116","last_updated":"2025-02-08T10:44:14Z","snapshot_observed_at":"2026-08-18T16:51:56.449619Z","submitted_at":"2024-05-08T15:13:33Z","title":"XAMPLER: Learning to Retrieve Cross-Lingual In-Context Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05116","snapshot_observed_at":"2026-08-15T19:32:11.832617Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.832617Z"},"links":{"cited_paper":"/paper/2405.05116","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:03c6912e5714c6a256c1356dbb79e27c37663adde8bbec60876ab86cf91f96c2","observation_id":"808f2c3b-86ea-40ee-a3f7-3f6a1d677dd7","resolution":{"observed_at":"2026-08-15T19:32:11.832617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-13T15:15:10.681693Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-15T19:32:11.836469Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.836469Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:25171f3960cfd4ee57c17dde4de621a6c7df13d2685690f655d97c9bfd11dff0","observation_id":"21f83949-5f50-4849-b452-9f4c18f02e2c","resolution":{"observed_at":"2026-08-15T19:32:11.836469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.06804","last_updated":"2021-01-17T23:38:40Z","snapshot_observed_at":"2026-08-16T18:51:47.106761Z","submitted_at":"2021-01-17T23:38:40Z","title":"What Makes Good In-Context Examples for GPT-$3$?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.06804","snapshot_observed_at":"2026-08-15T19:32:11.840260Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.840260Z"},"links":{"cited_paper":"/paper/2101.06804","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:515c8769fd8e0159a61695471526a178d0b22e52d1937891b94323b0e13989ba","observation_id":"77459781-beb5-418b-a360-dd6ee51c44c1","resolution":{"observed_at":"2026-08-15T19:32:11.840260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14128","last_updated":"2023-05-23T14:55:25Z","snapshot_observed_at":"2026-08-19T01:51:09.597546Z","submitted_at":"2023-05-23T14:55:25Z","title":"Dr.ICL: Demonstration-Retrieved In-context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14128","snapshot_observed_at":"2026-08-15T19:32:11.844046Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.844046Z"},"links":{"cited_paper":"/paper/2305.14128","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:62502dc0b89947b04ed734d042b8db2ba30a8c86748bd6ea3f23d6f2c1aac5bb","observation_id":"8b6f8d93-046a-4ca5-9ece-7139ec7b3938","resolution":{"observed_at":"2026-08-15T19:32:11.844046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17022","last_updated":"2024-06-03T20:50:26Z","snapshot_observed_at":"2026-08-16T14:48:48.486166Z","submitted_at":"2023-10-25T22:00:05Z","title":"Controlled Decoding from Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17022","snapshot_observed_at":"2026-08-15T19:32:11.847532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.847532Z"},"links":{"cited_paper":"/paper/2310.17022","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:c69d0fd1a687157fc315e1471018fcde19eeb4da09828a84e255f7289998fe64","observation_id":"bba6a4d7-04e2-46e9-b170-fac1190d4136","resolution":{"observed_at":"2026-08-15T19:32:11.847532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-19T02:54:55.334346Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-15T19:32:11.851136Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.851136Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:46b89343084caf1906e39b57372e5eb2993a1cce92dd83363a6e79a2de171718","observation_id":"24f52242-c3f5-4f23-8f22-2cb0792f4ee0","resolution":{"observed_at":"2026-08-15T19:32:11.851136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11042","last_updated":"2023-06-05T17:49:58Z","snapshot_observed_at":"2026-08-16T15:53:42.079924Z","submitted_at":"2023-02-21T22:47:45Z","title":"In-context Example Selection with Influences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.11042","snapshot_observed_at":"2026-08-15T19:32:11.854551Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.854551Z"},"links":{"cited_paper":"/paper/2302.11042","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:88340e896320507409addf9d1f28986f5e73d50ac40567b60cfb071d58f5f139","observation_id":"a30dfd69-e4e4-486d-979c-0d473eff657d","resolution":{"observed_at":"2026-08-15T19:32:11.854551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.858194Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.858194Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:ae759092e19da4e4d099acd0919422302bdb0102e22811ee6083664adcf8726d","observation_id":"9ba3fcc2-b728-4e22-8b96-7a688099e814","resolution":{"observed_at":"2026-08-15T19:32:11.858194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09881","last_updated":"2024-12-30T04:27:05Z","snapshot_observed_at":"2026-08-16T14:52:00.050104Z","submitted_at":"2023-10-15T16:40:19Z","title":"In-Context Learning with Iterative Demonstration Selection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09881","snapshot_observed_at":"2026-08-15T19:32:11.861610Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.861610Z"},"links":{"cited_paper":"/paper/2310.09881","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:e66503c4b7d36341a7b83f76d1ea7674f4f23d73dce9fce9ef3e4cec251dac56","observation_id":"35d72605-0c21-4d54-8eb4-07469d5cae99","resolution":{"observed_at":"2026-08-15T19:32:11.861610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-15T19:32:11.865242Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.865242Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:9054761ee69f614d828881a8ab834c1f27c012c09ea17b966acf7b74aeffab80","observation_id":"2adc3cfc-a2e6-4718-b8ea-7409e1bfa7c1","resolution":{"observed_at":"2026-08-15T19:32:11.865242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.869009Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.869009Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:673c268fb98717656a88bcd942b895252ae342581f241abe9a63afc0eef105fc","observation_id":"7eb28892-0d91-4983-849f-ae077d2ee695","resolution":{"observed_at":"2026-08-15T19:32:11.869009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.08633","last_updated":"2022-05-08T05:17:15Z","snapshot_observed_at":"2026-08-18T14:41:38.679885Z","submitted_at":"2021-12-16T05:17:56Z","title":"Learning To Retrieve Prompts for In-Context Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.08633","snapshot_observed_at":"2026-08-15T19:32:11.872431Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.872431Z"},"links":{"cited_paper":"/paper/2112.08633","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:8c9e0011242c5e36b5454259576128f6723a0f28802ead33b061195c9abd74c1","observation_id":"d5e857ef-d866-49b0-896e-b6354ac4c640","resolution":{"observed_at":"2026-08-15T19:32:11.872431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14502","last_updated":"2024-04-16T17:25:25Z","snapshot_observed_at":"2026-08-18T19:33:37.062007Z","submitted_at":"2023-05-23T20:15:56Z","title":"RetICL: Sequential Retrieval of In-Context Examples with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14502","snapshot_observed_at":"2026-08-15T19:32:11.875942Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.875942Z"},"links":{"cited_paper":"/paper/2305.14502","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:db52ba8654defc3bb022b5f58b2c2b12cbb13db25ac6e471400c9a80dd2f5fd2","observation_id":"f6fd0b9a-9545-4b1c-bf69-313fea8f6f84","resolution":{"observed_at":"2026-08-15T19:32:11.875942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.492822Z","title":null,"venue":null,"work_id":"020f628b-7d87-4701-913a-47e59a942aa7","year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.879507Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:cb01b34e924cb09deb2618448da2e13be74de968d1a3d452c1bac1b5679819af","observation_id":"64076e83-517c-45d1-a092-714b492714d3","resolution":{"observed_at":"2026-08-15T19:32:12.496284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16816","last_updated":"2024-08-07T19:47:21Z","snapshot_observed_at":"2026-08-16T13:57:47.294542Z","submitted_at":"2024-04-25T17:57:36Z","title":"IndicGenBench: A Multilingual Benchmark to Evaluate Generation Capabilities of LLMs on Indic Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16816","snapshot_observed_at":"2026-08-15T19:32:11.882868Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.882868Z"},"links":{"cited_paper":"/paper/2404.16816","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:855e823f421f2f5c97bc4d170d12462cb943df7597a9174006482702437594da","observation_id":"d9f57aee-6eb1-4f7d-8568-1171f34b2526","resolution":{"observed_at":"2026-08-15T19:32:11.882868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.886525Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.886525Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:ddcc2a74e80adfd8d8e961f0039e3f846bd2254330dc7d05201c072274a22913","observation_id":"0017ccfb-299e-4080-bbc5-85deb3d6b09e","resolution":{"observed_at":"2026-08-15T19:32:11.886525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05940","last_updated":"2023-06-24T07:43:35Z","snapshot_observed_at":"2026-08-16T15:34:15.834849Z","submitted_at":"2023-05-10T07:24:36Z","title":"Multilingual LLMs are Better Cross-lingual In-context Learners with Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05940","snapshot_observed_at":"2026-08-15T19:32:11.889902Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.889902Z"},"links":{"cited_paper":"/paper/2305.05940","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:c414b112d25e76c036def750fa3d022e798f8cdbd2a35cd26681dc323fdfc350","observation_id":"b09f84a3-dfc1-445c-b582-d27e8214c909","resolution":{"observed_at":"2026-08-15T19:32:11.889902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.476666Z","title":null,"venue":null,"work_id":"cb34b652-d9bb-4e88-a87f-a13e43e14584","year":1927},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.893564Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:20cfc78bedad8c261e3880df542acb012a66a17331ffd49081b0e99732bb9f3d","observation_id":"16b67387-aedb-418f-8253-770ac1cbd56b","resolution":{"observed_at":"2026-08-15T19:32:12.479997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07684","last_updated":"2021-09-16T03:08:22Z","snapshot_observed_at":"2026-08-16T17:56:15.611470Z","submitted_at":"2021-09-16T03:08:22Z","title":"Language Models are Few-shot Multilingual Learners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07684","snapshot_observed_at":"2026-08-15T19:32:11.897201Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.897201Z"},"links":{"cited_paper":"/paper/2109.07684","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:8ab8e10a4c6e9c781621663dc0b4f5c6297efbc8b1e02b6051479d6fbfac6496","observation_id":"c8528dc3-fd24-4c55-b71c-59104f85293d","resolution":{"observed_at":"2026-08-15T19:32:11.897201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.466400Z","title":null,"venue":null,"work_id":"a653656d-6017-4c0c-bded-b35cbf6d7c5b","year":2021},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.900846Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:0ff33629e95fd35692f7d234f416ad6e296ac4b7a6bab7a22ac5f3d5e74f4d10","observation_id":"6beb3cc3-8858-463f-bf87-87cbd5974b8b","resolution":{"observed_at":"2026-08-15T19:32:12.469671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12318","last_updated":"2024-10-14T17:58:05Z","snapshot_observed_at":"2026-08-19T05:51:32.710610Z","submitted_at":"2024-04-18T16:52:36Z","title":"Reuse Your Rewards: Reward Model Transfer for Zero-Shot Cross-Lingual Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12318","snapshot_observed_at":"2026-08-15T19:32:11.904336Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.904336Z"},"links":{"cited_paper":"/paper/2404.12318","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:ba73ba2395c6ab1c46310df8328ea3c0f3b3621d4899f6d78bd3db8e2bf854d1","observation_id":"fc650da2-924c-4975-8cd2-a1173017b9c9","resolution":{"observed_at":"2026-08-15T19:32:11.904336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10375","last_updated":"2023-05-03T14:43:50Z","snapshot_observed_at":"2026-08-16T16:07:15.963608Z","submitted_at":"2022-12-20T15:55:21Z","title":"Self-Adaptive In-Context Learning: An Information Compression Perspective for In-Context Example Selection and Ordering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10375","snapshot_observed_at":"2026-08-15T19:32:11.908338Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.908338Z"},"links":{"cited_paper":"/paper/2212.10375","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:b226cf02b81f1130e35476b9f2014f4089437aee84f67ef29b8f0fb08da0dd0d","observation_id":"d57f167d-420f-4b73-806a-c5f5bda41792","resolution":{"observed_at":"2026-08-15T19:32:11.908338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:12.454348Z","title":null,"venue":null,"work_id":"9edff1c8-f61f-4766-b287-f8ba6c754264","year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.912274Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:97f9862e94fa1b6b44dae57f326cba5b7e4a6d98b9f2f1f847f3c5c58e7e372d","observation_id":"10b108f2-63e6-4c68-baa4-656bc4565e5e","resolution":{"observed_at":"2026-08-15T19:32:12.458874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.915747Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.915747Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:083e7f8a296c165815d33e4f8cf46e4cb63018e2a72ce65a92f12ba291d53d2f","observation_id":"d3e71460-6e0b-4df9-8ef5-7f353d32021d","resolution":{"observed_at":"2026-08-15T19:32:11.915747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.13161","last_updated":"2022-05-04T22:41:50Z","snapshot_observed_at":"2026-08-16T18:00:06.567465Z","submitted_at":"2021-08-30T12:29:25Z","title":"Differentiable Prompt Makes Pre-trained Language Models Better Few-shot Learners","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.13161","snapshot_observed_at":"2026-08-15T19:32:11.919187Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.919187Z"},"links":{"cited_paper":"/paper/2108.13161","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:67a558039496239af437cbff08a8b6b3fee5039a60bb074609dc26821b164b24","observation_id":"504efef7-b724-427a-bff6-482a1560c6a0","resolution":{"observed_at":"2026-08-15T19:32:11.919187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04486","last_updated":"2022-11-08T19:00:02Z","snapshot_observed_at":"2026-08-17T18:43:15.618870Z","submitted_at":"2022-11-08T19:00:02Z","title":"Active Example Selection for In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.04486","snapshot_observed_at":"2026-08-15T19:32:11.922985Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.922985Z"},"links":{"cited_paper":"/paper/2211.04486","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:23d0e5b137872d5dc37c4624e9eeb2a75c5b05ed253792f847a9486adcc49c5c","observation_id":"1dcf989e-817f-420a-a622-4117afcf6bff","resolution":{"observed_at":"2026-08-15T19:32:11.922985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04497","last_updated":"2026-04-17T14:43:11Z","snapshot_observed_at":"2026-08-03T01:36:22.644152Z","submitted_at":"2024-11-30T00:10:56Z","title":"Opportunities and Challenges of Large Language Models for Low-Resource Languages in Humanities Research","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04497","snapshot_observed_at":"2026-08-15T19:32:11.926723Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.926723Z"},"links":{"cited_paper":"/paper/2412.04497","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:c92f54ec2b9a7b3bf29df7f1cdb2c440b7af87e335e15b0837cf8e78008fb9de","observation_id":"2683dc4b-873f-4de6-8fac-e818a743f3a0","resolution":{"observed_at":"2026-08-15T19:32:11.926723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-16T00:15:57.597094Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-15T19:32:11.930302Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.930302Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:87d6978f28623da77a95d7361a5dcdc2b9d0f52a533bce8f9817bccac398f64e","observation_id":"cf2f0f7c-5028-4232-b009-6214aaab78f1","resolution":{"observed_at":"2026-08-15T19:32:11.930302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.933750Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.933750Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:43664737b1d118d6b38fa8acf1f5214ae0655a27729c1a3a82eed2a3c42b79ae","observation_id":"03f41e15-8704-498f-a2b2-ccc175ed3402","resolution":{"observed_at":"2026-08-15T19:32:11.933750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:32:11.937637Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T19:32:11.937637Z"},"links":{"citing_paper":"/paper/2506.16502"},"observation_digest":"sha256:48dabc9086e93ee67ca36a39278c027abd532b8f172e4cef6e1f0cc6a34bff83","observation_id":"dabe6476-be01-4182-83c3-6c9aadae5779","resolution":{"observed_at":"2026-08-15T19:32:11.937637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16502","last_updated":"2025-06-19T17:56:16Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T18:24:07.102493Z","submitted_at":"2025-06-19T17:56:16Z","title":"Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 2 inbound Pith citation observations for arXiv:2506.16502."}