Pith. sign in

Paper Citation Record · LEDGER

Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2307.16039.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2307.16039 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 15 of 15 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 15 of 15 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T21:05:12.709951Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-23T04:55:24.835950Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9adc86c2-8131-4a2c-ace1-61ac0989f332 · inbound

RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback cites this paper.

RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 80

Resolution
verified exact
arxiv_id, observed 2026-05-15T21:32:27.921382Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-05-15T21:32:27.806494Z digest=sha256:98cd8715d9e0756c92a2bffce3beb2ac14a839a4483c25d71ee4f4f6b96375b4

Observation dd7540e7-cb29-4bee-8b02-c108a7c09538 · inbound

Training Language Models to Self-Correct via Reinforcement Learning cites this paper.

Training Language Models to Self-Correct via Reinforcement Learning Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 83

Resolution
verified exact
arxiv_id, observed 2026-05-17T12:04:10.549704Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=arxiv_source observed=2026-05-17T12:04:10.210508Z digest=sha256:7c365a775e165209b2e11cb5efd1bb64b13cfb9ba32cf6e269db2797e13118f5

Observation 060b73f1-9848-4154-a328-ac2b062ff445 · inbound

AdaMCoT: Rethinking Cross-Lingual Factual Reasoning through Adaptive Multilingual Chain-of-Thought cites this paper.

AdaMCoT: Rethinking Cross-Lingual Factual Reasoning through Adaptive Multilingual Chain-of-Thought Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-23T04:55:24.839070Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-23T04:55:04.067483Z digest=sha256:6a235f2eddb7b9cf235e05353c49ed0aa62703b0c67e2ade4cefff70d3cdc419

Observation 79639639-7383-4b54-8398-8dc8b3d1ca3e · inbound

Task Vector Bases: A Unified and Scalable Framework for Compressed Task Arithmetic cites this paper.

Task Vector Bases: A Unified and Scalable Framework for Compressed Task Arithmetic Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 2009

Resolution
unresolved
no resolver link, observed 2026-08-09T17:01:02.168574Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T17:01:02.168574Z digest=sha256:026b6af62fc30f7395dc0bcffea7c109948c3f39553098f7312c10a71084b299

Observation a4406abb-3375-45dd-9899-f7c59ffc709f · inbound

GenKnowSub: Improving Modularity and Reusability of LLMs through General Knowledge Subtraction cites this paper.

GenKnowSub: Improving Modularity and Reusability of LLMs through General Knowledge Subtraction Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T21:04:55.469711Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T21:04:55.469711Z digest=sha256:e092d600c3c90e722c2f6f34662ff815180d3348bab2e7efacdb44757a258fdb

Observation 9fee93cf-f89e-4176-bb85-7f8223f0f1e8 · inbound

Semantic Aware Linear Transfer by Recycling Pre-trained Language Models for Cross-lingual Transfer cites this paper.

Semantic Aware Linear Transfer by Recycling Pre-trained Language Models for Cross-lingual Transfer Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-15T21:05:12.709951Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T21:05:12.709951Z digest=sha256:d8b8efb1d0d0f7445775eac0f8951a3694eabf20e20745c51c0c0e4b350626c2

Observation 18e7052e-52a3-43f1-a667-d4da8503d156 · inbound

The Multilingual Divide and Its Impact on Global AI Safety cites this paper.

The Multilingual Divide and Its Impact on Global AI Safety Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T13:40:17.094804Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:40:17.094804Z digest=sha256:b499c0f81d5f99a4b19dbb608bb0a03cb6ee6621b55b85b4a2fb93cbf29beaed

Observation fe79e325-7e55-4539-b120-e1ad3e1a14b9 · inbound

CausalAbstain: Enhancing Multilingual LLMs with Causal Reasoning for Trustworthy Abstention cites this paper.

CausalAbstain: Enhancing Multilingual LLMs with Causal Reasoning for Trustworthy Abstention Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T12:08:36.518758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:08:36.518758Z digest=sha256:bcc5e4ff1afaef266a7215c4fe335bd9010bca3dbf48a16cf56cd22a01d7b197

Observation e19d6b6d-5385-400d-8660-d5b87b42977a · inbound

The Emergence of Abstract Thought in Large Language Models Beyond Any Language cites this paper.

The Emergence of Abstract Thought in Large Language Models Beyond Any Language Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T04:43:41.874603Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T04:43:41.874603Z digest=sha256:7957aa40ef2bc3ffdd6b6db4d9c1c845ab651c411573b4f098e97f04c2df71d9

Observation 8ee3b8ed-aa0d-41e0-91be-f4186e87631a · inbound

FineWeb2: One Pipeline to Scale Them All -- Adapting Pre-Training Data Processing to Every Language cites this paper.

FineWeb2: One Pipeline to Scale Them All -- Adapting Pre-Training Data Processing to Every Language Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-06T22:46:39.239094Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T22:46:39.239094Z digest=sha256:7f90424e96b66a93881ac45eb49c27a6cd043cdcf4e32ba1f30ac45f533127a6

Observation 044a60ca-8786-4521-92db-f6a9ac95860f · inbound

Text2Cypher Across Languages: Evaluating and Finetuning LLMs cites this paper.

Text2Cypher Across Languages: Evaluating and Finetuning LLMs Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T22:28:15.984713Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:28:15.984713Z digest=sha256:aa717625edbd3b6c5f8e06c37d16f8d8ae1e47078d3aca5a7e3f109aa8d9863f

Observation 9f4be4c7-7d94-47bf-b8bf-a289c9cc45c2 · inbound

The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks cites this paper.

The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T18:19:59.432414Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T18:19:59.432414Z digest=sha256:8150544403a684ec012b49dbcd19e951498c07f5d2ee95050fa692f17f824e9b

Observation 18b34b9e-5ad8-43c2-b84c-b983a4f96d36 · inbound

Uncovering Cross-Linguistic Disparities in LLMs using Sparse Autoencoders cites this paper.

Uncovering Cross-Linguistic Disparities in LLMs using Sparse Autoencoders Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-15T18:12:07.499680Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T18:12:07.499680Z digest=sha256:36128b08d5055afe985391271d7789d026fa0d46e544d90bb862c84dd2ec558f

Observation bd3debf8-77b6-4a9f-a89c-07734bb1bd2a · inbound

Whose Truth? Pluralistic Geo-Alignment for (Agentic) AI cites this paper.

Whose Truth? Pluralistic Geo-Alignment for (Agentic) AI Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-05T23:23:32.490637Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T23:23:32.490637Z digest=sha256:1596497d47015f79620b8140d9942d1f7faed9c767bf2d9df0c6b4f2309e2e37

Observation 62ee54a1-3688-45e8-97f0-c9fe9286fb83 · inbound

TASE: Token Awareness and Structured Evaluation for Multilingual Language Models cites this paper.

TASE: Token Awareness and Structured Evaluation for Multilingual Language Models Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-05T23:21:23.366527Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T23:21:23.366527Z digest=sha256:6bd379c9ebfc3bd1e9c00a0c14995654a7e1b3e5edef67dfb32a456b4327bc32