Pith. sign in

Paper Citation Record · LEDGER

Meta-Prompt Optimization for LLM-Based Sequential Decision Making

As of 15 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 2 inbound Pith citation observations for arXiv:2502.00728.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.00728 v1

Coverage vector

measured 28 of 28 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-09T18:00:22.243698Z

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T19:22:25.370012Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-20T19:08:53.951599Z

Reference resolution

28 of 28 outbound references displayed

  • verified exact1
  • verified fuzzy4
  • unresolved23
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation af21dd5b-02d6-43f6-8c9d-181a57701e23 · outbound

This paper cites A Survey on Data Selection for Language Models.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making A Survey on Data Selection for Language Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.119847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.119847Z digest=sha256:984b9c67e8fe4392a85650d05687d3bc9bf1df1171fec6a072d25f992a7429c7

Observation 462f690f-de3f-43a1-971b-d5307930b9d7 · outbound

This paper cites 3.2, there are two major differences compared to the way in which our EXPO algorithm optimizes the task description and meta-instruction (Algo.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making 3.2, there are two major differences compared to the way in which our EXPO algorithm optimizes the task description and meta-instruction (Algo

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T18:00:23.353314Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-09T18:00:22.224840Z digest=sha256:7fb911dbd612b2316e97d94082d992d1d8180c0736dca7d688b06db32a85c4ef

Observation 9359591a-19dd-43a1-b28f-42ead42bd4af · outbound

This paper cites Exploring Large Language Model based Intelligent Agents: Definitions, Methods, and Prospects.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Exploring Large Language Model based Intelligent Agents: Definitions, Methods, and Prospects

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.135311Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.135311Z digest=sha256:3e169af447063757ceec759e474e1cb1d11104c1f324610ad068a2d9c1368930

Observation cd1a4c34-747c-4588-85a7-88626223d23c · outbound

This paper cites In-context Exploration-Exploitation for Reinforcement Learning.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making In-context Exploration-Exploitation for Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.140133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.140133Z digest=sha256:ac4d41ec3b3f1a7afd01b02df29a270acef89ab9e73de1e345d3226f6b77a731

Observation 654bebc2-e3da-48c5-a748-d3d4e50ee02e · outbound

This paper cites Ambiguity-Aware In-Context Learning with Large Language Models.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Ambiguity-Aware In-Context Learning with Large Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.150366Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.150366Z digest=sha256:559f2afe1fa413a4513ef01649e512bdcffe992ba78697cdb6507998d6fe41ef

Observation 4eceadef-b432-4c94-af6d-1a2370874ca4 · outbound

This paper cites Task Facet Learning: A Structured Approach to Prompt Optimization.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Task Facet Learning: A Structured Approach to Prompt Optimization

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-09T18:00:23.182415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-09T18:00:22.154795Z digest=sha256:20741020ba42c1a620d8b6dcdc3c70d747d53cbbff5bb96055c812f453ba0309

Observation c285bda6-aaf2-44ec-b807-bf17045ea1ae · outbound

This paper cites an unresolved cited work.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-09T18:00:23.339018Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-09T18:00:22.229519Z digest=sha256:507b2eed6eb2d710ad7942d1d4661886c9959ee4e7af8004e76b3e7151341078

Observation ff14cd29-9328-44eb-87b2-62ad0667ac1a · outbound

This paper cites Can large language models explore in-context?.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Can large language models explore in-context?

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.163766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.163766Z digest=sha256:e0b8500b5b415c44056cdbabee8703e5cb3d997190c17e83ef631092f9065823

Observation fb9eb3b4-3c5e-4249-ae6f-3d199b64e5bb · outbound

This paper cites The texts we have modified are highlighted in red.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making The texts we have modified are highlighted in red

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T18:00:23.324953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-09T18:00:22.233951Z digest=sha256:fdc6c9a4d316b2d338134042bbd8144bfb7ff7698d132d37aede44278e64eb8a

Observation 9b2461c9-9827-4a92-aa5a-38452fb26acb · outbound

This paper cites AgentBench: Evaluating LLMs as Agents.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making AgentBench: Evaluating LLMs as Agents

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.173010Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.173010Z digest=sha256:c69722e0b0100c8619b97953120b0d083387d436edabdeecb3ade28d978ecfbd

Observation 6cc5a2ef-5aef-4f63-92dd-903ee2cf5cfc · outbound

This paper cites P., Xie, Q., and Nowak, R.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making P., Xie, Q., and Nowak, R

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.177654Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.177654Z digest=sha256:b9c5ac0bf0a36f6712f5f475dae97d2b69447d0f7518a1a953ac5bfd9be6add3

Observation 2fb9a376-1f31-46f4-8570-bf2bd42546a8 · outbound

This paper cites In-context Example Selection with Influences.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making In-context Example Selection with Influences

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.181850Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.181850Z digest=sha256:f95441c7262796e65926b2213d9f7387975996cde65103dfd280ed823900a28d

Observation 5f5dde57-31f6-4e41-bdf7-e4b1d6d36c36 · outbound

This paper cites Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.186149Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.186149Z digest=sha256:b68ee29767e755e539c7d1ad83f8de9c78075e40188424a2b1cd3e89488154de

Observation 784bf2ce-e540-4eed-957f-ceb6b1fe9cba · outbound

This paper cites Hyperband-based Bayesian Optimization for Black-box Prompt Selection.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Hyperband-based Bayesian Optimization for Black-box Prompt Selection

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.190454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.190454Z digest=sha256:3aac8afd24c5f83e2ff9b7b26032b9e54d21477fe613c75c8a9e5eff36f2b6b2

Observation 00c6afe2-3a42-4875-a0c0-26ca0322022e · outbound

This paper cites Efficient Prompt Optimization Through the Lens of Best Arm Identification.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Efficient Prompt Optimization Through the Lens of Best Arm Identification

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.194703Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.194703Z digest=sha256:afb93be182282c8c3e6829b8ea415ee43a18460a9ca1f30e47923d9f7c576eac

Observation c0a90b81-627e-42c7-b363-c5761d2ae73b · outbound

This paper cites Transformers Can Learn Temporal Difference Methods for In-Context Reinforcement Learning.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Transformers Can Learn Temporal Difference Methods for In-Context Reinforcement Learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.203334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.203334Z digest=sha256:f151d98b96058d385f80e6abc1261b98fe835b993206798dd5dc8706fac511dc

Observation ee64b18d-af2c-4530-8083-d969a5375018 · outbound

This paper cites The Rise and Potential of Large Language Model Based Agents: A Survey.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making The Rise and Potential of Large Language Model Based Agents: A Survey

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.207860Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.207860Z digest=sha256:4b13d26447fd5c3121d270f254d19839dec6c9adbd8ca51f92f32ad2f0613666

Observation eed582d5-f821-472c-ad03-5c6ff4c80787 · outbound

This paper cites AgentGym: Evolving Large Language Model-based Agents across Diverse Environments.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making AgentGym: Evolving Large Language Model-based Agents across Diverse Environments

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.211991Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.211991Z digest=sha256:8879a9860193bd7ee3c6439d34dd0a407b377331cce340d4c76239b4a0c5b7d6

Observation da3d5e68-d7d4-4ad2-89cb-67ae10560aa3 · outbound

This paper cites Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.216200Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.216200Z digest=sha256:f01147b8868593d4cf87ae9b909eb68358f3535e66688b9efae44ef3c5bc506d

Observation 7242a53b-f5cf-48fb-99d8-336053bdde34 · outbound

This paper cites Unlock- ing black-box prompt tuning efficiency via zeroth-order optimization.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Unlock- ing black-box prompt tuning efficiency via zeroth-order optimization

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T18:00:23.368742Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-09T18:00:22.220502Z digest=sha256:e8968817164e38eb89cad1254e71d6767a2c7681dff90b88747886f14cf3c778

Observation 7b5e3e55-8000-4d4f-8427-1f81d90481f0 · outbound

This paper cites The different components in the prompt are explained in detail in App.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making The different components in the prompt are explained in detail in App

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T18:00:23.310890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-09T18:00:22.238843Z digest=sha256:910d439df993fa5bddb0053ff310f7c8ee4dd900375c37bc7821abf9a1ec8f54

Observation 754201a6-4ff8-495f-818b-5b3206d925dd · outbound

This paper cites an unresolved cited work.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-09T18:00:23.296169Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-09T18:00:22.243698Z digest=sha256:779f9d3105110a142e40b322b437710ba3d13e06d95bd04a8aeeabbdce3cdb67

Observation 80a28cc4-8303-444d-b549-dfc0310ba3c0 · outbound

This paper cites PRewrite: Prompt Rewriting with Reinforcement Learning.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making PRewrite: Prompt Rewriting with Reinforcement Learning

Reference 1995

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.159425Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.159425Z digest=sha256:03f3248fd4de4fafeca444330a4cf1fd03e439f5b841b1ab7341ed8dd510d5b0

Observation 352d58f4-4954-4d01-9453-d9f5a2d16eba · outbound

This paper cites Teach Better or Show Smarter? On Instructions and Exemplars in Automatic Prompt Optimization.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Teach Better or Show Smarter? On Instructions and Exemplars in Automatic Prompt Optimization

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.199016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.199016Z digest=sha256:97b94634a03eed6ab335e2684c2dfffc453899dd34495e2e07bfb7f9f1644c62

Observation a0f5423e-9fe3-47f0-8768-6d997c86d5ad · outbound

This paper cites Prompt Optimization with Human Feedback.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Prompt Optimization with Human Feedback

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.168152Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.168152Z digest=sha256:be56a0edff638e23f07f29e95f44c5b2e531587d1b3593bc7a150d7209549e90

Observation 2d270bcf-542e-4ff5-92df-397c10ffe41f · outbound

This paper cites Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.145044Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.145044Z digest=sha256:82c3b37a42e7b1ba114cef79ed73790c5801068d32910bd0b9e07b53548d9d4b

Observation b52bdfb2-11c0-46d3-b3f9-7803b343a3a7 · outbound

This paper cites Efficient Sequential Decision Making with Large Language Models.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Efficient Sequential Decision Making with Large Language Models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.125335Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.125335Z digest=sha256:9224db9dd48cebceaa97a15ec50d754c1cdeb59a760528bb2f72cb0d7e971eda

Observation 75df76e5-3748-4981-8f55-a211fb62f66d · outbound

This paper cites InstructZero: Efficient Instruction Optimization for Black-Box Large Language Models.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making InstructZero: Efficient Instruction Optimization for Black-Box Large Language Models

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.130184Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.130184Z digest=sha256:e99066e4ed8e6fad6cf7fa2402900bb4d507da5c9276d1a94b1c3dd9a31d573f

Pith citing papers

Observation 217ebc3a-46c6-4f14-ba92-3dc281c7eb16 · inbound

MASPOB: Bandit-Based Prompt Optimization for Multi-Agent Systems with Graph Neural Networks cites this paper.

MASPOB: Bandit-Based Prompt Optimization for Multi-Agent Systems with Graph Neural Networks Meta-Prompt Optimization for LLM-Based Sequential Decision Making

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T19:22:25.370012Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-02T19:22:25.370012Z digest=sha256:5051b0d58757928e2dfb6bed4bb80155cc0a270ce063dfd675893e7d61da9b2f

Observation 3f2cfcd6-14b5-451b-b840-9da92574f633 · inbound

ALSO: Adversarial Online Strategy Optimization for Social Agents cites this paper.

ALSO: Adversarial Online Strategy Optimization for Social Agents Meta-Prompt Optimization for LLM-Based Sequential Decision Making

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-20T19:08:53.953119Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-20T19:08:46.636811Z digest=sha256:5e80cc128b94ef85091c5ad79e74ea67090dcabe22a0a6a3935d9f572ab3c943