Pith. sign in

Paper Citation Record · LEDGER

Meta-Prompt Optimization for LLM-Based Sequential Decision Making

As of 10 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 2 inbound Pith citation observations for arXiv:2502.00728.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.00728 v1

Coverage vector

measured 28 of 28 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-09T18:00:22.243698Z

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-02T19:22:25.370012Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-20T19:08:53.951599Z

Reference resolution

28 of 28 outbound references displayed

  • verified exact1
  • verified fuzzy4
  • unresolved23
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation af21dd5b-02d6-43f6-8c9d-181a57701e23 · outbound

This paper cites A Survey on Data Selection for Language Models.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making A Survey on Data Selection for Language Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.119847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.119847Z digest=sha256:0c4e9d5d46b481652eb7e3dfbfb4f9fc02fd485227308028ad24d2d53489cc8a

Observation 462f690f-de3f-43a1-971b-d5307930b9d7 · outbound

This paper cites 3.2, there are two major differences compared to the way in which our EXPO algorithm optimizes the task description and meta-instruction (Algo.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making 3.2, there are two major differences compared to the way in which our EXPO algorithm optimizes the task description and meta-instruction (Algo

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T18:00:23.353314Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T18:00:22.224840Z digest=sha256:62f3595e430fa562a4aaff05732e88374f1507b653c3cee9e2aa1aa7226fd0c4

Observation 9359591a-19dd-43a1-b28f-42ead42bd4af · outbound

This paper cites Exploring Large Language Model based Intelligent Agents: Definitions, Methods, and Prospects.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Exploring Large Language Model based Intelligent Agents: Definitions, Methods, and Prospects

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.135311Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.135311Z digest=sha256:bc73b909dacd933016308d763d1356c816484ca8eba24271bb86647d3b71f6e8

Observation cd1a4c34-747c-4588-85a7-88626223d23c · outbound

This paper cites In-context Exploration-Exploitation for Reinforcement Learning.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making In-context Exploration-Exploitation for Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.140133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.140133Z digest=sha256:117f4d4c87eee4b0378cfcff4a953e26cad2ecb7b41032ebcdd9b3131a430759

Observation 654bebc2-e3da-48c5-a748-d3d4e50ee02e · outbound

This paper cites Ambiguity-Aware In-Context Learning with Large Language Models.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Ambiguity-Aware In-Context Learning with Large Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.150366Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.150366Z digest=sha256:033e91373783158637af564760c100b197a9247076f6ce1f01151198ca7455af

Observation 4eceadef-b432-4c94-af6d-1a2370874ca4 · outbound

This paper cites Task Facet Learning: A Structured Approach to Prompt Optimization.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Task Facet Learning: A Structured Approach to Prompt Optimization

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-09T18:00:23.182415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T18:00:22.154795Z digest=sha256:66fbc88bd5e2fa1f02af40ac1338fe11e1b3017cd92d62e949430e37063a6932

Observation c285bda6-aaf2-44ec-b807-bf17045ea1ae · outbound

This paper cites an unresolved cited work.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Unresolved cited work

Reference 9

Resolution
unresolved
raw_fallback, observed 2026-08-09T18:00:23.339018Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T18:00:22.229519Z digest=sha256:69d9906bc25986b2350500fb640cb4c87ec19a78f6d3d01277932095390ceb6a

Observation ff14cd29-9328-44eb-87b2-62ad0667ac1a · outbound

This paper cites Can large language models explore in-context?.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Can large language models explore in-context?

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.163766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.163766Z digest=sha256:253b82f24c80650ada74fc6bcef5be578883b540a242092971612f9b7cfbb4db

Observation fb9eb3b4-3c5e-4249-ae6f-3d199b64e5bb · outbound

This paper cites The texts we have modified are highlighted in red.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making The texts we have modified are highlighted in red

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T18:00:23.324953Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T18:00:22.233951Z digest=sha256:a725e39b16a84dbb339cc43f24e3a87e92be8875eca9a623207187436339ca23

Observation 9b2461c9-9827-4a92-aa5a-38452fb26acb · outbound

This paper cites AgentBench: Evaluating LLMs as Agents.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making AgentBench: Evaluating LLMs as Agents

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.173010Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.173010Z digest=sha256:93cc391759d16a0e20c5e274542b30c262c03cc48b9a8068f9bbb08607ec2ebd

Observation 6cc5a2ef-5aef-4f63-92dd-903ee2cf5cfc · outbound

This paper cites P., Xie, Q., and Nowak, R.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making P., Xie, Q., and Nowak, R

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.177654Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.177654Z digest=sha256:2dee56f17ece3c5fc575fac0db4049be6fa8c87d8e75f762b0694173ba339127

Observation 2fb9a376-1f31-46f4-8570-bf2bd42546a8 · outbound

This paper cites In-context Example Selection with Influences.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making In-context Example Selection with Influences

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.181850Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.181850Z digest=sha256:2200a322cd1429d0a9ba4e3355df6bb21e88eaaf356b6b8ff0f35e73b60f5dd6

Observation 5f5dde57-31f6-4e41-bdf7-e4b1d6d36c36 · outbound

This paper cites Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.186149Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.186149Z digest=sha256:549e23919e6a1cbf794883208f0b26ec322d1a2741f1396ea298d2acb3f6d229

Observation 784bf2ce-e540-4eed-957f-ceb6b1fe9cba · outbound

This paper cites Hyperband-based Bayesian Optimization for Black-box Prompt Selection.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Hyperband-based Bayesian Optimization for Black-box Prompt Selection

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.190454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.190454Z digest=sha256:5b8627bb8c94a7a0553617d968e06cf1c6a3adf4b31eb77538b7c16986e607ed

Observation 00c6afe2-3a42-4875-a0c0-26ca0322022e · outbound

This paper cites Efficient Prompt Optimization Through the Lens of Best Arm Identification.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Efficient Prompt Optimization Through the Lens of Best Arm Identification

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.194703Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.194703Z digest=sha256:a2eebc55139690d8df3f94550b72f7daca4b2b795e6f7cff957613892a82d9c3

Observation c0a90b81-627e-42c7-b363-c5761d2ae73b · outbound

This paper cites Transformers Can Learn Temporal Difference Methods for In-Context Reinforcement Learning.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Transformers Can Learn Temporal Difference Methods for In-Context Reinforcement Learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.203334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.203334Z digest=sha256:3d5df333e3dd21b1a1cdc0440a976d5a5526469e1a7f6c8b4a784056841dd34e

Observation ee64b18d-af2c-4530-8083-d969a5375018 · outbound

This paper cites The Rise and Potential of Large Language Model Based Agents: A Survey.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making The Rise and Potential of Large Language Model Based Agents: A Survey

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.207860Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.207860Z digest=sha256:fb305296b7dc39184ab11f21b3cb05af5bcc5b7d3347de26643a977e4cbc330c

Observation eed582d5-f821-472c-ad03-5c6ff4c80787 · outbound

This paper cites AgentGym: Evolving Large Language Model-based Agents across Diverse Environments.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making AgentGym: Evolving Large Language Model-based Agents across Diverse Environments

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.211991Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.211991Z digest=sha256:d979424195a781c292c07fb81e14ea2b64392b34d7c5ea927ce8c78631117ef5

Observation da3d5e68-d7d4-4ad2-89cb-67ae10560aa3 · outbound

This paper cites Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.216200Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.216200Z digest=sha256:6f4e2b7ece3799962eabac74d9c2581e1dedda0cf0b6f45c0a99e39a4e411c1c

Observation 7242a53b-f5cf-48fb-99d8-336053bdde34 · outbound

This paper cites Unlock- ing black-box prompt tuning efficiency via zeroth-order optimization.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Unlock- ing black-box prompt tuning efficiency via zeroth-order optimization

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T18:00:23.368742Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T18:00:22.220502Z digest=sha256:04ae9d651550952a301b78d883d92068ee3dd04c4c9344b70db843929fd05596

Observation 7b5e3e55-8000-4d4f-8427-1f81d90481f0 · outbound

This paper cites The different components in the prompt are explained in detail in App.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making The different components in the prompt are explained in detail in App

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T18:00:23.310890Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T18:00:22.238843Z digest=sha256:e0b7b4f1560e96b30160dcc064981896f08689a01596566b92887ac303a2e34f

Observation 754201a6-4ff8-495f-818b-5b3206d925dd · outbound

This paper cites an unresolved cited work.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-09T18:00:23.296169Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T18:00:22.243698Z digest=sha256:4a1441ea12915c440c15f24c60bf4373778a350ee74c981061f031c291d5a651

Observation 80a28cc4-8303-444d-b549-dfc0310ba3c0 · outbound

This paper cites PRewrite: Prompt Rewriting with Reinforcement Learning.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making PRewrite: Prompt Rewriting with Reinforcement Learning

Reference 1995

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.159425Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.159425Z digest=sha256:2ce3640668a7bf637b6234a151ba7f6e99d6667d54be4ae93833cb50e3bfe230

Observation 352d58f4-4954-4d01-9453-d9f5a2d16eba · outbound

This paper cites Teach Better or Show Smarter? On Instructions and Exemplars in Automatic Prompt Optimization.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Teach Better or Show Smarter? On Instructions and Exemplars in Automatic Prompt Optimization

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.199016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.199016Z digest=sha256:b250064678966ec376e2f4dbda21cae9f0538ac6ad8b05c2817de41aa666b15d

Observation a0f5423e-9fe3-47f0-8768-6d997c86d5ad · outbound

This paper cites Prompt Optimization with Human Feedback.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Prompt Optimization with Human Feedback

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.168152Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.168152Z digest=sha256:e078f869631dbaa75f5bf27313759faa8d31bc49f270a20f1e91dd82b119885f

Observation 2d270bcf-542e-4ff5-92df-397c10ffe41f · outbound

This paper cites Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.145044Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.145044Z digest=sha256:d98d51deb5d7f0540dc7bb752a336089da22e575e5aacff7db6d83bc56103183

Observation b52bdfb2-11c0-46d3-b3f9-7803b343a3a7 · outbound

This paper cites Efficient Sequential Decision Making with Large Language Models.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making Efficient Sequential Decision Making with Large Language Models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.125335Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.125335Z digest=sha256:a51bebedddffcf559b4328e67cc2758d450898d1946dc506112db6d27dc4c651

Observation 75df76e5-3748-4981-8f55-a211fb62f66d · outbound

This paper cites InstructZero: Efficient Instruction Optimization for Black-Box Large Language Models.

Meta-Prompt Optimization for LLM-Based Sequential Decision Making InstructZero: Efficient Instruction Optimization for Black-Box Large Language Models

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-09T18:00:22.130184Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T18:00:22.130184Z digest=sha256:1b4e941eb13d82c911641e534e9b1930f436fc72047ba9588f2ef0e4e4859d94

Pith citing papers

Observation 217ebc3a-46c6-4f14-ba92-3dc281c7eb16 · inbound

MASPOB: Bandit-Based Prompt Optimization for Multi-Agent Systems with Graph Neural Networks cites this paper.

MASPOB: Bandit-Based Prompt Optimization for Multi-Agent Systems with Graph Neural Networks Meta-Prompt Optimization for LLM-Based Sequential Decision Making

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T19:22:25.370012Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-02T19:22:25.370012Z digest=sha256:c85ca6ce173a187cab51664082fcb701659f42cdf0a4b78b14e14533d991edb2

Observation 3f2cfcd6-14b5-451b-b840-9da92574f633 · inbound

ALSO: Adversarial Online Strategy Optimization for Social Agents cites this paper.

ALSO: Adversarial Online Strategy Optimization for Social Agents Meta-Prompt Optimization for LLM-Based Sequential Decision Making

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-20T19:08:53.953119Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-20T19:08:46.636811Z digest=sha256:3c0064160c11f5b067288de42972d23ba53330da92f52f99ee71d995db5fd292