{"as_of":"2026-08-18T20:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a3fbc0fe6375e5aaebbb714759ae57cb5214c21fd69ddb84456999673251606a","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:35:46.612050Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T01:22:24.750044Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T01:25:35.064596Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"cited_work":{"arxiv_id":"2507.18618","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18618","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the 2018 Conference on Empirical Methods in Natural Lan- guage Processing, pages 1797–1807","venue":null,"work_id":"1a4f78df-98f5-4bb1-ba1d-d3afd9e9c209","year":2018},"citing_paper":{"arxiv_id":"2511.01016","last_updated":"2026-04-16T11:22:56Z","snapshot_observed_at":"2026-08-17T00:54:01.548561Z","submitted_at":"2025-11-02T17:11:03Z","title":"Prompt-R1: Collaborative Automatic Prompting Framework via End-to-end Reinforcement Learning","version":9},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T01:22:24.750044Z"},"links":{"cited_paper":"/paper/2507.18618","citing_paper":"/paper/2511.01016"},"observation_digest":"sha256:6bab365587c29ff0c6ed377453e75d9c4c0325bb7953f6ce87217d94424b7a09","observation_id":"fe82830d-55f4-4d8a-89cf-0cab59cc8683","resolution":{"observed_at":"2026-05-18T01:25:35.067022Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18618/citation-record","integrity":"/paper/2507.18618/integrity","json":"/paper/2507.18618/citation-record.json","paper":"/paper/2507.18618"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.525111Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.525111Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:53213e3aea360a33427b9945554c6367f4df31a5ff47a20f481180fdf28c0846","observation_id":"6f33332a-0516-4f7d-9498-fa8e5bb0c015","resolution":{"observed_at":"2026-08-06T14:35:46.525111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T14:35:46.529756Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.529756Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:1045175bdaaa2d6e885d518f06911e4508161d69355ac03a1808628bead5cbe7","observation_id":"6296edb4-af6d-4e32-ab5b-1ad97188e58c","resolution":{"observed_at":"2026-08-06T14:35:46.529756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12548","last_updated":"2022-10-22T15:21:46Z","snapshot_observed_at":"2026-08-16T16:57:50.526540Z","submitted_at":"2022-05-25T07:50:31Z","title":"RLPrompt: Optimizing Discrete Text Prompts with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12548","snapshot_observed_at":"2026-08-06T14:35:46.534226Z","title":"Rlprompt: Optimizing discrete text prompts with reinforce- ment learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.534226Z"},"links":{"cited_paper":"/paper/2205.12548","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:0475e905873c564f2d453354ca39e53da8c0bdd9438c55ba70cecbf4f719f6a5","observation_id":"8344a737-9e84-4b6f-b48d-f63975534ed0","resolution":{"observed_at":"2026-08-06T14:35:46.534226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10435","last_updated":"2023-01-27T15:30:27Z","snapshot_observed_at":"2026-08-12T07:50:34.802331Z","submitted_at":"2022-11-18T18:56:13Z","title":"PAL: Program-aided Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10435","snapshot_observed_at":"2026-08-06T14:35:46.538854Z","title":"Pal: Program-aided language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.538854Z"},"links":{"cited_paper":"/paper/2211.10435","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:6d4aa79c557be9490929df975bc993caaa9881e42b1b34e5c7a2ee4141f0274e","observation_id":"76266c98-a71b-4ed2-9484-b401b7d2576b","resolution":{"observed_at":"2026-08-06T14:35:46.538854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.543097Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.543097Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:b90e6e9aa12725a8a9c932f28fb4fed7ee017eeaf4349bc5ba8f0e526206e1d1","observation_id":"a3c4b92e-6ada-4f3c-8db2-0c3ed141a70a","resolution":{"observed_at":"2026-08-06T14:35:46.543097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.547654Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.547654Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:6f90dba7da13608f088a1816816431c9a91ca6d60333d84254cc119e3d5578e5","observation_id":"83dd4e17-26f4-4e34-bd3d-eedec8a5a4a3","resolution":{"observed_at":"2026-08-06T14:35:46.547654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10504","last_updated":"2025-05-30T09:21:31Z","snapshot_observed_at":"2026-08-16T13:25:20.945944Z","submitted_at":"2024-08-20T03:06:48Z","title":"QPO: Query-dependent Prompt Optimization via Multi-Loop Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10504","snapshot_observed_at":"2026-08-06T14:35:46.552148Z","title":"Qpo: Query-dependent prompt optimization via multi-loop offline reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.552148Z"},"links":{"cited_paper":"/paper/2408.10504","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:990213a03d6da58735bef2d1adb27412faf6b926e8f84281e5f1261429f7326b","observation_id":"f5cbbbc3-0e24-4f63-b75c-615f955499db","resolution":{"observed_at":"2026-08-06T14:35:46.552148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19255","last_updated":"2024-07-02T03:46:03Z","snapshot_observed_at":"2026-08-18T20:34:01.378931Z","submitted_at":"2024-02-29T15:26:14Z","title":"GSM-Plus: A Comprehensive Benchmark for Evaluating the Robustness of LLMs as Mathematical Problem Solvers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19255","snapshot_observed_at":"2026-08-06T14:35:46.556756Z","title":"Gsm-plus: A comprehen- sive benchmark for evaluating the robustness of llms as mathematical problem solvers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.556756Z"},"links":{"cited_paper":"/paper/2402.19255","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:fe1cafd0e9fc769d18f9b08c6d833ee12efe904063ea1f67fd84b530a0bcf247","observation_id":"ec94d46f-565c-4263-ad3a-7b9b41f0a9cb","resolution":{"observed_at":"2026-08-06T14:35:46.556756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12895","last_updated":"2025-01-22T14:15:46Z","snapshot_observed_at":"2026-08-16T10:01:11.090552Z","submitted_at":"2025-01-22T14:15:46Z","title":"Test-Time Preference Optimization: On-the-Fly Alignment via Iterative Textual Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12895","snapshot_observed_at":"2026-08-06T14:35:46.561276Z","title":"Test-time preference optimization: On-the-fly alignment via iterative textual feedback","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.561276Z"},"links":{"cited_paper":"/paper/2501.12895","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:256f90a011d43ba5c8d63cf34006c8f526b8c519a07eccbce80074009390edaa","observation_id":"37df1f07-04c0-4273-a16f-c936b5f43567","resolution":{"observed_at":"2026-08-06T14:35:46.561276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.853553Z","title":"Guiding large language models via directional stimulus prompting","venue":null,"work_id":"dcca254f-eafd-4ea1-9e66-2107e39d75cb","year":2024},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.565344Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:b8a1191258c995869602ebd0949911a2c85057a81ffc48ea7a5b03e7be3e435e","observation_id":"0403aedc-c0ea-4daa-b1ea-898a546205aa","resolution":{"observed_at":"2026-08-06T14:35:46.857731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.840777Z","title":"Large language models as evolutionary optimizers","venue":null,"work_id":"1c05ab77-9918-4cc8-b06a-4f9d3c642e62","year":2024},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.568951Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:054fed9a93b96ba5f13babb6e25fc506cfb51562f8d1e181fcad999e4ac85b0c","observation_id":"d352ddc5-1a6c-4c75-821f-74b79dfd677d","resolution":{"observed_at":"2026-08-06T14:35:46.845124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T14:35:46.572930Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.572930Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:b24e4cbfdcbda46f2dd8b4bdad1fd6b3204049c8bdf4668f9685ce334f4b519f","observation_id":"d7fce49b-7cf9-4e1d-9e00-d29ba594963f","resolution":{"observed_at":"2026-08-06T14:35:46.572930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.576923Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.576923Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:70a686b1c6b8e8bce8ea82a61347f1e92de7101f467b8443513b461c0c8082ef","observation_id":"4071650e-385f-4f46-81e5-67f3bcb6e6a5","resolution":{"observed_at":"2026-08-06T14:35:46.576923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03495","last_updated":"2023-10-19T04:37:25Z","snapshot_observed_at":"2026-08-16T15:35:36.835145Z","submitted_at":"2023-05-04T15:15:22Z","title":"Automatic Prompt Optimization with \"Gradient Descent\" and Beam Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03495","snapshot_observed_at":"2026-08-06T14:35:46.580669Z","title":"gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.580669Z"},"links":{"cited_paper":"/paper/2305.03495","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:b46db974492b81d466cabe32f45d949cb026e88b33c48c1270edbe265c66e2ff","observation_id":"35e7ddcc-6812-40fe-ac18-ea223bc4bb2e","resolution":{"observed_at":"2026-08-06T14:35:46.580669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07867","last_updated":"2024-04-26T16:41:55Z","snapshot_observed_at":"2026-08-16T15:55:05.167686Z","submitted_at":"2023-02-15T18:59:21Z","title":"Learning Performance-Improving Code Edits","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07867","snapshot_observed_at":"2026-08-06T14:35:46.584738Z","title":"Learning performance-improving code edits","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.584738Z"},"links":{"cited_paper":"/paper/2302.07867","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:d701512ef22883f3e99b75661f7ee33e4ccbe5879c22bd58d70feee2a659f3db","observation_id":"b668c31b-1d49-4d8d-b04a-1f26549da0f2","resolution":{"observed_at":"2026-08-06T14:35:46.584738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.819850Z","title":"Query-dependent prompt evaluation and optimization with offline inverse rl","venue":null,"work_id":"ab77fe6e-83d8-41f1-8347-a304670ea62f","year":2023},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.588697Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:1d6a0910b314a21ffb9cba54e63fae304d38f1c9d86608297563a712f3d29ad3","observation_id":"dc10323f-8216-4edc-b237-cf8e162669af","resolution":{"observed_at":"2026-08-06T14:35:46.824655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.592339Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.592339Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:21d341c710ebe502ea20e12b8eba68c1e598cb8b3b2e2d344a58333afc1859c6","observation_id":"7f9cf577-3ccb-44e6-bf91-2d2d88ea5050","resolution":{"observed_at":"2026-08-06T14:35:46.592339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20850","last_updated":"2024-10-18T15:43:02Z","snapshot_observed_at":"2026-08-17T08:48:24.090826Z","submitted_at":"2024-05-31T14:33:07Z","title":"Improving Reward Models with Synthetic Critiques","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20850","snapshot_observed_at":"2026-08-06T14:35:46.596042Z","title":"Improving reward models with synthetic critiques","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.596042Z"},"links":{"cited_paper":"/paper/2405.20850","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:374f6fa3762c2e4ca622195f05cf6bf325fc915cd191ecd0eb9fc9b9e7ec01fd","observation_id":"666e019f-72e8-4a95-9c53-e87a7e1cefd1","resolution":{"observed_at":"2026-08-06T14:35:46.596042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-08-13T02:15:58.634561Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-08-06T14:35:46.600036Z","title":"differentiation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.600036Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:821969f3c46b012ad4b7e2e42d2a5681320beb45b5a0e0cb3da7d8bd21bcfc4c","observation_id":"fb151b7c-ce8a-4e0c-81c6-e9f2a5de8ffe","resolution":{"observed_at":"2026-08-06T14:35:46.600036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:35:46.798482Z","title":"Gonzalez","venue":null,"work_id":"051a7a8c-9ac6-4a5f-8809-767acf8a22fb","year":2023},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.604373Z"},"links":{"citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:200d1eba1d44715a8ae5f9b3ffe2caaf3c4dd68d4ff6ffe626e70ab999917a0d","observation_id":"0f7d78b6-fc10-43ad-8ed1-9ccd5a3510d3","resolution":{"observed_at":"2026-08-06T14:35:46.803447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11890","last_updated":"2022-11-21T22:38:20Z","snapshot_observed_at":"2026-08-16T16:14:22.650884Z","submitted_at":"2022-11-21T22:38:20Z","title":"TEMPERA: Test-Time Prompting via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11890","snapshot_observed_at":"2026-08-06T14:35:46.608164Z","title":"Tempera: Test-time prompting via reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.608164Z"},"links":{"cited_paper":"/paper/2211.11890","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:c69d453c18cc2cb332f1f597828ca9cebd1dbfd1312bacba3c1a99f065af8cb8","observation_id":"54b1263a-dcb4-4797-ad2b-1c9f11c2f0fb","resolution":{"observed_at":"2026-08-06T14:35:46.608164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01910","last_updated":"2023-03-10T17:20:17Z","snapshot_observed_at":"2026-08-17T11:53:58.758448Z","submitted_at":"2022-11-03T15:43:03Z","title":"Large Language Models Are Human-Level Prompt Engineers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01910","snapshot_observed_at":"2026-08-06T14:35:46.612050Z","title":"Large language models are human-level prompt engineers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:35:46.612050Z"},"links":{"cited_paper":"/paper/2211.01910","citing_paper":"/paper/2507.18618"},"observation_digest":"sha256:aef7db0495826922c88b10259404e013699178d4d0814af00068690e083aa034","observation_id":"afce6f4e-457e-43e1-9b3d-ed5e6664f6d0","resolution":{"observed_at":"2026-08-06T14:35:46.612050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18618","last_updated":"2025-07-24T17:54:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T11:55:01.508052Z","submitted_at":"2025-07-24T17:54:44Z","title":"TRPrompt: Bootstrapping Query-Aware Prompt Optimization from Textual Rewards"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 1 inbound Pith citation observation for arXiv:2507.18618."}