{"as_of":"2026-08-17T17:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:632fd258477e8b15de925f24445353e56258189aff6f12c292a7ee9eec556385","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:49:43.670451Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.11893/citation-record","integrity":"/paper/2505.11893/integrity","json":"/paper/2505.11893/citation-record.json","paper":"/paper/2505.11893"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.11816","last_updated":"2023-11-13T18:51:42Z","snapshot_observed_at":"2026-08-16T15:22:26.423595Z","submitted_at":"2023-06-20T18:19:17Z","title":"Learning to Generate Better Than Your LLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11816","snapshot_observed_at":"2026-08-15T20:49:43.450112Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.450112Z"},"links":{"cited_paper":"/paper/2306.11816","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:eefcb8fe9aa39276fc15137a1789e840b4fb0622ce24f7e8555a17b1efd02019","observation_id":"b40c543e-ba42-467b-9851-d81df6e02063","resolution":{"observed_at":"2026-08-15T20:49:43.450112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.271280Z","title":null,"venue":null,"work_id":"07ae40c6-799c-4b1e-8191-b0b4969db547","year":2021},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.455177Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:d3f6e02c88a7675d9262c3d54690945e4c1beec573ee7aab5b13ca911a6f5967","observation_id":"604c96a7-ac73-40d3-9cbd-fd423f5a0824","resolution":{"observed_at":"2026-08-15T20:49:44.274784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.459473Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.459473Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:81621a9c52b073da56ade29d222793179991f4d806efbb22da51d5f9b60e6aae","observation_id":"0c52e878-6c4b-4f32-bb44-54c31c056928","resolution":{"observed_at":"2026-08-15T20:49:43.459473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.260492Z","title":null,"venue":null,"work_id":"3e743637-ced5-489c-aca8-b1a4ab1793a5","year":2020},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.463746Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:0d3f0d989e7a579980463c133f3c339fbfce65e542d7f2c87404caab31c79273","observation_id":"81422fb1-5e71-4b05-8239-aa91b628ce9e","resolution":{"observed_at":"2026-08-15T20:49:44.264007Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06391","last_updated":"2023-08-11T21:17:13Z","snapshot_observed_at":"2026-08-16T15:09:00.860043Z","submitted_at":"2023-08-11T21:17:13Z","title":"Dynamic Planning with a LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06391","snapshot_observed_at":"2026-08-15T20:49:43.468230Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.468230Z"},"links":{"cited_paper":"/paper/2308.06391","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:d9217646e64bfdd8350dfd5cf9a010d1e09de294b9c6cbde23ce978fbdc66f0a","observation_id":"5e870033-86ab-4a7f-9e8a-a7bf7a7badef","resolution":{"observed_at":"2026-08-15T20:49:43.468230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-15T20:49:43.473333Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.473333Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:c401b53982ff01ce0ba0341f002e959773bc323623fb9a5445085f57e1bae986","observation_id":"11749062-7b5c-4dfd-915b-d1662b688975","resolution":{"observed_at":"2026-08-15T20:49:43.473333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.249190Z","title":null,"venue":null,"work_id":"e0540412-7eec-4191-b8a4-935579a1c870","year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.478393Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:c770dade86487965dfda79bc76c34a17d46cd65d1ad203987cf4575ebf91537e","observation_id":"51bf1130-af0c-4c31-bbe5-d50736a19a1c","resolution":{"observed_at":"2026-08-15T20:49:44.253019Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.236738Z","title":null,"venue":null,"work_id":"ff70155d-2a04-4875-82c3-a460376997b4","year":null},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.482200Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:07e001c95e836e4d346e17e9300a2a752c2a14b51a6d5efddfbc2fe347893764","observation_id":"eeb88a65-7995-4357-9dad-a88189a72020","resolution":{"observed_at":"2026-08-15T20:49:44.241495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11455","last_updated":"2024-08-29T14:48:10Z","snapshot_observed_at":"2026-08-16T20:34:17.224205Z","submitted_at":"2024-06-17T12:11:01Z","title":"Adaptive Reinforcement Learning Planning: Harnessing Large Language Models for Complex Information Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11455","snapshot_observed_at":"2026-08-15T20:49:43.491623Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.491623Z"},"links":{"cited_paper":"/paper/2406.11455","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:6605a6434480a9b057dc40e57f1de4d67261bc9fe079df77392fd44d9792e2a7","observation_id":"7289a02e-d1e4-4372-a09b-8392a7a51c0a","resolution":{"observed_at":"2026-08-15T20:49:43.491623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18638","last_updated":"2024-04-29T12:16:08Z","snapshot_observed_at":"2026-08-16T13:57:00.223456Z","submitted_at":"2024-04-29T12:16:08Z","title":"Reinforcement Learning Problem Solving with Large Language Models","version":1},"cited_work":{"arxiv_id":"2404.18638","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.18638","snapshot_observed_at":"2026-08-15T20:49:43.905059Z","title":"Reinforcement Learning Problem Solving with Large Language Models","venue":"cs.AI","work_id":"b9567f89-8307-4571-aecc-80906226a38f","year":2024},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.496302Z"},"links":{"cited_paper":"/paper/2404.18638","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:7ab164984abe327a92f26db296835634caf69c4738a05eaba6b7ed5a227db283","observation_id":"ab65e4b4-36d9-4446-b23a-0e6a0b0c6ad2","resolution":{"observed_at":"2026-08-15T20:49:43.912278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.02247","last_updated":"2017-02-27T21:48:25Z","snapshot_observed_at":"2026-08-14T21:31:32.986173Z","submitted_at":"2016-11-07T20:09:16Z","title":"Q-Prop: Sample-Efficient Policy Gradient with An Off-Policy Critic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.02247","snapshot_observed_at":"2026-08-15T20:49:43.501514Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.501514Z"},"links":{"cited_paper":"/paper/1611.02247","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:5e247195b382bd60058034da233209aad160dce5b94402f66f41f506a1947216","observation_id":"6a47a5a6-8a70-41f6-9163-a4b38df6ad2b","resolution":{"observed_at":"2026-08-15T20:49:43.501514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.213813Z","title":null,"venue":null,"work_id":"dd6fdff4-fc5c-4731-918c-d2e35861b69f","year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.505807Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:1a75b29a6c0759f86160f7384f2ba491a5063949c8386ed5e8531136f1514e4f","observation_id":"d9967bb1-2b49-4800-b9f2-1efd1d7bd3de","resolution":{"observed_at":"2026-08-15T20:49:44.217500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.202720Z","title":null,"venue":null,"work_id":"0d338c49-9519-4d1f-aa2c-c9d6a32251d2","year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.509561Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:625df4e60d9f66a52c60d7c6df80823c4808acdb006e7636323ad62537ac823e","observation_id":"f53c2113-2ad1-4aa9-9c6b-fab62ae13a2c","resolution":{"observed_at":"2026-08-15T20:49:44.206532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12753","last_updated":"2024-09-26T09:17:10Z","snapshot_observed_at":"2026-08-16T13:59:30.982764Z","submitted_at":"2024-04-19T09:59:44Z","title":"AutoScraper: A Progressive Understanding Web Agent for Web Scraper Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12753","snapshot_observed_at":"2026-08-15T20:49:43.513087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.513087Z"},"links":{"cited_paper":"/paper/2404.12753","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:35c5e548d022301a06c23d7f23833294e3d172cf21ddb412c7c9dbc88ff4670b","observation_id":"1a8fc7d3-bd56-4d3c-9b0a-7cbc97e4a2a4","resolution":{"observed_at":"2026-08-15T20:49:43.513087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-08-17T09:42:08.942018Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-15T20:49:43.517127Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.517127Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:6da7b97c6a9af3052e30232060cba2feafe91072fd1de19bc05cb52000e6c6f7","observation_id":"63225803-fe72-4d22-ac36-8d73dd8580cc","resolution":{"observed_at":"2026-08-15T20:49:43.517127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.191782Z","title":null,"venue":null,"work_id":"28a73d72-894f-461b-9a0e-ea18c15bd232","year":2018},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.521019Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:fb6ad68974b5ec0214355708943f66761f68653040191b6f66247992f0a085ba","observation_id":"6f923aff-fd79-4810-88ec-df1c35318508","resolution":{"observed_at":"2026-08-15T20:49:44.195220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.181583Z","title":null,"venue":null,"work_id":"0b9cbbb0-2be4-4c01-85bb-b7cdcd8fecca","year":2021},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.524530Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:3ff688c0cf2624ab771af7b018a0f8f92c0e9e2a69b6aed16785a2e2b70f16c8","observation_id":"d7531ba6-29fd-4d55-b048-fc41b190b330","resolution":{"observed_at":"2026-08-15T20:49:44.184988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04683","last_updated":"2017-12-05T19:36:03Z","snapshot_observed_at":"2026-08-17T04:35:11.747367Z","submitted_at":"2017-04-15T19:31:41Z","title":"RACE: Large-scale ReAding Comprehension Dataset From Examinations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04683","snapshot_observed_at":"2026-08-15T20:49:43.528196Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.528196Z"},"links":{"cited_paper":"/paper/1704.04683","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:31cfed1de7836c5e294c818dbe84ad06e1158f84443075e7682ecdfaeb937df7","observation_id":"f6224a7d-274a-47ae-a87a-3605cb1d3138","resolution":{"observed_at":"2026-08-15T20:49:43.528196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.532258Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.532258Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:4171c300be13405735fe4f36b7d79c5d5b90fd46790cc1f7340eb42cc2d003b8","observation_id":"ecf48417-4807-46e3-87f4-b548f8bdae79","resolution":{"observed_at":"2026-08-15T20:49:43.532258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.540160Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.540160Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:92cd35e9162d1e508b445dae6897358891b0e1b5dacb2c1f858f4e81cc28163b","observation_id":"be01e576-cec5-45dd-af94-6ced6474edc7","resolution":{"observed_at":"2026-08-15T20:49:43.540160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11477","last_updated":"2023-09-27T07:29:44Z","snapshot_observed_at":"2026-08-12T21:21:48.006892Z","submitted_at":"2023-04-22T20:34:03Z","title":"LLM+P: Empowering Large Language Models with Optimal Planning Proficiency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11477","snapshot_observed_at":"2026-08-15T20:49:43.543617Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.543617Z"},"links":{"cited_paper":"/paper/2304.11477","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:79b451b9fe35a854b480138db3b6258dc4889cff59341e526ff8c8c7284fe332","observation_id":"3ab26e23-a256-40d8-b7a8-66156380ab95","resolution":{"observed_at":"2026-08-15T20:49:43.543617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.143517Z","title":null,"venue":null,"work_id":"bf251323-dd10-4167-9db5-2986d7bb6b2c","year":2024},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.547757Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:11161afe8f41052c0afc6c3f63353bd77dddaaf4d08cdc3512d7c368719f0e9d","observation_id":"2ced2633-8ff0-491b-a32f-1ab4a2bbc229","resolution":{"observed_at":"2026-08-15T20:49:44.149063Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-08-16T00:12:56.001802Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-15T20:49:43.551397Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.551397Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:2cb3e11a37a2868369421948fff3d0244b6ec522144c34c317bf3bd697e8b2c0","observation_id":"2a6b0e02-a781-4fde-be55-440fb242d701","resolution":{"observed_at":"2026-08-15T20:49:43.551397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-15T20:49:43.555423Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.555423Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:595c1a09deac0bbce27219ba0d3938ea1403ed07e94ba4892f17ad01520c0cf4","observation_id":"0485ccc7-efb1-4d3a-8639-33cb7803e3e3","resolution":{"observed_at":"2026-08-15T20:49:43.555423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.559535Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.559535Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:15db35d4f7c1d475a233d3c42e0d777a777c97e99bb2e83c8af24f1049ed26fa","observation_id":"0fc46e1c-8bd3-40e2-8ad3-8781e8c5b971","resolution":{"observed_at":"2026-08-15T20:49:43.559535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T20:49:43.563171Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.563171Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:a66eb5c0bed5ffc93c6807693771816f106fcd00fe3a9e3496a023f1139c9588","observation_id":"1ea8e5d9-abfb-48cb-9400-04054320cad1","resolution":{"observed_at":"2026-08-15T20:49:43.563171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.123435Z","title":null,"venue":null,"work_id":"0b174ebb-e5d4-460a-84a1-1bfaaead09fc","year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.567540Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:3d4d673189b0ca009aff7f41997729b7c6e6a7a3d84bee9273daacba39a1c3d1","observation_id":"9375a8ed-21f1-44cd-b1ff-0472919e86d4","resolution":{"observed_at":"2026-08-15T20:49:44.127428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.111204Z","title":null,"venue":null,"work_id":"5bfdd966-2cb7-41ce-839b-b186ae0b5514","year":2018},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.573098Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:788ba1b1f8be418dbef9e3cbd54571e0826f0f4f8fd5d939b0ad7ccda3aea665","observation_id":"f71232f8-5768-4db6-8e3a-6a6122e8c605","resolution":{"observed_at":"2026-08-15T20:49:44.114879Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.099652Z","title":null,"venue":null,"work_id":"4c6eff85-5f97-4647-887d-c7fe50742d2a","year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.577320Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:bc0f0995fb940ea2969a6531ef117d7b4e007c4468900a99aa26ddd3d05f3d2f","observation_id":"a26e5c67-b142-4a5f-9867-8ddf5f26c69d","resolution":{"observed_at":"2026-08-15T20:49:44.103439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.087705Z","title":null,"venue":null,"work_id":"b26c7683-8e8f-48b0-aed6-fa6e622b86ca","year":2018},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.581285Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:dc459c602d33f143f5314970264f5c19e96e9149b1f3537e7084991492152dcf","observation_id":"fd644ff7-bd1b-4ac8-a721-3788bcdf106b","resolution":{"observed_at":"2026-08-15T20:49:44.092315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.076044Z","title":null,"venue":null,"work_id":"5c3fc387-f9de-4789-996b-9389b7c2431c","year":2010},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.586013Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:1cefff994a3062ae66e0f997c13c0ecdd09dd3baba3bda228fac4f81982fa773","observation_id":"42d1acf7-9917-4857-a1fa-1f82e1516790","resolution":{"observed_at":"2026-08-15T20:49:44.079694Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.065406Z","title":null,"venue":null,"work_id":"132b9680-baa7-41d7-9264-e1189677f0fc","year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.589636Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:8294fe780363e8ebace390c4a4bf37f2f4b9522b2e9de74ca4fdacc092baf4d2","observation_id":"5c28cbd2-36cc-4510-9f57-8b036f021db1","resolution":{"observed_at":"2026-08-15T20:49:44.068922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.593639Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.593639Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:88d7975cbceb632bd1161b0eef71faae04c6a79c8d0d7af4cfcc1530fb9ff9d8","observation_id":"4e48e1f2-5c50-478d-ae92-e701d8145191","resolution":{"observed_at":"2026-08-15T20:49:43.593639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.047697Z","title":null,"venue":null,"work_id":"9c4ab42b-228d-4195-90f6-f0060e700579","year":2020},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.597297Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:6514e50d728bac1ad01358429ac03645b1b0952194f2078fb59f970ac5188377","observation_id":"df2ee14e-4adb-40f3-adb2-b7e918f4a035","resolution":{"observed_at":"2026-08-15T20:49:44.051337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T20:49:43.601166Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.601166Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:0bd4e3fd4197d46d4bc3279e759e95ff1f494161e31d719f882b03204b5f0dec","observation_id":"ea9f02bc-f229-457f-b650-074758dd88c5","resolution":{"observed_at":"2026-08-15T20:49:43.601166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.605111Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.605111Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:2312041085dde15c44191baebcf8b16b996588a2dafd0f2c2f364ee3e09595a8","observation_id":"163cf2a0-3e7d-4a02-93d5-9127b736fb34","resolution":{"observed_at":"2026-08-15T20:49:43.605111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.029946Z","title":null,"venue":null,"work_id":"0671b545-90bc-4341-8ab8-43aed777deaf","year":2018},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.608826Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:b0a88ba6423dc3c1f83ac93891a104ad74f38c76612c57c671f23784e627c5f7","observation_id":"ad48a6ab-4c21-4e6f-9ee0-2038bdaaec52","resolution":{"observed_at":"2026-08-15T20:49:44.033669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.613141Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.613141Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:26c3b29690b31bb3999448298837ca5a00afc182857d181fb8081fb99f5f6447","observation_id":"8a30836e-610d-4722-9f25-fed679dc4037","resolution":{"observed_at":"2026-08-15T20:49:43.613141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10205","last_updated":"2024-05-27T07:08:31Z","snapshot_observed_at":"2026-08-16T15:54:08.108332Z","submitted_at":"2023-02-20T12:57:12Z","title":"ChatIE: Zero-Shot Information Extraction via Chatting with ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10205","snapshot_observed_at":"2026-08-15T20:49:43.617892Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.617892Z"},"links":{"cited_paper":"/paper/2302.10205","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:160ccd978cbdf2b7f87a57aff6454b4918b28a668ba4dc5a785dab59c6f6dcc3","observation_id":"59383e0e-fa48-4c4f-95f3-791984039dab","resolution":{"observed_at":"2026-08-15T20:49:43.617892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.011347Z","title":null,"venue":null,"work_id":"d78bc975-39fa-481c-a23e-8864c836dbd2","year":2018},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.621839Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:165c88f2bfe0724364a0d348ab63e69499f7dfcb06bc2e1f3adec3258dbb4252","observation_id":"0c3c9289-230d-4480-941a-88a652269a25","resolution":{"observed_at":"2026-08-15T20:49:44.015037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-long.277","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.998361Z","title":null,"venue":null,"work_id":"2339c62b-f299-4821-a755-35c116af3bad","year":2021},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.625544Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:81ba05116e8e5c54c5bede86bd56aca1c1e303c0893256a44fdf54726a3a9115","observation_id":"b76696da-4c79-4a80-95d0-cece83cb2fc4","resolution":{"observed_at":"2026-08-15T20:49:44.002683Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01622","last_updated":"2024-10-23T15:02:57Z","snapshot_observed_at":"2026-08-16T14:22:02.195673Z","submitted_at":"2024-02-02T18:39:51Z","title":"TravelPlanner: A Benchmark for Real-World Planning with Language Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01622","snapshot_observed_at":"2026-08-15T20:49:43.629393Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.629393Z"},"links":{"cited_paper":"/paper/2402.01622","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:1622b9169d47cfe4c82c00a18a89b449477e2071a1a61413a65cc4f04c9352dc","observation_id":"c154d195-e624-463a-82d2-91ef604b4cbd","resolution":{"observed_at":"2026-08-15T20:49:43.629393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15383","last_updated":"2025-01-26T03:47:25Z","snapshot_observed_at":"2026-08-17T05:35:17.658314Z","submitted_at":"2025-01-26T03:47:25Z","title":"Qwen2.5-1M Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15383","snapshot_observed_at":"2026-08-15T20:49:43.633606Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.633606Z"},"links":{"cited_paper":"/paper/2501.15383","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:5105d2ac6977ef1858fddd38b9d7483bca25aecac9c8250236ffe8b90bcb256d","observation_id":"455b8407-ff33-4fa8-b0fd-d71e0b548e53","resolution":{"observed_at":"2026-08-15T20:49:43.633606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04129","last_updated":"2023-03-07T18:44:07Z","snapshot_observed_at":"2026-08-16T15:50:02.706557Z","submitted_at":"2023-03-07T18:44:07Z","title":"Foundation Models for Decision Making: Problems, Methods, and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04129","snapshot_observed_at":"2026-08-15T20:49:43.638776Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.638776Z"},"links":{"cited_paper":"/paper/2303.04129","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:f99961781aaca166e675b7fabc858441cf89f50cc372265c9725cdd9a0250eea","observation_id":"152f3ef2-94a2-4eeb-93a8-47b224a82dbc","resolution":{"observed_at":"2026-08-15T20:49:43.638776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01469","last_updated":"2024-08-04T16:26:14Z","snapshot_observed_at":"2026-08-16T14:55:48.051655Z","submitted_at":"2023-10-02T17:01:56Z","title":"LLM Lies: Hallucinations are not Bugs, but Features as Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01469","snapshot_observed_at":"2026-08-15T20:49:43.642552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.642552Z"},"links":{"cited_paper":"/paper/2310.01469","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:afb2a2084b075d5431c108838f3c4274777a9a1e76859fe09515e2dab3b547a0","observation_id":"f436462a-effa-480b-b91e-9b6fc9347657","resolution":{"observed_at":"2026-08-15T20:49:43.642552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.646265Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.646265Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:04a71f625a2a1d03417f4c95276fe964cba6ad389778bb98a227285fdfb78999","observation_id":"69d050ae-e6bb-4e08-8fa8-4eb9fc2627c8","resolution":{"observed_at":"2026-08-15T20:49:43.646265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.979615Z","title":null,"venue":null,"work_id":"f7d37931-12c1-4620-ad3c-0173ae871759","year":2023},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.651040Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:81d9d836bc89b17fc2863f1c02dd7abdc32bf4f6605001dc2dc8f6ce9d9df3e8","observation_id":"523f8844-9437-4ca2-91ad-e3ba6ebc2ff3","resolution":{"observed_at":"2026-08-15T20:49:43.983576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.968649Z","title":null,"venue":null,"work_id":"b1f8dbcb-c0a5-4f77-aa2a-7ec892081fa0","year":2018},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.655028Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:41bcaae4d4cece85fbfad29c0ed19791166b74a1fdf232fb0af251e178771e64","observation_id":"4aff3b52-ecdb-436e-84fa-49e7259a9ede","resolution":{"observed_at":"2026-08-15T20:49:43.972451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17193","last_updated":"2024-02-27T04:18:49Z","snapshot_observed_at":"2026-08-16T14:15:03.626390Z","submitted_at":"2024-02-27T04:18:49Z","title":"When Scaling Meets LLM Finetuning: The Effect of Data, Model and Finetuning Method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17193","snapshot_observed_at":"2026-08-15T20:49:43.658852Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.658852Z"},"links":{"cited_paper":"/paper/2402.17193","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:70caada2460e2e1676470f23968198b9519ee7ee04ff443d62c5a66cf3238be0","observation_id":"f7c865ba-90df-4fcb-9de5-c1b0258333b9","resolution":{"observed_at":"2026-08-15T20:49:43.658852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:43.662726Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.662726Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:1d1e7cfd4c4b80d0b071638aecd2c39331f016f4af5acc17c7cf41d3d03151e4","observation_id":"05fbb8b3-3009-4d68-bbc7-97db5a40421f","resolution":{"observed_at":"2026-08-15T20:49:43.662726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-16T05:27:41.446467Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-15T20:49:43.666498Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.666498Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:fdd0e4604ef519f55551b566e8c7fdc10781d44bffad74c30cbb69fed1ad2d59","observation_id":"5b096d5c-a7db-48df-a62c-344d9e1e10bc","resolution":{"observed_at":"2026-08-15T20:49:43.666498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-16T00:15:57.597094Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-15T20:49:43.670451Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.670451Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:6a9edcfaa021b514a9ddcf8286513bf50e0bf76ad9a221eb257a38dc7e97674e","observation_id":"16fe5723-6c0a-4741-a0b6-04095b9d801a","resolution":{"observed_at":"2026-08-15T20:49:43.670451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.163562Z","title":"In Proceedings of the 2016 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"2aea221b-feb2-4121-b391-c1d11ac8a71e","year":2016},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.536386Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:2f856df02bc6ef91a41483f38aa8233745947d9322ecc9f094aacd4342d79cb3","observation_id":"07cea86f-cf51-4077-b963-d2109396a843","resolution":{"observed_at":"2026-08-15T20:49:44.168121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:49:44.224584Z","title":"In Proceedings of the 2024 Joint In- ternational Conference on Computational Linguistics, Language Resources and Evaluation (LREC-COLING 2024)","venue":null,"work_id":"55cd911d-e8bc-4911-b5f7-a4828004f8db","year":2024},"citing_paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T20:49:43.487335Z"},"links":{"citing_paper":"/paper/2505.11893"},"observation_digest":"sha256:ffe577a0ad53e35f9bac9e4b4af17bd46048ca10b7f3f0481bac9fcfa31dc0b0","observation_id":"3a721040-78f4-4606-868f-ed7163cd6aa2","resolution":{"observed_at":"2026-08-15T20:49:44.228985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.11893","last_updated":"2025-05-17T08:06:14Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T10:13:50.741940Z","submitted_at":"2025-05-17T08:06:14Z","title":"RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2505.11893."}