{"as_of":"2026-08-14T20:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bc5d2d77c6efa6efddeebc751705ac98a7e62d98128afadcd50d766541335925","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:00:08.031991Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:05:56.982882Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T23:05:57.178299Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"cited_work":{"arxiv_id":"2412.11417","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11417","snapshot_observed_at":"2026-08-05T23:05:57.178299Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","venue":"cs.AI","work_id":"de9f6c79-1790-4cce-bee9-706cf8e66b55","year":2024},"citing_paper":{"arxiv_id":"2508.05957","last_updated":"2025-08-08T02:43:45Z","snapshot_observed_at":"2026-08-07T13:57:09.870710Z","submitted_at":"2025-08-08T02:43:45Z","title":"Multi-Armed Bandits-Based Optimization of Decision Trees","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T23:05:56.982882Z"},"links":{"cited_paper":"/paper/2412.11417","citing_paper":"/paper/2508.05957"},"observation_digest":"sha256:edb6298df33a417ceb3c9ead032b93c4f5f08ca357de6476b681f54b4c29664c","observation_id":"706dfce6-7892-42bf-b350-c2ebf1cbde03","resolution":{"observed_at":"2026-08-05T23:05:57.183612Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.11417/citation-record","integrity":"/paper/2412.11417/integrity","json":"/paper/2412.11417/citation-record.json","paper":"/paper/2412.11417"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.515479Z","title":"Emulating human play in a leading mobile card game,","venue":null,"work_id":"c61ed5d6-9791-4c44-a6d0-9897a7ba5404","year":2018},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.889609Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:87a40097e3b36b0ba4d95184947271aee48eb17dab7317bcce94afe9fcac84a0","observation_id":"d00e597f-15e3-4487-99b4-bfa81ceff794","resolution":{"observed_at":"2026-08-11T15:00:08.520355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.501085Z","title":"Strategy generation for multiunit real-time games via voting,","venue":null,"work_id":"cae00cbb-e1a7-4039-ad00-bdfa1b65fdc8","year":2018},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.894925Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:8c306019977b980182a8a521ff45adc8995abd157d322c53ebeee2eaa1fc948b","observation_id":"6f55e57d-deef-4103-97b2-3a6274f2cd30","resolution":{"observed_at":"2026-08-11T15:00:08.506210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:07.898957Z","title":"Mastering the game of go with deep neural networks and tree search,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.898957Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:cd984b1089726dee5b9e6df96f601bae1247c61f6e1692331da20151e071e282","observation_id":"87c4d2a5-0288-4ebf-9d9e-30afd255b7d3","resolution":{"observed_at":"2026-08-11T15:00:07.898957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.473792Z","title":"Mastering the game of go without human knowledge,","venue":null,"work_id":"a9cb3a9c-4f94-4cff-84d8-ccd3b1ff8e5e","year":2017},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.903487Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:cb05b0f6a5c89a93fee60a3c4c5b2ea3005f225bc39fe27fa402528c0662fae2","observation_id":"8b6b15f2-8625-4cfd-b729-feda5e1c1556","resolution":{"observed_at":"2026-08-11T15:00:08.478255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-08-13T14:13:07.807518Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-11T15:00:07.908513Z","title":"Dota 2 with large scale deep reinforcement learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.908513Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:eda9992c45091bc57cd40ed20c0307d239096bcf6fba912bb44cf6117099eea9","observation_id":"be9a6928-f320-4ee0-8bad-b796dd5bd260","resolution":{"observed_at":"2026-08-11T15:00:07.908513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:07.912367Z","title":"Grand- master level in starcraft ii using multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.912367Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:7cdc1d11a38ea772ecfd2c7fb71a00578c5b1a8240709b28758f3ea0b54e6f55","observation_id":"770441ca-cea8-4476-86fd-f79a168e5dff","resolution":{"observed_at":"2026-08-11T15:00:07.912367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.450728Z","title":"Full douzero+: Improving doudizhu ai by opponent modeling, coach-guided training and bidding learning,","venue":null,"work_id":"f88ba3f0-14fe-40db-b8e7-d922a741f42f","year":2023},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.917987Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:52fd313a209076b2b8dd9850138cc61c84410ade9cc433038067847c374ff6a2","observation_id":"ff7780fc-ad59-479b-b86d-4fa626738e96","resolution":{"observed_at":"2026-08-11T15:00:08.455730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.433333Z","title":"Danzero+: Dominating the guandan game through reinforcement learning,","venue":null,"work_id":"f322ab81-cd04-4d7b-96cd-44a826bcc5e6","year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.921375Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:4d55067d5ebdaee8983d6b8e7d18030109ac7a5b32b56681ad855c7e4874d83e","observation_id":"64b263ad-2f62-4386-97b7-3821930a4ef8","resolution":{"observed_at":"2026-08-11T15:00:08.439689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.417032Z","title":"Mastering curling with rl-revised decision tree,","venue":null,"work_id":"1e8e6552-f3e4-453b-8d90-6ce571ef4aca","year":2023},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.924417Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:ff12dfe27bb7d5e64e1b504a214b1b1a33443240aa00205743bfda1f216cd106","observation_id":"df76c031-04ab-433d-be60-0f896c32bdb1","resolution":{"observed_at":"2026-08-11T15:00:08.421983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-11T15:00:07.929274Z","title":"Emergent abilities of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.929274Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:75f98058f126201c03652f9fc508033ed81976d793e8399b7bb2e8bf72ef9cb1","observation_id":"6ea2a705-d8d3-4556-b82a-63bbefc77ab9","resolution":{"observed_at":"2026-08-11T15:00:07.929274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-11T15:00:07.933048Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.933048Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:0acd7d84625ddcdebf598b2dce2f75bf2471e08e974d523a462367069f3f8a12","observation_id":"07566e5c-beea-47a0-b7e4-4189e3ac2f7b","resolution":{"observed_at":"2026-08-11T15:00:07.933048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-11T15:00:07.937744Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.937744Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:10a4da495e4591c1f031aa0db87579700a682e095d2af17ef1c8c2e84cd2bf72","observation_id":"d2b7a8cf-4cae-4b0d-85b9-efaf1665636b","resolution":{"observed_at":"2026-08-11T15:00:07.937744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.402917Z","title":"Toolformer: Language models can teach themselves to use tools,","venue":null,"work_id":"08cb7c38-205a-4e67-ba80-3451186074ac","year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.941600Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:eb174ad3e3a9d2d587129ac69bd70b1dc984cbdc2405a20e65a8eea08a3ccb3d","observation_id":"16bed98f-5c20-4161-ae53-5f6b7836fd32","resolution":{"observed_at":"2026-08-11T15:00:08.407847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.390983Z","title":"Hugginggpt: Solving ai tasks with chatgpt and its friends in hugging face,","venue":null,"work_id":"0250a508-6b45-47f3-aec6-759183ebee84","year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.945512Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:3736a0e95a71a9ba245d2659b6c69672babccee0e1bec7c76156b2d799d90c70","observation_id":"c2cc585e-8cea-4c99-994d-da740061e6a3","resolution":{"observed_at":"2026-08-11T15:00:08.394911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-07T17:14:39.278754Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-11T15:00:07.950201Z","title":"Webgpt: Browser- assisted question-answering with human feedback,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.950201Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:12495d24d024ca2052ea0c6eda8244231f8530c53e8931252b5f30340488293a","observation_id":"ff0bb081-c039-44d1-afc8-da712c7c5971","resolution":{"observed_at":"2026-08-11T15:00:07.950201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-11T15:00:07.954741Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.954741Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:7dc21e077c5278f49091d412b203c69af9026e3fc05dd92bba0141c729cd9e62","observation_id":"e7b8a1a4-dbd3-47d4-8bd5-81c9654ba6ed","resolution":{"observed_at":"2026-08-11T15:00:07.954741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-11T15:00:07.959349Z","title":"Qwen2. 5-coder technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.959349Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:620e9b7c79434e4fa563cc46dcd0c3e87c71447a7b288c9147a40a88bb3076c3","observation_id":"859a69ad-8b17-47d3-b864-e660a24d1f91","resolution":{"observed_at":"2026-08-11T15:00:07.959349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.377678Z","title":"Google research football: A novel reinforcement learning environment,","venue":null,"work_id":"1fcad935-5ee7-4d1b-a586-392de5079684","year":2020},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.963348Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:92875e88d6f8792d12afe06deaadc7f0f616d09c9ded0461996b68ba00611883","observation_id":"472aa2cf-26a8-49fd-a4b1-c82d535c664f","resolution":{"observed_at":"2026-08-11T15:00:08.381343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.03204","last_updated":"2020-12-06T07:51:59Z","snapshot_observed_at":"2026-08-04T20:10:08.926247Z","submitted_at":"2020-12-06T07:51:59Z","title":"Fever Basketball: A Complex, Flexible, and Asynchronized Sports Game Environment for Multi-agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.03204","snapshot_observed_at":"2026-08-11T15:00:07.967882Z","title":"Fever basketball: A complex, flexible, and asynchronized sports game environment for multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.967882Z"},"links":{"cited_paper":"/paper/2012.03204","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:3c5ca285cfed2839715557c571ba8c63e382b511a72822e95df8ca6ef8140d30","observation_id":"e9cee1c4-38e1-4fe1-a281-c4f7f4ba7bd5","resolution":{"observed_at":"2026-08-11T15:00:07.967882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.13590","last_updated":"2020-04-01T03:46:55Z","snapshot_observed_at":"2026-08-14T09:57:25.486329Z","submitted_at":"2020-03-30T16:18:16Z","title":"Suphx: Mastering Mahjong with Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.13590","snapshot_observed_at":"2026-08-11T15:00:07.972096Z","title":"Suphx: Mastering mahjong with deep reinforcement learning,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.972096Z"},"links":{"cited_paper":"/paper/2003.13590","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:7c125073b8242e21916202da7d038619e616b3a3bb81866211ff6177c9121497","observation_id":"c92bffee-6d9a-4986-b24b-c007d951a374","resolution":{"observed_at":"2026-08-11T15:00:07.972096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.365646Z","title":"Douzero: mastering doudizhu with self-play deep reinforcement learning,","venue":null,"work_id":"16bb009d-393a-4f4c-a3fe-9812b0490dd3","year":2021},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.977070Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:f88cf36fa48ab2b15770646155906162d327a5f18d04c029d606f27fc95f78e1","observation_id":"ec4cdb99-e01f-491c-ade4-7e571b6f9a31","resolution":{"observed_at":"2026-08-11T15:00:08.370177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.352841Z","title":"Chessgpt: Bridging policy learning and language mod- eling,","venue":null,"work_id":"f72ab8a7-fecd-410e-9182-070d13bfd615","year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.981134Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:0c5f101d8bdec1b72f8e0d483ed65f0ddc7add149c8152eb5e5b2736dd6373a8","observation_id":"1c62660c-41c8-4ee4-9c49-9d2b2b42bbba","resolution":{"observed_at":"2026-08-11T15:00:08.357255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-11T15:00:07.985179Z","title":"V oyager: An open-ended embodied agent with large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.985179Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:e3265f5f1a72d9716bfb4bcb9dbc8452880068d88bb62132a9efc39f8b150541","observation_id":"707485f5-32a9-4022-bd5e-63f75c031243","resolution":{"observed_at":"2026-08-11T15:00:07.985179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.336779Z","title":"Minedojo: Building open- ended embodied agents with internet-scale knowledge,","venue":null,"work_id":"5880c33a-45c2-4639-9619-e478b9408dbb","year":2022},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.989308Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:0f4a07f66e54d751219faf215671733d492ea1e869c2c10c1134415be32d4182","observation_id":"9f367805-8182-4f17-9b07-4a01c2234c06","resolution":{"observed_at":"2026-08-11T15:00:08.341422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11865","last_updated":"2024-06-18T03:07:37Z","snapshot_observed_at":"2026-08-13T04:58:55.794763Z","submitted_at":"2023-12-19T05:27:16Z","title":"Large Language Models Play StarCraft II: Benchmarks and A Chain of Summarization Approach","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11865","snapshot_observed_at":"2026-08-11T15:00:07.993239Z","title":"Large language models play starcraft ii: Benchmarks and a chain of summarization approach,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.993239Z"},"links":{"cited_paper":"/paper/2312.11865","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:42f3f4c783fa038e5d0274aa75828a15432a826ad94f000f12440e74820df224","observation_id":"20691713-3637-45f5-a115-b1beba7a27b9","resolution":{"observed_at":"2026-08-11T15:00:07.993239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01118","last_updated":"2024-04-02T15:46:35Z","snapshot_observed_at":"2026-08-13T04:28:44.325236Z","submitted_at":"2024-02-02T03:22:12Z","title":"PokeLLMon: A Human-Parity Agent for Pokemon Battles with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01118","snapshot_observed_at":"2026-08-11T15:00:07.997528Z","title":"Pok \\’ellmon: A human-parity agent for pok \\’emon battles with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:07.997528Z"},"links":{"cited_paper":"/paper/2402.01118","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:c2ae9074eebead639b6d23313b6cd71d9f3c90a88fdc09c1878d25720ef11d5e","observation_id":"ff03e40f-694b-46b5-b091-258372deea50","resolution":{"observed_at":"2026-08-11T15:00:07.997528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.323128Z","title":"Towards general computer control: A multi- modal agent for red dead redemption ii as a case study,","venue":null,"work_id":"83d66401-f88d-43d8-b88d-5c761ec70462","year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:08.002773Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:2d805171563ca6deb80116a8204d06384b734d26d0a6b346a549d1223908fcc8","observation_id":"63d3722e-674d-47f5-9302-560bdf60efd5","resolution":{"observed_at":"2026-08-11T15:00:08.327854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01030","last_updated":"2024-06-07T01:53:07Z","snapshot_observed_at":"2026-08-13T17:32:48.816452Z","submitted_at":"2024-02-01T21:38:58Z","title":"Executable Code Actions Elicit Better LLM Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01030","snapshot_observed_at":"2026-08-11T15:00:08.007362Z","title":"Executable code actions elicit better llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:08.007362Z"},"links":{"cited_paper":"/paper/2402.01030","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:2a761f585dcf6b01e22d51f0aab0e4002d6ecbf3ec82bbc205211b32d1fbb4d2","observation_id":"1983a87b-3a89-4a8f-a862-cf6c2ba03a60","resolution":{"observed_at":"2026-08-11T15:00:08.007362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12931","last_updated":"2024-04-30T21:35:53Z","snapshot_observed_at":"2026-08-02T10:40:03.816188Z","submitted_at":"2023-10-19T17:31:01Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12931","snapshot_observed_at":"2026-08-11T15:00:08.011376Z","title":"Eureka: Human- level reward design via coding large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:08.011376Z"},"links":{"cited_paper":"/paper/2310.12931","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:c2ac99aafa9d1e7482e4fe82e3b1eed87fd7dc7c024ad3ec9bc6c6d686f350d7","observation_id":"80fca482-4d62-44f2-b6c1-9deee9c155c9","resolution":{"observed_at":"2026-08-11T15:00:08.011376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.015989Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:08.015989Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:e471999bfeca57b150ce83fc31d8aed7c84f378c566014264a3409c2d0c1ca86","observation_id":"72106eca-28e0-44b2-a468-1638ec2aa15d","resolution":{"observed_at":"2026-08-11T15:00:08.015989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-11T15:00:08.022494Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:08.022494Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:13e6f0d72ddf662847e30e98534a214169d65ca657e62be74ededb0d4e2f2188","observation_id":"c30c1fa6-e9bb-4ffd-a3fa-0bc0f7a68f8b","resolution":{"observed_at":"2026-08-11T15:00:08.022494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.300993Z","title":"Trust region policy optimization,","venue":null,"work_id":"40513bff-e89f-4a14-9ec1-a6449c4fb64d","year":2015},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:08.026908Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:650b09b45579b7aa2e9c366b87d60a3a6ca994afb258d6796086c4df0b552192","observation_id":"ed43bd58-15d1-48ef-a345-ca377a0bf7bc","resolution":{"observed_at":"2026-08-11T15:00:08.305964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:00:08.279353Z","title":"High- dimensional continuous control using generalized advantage estimation,","venue":null,"work_id":"5142793c-3664-451d-b7fb-b666fee3c254","year":2016},"citing_paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T15:00:08.031991Z"},"links":{"citing_paper":"/paper/2412.11417"},"observation_digest":"sha256:a1b8bc967b9ae63d0f7204a5fc49b15c409cd03186c51cbbe8e24373f1a06a7f","observation_id":"7c7265be-94ef-4eeb-b933-6a2a144dd2dc","resolution":{"observed_at":"2026-08-11T15:00:08.287462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11417","last_updated":"2024-12-17T04:04:12Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T17:33:36.345760Z","submitted_at":"2024-12-16T03:33:49Z","title":"RL-LLM-DT: An Automatic Decision Tree Generation Method Based on RL Evaluation and LLM Enhancement"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2412.11417."}