{"as_of":"2026-08-07T05:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:742c6a48998f85809a54930092720a385e38c9ec429654dfd1cadd25c1e75373","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:52:45.955765Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03502/citation-record","integrity":"/paper/2608.03502/integrity","json":"/paper/2608.03502/citation-record.json","paper":"/paper/2608.03502"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.809209Z","title":null,"venue":null,"work_id":"1648f801-58ac-4572-9db7-8fce4e3ba116","year":2018},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.007858Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:ce7a3bdc7428850b4796b1bcda427b204183d7be386f42c6e01c8d6440250f73","observation_id":"eca521a5-94e8-42c0-bdea-477d7231d8d0","resolution":{"observed_at":"2026-08-05T17:52:48.916567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.573213Z","title":"Human -level control through deep reinforcement learning,","venue":null,"work_id":"35206f86-7e0c-484f-9a59-9ded5032aca3","year":2015},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.096525Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:03cf909df13d8689ea08904871ccbf3d0e8885c83b8f70bfce238ea706ad9a55","observation_id":"8c52a268-6028-4ca4-829d-535ce9648ece","resolution":{"observed_at":"2026-08-05T17:52:48.681665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T17:52:44.161873Z","title":"Proximal Policy Optimization Algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.161873Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:499b4fd76efcf3cb1cb4cf5c0bb571d3a2d3e63b48374b97650de696e22b8b4b","observation_id":"a99d210d-1c5b-4a59-9226-4389fc8a1654","resolution":{"observed_at":"2026-08-05T17:52:44.161873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.396900Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep RL,","venue":null,"work_id":"c23a2ef1-4a87-4f2e-8039-78fc9b7e06b5","year":2018},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.246953Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:c2dbf5b9e0cbdbfd080a1ca2c48bb6caee462ce979217ae1b3d9ba3d174245e7","observation_id":"4b9051e0-2a97-45c1-b01d-072f5380c34e","resolution":{"observed_at":"2026-08-05T17:52:48.456121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.322287Z","title":"Reinforcement Learning Unplugged: Benchmarks for Offline RL,","venue":null,"work_id":"13942a46-6e16-4ac5-887c-5b86940f4c75","year":2020},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.326748Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:35f7d6e9fc0b1892fd58caf00f275ae0ba5404b2fd147b0090cd083b6ba41c2f","observation_id":"d843c560-c625-4da2-bc14-921e0372db2b","resolution":{"observed_at":"2026-08-05T17:52:48.391335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T17:52:44.399729Z","title":"Voyager: An Open -Ended Embodied Agent with LLM -Driven Skill Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.399729Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:eb0262e4bf11fa742d38c90e5e80ab453729c0b2b7b7b3cb2b890f4d07936153","observation_id":"dd13bf29-602d-49ef-9f3d-a4e725215c03","resolution":{"observed_at":"2026-08-05T17:52:44.399729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-05T17:52:44.474091Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.474091Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:f644bf95346160c094dbb3b36cf2d506c2b731c129b7b4c57545393db9958b95","observation_id":"9babcc4e-2d69-4e2c-808b-8871c7ecbfe7","resolution":{"observed_at":"2026-08-05T17:52:44.474091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-05T17:52:44.560783Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.560783Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:5dc90f5400a909f2324fea85536b95510fc5990f1399f74dd7f0fbf3a66db186","observation_id":"8f5321e7-3c2b-4115-a645-a968551162ec","resolution":{"observed_at":"2026-08-05T17:52:44.560783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07865","last_updated":"2024-09-14T11:41:49Z","snapshot_observed_at":"2026-07-06T17:43:27.034067Z","submitted_at":"2024-03-12T17:55:38Z","title":"CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07865","snapshot_observed_at":"2026-08-05T17:52:44.629599Z","title":"Tool-Use by Language Models: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.629599Z"},"links":{"cited_paper":"/paper/2403.07865","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:ed9aae30cd95ae6c46ba797f9eb8afc856b63fbba3a5880db68b0fb0bd88b7d7","observation_id":"59738885-9cdd-4ab7-bd73-aff76588b9b8","resolution":{"observed_at":"2026-08-05T17:52:44.629599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10533","last_updated":"2024-09-24T01:14:07Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T09:38:16Z","title":"APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding","version":2},"cited_work":{"arxiv_id":"2402.10533","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10533","snapshot_observed_at":"2026-08-05T17:52:46.222951Z","title":"APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding","venue":"cs.SD","work_id":"8179902f-b1d3-4ee2-bfeb-5b82f8f48fbe","year":2024},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.693924Z"},"links":{"cited_paper":"/paper/2402.10533","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:ed2530b3f3032876f193bffe77f657eeebb210d8314c346be8fe304e353bd1b3","observation_id":"cba9dc8f-745c-4e70-8b2a-0763c6f61683","resolution":{"observed_at":"2026-08-05T17:52:46.298256Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T17:52:44.777206Z","title":"Plan -and-Solve: LLM-Based Task Planning for RL Agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.777206Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:7d03d2cd8f58d13a118e630d32ff228c402bcfd2d262241c37b9f61a85df48e4","observation_id":"63ef0a9b-0eb2-4062-acbb-75db8b113e97","resolution":{"observed_at":"2026-08-05T17:52:44.777206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.171346Z","title":"Language-Conditioned Reinforcement Learning,","venue":null,"work_id":"b9fb0ee7-5b42-42c8-94db-f2a3e6404ffa","year":2020},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.884946Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:9c51afd61e0ea8ce7581de7d558ac731b81d5b96b9d343b7bfad254188052363","observation_id":"f5bf6165-612b-4c71-b364-73539460400a","resolution":{"observed_at":"2026-08-05T17:52:48.260711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00012","last_updated":"2024-03-12T12:59:45Z","snapshot_observed_at":"2026-07-06T17:37:39.610989Z","submitted_at":"2024-02-27T02:23:07Z","title":"PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell Modeling","version":2},"cited_work":{"arxiv_id":"2403.00012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.00012","snapshot_observed_at":"2026-08-05T17:52:46.040992Z","title":"PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell Modeling","venue":"cs.LG","work_id":"60bbd3f4-1ee8-43ee-8639-4b9c4dbfcc51","year":2024},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.964876Z"},"links":{"cited_paper":"/paper/2403.00012","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:a34eab2339ec9367bcab55896c9cb9cea3e67edd696fcac4580d2c5f6e5eff15","observation_id":"5a961a01-c5c1-4357-8ec0-85ef8cbcc08f","resolution":{"observed_at":"2026-08-05T17:52:46.114688Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.997370Z","title":"LLM-Guided Symbolic Planning,","venue":null,"work_id":"7d67c093-4587-49fc-a0e1-4ffcea87e461","year":2024},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.039979Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:8b83c58b412075cdf7c02e3235c04fe43b54aa2aa6ed527393d247b5b6e7d515","observation_id":"fdd51f49-66ea-4dd4-944f-60bc90a8f274","resolution":{"observed_at":"2026-08-05T17:52:48.085418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.863538Z","title":"Improving Reproducibility in Reinforcement Learning Research,","venue":null,"work_id":"d054e531-a971-4157-8875-f091984e5604","year":2020},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.131198Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:f248332e2240db8d6352c95098213b14a2f3fe5a1a883bfd67eb412a173ea73d","observation_id":"5aa58d80-a10b-4a1a-9b01-a8b2cf53862d","resolution":{"observed_at":"2026-08-05T17:52:47.921425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.697546Z","title":"Representation Learning: A Review and New Perspectives,","venue":null,"work_id":"ef9ab27d-b9e5-4c0c-a3a8-c8ef80997901","year":2013},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.201475Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:0169ecc8a7fee1c50d9fa4f31816d4aea37e65271f7a224a81455aad099da3c1","observation_id":"f327194e-3b15-4708-98e3-97f18730a82f","resolution":{"observed_at":"2026-08-05T17:52:47.775356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.550235Z","title":"Courville, I","venue":null,"work_id":"aced84f7-5c95-4639-aa63-41614ea2090d","year":2016},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.258680Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:86ff6650c2637e0a128e9e75c05b56171503ea8c86c1c10e2ea9dff08a540df2","observation_id":"0ba9a4bf-c66f-44a4-8a4c-e10d85df9e8d","resolution":{"observed_at":"2026-08-05T17:52:47.607490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.379272Z","title":"A Geometric Perspective on Optimal Representations for Reinforcement Learning,","venue":null,"work_id":"0ea56169-fe84-443d-82cf-261da624cfff","year":2019},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.347094Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:5a204d14da16debd3e00a3887257c881847b68ae222594ca18d4baf0033d12b9","observation_id":"a3b46684-97ba-482e-8070-bcf62c816258","resolution":{"observed_at":"2026-08-05T17:52:47.484062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.223896Z","title":"Deep Reinforcement Learning that Matters,","venue":null,"work_id":"748a6223-d375-4ab4-b655-673f09254133","year":2018},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.414073Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:24254f936e0a045dfd3710939234355ffae7a5fe2c8e4e4b0f006c80ae28d05f","observation_id":"85594ee2-b6db-4aa6-9fc7-c82b88b4819a","resolution":{"observed_at":"2026-08-05T17:52:47.307755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.034911Z","title":null,"venue":null,"work_id":"7a663bbe-7fc5-4f20-9cf4-5d571370aae4","year":2019},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.671139Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:409d5eb15606e2f1c67838b33b42bb49e97155bb8faf536b1017c3b0ce39e34b","observation_id":"eb977f77-e46a-4a77-96c1-f02aaaaf45c1","resolution":{"observed_at":"2026-08-05T17:52:47.124525Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:46.886352Z","title":null,"venue":null,"work_id":"ac51d1a3-f209-4a8b-8aca-b6b8d1eecb41","year":2022},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.737692Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:e10e639d16b671601b6e3aaed90968820297778d904f2a77303ace50d13d55b9","observation_id":"d7af8bce-84f6-4ffd-9414-2780caaabab5","resolution":{"observed_at":"2026-08-05T17:52:46.977594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:46.728909Z","title":null,"venue":null,"work_id":"514f6f3b-a8d1-44d6-8fe8-1817d15ad4ad","year":2017},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.804904Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:79459f7d3eedefc8130ce5180881e5e84eae668d616c92fc6043c07a0d5487c1","observation_id":"fecb19fb-45d1-49b8-805d-fced83feb892","resolution":{"observed_at":"2026-08-05T17:52:46.806193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:46.567825Z","title":null,"venue":null,"work_id":"72bd924f-1627-4ac7-ad5b-44788217cd58","year":1986},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.872937Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:f349170594a3f90ea9206e9a3823bbdb05dc031a9069de95dc9650527365eac1","observation_id":"58dd0910-0449-4b33-9bfa-989fa0fc5661","resolution":{"observed_at":"2026-08-05T17:52:46.660091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:46.414371Z","title":null,"venue":null,"work_id":"29f5dcad-04a2-45be-9fce-03b8b7153dd5","year":2017},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.955765Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:a0bf5a2d8ba17a80b77b5076df1fff84b85b73ed0c5c2bd977ff3ed3622b28d8","observation_id":"4fa53196-163c-4484-b91c-9a8bdab40386","resolution":{"observed_at":"2026-08-05T17:52:46.476976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T05:15:32.183255Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2608.03502."}