{"as_of":"2026-08-05T03:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c8a4aa94af353ccd9d7ca4955f7f52d818915bf9f856f7e463e8f1fae50a255e","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T23:26:23.989545Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.16318/citation-record","integrity":"/paper/2605.16318/integrity","json":"/paper/2605.16318/citation-record.json","paper":"/paper/2605.16318"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1705.04378","last_updated":"2018-07-20T22:54:01Z","snapshot_observed_at":"2026-07-06T05:42:19.240971Z","submitted_at":"2017-05-11T21:17:00Z","title":"An overview and comparative analysis of Recurrent Neural Networks for Short Term Load Forecasting","version":2},"cited_work":{"arxiv_id":"1705.04378","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.04378","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An overview and comparative analysis of Recurrent Neural Networks for Short Term Load Forecasting","venue":"cs.NE","work_id":"3b5c9433-5bf3-4888-9b0b-c73bfa67f2e6","year":2017},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/1705.04378","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:67bf956153328cbc8d93f6ece79332dd29253f73085749068a7a972532250f2c","observation_id":"07b1ec12-0b96-4af1-95b2-dac0328eb953","resolution":{"observed_at":"2026-05-20T23:29:13.179830Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":"1606.01540","doi":"10.1109/jssc.2019","metadata_source":"pith","pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"OpenAI Gym","venue":"cs.LG","work_id":"6af98f3f-f074-41ae-a689-7dd7b4b8efde","year":2016},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:e9a71f8cf9b41380211c29eba97b71dd2297c75fe07bdcc3462fc6c058e640db","observation_id":"11b98cc0-c2a1-4692-9537-46a065a54194","resolution":{"observed_at":"2026-05-20T23:29:13.160678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chandar, C","venue":null,"work_id":"d5794466-c1a7-4032-b2a5-ece0667c239c","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:ed933eefe02f8278d7dc61132b519960877f79ef2eeb275cd2dd00118e2cd1cd","observation_id":"5c8ff4fd-aa8c-4778-9254-baa17cb0f253","resolution":{"observed_at":"2026-05-20T23:34:14.567256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chung, C","venue":null,"work_id":"a5a64203-ba11-4ffb-84dd-e2dae546031d","year":2014},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:923efb56f66a3d10154903ae1fe6041d4af6403b94ef0cee1b843b18fe16efcd","observation_id":"e3735a47-7baf-4869-82ba-8a8ac45b1529","resolution":{"observed_at":"2026-05-20T23:34:14.541077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.06325","last_updated":"2022-05-05T17:16:00Z","snapshot_observed_at":"2026-07-06T11:38:09.580962Z","submitted_at":"2021-08-13T17:33:47Z","title":"Continual Backprop: Stochastic Gradient Descent with Persistent Randomness","version":3},"cited_work":{"arxiv_id":"2108.06325","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2108.06325","snapshot_observed_at":"2026-07-04T19:30:06.953256Z","title":"Feng Chen, Daniel Kunin, Atsushi Yamamura, and Surya Ganguli","venue":null,"work_id":"77646da8-b33e-4a80-993f-b4fbf75f891b","year":2021},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/2108.06325","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:b46b79d028490221d1244ea5b27decaf81bcc2c368c8c1c9d6b22b28e4ce288d","observation_id":"a7124105-e1db-418a-8ef2-3c4ffd68ad8e","resolution":{"observed_at":"2026-05-20T23:29:13.173673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.04455","last_updated":"2015-12-14T18:44:48Z","snapshot_observed_at":"2026-07-06T04:39:51.329643Z","submitted_at":"2015-12-14T18:44:48Z","title":"Memory-based control with recurrent neural networks","version":1},"cited_work":{"arxiv_id":"1512.04455","doi":null,"metadata_source":"pith","pith_arxiv_id":"1512.04455","snapshot_observed_at":"2026-06-29T19:03:51.189918Z","title":"Memory-based control with recurrent neural networks","venue":"cs.LG","work_id":"19288659-e620-433f-99dd-34295c429b3c","year":2015},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/1512.04455","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:723f80af6090fc3c7c372beb95c450909eb036d5c884ab0331855391b77ec7fc","observation_id":"cbfaa98f-9180-48aa-8e68-960c45fa1f57","resolution":{"observed_at":"2026-05-20T23:29:13.168177Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.07951","last_updated":"2019-03-09T13:25:32Z","snapshot_observed_at":"2026-08-01T00:17:29.260492Z","submitted_at":"2018-10-18T08:48:12Z","title":"Don't Unroll Adjoint: Differentiating SSA-Form Programs","version":4},"cited_work":{"arxiv_id":"1810.07951","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.07951","snapshot_observed_at":"2026-07-04T19:50:11.009012Z","title":"Don't Unroll Adjoint: Differentiating SSA-Form Programs","venue":"cs.PL","work_id":"5d90189b-3ce5-4924-9636-e29eae3de855","year":2018},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/1810.07951","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:e890d70e0f780944a9b786444e8da1893f38445dd4e88847f906ee9ff238b2a4","observation_id":"32c14023-889c-4251-8fce-075b731d13a6","resolution":{"observed_at":"2026-05-20T23:29:13.185651Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02078","last_updated":"2015-11-17T02:42:24Z","snapshot_observed_at":"2026-08-04T02:12:07.668406Z","submitted_at":"2015-06-05T22:33:04Z","title":"Visualizing and Understanding Recurrent Networks","version":2},"cited_work":{"arxiv_id":"1506.02078","doi":null,"metadata_source":"pith","pith_arxiv_id":"1506.02078","snapshot_observed_at":"2026-07-02T17:37:14.485931Z","title":"Visualizing and Understanding Recurrent Networks","venue":"cs.LG","work_id":"ccce2c0d-8663-4fab-9321-b8ce0adb6b4b","year":2015},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/1506.02078","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:a95da062158b0e849bbd695134f05be8522cc2aaee20cddc7eda931526321019","observation_id":"2b12283a-765b-4d13-90ad-dbcef41d2a4d","resolution":{"observed_at":"2026-05-20T23:29:13.155625Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07232","last_updated":"2020-06-12T14:38:15Z","snapshot_observed_at":"2026-08-04T12:38:00.988675Z","submitted_at":"2020-06-12T14:38:15Z","title":"A Practical Sparse Approximation for Real Time Recurrent Learning","version":1},"cited_work":{"arxiv_id":"2006.07232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07232","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Menick, E","venue":null,"work_id":"ca2baf1c-5ceb-4f86-99b1-4f45be9194d3","year":2006},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/2006.07232","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:e65d34a6eafb08ee11ddbd9012a0512807746cf6ed2fba2ff6ca5a792935c2bc","observation_id":"72b82647-fe2e-41a6-a433-c989798fea99","resolution":{"observed_at":"2026-05-20T23:29:13.190992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parisotto, F","venue":null,"work_id":"1ec6e925-a3d2-4e23-84d2-6e2d071c189a","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:5c1269fd84f53f226b084462ba53d33df9bd709791e9380bba46175ee01e7997","observation_id":"8f2be63f-6fd4-48df-b4cb-08a44c0f50bc","resolution":{"observed_at":"2026-05-20T23:34:14.583943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.15236","last_updated":"2021-12-30T23:10:32Z","snapshot_observed_at":"2026-08-03T04:20:36.732696Z","submitted_at":"2021-12-30T23:10:32Z","title":"Learning Agent State Online with Recurrent Generate-and-Test","version":1},"cited_work":{"arxiv_id":"2112.15236","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2112.15236","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Samani and R","venue":null,"work_id":"65d75c5f-577c-4f5a-820f-4bdc31adaa2a","year":null},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/2112.15236","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:484de667a47193b6acbcf872fc840b68110912468d73a00b2b1df08b1405a748","observation_id":"50019752-118e-442d-9c70-e9c74793f8ac","resolution":{"observed_at":"2026-05-20T23:29:13.147238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.04582","last_updated":"2015-08-19T09:37:25Z","snapshot_observed_at":"2026-07-06T04:27:04.289959Z","submitted_at":"2015-08-19T09:37:25Z","title":"Learning to Predict Independent of Span","version":1},"cited_work":{"arxiv_id":"1508.04582","doi":null,"metadata_source":"pith","pith_arxiv_id":"1508.04582","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to Predict Independent of Span","venue":"cs.LG","work_id":"162ae963-31b4-4ab5-83ab-a21c802b973a","year":2015},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/1508.04582","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:289d5649e0b0ec0d3221ae110ceaf94a75d306137efd4381a07061091dc9aa13","observation_id":"06e69e47-ee96-4cf7-b25f-81b0f006a00b","resolution":{"observed_at":"2026-05-20T23:29:13.138502Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vaswani, N","venue":null,"work_id":"f6a7eec0-a078-4d60-9c83-ac274c5303c1","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:11bdc6f93a049af16abac047172be4d92daab3edea68b1db7b5657f59bcd55ff","observation_id":"9e87f9dc-bb93-49e0-abdb-ee630646aa6f","resolution":{"observed_at":"2026-05-20T23:34:14.536964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.07978","last_updated":"2018-05-24T14:13:20Z","snapshot_observed_at":"2026-07-06T05:39:20.517167Z","submitted_at":"2017-04-26T05:55:07Z","title":"On Improving Deep Reinforcement Learning for POMDPs","version":6},"cited_work":{"arxiv_id":"1704.07978","doi":null,"metadata_source":"pith","pith_arxiv_id":"1704.07978","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On Improving Deep Reinforcement Learning for POMDPs","venue":"cs.LG","work_id":"ef30aea3-63ea-4938-b0c8-72fe8945eeec","year":2017},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"cited_paper":"/paper/1704.07978","citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:97a40e0556310ad9c4a5f9095306cbc4d88780dce38defda3d83ed613207dd8e","observation_id":"20b36415-69e6-4bcf-a3b1-1be34dc60d37","resolution":{"observed_at":"2026-05-20T23:29:13.197038Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"230c0ba0-4743-49a8-94f6-c42409932af9","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:a3af1bb6b498e5f9e0de93ec886eb0f6b06404da5d6bd5bfa7336890886099fa","observation_id":"21325ec6-0e69-4a41-a5e8-dc91b3b6f09f","resolution":{"observed_at":"2026-05-20T23:34:14.597571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"in an experience replay buffer), they must also continually incorporate the newest information into their decisions (i.e","venue":null,"work_id":"38b38595-0b40-490a-ba0a-44533d8fdf6a","year":2002},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:feb7bfec7a5f267547ad93376997fafac753539eca619e71409864b0b474426f","observation_id":"e252bdce-3a65-4d68-96c8-0c2a479c7ea4","resolution":{"observed_at":"2026-05-20T23:34:14.532540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cb4a0496-d2c6-483d-a281-8163a3aee50e","year":2021},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:abfe5f62547f1e83675c962498b0f5b96478e2f7230a7768a6b1a007f3be9bb9","observation_id":"c74618e6-0726-4f86-8bde-e50ac20fd02a","resolution":{"observed_at":"2026-05-20T23:34:14.547425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"They show improvement in several settings, but don’t explore the model when starved for temporal information in the update","venue":null,"work_id":"9a4dcd66-94aa-4349-a975-062f3c0c5a92","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:dc62e522c3a44e67f1377ec3b799a746fdedee565689fa4aa76cc386791c7679","observation_id":"81db78f9-b71b-4cc8-9672-ba8b9f72f0fd","resolution":{"observed_at":"2026-05-20T23:34:14.527390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"One can even change the requirements on the architecture in terms of final objectives","venue":null,"work_id":"80cd777a-b662-4621-a024-b14e33a1d043","year":1991},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:a76fdbbdb44a4c059c05256673aca870fcc8f59bb2d400649ff7a11ed07e954a","observation_id":"3c949341-3e85-41b1-b7f2-75178f519531","resolution":{"observed_at":"2026-05-20T23:34:14.552544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"reservoir","venue":null,"work_id":"2bff8a71-8cc1-4888-9fb1-d2255e72cafa","year":1995},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:24256302d784abc8cdf4f8a483fef4b6c06b18819868385ea47d8a4d5ab9035c","observation_id":"19510957-f2f1-464f-8542-d381f8c2660b","resolution":{"observed_at":"2026-05-20T23:34:14.601773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4d9fbf6d-7d50-43c3-adf7-9f4a3a282f03","year":2018},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:3d78b126d0a52c180bbdd8ff60cc9c4d70fc74b5f510deb5370a29f04a5ddef8","observation_id":"74957301-d485-4fd2-a403-f714e7c50f93","resolution":{"observed_at":"2026-05-20T23:34:14.510857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Because of these compromises, it is still unclear if transformers are a viable solution to the state construction problem in continual reinforcement learning","venue":null,"work_id":"2c41afb3-ebc9-491d-a799-5cdf51eff306","year":2021},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:e099121ce64783eb62d0b7d2fc6e3186abfda54367638b24c8ad323754a75747","observation_id":"a83f4d97-2bd5-48ba-bb71-e1c9fae9fbba","resolution":{"observed_at":"2026-05-20T23:34:14.557723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"58db837f-cb5e-4199-adfe-6e1529220ec8","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:417726ad1276a1deb1d85a7652c748cad6119af394ac901c3987b67843dd745c","observation_id":"386cec15-bac5-4c62-8bf9-1165249db3df","resolution":{"observed_at":"2026-05-20T23:34:14.593023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We use a third strategy here (using gradient information to refresh the hidden state to minimize the objective), but found little difference between this and the stale approach","venue":null,"work_id":"b825dd6e-5284-4736-9fe8-9111380864b7","year":2015},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:41645ddd7144aa9828db75cffb49fb4a3f7c18316b94f3db18912acd80f98418","observation_id":"752920eb-8f7e-491a-b271-43a0b5b35ab9","resolution":{"observed_at":"2026-05-20T23:34:14.516453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"As compared to the additive and multiplicative the mixture of experts RNN network performs in-between the two networks","venue":null,"work_id":"6e1d2cc9-7319-4689-9d12-c92d0903aa0c","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:647a8767527fa3acb0f3fc181a0c6d015852e0d77cda067b035aa42936299d12","observation_id":"f8bc8c17-8e22-4714-a841-19b731939e28","resolution":{"observed_at":"2026-05-20T23:34:14.588681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"For DirectionalTMaze the AAGRU and MAGRU have a reasonable median performance","venue":null,"work_id":"9671a6cb-7be4-4385-9cff-62c5b0fd26a0","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:f16f8db7082e530e4dfca00941bb9c9c4c5a1f16519d7c5370f344161bc4ad6f","observation_id":"e08fde7c-36ab-4479-913d-2210aa82ea94","resolution":{"observed_at":"2026-05-20T23:34:14.562413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Overall, we found the size of the encoding network to not make a large difference in the final performance","venue":null,"work_id":"d1c599cf-e9eb-47ab-bc2d-eafd2a9cb2d1","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:6c1d70a062663cc1483759f93bbc2a6f7d0ef3f38dcaa55f1afc33b06ae87f88","observation_id":"74909077-031d-4486-9288-bc298bab9124","resolution":{"observed_at":"2026-05-20T23:34:14.577422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d2d4ed65-881c-4ccf-96ea-b0ac252d72aa","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:b35c16e5723cb6705f3aa153a498114b6d7df33b2697449879726ab9d1db0e32","observation_id":"ea9d5c2a-acee-47bb-9ebd-5ee1173476b4","resolution":{"observed_at":"2026-05-20T23:34:14.572914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Line is the median over 1000 episodes, with the shaded region as the 1st and 3rd quantile over the same window","venue":null,"work_id":"605d5308-1809-44a0-af95-4d00074375ce","year":2022},"citing_paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T23:26:23.989545Z"},"links":{"citing_paper":"/paper/2605.16318"},"observation_digest":"sha256:2b125b81082135a3a1828ebe39d63baba565f5f7d93c27790998c2212901220d","observation_id":"d1823429-27dc-435f-a05c-cb81b82086a8","resolution":{"observed_at":"2026-05-20T23:34:14.522162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.16318","last_updated":"2026-05-04T22:18:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-04T22:18:05Z","title":"Investigating Action Encodings in Recurrent Neural Networks in Reinforcement Learning"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":10,"verified_fuzzy":14},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2605.16318."}