{"as_of":"2026-08-15T10:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b141a2988a644901a9d6cda60d5b8f1dd3a71ec73546cc594bda8a3b4fb7d1f","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:21:50.582390Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.01275/citation-record","integrity":"/paper/1908.01275/integrity","json":"/paper/1908.01275/citation-record.json","paper":"/paper/1908.01275"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1906.08879","last_updated":"2019-06-20T22:08:51Z","snapshot_observed_at":"2026-07-06T08:01:50.383586Z","submitted_at":"2019-06-20T22:08:51Z","title":"Placeto: Learning Generalizable Device Placement Algorithms for Distributed Machine Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08879","snapshot_observed_at":"2026-08-14T15:21:50.428466Z","title":"B., Gupta, S., Mao, H., and Alizadeh, M","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.428466Z"},"links":{"cited_paper":"/paper/1906.08879","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:e2ac4fbb32caf6ae419442b043e11b6b377e193649d5eefd48def6a9fffcb87d","observation_id":"00e02884-7e5a-4207-9575-025b7792fcc5","resolution":{"observed_at":"2026-08-14T15:21:50.428466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.122541Z","title":"Speech recog- nition with deep recurrent neural networks","venue":null,"work_id":"398bfca8-e35e-439e-b255-837e83541096","year":2013},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.455907Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:3ea9baef3dfe433eb8c1a3511ff241c91d285a894bcfd449899c51bf7a418e0c","observation_id":"6e28d589-6bc8-46f8-ab5f-3a54c1d15dc2","resolution":{"observed_at":"2026-08-14T15:21:51.127842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.07926","last_updated":"2017-04-25T22:51:12Z","snapshot_observed_at":"2026-08-14T21:04:43.945304Z","submitted_at":"2017-04-25T22:51:12Z","title":"From Language to Programs: Bridging Reinforcement Learning and Maximum Marginal Likelihood","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.07926","snapshot_observed_at":"2026-08-14T15:21:50.460868Z","title":"Z., and Liang, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.460868Z"},"links":{"cited_paper":"/paper/1704.07926","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:9cb5a753d7d3934caa8d6cefc32f011764e0146ca33c103dda74847acd826ac5","observation_id":"228359e0-e55e-4081-8ab8-5bb7f1b6de37","resolution":{"observed_at":"2026-08-14T15:21:50.460868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-14T15:21:50.465908Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforce- ment learning with a stochastic actor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.465908Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:6062f4703aefdc96e52abdceeee9dc9aad41672671e407f4791329103b7ef608","observation_id":"3910cf45-f41f-41a6-bafc-b28f6d51451f","resolution":{"observed_at":"2026-08-14T15:21:50.465908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.106085Z","title":"Autophase: Compiler phase-ordering for hls with deep reinforcement learn- ing","venue":null,"work_id":"82ada212-0fba-4499-8a44-a5e25e33398c","year":2019},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.471075Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:e974880092d55c9e899dc54c6b4a6df67c4655ec7982cb1c27efbc8f766e2688","observation_id":"22f86071-80f4-4f34-acde-68180cfe3e0f","resolution":{"observed_at":"2026-08-14T15:21:51.111257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.073595Z","title":"Learning- based and data-driven tcp design for memory-constrained iot","venue":null,"work_id":"87ab4352-a0d3-4b36-b062-527d6fb2d0c7","year":2016},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.486859Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:aabb091c0db199af51b89e28b1d98a25ffd55df00af4a98f762fab90b5bb4579","observation_id":"44a93076-ad39-4c38-afd4-a6c552b3e9c3","resolution":{"observed_at":"2026-08-14T15:21:51.079314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.09381","last_updated":"2018-06-29T00:19:24Z","snapshot_observed_at":"2026-08-14T20:00:00.450392Z","submitted_at":"2017-12-26T19:43:59Z","title":"RLlib: Abstractions for Distributed Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.09381","snapshot_observed_at":"2026-08-14T15:21:50.497388Z","title":"Ray rllib: A com- posable and scalable reinforcement learning library.arXiv preprint arXiv:1712.09381,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.497388Z"},"links":{"cited_paper":"/paper/1712.09381","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:2a99812f49a4d9e2f58e24b955f0e09f9922144bfd0659d24f7044ee7c2cb147","observation_id":"68442d96-dc64-45ac-8e18-5cbbf335b371","resolution":{"observed_at":"2026-08-14T15:21:50.497388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.10319","last_updated":"2019-02-27T03:24:40Z","snapshot_observed_at":"2026-08-14T17:10:37.177465Z","submitted_at":"2019-02-27T03:24:40Z","title":"Neural Packet Classification","version":1},"cited_work":{"arxiv_id":"1902.10319","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.10319","snapshot_observed_at":"2026-08-14T15:21:50.788059Z","title":"Neural Packet Classification","venue":"cs.NI","work_id":"16b08619-bd29-42a4-ac06-708db2bbfd26","year":2019},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.502401Z"},"links":{"cited_paper":"/paper/1902.10319","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:4b97eb72e68eec28e119c795c54f763d2bba736585da984e0c271c35f5287e61","observation_id":"f883fe50-ff45-4c88-81be-b640f2782c62","resolution":{"observed_at":"2026-08-14T15:21:50.793436Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.03711","last_updated":"2019-04-07T19:00:45Z","snapshot_observed_at":"2026-08-15T02:05:32.819501Z","submitted_at":"2019-04-07T19:00:45Z","title":"Neo: A Learned Query Optimizer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.03711","snapshot_observed_at":"2026-08-14T15:21:50.518247Z","title":"Neo: A learned query optimizer","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.518247Z"},"links":{"cited_paper":"/paper/1904.03711","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:8e1d6f31460908434942fed0804c6972f873058bc3edcf1b8b4d83d8985aa6f8","observation_id":"46656035-c6da-4682-83ac-1e2136a7d39c","resolution":{"observed_at":"2026-08-14T15:21:50.518247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-14T15:21:50.523130Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.523130Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:c9077ad4aa5f0ae06cdc4441c725d9e082ef9028ae5df220fc43e87d3b6f6482","observation_id":"65ba32d6-babe-45d0-b023-20fd4d9ac686","resolution":{"observed_at":"2026-08-14T15:21:50.523130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.023272Z","title":"P., Mirza, M., Graves, A., Lillicrap, T., Harley, T., Silver, D., and Kavukcuoglu, K","venue":null,"work_id":"a16ff760-f955-4d67-896d-65c6a514b45d","year":1928},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.528120Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:ae103632dc18bd43a1fce3a8808a6c979be40324ce229c9ac5595821b5a07faa","observation_id":"3eade8a4-45eb-46f3-b4b5-7b286ecf3f1b","resolution":{"observed_at":"2026-08-14T15:21:51.029564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04718","last_updated":"2020-04-11T05:57:36Z","snapshot_observed_at":"2026-08-14T18:16:34.155333Z","submitted_at":"2018-10-10T19:20:36Z","title":"A Stochastic Approximation Approach for Foresighted Task Scheduling in Cloud Computing","version":2},"cited_work":{"arxiv_id":"1810.04718","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.04718","snapshot_observed_at":"2026-08-14T15:21:50.710835Z","title":"A Stochastic Approximation Approach for Foresighted Task Scheduling in Cloud Computing","venue":"cs.DC","work_id":"abbe01c0-2adc-463a-bff8-5a613478fe92","year":2018},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.533011Z"},"links":{"cited_paper":"/paper/1810.04718","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:491d9bee71fb8619ce13ffd6dafddc75b1cea282891c38101429e5b61ed16e67","observation_id":"6549131c-32b3-4b7a-8ed2-e46873144e3f","resolution":{"observed_at":"2026-08-14T15:21:50.718986Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08604","last_updated":"2018-03-22T22:39:32Z","snapshot_observed_at":"2026-08-14T19:33:21.239869Z","submitted_at":"2018-03-22T22:39:32Z","title":"Learning State Representations for Query Optimization with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08604","snapshot_observed_at":"2026-08-14T15:21:50.537780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.537780Z"},"links":{"cited_paper":"/paper/1803.08604","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:d1e23a81c9ef842aa8bfbc542b4efcf71544eabf35413526912468cc90629931","observation_id":"8e44b00e-10fd-41b8-994a-7e5e2f08af8e","resolution":{"observed_at":"2026-08-14T15:21:50.537780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.02494","last_updated":"2020-02-10T11:57:18Z","snapshot_observed_at":"2026-08-14T16:36:09.973967Z","submitted_at":"2019-05-07T12:15:06Z","title":"Reinforced Genetic Algorithm Learning for Optimizing Computation Graphs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.02494","snapshot_observed_at":"2026-08-14T15:21:50.542568Z","title":"Regal: Transfer learning for fast optimization of computation graphs","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.542568Z"},"links":{"cited_paper":"/paper/1905.02494","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:2d52f07bb07974b8f732af3fea7378c66f7917257b322c1acfb71ae4e1abce45","observation_id":"0b3c0038-9114-44d9-9009-fc73b5eb699e","resolution":{"observed_at":"2026-08-14T15:21:50.542568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.004875Z","title":"Semantic locality and context-based prefetching using reinforce- ment learning","venue":null,"work_id":"dbca7139-8823-4cf9-862a-eee7b9d8d4ab","year":2015},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.547836Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:8a5743c6cf60192ee5e590731bd3b44df23cc4d86fb08907d252a7d9e00eaa47","observation_id":"30458130-2d91-47b1-9a74-eeeeb3009117","resolution":{"observed_at":"2026-08-14T15:21:51.010966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.988094Z","title":"P., Obraczka, K., Burleigh, S., and Hirata, C","venue":null,"work_id":"8cb86c59-566e-41cd-851a-1106fc159669","year":2016},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.563366Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:1bad492641a480ad7b91928c6aaf4a6c4949029421d05ab52c7dd5e7e9ae7426","observation_id":"257fb1fb-ca77-40c9-9dbc-e75de8397943","resolution":{"observed_at":"2026-08-14T15:21:50.993127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.971791Z","title":"Machine learning in compiler optimization","venue":null,"work_id":"8d09e080-1e08-48f9-8b41-a29549187f8d","year":1901},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.568188Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:2adc016e8a97b1e33a5177f02c45ecaf4a563d55862aa8ee4240b77d5c087bc3","observation_id":"ebb2c584-f104-445b-b136-84ff63d22609","resolution":{"observed_at":"2026-08-14T15:21:50.976831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.00103","last_updated":"2017-11-09T23:06:14Z","snapshot_observed_at":"2026-08-03T05:45:09.122112Z","submitted_at":"2017-08-31T23:12:15Z","title":"Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.00103","snapshot_observed_at":"2026-08-14T15:21:50.577434Z","title":"Seq2sql: Generating structured queries from natural language using reinforce- ment learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.577434Z"},"links":{"cited_paper":"/paper/1709.00103","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:77ac7ccdaa6820bffa51681a20ffbb2f3f3baf1aa2b5e0924bf5f52469020a9e","observation_id":"8daf851d-f838-4a05-b827-3c4f25a8cabe","resolution":{"observed_at":"2026-08-14T15:21:50.577434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.938775Z","title":"A reinforcement learning approach to automatic error recovery","venue":null,"work_id":"b8e3efc4-807d-4a47-a709-4d95fd0ba597","year":2007},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.582390Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:d2e42e9256a3d27a6e67dbb530a80578fb93a4bd450f2321f137c12ba10b6e16","observation_id":"6ef79119-f153-434c-99ea-3f3fb5711f02","resolution":{"observed_at":"2026-08-14T15:21:50.943948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-14T15:21:50.558300Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.558300Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:f4aa51f841cb1981adeb5f1189b9fdcc2ea07c362e77b32342e36ee078df3853","observation_id":"353e3208-c3f6-4513-a045-991b4a3c2e96","resolution":{"observed_at":"2026-08-14T15:21:50.558300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.138271Z","title":"Energy-efﬁcient virtual machines consolidation in cloud data centers us- ing reinforcement learning","venue":null,"work_id":"02ffa66d-5d79-41cd-9c69-90945c3f12fc","year":2014},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.445112Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:13185da444351344e164b4ad2d89aa178d7dd2bf6292d2b274b2cd8aa9136168","observation_id":"ce5c9204-5520-4d21-ab6d-857cba63bb6b","resolution":{"observed_at":"2026-08-14T15:21:51.143986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.03196","last_updated":"2019-01-10T20:33:48Z","snapshot_observed_at":"2026-08-14T18:42:58.580322Z","submitted_at":"2018-08-09T15:30:06Z","title":"Learning to Optimize Join Queries With Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.03196","snapshot_observed_at":"2026-08-14T15:21:50.481128Z","title":"Learning to optimize join queries with deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.481128Z"},"links":{"cited_paper":"/paper/1808.03196","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:caa1fc17615c2a767e6c26779dc17bb1b6dd3eafa01e7c3e64330386afaf346e","observation_id":"dd34cad1-ffdd-4823-b017-c9bc726f552f","resolution":{"observed_at":"2026-08-14T15:21:50.481128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.090622Z","title":"M., Pahl, C., Metzger, A., and Estrada, G","venue":null,"work_id":"3c24d9ed-5947-448a-b26a-ebf4edbbb5b2","year":2015},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.476129Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:5cc20cc20e47d3ff19866223ad1fe49f34c2395fa8367233becbee31e98b5675","observation_id":"dca263bd-c607-4c3f-84da-2ad2d4d02024","resolution":{"observed_at":"2026-08-14T15:21:51.095317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.09975","last_updated":"2018-12-24T19:48:42Z","snapshot_observed_at":"2026-08-14T17:38:47.431254Z","submitted_at":"2018-12-24T19:48:42Z","title":"Iroko: A Framework to Prototype Reinforcement Learning for Data Center Traffic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.09975","snapshot_observed_at":"2026-08-14T15:21:50.553187Z","title":"Iroko: A framework to prototype reinforcement learning for data center trafﬁc control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.553187Z"},"links":{"cited_paper":"/paper/1812.09975","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:4a69dbdb5c8401b331d469da9eef4b3d50c839f07fd75b0b47d4495b23e70200","observation_id":"3f65f03d-e9c0-4e6b-8269-d58db559c0ac","resolution":{"observed_at":"2026-08-14T15:21:50.553187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.955829Z","title":null,"venue":null,"work_id":"6c0d4c4e-d781-4a54-910e-44f4d18e28e4","year":2017},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.572810Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:f7348d6bf501bbb070d598f2da1cfb5508e80f4237ce32aa35466d8637d104cb","observation_id":"621689b6-c168-4c04-97de-037d4b72e670","resolution":{"observed_at":"2026-08-14T15:21:50.960793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.041763Z","title":"A hierarchical framework of cloud resource allo- cation and power management using deep reinforcement learning","venue":null,"work_id":"2d60082d-9073-4d92-aa00-4f9329c3b375","year":2017},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.512996Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:91cc9854f4b7f6cdd18289e29f5c4708768ed6dea2da166ed77fba20524e999a","observation_id":"85855dde-fd10-4204-9fbf-a17f6c1e966d","resolution":{"observed_at":"2026-08-14T15:21:51.047557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00260","last_updated":"2019-09-04T19:30:00Z","snapshot_observed_at":"2026-08-14T19:23:21.694743Z","submitted_at":"2018-11-01T07:02:45Z","title":"Horizon: Facebook's Open Source Applied Reinforcement Learning Platform","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00260","snapshot_observed_at":"2026-08-14T15:21:50.450088Z","title":"Horizon: Facebook’s open source applied reinforcement learning platform","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.450088Z"},"links":{"cited_paper":"/paper/1811.00260","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:e668d800efdbba153237e36104014716284a0f9d613134be220431a1fed37877","observation_id":"5ce10ee3-c0b1-47f6-9238-b612a0de9e03","resolution":{"observed_at":"2026-08-14T15:21:50.450088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.00020","last_updated":"2017-04-23T07:16:13Z","snapshot_observed_at":"2026-08-14T21:32:35.593793Z","submitted_at":"2016-10-31T20:07:23Z","title":"Neural Symbolic Machines: Learning Semantic Parsers on Freebase with Weak Supervision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.00020","snapshot_observed_at":"2026-08-14T15:21:50.492154Z","title":"D., and Lao, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.492154Z"},"links":{"cited_paper":"/paper/1611.00020","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:d461d0959525a3c8c99ea730c36e33d4ab5d51ebdd67e8d1f689d3b3ab5c26b6","observation_id":"e67973b2-5a57-4a21-9d62-e75a6d1f27bf","resolution":{"observed_at":"2026-08-14T15:21:50.492154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.434077Z","title":"Castro, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.434077Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:4cf8198fa96cde79a56db61b616708e43b854f866f219572fe47547bcff723bf","observation_id":"aca0b995-cb4e-4dd7-9516-27df91712d13","resolution":{"observed_at":"2026-08-14T15:21:50.434077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.06110","last_updated":"2018-12-14T19:03:38Z","snapshot_observed_at":"2026-08-14T19:03:45.460809Z","submitted_at":"2018-12-14T19:03:38Z","title":"Dopamine: A Research Framework for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.06110","snapshot_observed_at":"2026-08-14T15:21:50.439294Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.439294Z"},"links":{"cited_paper":"/paper/1812.06110","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:085962a4a919f7a567688e6a3e777d5b96af6bafd4a21429ec235ee57733fd01","observation_id":"fe4bf235-4093-4328-a5d4-39a4d09e56f5","resolution":{"observed_at":"2026-08-14T15:21:50.439294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-14T15:21:50.507654Z","title":"P., Hunt, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.507654Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:86d510463ea461391bbe974ae7afdac5a6e98bf913e92a0bc6ae3f4ad9ca4b87","observation_id":"0020236b-a2b5-42d6-9bfd-54c9f8b01aca","resolution":{"observed_at":"2026-08-14T15:21:50.507654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T18:20:33.909836Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":2,"verified_fuzzy":11},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:1908.01275."}