{"as_of":"2026-08-05T10:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bdcbefa4a198c584546544fb5464947eabcc740f5a667a3ce73d732a53afe2a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T21:36:15.462731Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":685,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"1906.10124","last_updated":"2019-06-25T15:18:10Z","snapshot_observed_at":"2026-08-02T15:08:54.470275Z","submitted_at":"2019-06-25T15:18:10Z","title":"On Multi-Agent Learning in Team Sports Games","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-25T15:51:28.289206Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/1906.10124"},"observation_digest":"sha256:64b06696ee87e095518b565ab34e659486f7ed4934f6e5cc4fe0fdd0794fdfb2","observation_id":"d0273461-0999-4404-ba80-a2ac269a3c0d","resolution":{"observed_at":"2026-05-25T15:56:01.083402Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"1906.12213","last_updated":"2019-06-27T09:26:22Z","snapshot_observed_at":"2026-08-01T03:34:30.364434Z","submitted_at":"2019-06-27T09:26:22Z","title":"On the notion of number in humans and machines","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-25T15:00:17.763409Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/1906.12213"},"observation_digest":"sha256:3b28c10f019611d9c32bd8f1bf20c6d3bc4657877cbf4a9534c14fcf0ea5100e","observation_id":"c1a135e8-97c2-4348-b5b8-8bb4ced94a95","resolution":{"observed_at":"2026-05-25T15:00:57.476299Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"1906.12266","last_updated":"2019-06-28T15:35:11Z","snapshot_observed_at":"2026-07-06T08:03:38.968054Z","submitted_at":"2019-06-28T15:35:11Z","title":"Growing Action Spaces","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T13:24:59.682609Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/1906.12266"},"observation_digest":"sha256:1974f8a7918061be2d8f3fb3eb58cb0f5252ddcace36ea8462c35de4fa2ab0f5","observation_id":"06e99ac3-fe0a-4ed6-b238-a3534fdbba75","resolution":{"observed_at":"2026-05-25T13:25:52.321518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"1907.09273","last_updated":"2019-07-25T21:52:08Z","snapshot_observed_at":"2026-07-06T08:09:17.579596Z","submitted_at":"2019-07-22T12:32:15Z","title":"Why Build an Assistant in Minecraft?","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-24T18:20:58.081505Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/1907.09273"},"observation_digest":"sha256:9f4a9e2316077c446a2d52f4b8550cc6dfbd5c8e8f03d1b68505ae2943cb6495","observation_id":"35e75a83-3d24-4313-a2d7-1f86f895855d","resolution":{"observed_at":"2026-05-24T18:24:48.301430Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"1907.09467","last_updated":"2019-07-20T05:13:53Z","snapshot_observed_at":"2026-07-06T08:09:23.168454Z","submitted_at":"2019-07-20T05:13:53Z","title":"Arena: a toolkit for Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T18:35:31.633881Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/1907.09467"},"observation_digest":"sha256:6dd6577b3738dd920b519eda2633cf51b0d4665a1f56624840c9582b592ae823","observation_id":"f5bbccb0-2ae1-48a0-bc6a-915220e915df","resolution":{"observed_at":"2026-05-24T18:36:19.029469Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-12T13:05:34.106110Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/1911.01547"},"observation_digest":"sha256:e02b27bf7671854c7df2353f0bc220e7df8e2db2ff73bc1de1b728ccdd42f9eb","observation_id":"c9bcdcb0-802e-4441-84fb-064b766c5d51","resolution":{"observed_at":"2026-05-12T13:05:34.246284Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-24T15:14:20.064520Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/1912.01703"},"observation_digest":"sha256:6e69d90b2aea2cf733ad4355853bd6138c2abce5f7517c64de990c6607ec3aef","observation_id":"4a229d33-acbc-40af-a90f-f670dfd602d6","resolution":{"observed_at":"2026-05-24T15:14:37.086856Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2502.13388","last_updated":"2026-04-10T14:53:27Z","snapshot_observed_at":"2026-07-06T20:38:57.586136Z","submitted_at":"2025-02-19T02:53:43Z","title":"Reflection of Episodes: Learning to Play Game from Expert and Self Experiences","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T03:09:43.596964Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2502.13388"},"observation_digest":"sha256:f2f138714712cdaec52390c389df5823a37406567610b0b04a945de973311f46","observation_id":"0a615c1f-66db-42b6-82eb-928eaa70934f","resolution":{"observed_at":"2026-05-23T03:12:28.494471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2506.21872","last_updated":"2026-04-07T07:52:44Z","snapshot_observed_at":"2026-07-06T21:48:26.210695Z","submitted_at":"2025-06-27T03:10:20Z","title":"A Survey of Continual Reinforcement Learning","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-19T08:27:03.376909Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2506.21872"},"observation_digest":"sha256:17c91cc39a86946136667d4be2278b9015eb3dac14a06ff8ef16a3d9791bbff3","observation_id":"2ce40946-0517-48f3-80c3-2264f19c5da5","resolution":{"observed_at":"2026-05-19T08:27:11.200227Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2511.15407","last_updated":"2026-05-24T06:09:04Z","snapshot_observed_at":"2026-08-03T21:29:28.726590Z","submitted_at":"2025-11-19T13:04:44Z","title":"IPR-1: Interactive Physical Reasoner","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-17T20:55:10.819298Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2511.15407"},"observation_digest":"sha256:d3decc5eeb4622f3781acdfe81941119b1a161ece7e31758f83de36c387b1718","observation_id":"73ff22d3-c7c3-48d1-953f-a0b2b2609ca5","resolution":{"observed_at":"2026-05-17T20:55:14.975569Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-03T21:29:36.422499Z","title":"Starcraft ii: A new challenge for rein- forcement learning.arXiv preprint arXiv:1708.04782, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.15407","last_updated":"2026-05-24T06:09:04Z","snapshot_observed_at":"2026-08-03T21:29:28.726590Z","submitted_at":"2025-11-19T13:04:44Z","title":"IPR-1: Interactive Physical Reasoner","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T21:29:36.422499Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2511.15407"},"observation_digest":"sha256:8d0bee0a308745b1e6542b1cacba2cf9d11590445eb6642a122cdaaf10659442","observation_id":"3e74255b-5665-4594-95d9-a444c91c232d","resolution":{"observed_at":"2026-08-03T21:29:36.422499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2511.17925","last_updated":"2026-04-11T05:08:44Z","snapshot_observed_at":"2026-08-02T19:13:44.983364Z","submitted_at":"2025-11-22T05:40:52Z","title":"Switch-JustDance: Benchmarking Whole Body Motion Tracking Controllers Using a Commercial Console Game","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-17T06:35:08.882701Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2511.17925"},"observation_digest":"sha256:acb3afa7eeb913070c227d29b6db1cc17b41e062ba323d75c81b9c55ec9d7344","observation_id":"ac265728-4253-471e-8af7-15834ae13a00","resolution":{"observed_at":"2026-05-17T06:39:10.386962Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-03T11:34:15.008621Z","title":"Towers\": 2[ 3{","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2601.05899","last_updated":"2026-05-26T17:34:04Z","snapshot_observed_at":"2026-08-04T14:56:41.772989Z","submitted_at":"2026-01-09T16:18:08Z","title":"TowerMind: A Tower Defence Game Learning Environment and Benchmark for LLM as Agents","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T11:34:15.008621Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2601.05899"},"observation_digest":"sha256:f9516c3903f51c04ba65bb6a9f292b680aa69235e0ae7b5275724ea4c847bd7e","observation_id":"97f471f9-1bc0-4763-a86e-55caebe366d5","resolution":{"observed_at":"2026-08-03T11:34:15.008621Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2604.08685","last_updated":"2026-04-09T18:16:19Z","snapshot_observed_at":"2026-07-06T22:57:45.084987Z","submitted_at":"2026-04-09T18:16:19Z","title":"RAMP: Hybrid DRL for Online Learning of Numeric Action Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T17:06:22.252782Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2604.08685"},"observation_digest":"sha256:dc82062a7b7c259f51441c160002eeba1b8d01e25eacc36ff6cc697adbda2c1f","observation_id":"632aa44b-fc82-4fa7-a48b-6500e5f4c9e9","resolution":{"observed_at":"2026-05-11T07:35:58.090609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2605.01862","last_updated":"2026-05-08T03:23:44Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T13:11:28Z","title":"QHyer: Q-conditioned Hybrid Attention-mamba Transformer for Offline Goal-conditioned RL","version":2},"reference_index":236,"source":"arxiv_source","source_observed_at":"2026-05-11T01:17:48.643521Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2605.01862"},"observation_digest":"sha256:6fc169cdc3a789b2e88e7ea31f44bcb5e8f2fc39a601996955f073031bb71251","observation_id":"7472ead7-3b43-4085-9065-6a680560dba0","resolution":{"observed_at":"2026-05-11T04:30:58.230035Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2605.07837","last_updated":"2026-05-08T15:04:04Z","snapshot_observed_at":"2026-07-09T23:17:43.933034Z","submitted_at":"2026-05-08T15:04:04Z","title":"Approximation-Free Differentiable Oblique Decision Trees","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-11T03:39:14.908354Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2605.07837"},"observation_digest":"sha256:850171adbd0b5da0163e02f6bd558bf71b2135e8eeaf6358180af7c96c58381a","observation_id":"13d15c3f-9fbf-4f32-8182-40d3ad2a5d0c","resolution":{"observed_at":"2026-05-11T03:40:53.745981Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2606.22502","last_updated":"2026-06-21T13:50:43Z","snapshot_observed_at":"2026-08-02T20:29:08.654346Z","submitted_at":"2026-06-21T13:50:43Z","title":"WebCQ: Cooperative Multi-Agent Deep Reinforcement Learning for Scalable Web GUI Testing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T09:54:19.822312Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2606.22502"},"observation_digest":"sha256:488752b75b1e5812c60b29249922603d551fd1ec18c7154a8d7a32cf8ecb2e2d","observation_id":"8fc3b084-9943-4ab5-a6ef-862454ba4e2c","resolution":{"observed_at":"2026-07-04T09:29:44.151813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2606.30090","last_updated":"2026-06-29T10:28:43Z","snapshot_observed_at":"2026-07-07T00:04:00.652252Z","submitted_at":"2026-06-29T10:28:43Z","title":"SAT-RTS: A systematic framework for tactical knowledge extraction and visualization-based analysis in real-time strategy games","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T06:03:21.785190Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2606.30090"},"observation_digest":"sha256:8eda81796baaf04fcff05ae6c38ead474f32d7010661c74dba78ec1fff5fa47c","observation_id":"58d66827-551c-4d64-9bdc-0f3b65458729","resolution":{"observed_at":"2026-06-30T06:04:20.409447Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1708.04782","doi":"10.48550/arxiv.1708.04782","metadata_source":"pith","pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","venue":"cs.LG","work_id":"9c70874f-186a-43a4-be0b-cc1efa99bd91","year":2017},"citing_paper":{"arxiv_id":"2607.00190","last_updated":"2026-06-30T21:15:34Z","snapshot_observed_at":"2026-07-07T00:05:54.401681Z","submitted_at":"2026-06-30T21:15:34Z","title":"Play Like Champions: Counterfactual Feedback Generation in Latent Space","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-02T19:41:39.901829Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2607.00190"},"observation_digest":"sha256:0fa73f28d35373a5ae88f0ac4fb88d81bb12216c59570f8bca795cbcf69b4c48","observation_id":"ba9d1d9b-71c7-463d-8eb5-9b8cc00973b6","resolution":{"observed_at":"2026-07-02T19:47:18.891339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-01T15:04:31.485558Z","title":"arXiv preprint arXiv:1708.04782 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18597","last_updated":"2026-07-25T03:45:26Z","snapshot_observed_at":"2026-08-01T15:04:25.301340Z","submitted_at":"2026-07-21T00:17:55Z","title":"A Self-Evolving Default Action for Cooperative Tasks with Continuous Action Space","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T15:04:31.485558Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2607.18597"},"observation_digest":"sha256:391e968bf03d2ef1a784b92e513c5ddae8ead0734450203bc234daf44db2479e","observation_id":"b8400634-b611-4eb0-9d7d-0024ad964428","resolution":{"observed_at":"2026-08-01T15:04:31.485558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-04T21:36:15.462731Z","title":"arXiv preprint arXiv:1708.04782 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01763","last_updated":"2026-08-03T06:34:31Z","snapshot_observed_at":"2026-08-05T09:21:41.037128Z","submitted_at":"2026-08-03T06:34:31Z","title":"EntailLLM: Verifying LLM-Generated Vulnerability Discovery Paths with Domain Knowledge via Logic Programming","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-04T21:36:15.462731Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2608.01763"},"observation_digest":"sha256:9b4d628494555faddc9a0adb8f88a10c4c9be54de714a76990b6bfcea8a3fe54","observation_id":"bb921b60-8587-4df8-a10a-236f5ba8dce5","resolution":{"observed_at":"2026-08-04T21:36:15.462731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1708.04782/citation-record","integrity":"/paper/1708.04782/integrity","json":"/paper/1708.04782/citation-record.json","paper":"/paper/1708.04782"},"outbound":[],"paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:1708.04782."}