{"as_of":"2026-08-23T11:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:36556abdc695e37b7257ccaee4df4af644ea2d49da731b2706d4cac8df3ad5b4","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T10:45:48.307747Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.10577/citation-record","integrity":"/paper/1908.10577/integrity","json":"/paper/1908.10577/citation-record.json","paper":"/paper/1908.10577"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.709942Z","title":"Trafﬁc’s mind-boggling economic toll,","venue":null,"work_id":"06303153-a87f-4ce4-8b0b-f6e3af74d722","year":2018},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.934217Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:84a48b78cbfa5dbb43c0156288ecdc45ab01625d745894467a159b1ab2b528c2","observation_id":"44a41484-d7ea-45c8-aed5-65f8e740cb89","resolution":{"observed_at":"2026-08-14T10:45:49.720208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.688467Z","title":"Exploring the so- cial learning of taxi drivers in latent vehicle-to-vehicle networks,","venue":null,"work_id":"c8d0c5a7-3702-4f07-9bff-0d577c836908","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.940168Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:01db2baf510a9780c538992412c70a2febaefa125f54f4478b86157f05476fcb","observation_id":"158320cd-e432-46d0-9b4c-4511dfdc77d9","resolution":{"observed_at":"2026-08-14T10:45:49.694581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.665896Z","title":"Bidirectionally coupled network and road trafﬁc simulation for improved IVC analysis,","venue":null,"work_id":"b8a5e91d-c4cc-47b7-80f4-8b8cd69688c6","year":2010},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.946945Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:6f3f9e741d686fc60a9f7886d0b8d5b1ba1d6382dbad197aefb69722cf2366dd","observation_id":"ca5d6be0-3b31-4d7d-8613-d72c4a4959af","resolution":{"observed_at":"2026-08-14T10:45:49.672156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.649165Z","title":"Block simplex signal recovery: Methods, trade-offs, and an application to routing,","venue":null,"work_id":"fe71d0aa-9a00-4c1d-8f6c-0550ece56de3","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.955849Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:c0534d6758804647d21d335ce87ac74a474dff31d6090181738304e1928bf34e","observation_id":"b12744c8-69d8-45a6-935b-ea46949ff69c","resolution":{"observed_at":"2026-08-14T10:45:49.653950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.629935Z","title":"Re- grets in routing networks: Measuring the impact of routing apps in trafﬁc,","venue":null,"work_id":"f5608ac5-28bb-4fb4-9c74-05397cb8f84d","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.964042Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:ec0933661c8389e8be78f4fef9c36f96b06b3639cbaa07561ae5d46520d96070","observation_id":"e77d8205-b154-4228-bf1d-fd54594b9c02","resolution":{"observed_at":"2026-08-14T10:45:49.636431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.611162Z","title":"Competitive analysis for points of interest,","venue":null,"work_id":"e0eb5acc-14f1-4d9b-95cc-d6c3b78e90dd","year":2020},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.979946Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:5c53a3c33d87ea23e031d7f747ee600cd9741dfe8a4c297b6e92d366c9327f45","observation_id":"2db67a4d-9018-47c0-a141-3967aeb8fe6b","resolution":{"observed_at":"2026-08-14T10:45:49.617718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.594632Z","title":"Semi-supervised hierarchical recurrent graph neural network for city-wide parking availability prediction,","venue":null,"work_id":"0805599e-6ea0-42d9-8e19-49b03c6d2099","year":2020},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.986978Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:c1e58a8c75cc4bedcc78cdc13bb603ba2f230ce7e89d91db933bec1c961b7fc1","observation_id":"8a0a5991-58fa-4982-869e-4a5c104f5544","resolution":{"observed_at":"2026-08-14T10:45:49.599939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.577697Z","title":"Settings for ﬁxed-cycle trafﬁc signals,","venue":null,"work_id":"95107f4d-500b-420b-b45c-6cf20e25fc05","year":1963},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.992830Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:8cca033c68e059ae312a943578b647cb597699e9f5f2177f9ac2d1fb5417c8dc","observation_id":"acac9a22-9b73-4591-bd7c-f6127aaadedc","resolution":{"observed_at":"2026-08-14T10:45:49.583029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.556469Z","title":"Trafﬁc network micro- simulation model and control algorithm based on approximate dynamic programming,","venue":null,"work_id":"963fb448-434f-438f-b449-2ce833b9c72e","year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:47.997941Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:99f070c3b4a9a08afb42bc21ad788b00108e9a1a919a10cc233f13d2bff68c73","observation_id":"116bbfb8-bd05-4e45-ad03-7199acbd5eef","resolution":{"observed_at":"2026-08-14T10:45:49.562976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.538695Z","title":"Self-organizing trafﬁc lights: A realistic simulation,","venue":null,"work_id":"84b1c77a-cc24-46bc-900d-dff6fc774c55","year":2013},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.004776Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:3b0adcd98ace9b1753e48c5d78f9648c93bf5324a8cb1ba042ee64ce409dc241","observation_id":"cf641cb6-6db6-4b76-acc5-b84b2fcd74da","resolution":{"observed_at":"2026-08-14T10:45:49.544550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.522836Z","title":"Intellilight: A reinforcement learning approach for intelligent trafﬁc light control,","venue":null,"work_id":"1f1bc61c-dd85-461a-9500-e9b7b040e619","year":2018},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.010911Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:2f4aa4c492b766488ba5999e041114ed86c5e44bd5bc88c9c71e4f86f6463651","observation_id":"8fabcb6e-f68e-4779-81ab-84c986d4fcb8","resolution":{"observed_at":"2026-08-14T10:45:49.528381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.506051Z","title":"An experimental review of reinforcement learning algorithms for adaptive trafﬁc signal control,","venue":null,"work_id":"c1f7d4c4-6aef-44c9-94d5-94aa50aae418","year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.015935Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:d0f704b4781ab0ef94ddf72c7c16b0c3caace141c6ea5813b07c24898585789b","observation_id":"893d9b57-5d26-47ed-a97b-72241cebb394","resolution":{"observed_at":"2026-08-14T10:45:49.511907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.486196Z","title":"Em- bed to control: A locally linear latent dynamics model for control from raw images,","venue":null,"work_id":"555b38ea-06cd-4056-b910-ace52f48c44e","year":2015},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.021233Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:0702fe5c0f645a5afadbf84fa6f7b1f7c51ed5f9f0ba1b3220a42e0e5190decc","observation_id":"3308ea27-009f-4402-9be6-dd7969bef892","resolution":{"observed_at":"2026-08-14T10:45:49.492347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.466562Z","title":"A comprehensive survey of multiagent reinforcement learning,","venue":null,"work_id":"6fb91af7-4274-4a1b-b293-44531b5fdc75","year":2008},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.026290Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:0dbf967e740ebb964da2c9823e06e956794f6c72fa559fa320b495ead924e738","observation_id":"10206968-cff2-4fc7-b8e9-f9090f8e4c57","resolution":{"observed_at":"2026-08-14T10:45:49.472637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.449147Z","title":"Multiagent reinforcement learning for urban trafﬁc control using coordination graphs,","venue":null,"work_id":"aa9f5408-e01d-4751-bcd2-86e57604f7b9","year":2008},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.031103Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:09add5a85e53c6256daa2690aa0b4400e00bcf49b8eb4164330551273b16c7f4","observation_id":"2e954b87-ff74-4477-8c95-62185da34279","resolution":{"observed_at":"2026-08-14T10:45:49.454927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.433346Z","title":"Graph attention networks,","venue":null,"work_id":"3cacefc9-4881-40fb-a208-b094f1daf6fa","year":2018},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.036220Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:5e8e1ad3b133c4d46a01569c69f666784e8e40827e91f4e44df5f95246e736d6","observation_id":"37c8acfd-44eb-486b-941a-b3c0023df0d1","resolution":{"observed_at":"2026-08-14T10:45:49.438624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.414753Z","title":"Multiagent reinforcement learning for integrated network of adaptive trafﬁc signal controllers (MARLIN-ATSC): methodology and large-scale application on downtown toronto,","venue":null,"work_id":"aafe2ebd-da37-4ba0-9c16-b9e4ee4fce5f","year":2013},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.041448Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:492a2335916f516c1623903fc7085a3c1baa6a8dff3bc127f219ee62355d6c07","observation_id":"5c87fc6d-0c41-426e-a445-3258a4955876","resolution":{"observed_at":"2026-08-14T10:45:49.420160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.394262Z","title":"Adaptive multi-objective reinforce- ment learning with hybrid exploration for trafﬁc signal control based on cooperative multi-agent framework,","venue":null,"work_id":"830ab5d6-f4e6-4941-a5e8-1444cdc27b8e","year":2014},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.046868Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:07b5f3a8b74d512ad8ab3711523c887f313f0f84d48242705fde013a47a6949c","observation_id":"61ea6927-18d5-44c0-bf8f-938cbe1f2718","resolution":{"observed_at":"2026-08-14T10:45:49.400181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.363977Z","title":"Reinforcement learning for true adaptive trafﬁc signal control,","venue":null,"work_id":"8b98afee-c551-4a7f-822b-623154347395","year":2003},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.051815Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:e4bd6e3ffbb7915bef7b59ef6cdee36dd5c5471e4def9a6ebe854c54b1f20a48","observation_id":"b5f95c68-d218-4758-8cc4-9616b0ea28c1","resolution":{"observed_at":"2026-08-14T10:45:49.373882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.345440Z","title":"An agent-based learning towards decentralized and coordinated trafﬁc signal control,","venue":null,"work_id":"768aab1e-8fa7-43bc-a793-cafbeae6d818","year":2010},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.056934Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:7758d987b2d0c16bbcc46575f0b307db49ade268cb9483dea5ba5c623dc5bcec","observation_id":"a377488e-7794-4e68-be80-82b70f67d372","resolution":{"observed_at":"2026-08-14T10:45:49.350592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.324276Z","title":"Reinforcement learning of trafﬁc light controllers adapting to trafﬁc congestion","venue":null,"work_id":"5ff40083-3f49-4b03-a1c3-e35dca932542","year":2005},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.062050Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:ec3dad1148b958fd7be17b49361bfe11278050f8ee5fc038fc4673a3ba498683","observation_id":"bde3929c-a86b-4967-a700-35d44f60eac8","resolution":{"observed_at":"2026-08-14T10:45:49.329959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.301646Z","title":"Reinforcement learning- based multi-agent system for network trafﬁc signal control,","venue":null,"work_id":"5aecea80-0f9b-4647-8cab-d0e2ff9759a6","year":2010},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.066991Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:44de6baffae02714546fe81b71bea36cea094b5c2746705a972d28e3514f43d1","observation_id":"4f791da3-ff3e-486b-b431-847b165fde09","resolution":{"observed_at":"2026-08-14T10:45:49.310553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.280558Z","title":"Time critic policy gradi- ent methods for trafﬁc signal control in complex and congested scenarios,","venue":null,"work_id":"9ae8a9bf-ab22-4660-8f70-4afa68262d2b","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.072508Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:0179ef8affddd379f13b05f882acdb305e3bf9d636617225aebf063d6dd0413a","observation_id":"f5aa3d17-e5c0-4ee5-94ea-9611bf7510b8","resolution":{"observed_at":"2026-08-14T10:45:49.287201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.258594Z","title":"Coordinated deep reinforce- ment learners for trafﬁc light control,","venue":null,"work_id":"318dd129-8eac-41aa-b984-4080932643e7","year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.078203Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:ee9065ae01382294cdc7c9b3029c745d7e92bdc196f2302dbba3182aa6459911","observation_id":"313ad637-259a-410d-a15e-323cdb14f51a","resolution":{"observed_at":"2026-08-14T10:45:49.264735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.238752Z","title":"Collaborative multiagent reinforcement learning by payoff propagation,","venue":null,"work_id":"cd03fc58-7872-4ac3-8c86-d295823b147b","year":2006},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.083306Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:c4c2524d5a0c6f041a1ecb5fa986c8938deaa339bf009a381b4971a7880a2dfb","observation_id":"83e6ba56-6033-46ad-a548-c2778de42170","resolution":{"observed_at":"2026-08-14T10:45:49.245209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.220544Z","title":"Trafﬁc light control by multiagent reinforcement learning systems,","venue":null,"work_id":"4f628075-3fc4-428c-8a7b-77985b418344","year":2010},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.088507Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:9be3c7d8a5bd908f50047b2fc779b9c4d7c959b8d9bb398da607c3469b68bb86","observation_id":"7021a4dc-4b01-4d5b-be5b-c7bb0b5354ed","resolution":{"observed_at":"2026-08-14T10:45:49.225927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.199598Z","title":"Multi-agent reinforcement learning for trafﬁc light control,","venue":null,"work_id":"fd69c58b-43f2-45f8-8972-5989ed4693c2","year":2000},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.093399Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:a46879133bf0a3f9be8e164e8325f56e1b5974e526ea3a3704f07803ef56597f","observation_id":"595abafc-dc3f-49bb-90fe-97538d30ed89","resolution":{"observed_at":"2026-08-14T10:45:49.207081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.176087Z","title":"Multi-agent deep re- inforcement learning for large-scale trafﬁc signal control,","venue":null,"work_id":"331d717c-3d27-4bad-ade5-fe6faefcc876","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.098608Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:cb61fede9a2049a9a48fcd13611a586ca1cb8fbfe5a2df4280e4faa31dc00d73","observation_id":"8fd6913a-c948-48ec-8de1-4d8b21f382d9","resolution":{"observed_at":"2026-08-14T10:45:49.181539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.158652Z","title":"Presslight: Learning max pressure control to coordinate traf- ﬁc signals in arterial network,","venue":null,"work_id":"7db3a773-068e-4e22-92b8-d567db830173","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.103735Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:0ae31121a6471a3ffa317e1c2c0a2a5a39609cae97edd362e288b05acc07d72c","observation_id":"a6cd2be8-ff6a-44c5-a9ad-aa832f51ccf0","resolution":{"observed_at":"2026-08-14T10:45:49.164616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.136941Z","title":"The max-pressure controller for arbitrary networks of signalized intersections,","venue":null,"work_id":"a232f006-f6d6-4df9-8e77-6489cea4ae9a","year":2013},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.108389Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:6c7221193205c03e89cb793897319eadad6421779229e4eee07e58e305af5748","observation_id":"302f9cb1-03bc-468f-afd1-b68efef2d65b","resolution":{"observed_at":"2026-08-14T10:45:49.143211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.119644Z","title":"Trafﬁc signal control based on reinforcement learning with graph convolutional neural nets,","venue":null,"work_id":"dd1e14ce-c3a2-4e9d-9f1c-862148d564fa","year":2018},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.113437Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:6054766dfaa353d9f5375b7a3119658bd7203a3f7bc26122c5cc188f9caf6ca4","observation_id":"899a21da-ea05-430e-b4a1-6ee5d784f981","resolution":{"observed_at":"2026-08-14T10:45:49.124863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.097798Z","title":"Colight: Learning network-level coop- eration for trafﬁc signal control,","venue":null,"work_id":"3e7f8c2e-efd6-4a03-a4c7-46dad4836cb6","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.118649Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:9fd97f691e20e8700c6d39802f9a65da8bd30b3830a05aef3a9d2ab21cab581e","observation_id":"2bc5ba23-6388-4fe4-90a4-8cd273ed31f5","resolution":{"observed_at":"2026-08-14T10:45:49.105913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.073542Z","title":"A distributed virtual traf- ﬁc light algorithm exploiting short range V2V communications,","venue":null,"work_id":"0fd4d9b3-f095-4367-8aa8-00de6a09697b","year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.123690Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:0519640a9f4e5812038a0d58b0ec696677f8e3d2f56ff49c3c975ed10d130740","observation_id":"a88a1682-0eab-41f1-999d-7f07e032d79e","resolution":{"observed_at":"2026-08-14T10:45:49.079331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.053786Z","title":"On the impact of virtual trafﬁc lights on carbon emissions mitigation,","venue":null,"work_id":"1f181818-0928-477b-9354-29855e78f8b4","year":2011},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.128459Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:b5476308c5e8486d152f957d54fe8de95df6aca4d5301cb2b30c8175dc6c333e","observation_id":"f87ca0f3-f27a-4c26-ac7a-271c558b3335","resolution":{"observed_at":"2026-08-14T10:45:49.061347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.027423Z","title":"Cooperative multi- agent control using deep reinforcement learning,","venue":null,"work_id":"0a36ae64-74d7-4541-8b1f-67e11ff39e3a","year":2017},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.133349Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:567c4989f30a8fcb2908c844a299cc9ef19e36380d7e7bc2ccfee509ed6fe7e6","observation_id":"57b1c484-dc73-4cd7-b019-655a3474468a","resolution":{"observed_at":"2026-08-14T10:45:49.035416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:49.011233Z","title":"Cooperative multi-agent learning: The state of the art,","venue":null,"work_id":"4703c299-4ece-4a5c-9587-f69ac4e7bfa6","year":2005},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.137989Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:678a7ac9bbf6b34d05f8eb9e9c3c5cb050fe831227c26372bd2550d0401e21b8","observation_id":"8d32b7d9-1481-47e9-857a-e98295f7d729","resolution":{"observed_at":"2026-08-14T10:45:49.016351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.988627Z","title":"Learning to communicate with deep multi-agent reinforcement learning,","venue":null,"work_id":"5181211d-907d-414b-887a-c33c28ac6327","year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.143187Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:f1787cc55ed0ac02bc79dbb95e1c12542e4fcb8ebf2b1a0fb87f4ca9253f10d1","observation_id":"bb757b96-b408-45b0-be88-ddc9473ab041","resolution":{"observed_at":"2026-08-14T10:45:48.996019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.969052Z","title":"Learning multiagent communi- cation with backpropagation,","venue":null,"work_id":"e2d9b1d3-c9e6-4729-baae-3664c86b0109","year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.148132Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:356e2cf271fc6caecfff7453b88366a757cd74c4c56e2b3fa9b9bac9591e5347","observation_id":"7226767f-784a-4bb0-b45e-a8d32738623f","resolution":{"observed_at":"2026-08-14T10:45:48.974071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.952300Z","title":"Soft information for localization-of-things,","venue":null,"work_id":"e9788c39-1d9c-43d7-87ab-8bd8b3f4276f","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.153054Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:f22f81b08bc1fb3c15cafc5ce2dc83a0bca689cc97882d87bf03c41ab76a2be4","observation_id":"1eadf582-2121-495d-ac58-62d18de05739","resolution":{"observed_at":"2026-08-14T10:45:48.957328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.930792Z","title":"Network operation strategies for efﬁcient localization and navigation,","venue":null,"work_id":"792a9e41-f79b-402e-8633-b01ba7b187f4","year":2018},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.157834Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:938491082e0aebf8c6fc4d62b9509ad51e8476ac75c24866a5a1a6e5c27ccdbd","observation_id":"52b8fbc5-bb6d-49fe-9ea2-da65fde188d3","resolution":{"observed_at":"2026-08-14T10:45:48.940415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.912473Z","title":"Decen- tralized gaussian ﬁlters for cooperative self-localization and multi- target tracking,","venue":null,"work_id":"03ef9555-360c-4556-98cd-3cdc587dfba9","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.162602Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:d22801ec7f3d6bcc700792f45fca3b250a2ca778688fd83ba4324665bbb6eb48","observation_id":"2fc9a315-37fc-448d-af51-df305f8603f3","resolution":{"observed_at":"2026-08-14T10:45:48.918454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.890264Z","title":"Experiments with cooperative control of underwater robots,","venue":null,"work_id":"9d6ddf39-029f-43ae-aaa1-0701a155b6b2","year":2009},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.167621Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:f69308d057002ec87361706f51e04227a89ae265f97cd03d2d9936f87c9ab311","observation_id":"09aa34c3-ff4c-44f1-acf7-0a03a7f44abb","resolution":{"observed_at":"2026-08-14T10:45:48.896127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.871790Z","title":"A multiple-goal reinforcement learning method for complex vehicle overtaking maneuvers,","venue":null,"work_id":"c5e6b579-4fe9-4996-929e-a80854fc6d35","year":2011},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.172657Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:c581d6a59a77c30d59150663b782092d89cae5bc38f52ba98cd9cd9cf2c746fc","observation_id":"c8d101c7-1ce0-48c0-956a-9636a0ffacb4","resolution":{"observed_at":"2026-08-14T10:45:48.878109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.854866Z","title":"Playing atari with deep reinforce- ment learning,","venue":null,"work_id":"de73ce80-ad3f-4979-834a-298e97a605e3","year":2013},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.177399Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:e4e0acec0c48c0f395fc16ffa002c734c68c5532350ff490648164935bcbe938","observation_id":"bbd3d813-ed02-4f19-8cbc-32c4539ab0ec","resolution":{"observed_at":"2026-08-14T10:45:48.859932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.838423Z","title":"Multiagent cooperation and competition with deep reinforcement learning,","venue":null,"work_id":"606d6e25-0849-4e2b-9911-d4c0e9986054","year":2017},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.183496Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:e801774c1e82591e0188420bcfd6ff1a5ad1a9e44735bd4f884d5917d3885215","observation_id":"f1ff8fa7-8988-42a3-9ca5-9478e9b2b029","resolution":{"observed_at":"2026-08-14T10:45:48.844376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1401.8074","last_updated":"2014-01-31T07:02:58Z","snapshot_observed_at":"2026-08-19T15:42:12.822443Z","submitted_at":"2014-01-31T07:02:58Z","title":"Empirically Evaluating Multiagent Learning Algorithms","version":1},"cited_work":{"arxiv_id":"1401.8074","doi":null,"metadata_source":"pith","pith_arxiv_id":"1401.8074","snapshot_observed_at":"2026-08-14T10:45:48.455092Z","title":"Empirically Evaluating Multiagent Learning Algorithms","venue":"cs.GT","work_id":"14e0b25f-d4b8-4e0c-8751-747f20bcf765","year":2014},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.188074Z"},"links":{"cited_paper":"/paper/1401.8074","citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:1f2cc7e1fe99ed05ad5810e76c0a9a5ff509ae49b71ac74c97e84db5fee72075","observation_id":"66cab8c5-69ca-4792-9acd-4c172d509005","resolution":{"observed_at":"2026-08-14T10:45:48.464842Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.821708Z","title":"Multi-agent actor-critic for mixed cooperative-competitive envi- ronments,","venue":null,"work_id":"3da1e030-7f45-48e9-b995-8c9d6b1eeade","year":2017},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.193268Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:2ccc85c67b16f2145725b4f35882ba20847c72468f58ad660969b740023dbb80","observation_id":"e13825ec-a69f-4145-a9a4-3704ec45e4f2","resolution":{"observed_at":"2026-08-14T10:45:48.827187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.805559Z","title":"Graph convolutional reinforcement learning,","venue":null,"work_id":"bba79027-5e35-4b08-a59e-b3a6469780c2","year":2020},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.198170Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:55bdb0f9c363c800dbba7d413bb0e7ddae09b2a074478d0e60ac0d0d41fb2764","observation_id":"2a29b7b3-fea7-49ad-bdee-de3746ca49e7","resolution":{"observed_at":"2026-08-14T10:45:48.810673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.788141Z","title":"The graph neural network model,","venue":null,"work_id":"4fd87590-6055-4b38-a758-b9c060f5bcb0","year":2009},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.203048Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:9315790b4b19b7053679d162a1c5f739bdc2b9f61f148176584dca3bfcae9a1d","observation_id":"09bdebba-146f-45f5-8a06-dd77437e6100","resolution":{"observed_at":"2026-08-14T10:45:48.793570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01261","last_updated":"2018-10-17T17:51:36Z","snapshot_observed_at":"2026-08-17T23:08:02.689731Z","submitted_at":"2018-06-04T17:58:18Z","title":"Relational inductive biases, deep learning, and graph networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01261","snapshot_observed_at":"2026-08-14T10:45:48.208111Z","title":"Relational inductive biases, deep learning, and graph networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.208111Z"},"links":{"cited_paper":"/paper/1806.01261","citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:27282bcd5e37d59accdff16b62fbce29aa5a79d21099da91b6285826a57b2770","observation_id":"01ed2b8b-4126-473f-89de-d49f295378d0","resolution":{"observed_at":"2026-08-14T10:45:48.208111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.770890Z","title":"Interaction networks for learning about objects, relations and physics,","venue":null,"work_id":"335c67ec-541c-41d5-8143-feeee8a296f0","year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.214636Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:2bd6c995c21cedbb161f9152d7d86461bd44afab741825c106211c9f35839ba6","observation_id":"5439466d-20c0-42d6-83b2-f6ade85ee7b6","resolution":{"observed_at":"2026-08-14T10:45:48.776672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.05493","last_updated":"2017-09-22T21:36:00Z","snapshot_observed_at":"2026-08-18T19:35:22.009192Z","submitted_at":"2015-11-17T18:10:12Z","title":"Gated Graph Sequence Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.05493","snapshot_observed_at":"2026-08-14T10:45:48.219469Z","title":"Gated graph sequence neural networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.219469Z"},"links":{"cited_paper":"/paper/1511.05493","citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:ada252b0a31a6b80f7bf25c86402e5eeabc91c872cccd24741a6b8146034995a","observation_id":"3ee3df93-23ff-48ea-823d-87a884f7586c","resolution":{"observed_at":"2026-08-14T10:45:48.219469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.747988Z","title":"Abductive learning: towards bridging machine learning and logical reasoning,","venue":null,"work_id":"d73a7b42-be34-4e73-969f-ad917a977a4a","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.225154Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:121841ed306e995432aa5ff131677ae107d5eb468973d1d7a954b8568b942055","observation_id":"214ed6f1-bcfe-4787-b72a-af5d48f055f5","resolution":{"observed_at":"2026-08-14T10:45:48.754056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.730646Z","title":"Neural message passing for quantum chemistry,","venue":null,"work_id":"38dad459-673e-4706-a7b0-47c00a4c22f5","year":2017},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.229770Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:9d3654950b36aea3fe3918a3d9e56887028ceeb67433488c87294bb38b19478c","observation_id":"fcb5b43e-de9f-4fa7-a34a-01d9c8982090","resolution":{"observed_at":"2026-08-14T10:45:48.736076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.712759Z","title":"Nervenet: Learning structured policy with graph neural networks,","venue":null,"work_id":"040fd5f3-1b00-45f0-ae0c-3c97d187f0db","year":2018},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.234553Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:c8b45cc87db9b72a5888e7fbeecc729c50107406ed7c528af6025a9a2be7c305","observation_id":"bd291113-b441-45b3-bdd5-f0a93dc3e566","resolution":{"observed_at":"2026-08-14T10:45:48.719439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.691778Z","title":"Deep reinforcement learning with relational inductive biases,","venue":null,"work_id":"ab3fcf29-ff09-4886-acd7-c6b687ac5e0f","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.239268Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:30007bb0fa163658a411b1ea33939afba5345ab397f3ccf7e89a70101c95a950","observation_id":"c08e14b8-a67c-4e23-9b3c-9a722addc514","resolution":{"observed_at":"2026-08-14T10:45:48.697677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.666986Z","title":"Simula- tion and optimization of trafﬁc in a city,","venue":null,"work_id":"cdaa82c0-5d45-48ea-8ac1-231a8f0aed40","year":2004},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.244306Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:bc6a97d86f42ebdb7e1c6e232d84ec00082639a85b64aa69c392ed8eab1d5c2f","observation_id":"f9e2c453-871e-4079-8f92-f4b3a2f2fe51","resolution":{"observed_at":"2026-08-14T10:45:48.675185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.647146Z","title":"Long short-term memory,","venue":null,"work_id":"db55d4dc-ca37-4910-873c-f2d9abdb59ca","year":1997},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.248893Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:9f8de7db2d0f34b72af2333df3fc10d2bbc12b50f64f3d97c2cf568f08bdc5ee","observation_id":"773d0900-1cd0-4c6a-8b6f-2e69bd638e8d","resolution":{"observed_at":"2026-08-14T10:45:48.652287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.615407Z","title":"Multi-agent reinforcement learning: Independent vs. co- operative agents,","venue":null,"work_id":"940bdc5f-c08f-4daf-a580-52dc3af40af4","year":1993},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.253555Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:d70e34587692999df6a017ae91f63af6167febf4642f215ed36fc8e8366d402e","observation_id":"15f7536a-bc79-4e39-8e60-6f937da1d7e2","resolution":{"observed_at":"2026-08-14T10:45:48.623179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.00853","last_updated":"2015-11-27T06:58:14Z","snapshot_observed_at":"2026-08-14T22:49:52.991256Z","submitted_at":"2015-05-05T01:16:39Z","title":"Empirical Evaluation of Rectified Activations in Convolutional Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.00853","snapshot_observed_at":"2026-08-14T10:45:48.258361Z","title":"Empirical evaluation of rectiﬁed activations in convolutional network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.258361Z"},"links":{"cited_paper":"/paper/1505.00853","citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:c9967f0530877cb3a669f710e6d2312777ea3093bd7d81f9c22f6d50e3fe4d4b","observation_id":"690c5017-3ee0-4f4b-afe4-f1fb9c1d6b80","resolution":{"observed_at":"2026-08-14T10:45:48.258361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.592575Z","title":"Attention is all you need,","venue":null,"work_id":"d3b0be9f-f11a-42a5-83fc-9670732bb1f1","year":2017},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.265863Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:c94b66b63cc924d9d050a8f5fa0d922c14011ae34899242ea00571e8fe364984","observation_id":"1a35ab8e-4995-4d2f-9506-93ab55193069","resolution":{"observed_at":"2026-08-14T10:45:48.599597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07289","last_updated":"2016-02-22T07:02:58Z","snapshot_observed_at":"2026-08-18T04:36:00.952991Z","submitted_at":"2015-11-23T15:58:05Z","title":"Fast and Accurate Deep Network Learning by Exponential Linear Units (ELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07289","snapshot_observed_at":"2026-08-14T10:45:48.270953Z","title":"Fast and accurate deep network learning by exponential linear units (elus),","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.270953Z"},"links":{"cited_paper":"/paper/1511.07289","citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:1779dddbb14351a4070ee755beed39f350e002a7320ad57167a47da31afe04d1","observation_id":"f04523d0-ce1a-466b-b8a7-1aac1cb44dea","resolution":{"observed_at":"2026-08-14T10:45:48.270953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.570245Z","title":"Deep recurrent q-learning for partially observable mdps,","venue":null,"work_id":"60d95441-d439-46ff-a220-9f3e3ec2ae40","year":2015},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.276448Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:f8cb22f3c7e2c6bc467fc4971bb38d6b99a169ec8179b4410becd20a2974fbcc","observation_id":"fe03e030-8001-41ca-849f-c9abce395f59","resolution":{"observed_at":"2026-08-14T10:45:48.577534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.547918Z","title":"Memory- based control with recurrent neural networks,","venue":null,"work_id":"8ef023d2-f4de-46d0-8e0f-c26a509ac1f3","year":2015},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.283368Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:0e5cce8324c44f154ad56d3bc80c5058dd539b06127f217529e736ad3e8025f6","observation_id":"6a8e906e-8493-47ee-a6cc-bea68079167a","resolution":{"observed_at":"2026-08-14T10:45:48.553898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.523218Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":"eae31341-5598-463b-9e83-6debb53d1fca","year":2015},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.288889Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:680932057c9096d3e10ecf65e594f318d22a1a78d5bb8333ffeb298fd5192e80","observation_id":"f7590608-fac9-45a2-b589-dc30786d5173","resolution":{"observed_at":"2026-08-14T10:45:48.529343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.502601Z","title":"Cityﬂow: A multi-agent reinforcement learning environment for large scale city trafﬁc scenario,","venue":null,"work_id":"45a7448d-c57b-45ee-b0c4-e654981a29c8","year":2019},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.295717Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:c675007c8b41edda815eb132fc140f4a66b222f4e5331e20f6ef3ca08be69a44","observation_id":"e43ea87e-bda9-41ac-9c5d-7df1cc4dbcc0","resolution":{"observed_at":"2026-08-14T10:45:48.508432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T10:45:48.302772Z","title":"Delving deep into rectiﬁers: Surpassing human-level performance on imagenet classiﬁcation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.302772Z"},"links":{"citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:2ded01c417c9e1cd1d3c8dd93f73d0749440dddf764124e88a9f267a344ee5b4","observation_id":"25087bb8-7e5d-4700-8a16-1ccb3267559c","resolution":{"observed_at":"2026-08-14T10:45:48.302772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-14T10:45:48.307747Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-14T10:45:48.307747Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/1908.10577"},"observation_digest":"sha256:09bdc99baa71bbc5fdd45851d8f98a1fd05d585943703884b096a22ca0709433","observation_id":"0fb11ab9-3f06-48d9-a85e-3ab926d6be2a","resolution":{"observed_at":"2026-08-14T10:45:48.307747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1908.10577","last_updated":"2020-11-29T16:39:47Z","latest_version":3,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-18T19:36:03.649466Z","submitted_at":"2019-08-28T07:16:39Z","title":"STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":61},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:1908.10577."}