{"as_of":"2026-08-09T12:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:190404ebb6411577196fe3b6a67f0f1ad23a943ab064a57d242e720053df0224","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:47:19.524779Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T05:47:29.031123Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T05:51:08.879906Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"cited_work":{"arxiv_id":"2505.17572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17572","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"USTBench: Benchmarking and dissecting spatiotemporal reasoning of LLMs as urban agents","venue":null,"work_id":"81af156a-754b-475d-9781-c3f931cff5b0","year":2025},"citing_paper":{"arxiv_id":"2605.22355","last_updated":"2026-05-21T11:42:33Z","snapshot_observed_at":"2026-08-02T10:09:30.789824Z","submitted_at":"2026-05-21T11:42:33Z","title":"TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T05:47:29.031123Z"},"links":{"cited_paper":"/paper/2505.17572","citing_paper":"/paper/2605.22355"},"observation_digest":"sha256:896efbcf24557599ad2adb7b8e3eb5bf36ed69f694902d066077b0c00e5d00bd","observation_id":"12238777-3eda-4da9-85cd-1e1a49d2e174","resolution":{"observed_at":"2026-05-22T05:51:08.882918Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17572/citation-record","integrity":"/paper/2505.17572/integrity","json":"/paper/2505.17572/citation-record.json","paper":"/paper/2505.17572"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:29.927667Z","title":"Smart sustainable cities of the future: An extensive interdisciplinary literature review.Sustainable cities and society, 31:183–212, 2017","venue":null,"work_id":"f1ee1bf6-fb7b-4e17-a0e8-fa732cbd7fd8","year":2017},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.046737Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:97c373444531be5fb4d200e1195911b9c734031d84778200290e9109e579b6ff","observation_id":"d3bad177-8d16-4566-a713-eac1b4519d0a","resolution":{"observed_at":"2026-08-07T14:47:30.053205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:29.605678Z","title":"Box and jenkins: time series analysis, forecasting and control","venue":null,"work_id":"a94e86ad-64b6-4cc7-94e9-39a5227e0e97","year":null},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.109721Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:f621b61ad9ea422feb2f64c9bcb6d97af6ee3737483fcb9e3b19190ecd61317a","observation_id":"9885d6b5-dcee-466e-a819-85deb337d722","resolution":{"observed_at":"2026-08-07T14:47:29.739759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:29.360872Z","title":"TEMPO: Prompt-based generative pre-trained transformer for time series forecasting","venue":null,"work_id":"ce2439fb-b303-438a-bbcc-ba51ab8867ef","year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.210665Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:2b39643fae9ba310e393b3cb6a6cc0fe063aeffcfc7e9965cebdfe67fbf1c3ba","observation_id":"bf73a06d-d4d3-45e8-a8e0-c00a25460d23","resolution":{"observed_at":"2026-08-07T14:47:29.470939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:29.125198Z","title":"Agentboard: An analytical evaluation board of multi-turn llm agents.Advances in Neural Information Processing Systems, 37:74325–74362, 2024","venue":null,"work_id":"3e8de885-82f9-4926-a25a-83cdf721be23","year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.317306Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:bd7f5090a8da532bab3bb375cb7af7c5f7152747ceb259ecf41bfbd0da86cba8","observation_id":"c255d701-a394-4e5c-be7d-30674f53e250","resolution":{"observed_at":"2026-08-07T14:47:29.217389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:12.443472Z","title":"Graphwiz: An instruction-following language model for graph computational problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.443472Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:efdd6ba7a48173445436af3d5835ffded10f3d1f48659721e3793562ed9ea314","observation_id":"ad43525f-18d8-4cd5-943f-5c15873e9543","resolution":{"observed_at":"2026-08-07T14:47:12.443472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:28.850338Z","title":"Deeptransport: Learning spatial-temporal dependency for traffic condition forecasting","venue":null,"work_id":"ac77d2e8-573c-4d9c-84dc-68a49b89977f","year":2018},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.538621Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:b544107f9953ecee7f502a1d5d002a5f003749212326e3f606e811ba3c8d120f","observation_id":"6c75bcdb-df9a-46e9-9849-480d16ce3eba","resolution":{"observed_at":"2026-08-07T14:47:28.987240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17667","last_updated":"2024-06-28T10:40:26Z","snapshot_observed_at":"2026-07-06T16:54:22.039181Z","submitted_at":"2023-11-29T14:30:16Z","title":"TimeBench: A Comprehensive Evaluation of Temporal Reasoning Abilities in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17667","snapshot_observed_at":"2026-08-07T14:47:12.611434Z","title":"Timebench: A comprehensive evaluation of temporal reasoning abilities in large language models.arXiv preprint arXiv:2311.17667, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.611434Z"},"links":{"cited_paper":"/paper/2311.17667","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:41bd588d98936c84788ec218156993ee59176437e5b2e3e254875f9d414ca0ca","observation_id":"a3e9f2f7-2aa0-4acc-8083-40f2d7188618","resolution":{"observed_at":"2026-08-07T14:47:12.611434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:28.638363Z","title":"On the evolution of random graphs.Publ","venue":null,"work_id":"0c54bbf9-bbbe-43e2-a083-76d8b285c478","year":1960},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.700990Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:dc0a685df63f476f4dadf801e4e9ba8d5dd252a152e50ef87abc8e1ea41d94b9","observation_id":"c8fe3724-6bf0-4dbf-8be1-42ebe63c9e00","resolution":{"observed_at":"2026-08-07T14:47:28.735372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09170","last_updated":"2024-06-13T14:31:19Z","snapshot_observed_at":"2026-07-06T18:30:19.486766Z","submitted_at":"2024-06-13T14:31:19Z","title":"Test of Time: A Benchmark for Evaluating LLMs on Temporal Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09170","snapshot_observed_at":"2026-08-07T14:47:12.799685Z","title":"Test of time: A benchmark for evaluating llms on temporal reasoning.arXiv preprint arXiv:2406.09170, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.799685Z"},"links":{"cited_paper":"/paper/2406.09170","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:2cb2a9a201169492f658727ea68ab42ad6213404c5d6ebd68b7e52031d67a9b4","observation_id":"a59d186c-7fc3-48c5-9aa1-90e8e9f54f9b","resolution":{"observed_at":"2026-08-07T14:47:12.799685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13948","last_updated":"2025-05-31T15:26:01Z","snapshot_observed_at":"2026-08-03T10:35:34.153257Z","submitted_at":"2024-06-20T02:32:16Z","title":"CityGPT: Empowering Urban Spatial Cognition of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13948","snapshot_observed_at":"2026-08-07T14:47:12.923658Z","title":"Citygpt: Empowering urban spatial cognition of large language models.arXiv preprint arXiv:2406.13948, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:12.923658Z"},"links":{"cited_paper":"/paper/2406.13948","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:8a678976eaff1782e6354cf4e4e18d8450f6f69e03b1ab802ed67483b94183e2","observation_id":"90ac15c2-34fb-41be-9f7e-e7ba2f5f5eb2","resolution":{"observed_at":"2026-08-07T14:47:12.923658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13945","last_updated":"2025-05-31T15:40:15Z","snapshot_observed_at":"2026-08-01T03:56:21.453468Z","submitted_at":"2024-06-20T02:25:07Z","title":"CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13945","snapshot_observed_at":"2026-08-07T14:47:13.027010Z","title":"Citybench: Evaluating the capabilities of large language model as world model.arXiv preprint arXiv:2406.13945, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.027010Z"},"links":{"cited_paper":"/paper/2406.13945","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:6453d570262fc2d949f86ec556b5362a8eb0c7af5d76a4f976b698a38736b3d7","observation_id":"b05f7949-d8c9-498a-9b12-096d40ba262b","resolution":{"observed_at":"2026-08-07T14:47:13.027010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:28.423907Z","title":"Pygad: An intuitive genetic algorithm python library.Multimedia tools and applications, 83(20):58029–58042, 2024","venue":null,"work_id":"7017cf5b-0c44-493e-92d1-65727848e866","year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.132409Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:896d0f573a38a44fb7f0d023294dff10c91b9f09eaece81f04ef2b63235e22ad","observation_id":"56f07dc6-d6a3-4acb-8701-9bc858e7f096","resolution":{"observed_at":"2026-08-07T14:47:28.524138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-07T14:47:13.204895Z","title":"Chatglm: A family of large language models from glm-130b to glm-4 all tools.arXiv preprint arXiv:2406.12793, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.204895Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:6149ea7486e40ebf7c6f2fa142485c2e47fc46ef37719d237d3f676d23d3b8f3","observation_id":"301f1204-0906-4602-ba2f-615260bd1b80","resolution":{"observed_at":"2026-08-07T14:47:13.204895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:47:13.286626Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.286626Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:2ab5d6c9f32a42b3b23dc47925f70dee89ad5e9c3e8f46aca6b363dd88f3330e","observation_id":"b1aca464-8f36-4df2-b1a8-765071066833","resolution":{"observed_at":"2026-08-07T14:47:13.286626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:47:13.387728Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.387728Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:6d3b2c2db474dddf4273e6c1e77e95303d0f6593044d4aa25971f3b2a502501b","observation_id":"d35c513c-5a74-454e-882a-19d19dea1460","resolution":{"observed_at":"2026-08-07T14:47:13.387728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02207","last_updated":"2024-03-04T18:25:29Z","snapshot_observed_at":"2026-08-06T19:42:39.893943Z","submitted_at":"2023-10-03T17:06:52Z","title":"Language Models Represent Space and Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02207","snapshot_observed_at":"2026-08-07T14:47:13.477756Z","title":"Language models represent space and time.arXiv preprint arXiv:2310.02207, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.477756Z"},"links":{"cited_paper":"/paper/2310.02207","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:e68c2e43dba754af3e70d64a30f59ae9c02c9842f586ca6d481c50d9f129cefb","observation_id":"88da6acb-25fb-4d14-bf4a-95722d3d2e20","resolution":{"observed_at":"2026-08-07T14:47:13.477756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:28.158737Z","title":"The scoot on-line traffic signal optimisation technique.Traffic Engineering & Control, 23(4), 1982","venue":null,"work_id":"1d1d194c-b444-4a04-bc94-712b9f328aaf","year":1982},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.575875Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:445fb89c3d53fc2e351f5d725e2b5f631ba4610760edb0bae01dab1f74203d86","observation_id":"06b0d6f0-dd10-4535-9cb6-71fdfe62f4c8","resolution":{"observed_at":"2026-08-07T14:47:28.285556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:47:13.695425Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.695425Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:9869bf65d7138573c33f706cd98fbc6551fe953a1843b921551a564e803e5f9b","observation_id":"50b9e666-f72a-4045-93a3-4acfb89323e9","resolution":{"observed_at":"2026-08-07T14:47:13.695425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T14:47:13.795554Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.795554Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:9d63f3763ecc3541cbe9bb5989f06363799fe0989dc854b1f8b63c0479c6d15f","observation_id":"49476d7d-4ca7-496c-ad4c-af8166894df1","resolution":{"observed_at":"2026-08-07T14:47:13.795554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:13.899032Z","title":"Towards mitigating LLM hallucination via self reflection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:13.899032Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:36c14a57658cf811157efcccc22bdfee4dca30e74842e065c1bc1f889ed5dc9c","observation_id":"e88a2df5-49c1-4ece-898c-30b2188c82e7","resolution":{"observed_at":"2026-08-07T14:47:13.899032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:27.911726Z","title":"Llmlight: Large language models as traffic signal control agents","venue":null,"work_id":"de6fe33f-adfb-46e7-84f2-861ca5d0ff08","year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.009911Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:27ffe68ef6ff243c785c84a90d514188ca9967f1fc4a96476085b713ce9441e9","observation_id":"c9424195-67a4-4265-9689-cd4d5e9eb84f","resolution":{"observed_at":"2026-08-07T14:47:28.013525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15064","last_updated":"2024-05-23T21:22:00Z","snapshot_observed_at":"2026-07-06T18:19:00.169416Z","submitted_at":"2024-05-23T21:22:00Z","title":"Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning","version":1},"cited_work":{"arxiv_id":"2405.15064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15064","snapshot_observed_at":"2026-08-07T14:47:20.383635Z","title":"Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning","venue":"cs.CL","work_id":"863eda0b-693a-48b2-8d79-5cf8e0ff5e2b","year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.089548Z"},"links":{"cited_paper":"/paper/2405.15064","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:c0bee44075d46aff3b860f269129b0023216910cc909361c61abf8c7f8d9f903","observation_id":"ecf904e5-b7a4-4121-929f-8c83c7c34bcc","resolution":{"observed_at":"2026-08-07T14:47:20.582052Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:14.169851Z","title":"Repetition in repetition out: Towards understanding neural text degeneration from the data perspective.Advances in Neural Information Processing Systems, 36:72888–72903, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.169851Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:0b0bc7b1faf27d7d689e1ae1b23dd5521f6318952cc41d15e8cc64d4459f754a","observation_id":"ae512c5d-51a9-4e84-99e8-024664a580cc","resolution":{"observed_at":"2026-08-07T14:47:14.169851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:27.727236Z","title":"Towards alleviating traffic congestion: Optimal route planning for massive-scale trips","venue":null,"work_id":"7d0aa3e1-06cc-42e1-85d8-96f959472db0","year":2021},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.238835Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:28b60a080279cd6a40aa5b1bf7b8811a8ea9e517231be9d1d6e6b0f8f908be09","observation_id":"cde91bcb-a5c6-4f1a-9bdf-dc48f39c0cee","resolution":{"observed_at":"2026-08-07T14:47:27.808459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19065","last_updated":"2024-06-27T10:34:02Z","snapshot_observed_at":"2026-07-06T18:37:51.919811Z","submitted_at":"2024-06-27T10:34:02Z","title":"STBench: Assessing the Ability of Large Language Models in Spatio-Temporal Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19065","snapshot_observed_at":"2026-08-07T14:47:14.331330Z","title":"Stbench: Assessing the ability of large language models in spatio-temporal analysis.arXiv preprint arXiv:2406.19065, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.331330Z"},"links":{"cited_paper":"/paper/2406.19065","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:a8ed83d09afb0b4ef07161e002dd2ce951df3ca66db574ab283947b966ca7b55","observation_id":"bf669141-44b7-4e7e-ab00-e559ef889780","resolution":{"observed_at":"2026-08-07T14:47:14.331330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:27.534137Z","title":"Urbangpt: Spatio-temporal large language models","venue":null,"work_id":"d0ecbd86-ad02-482a-90ed-2301ae7e5eef","year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.400820Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:e31099faa16f37b14eac4b601b344640ffb9f51a23c2ef3f30652dd83db723fd","observation_id":"e5fbb148-bc8a-42b0-a3c2-d058aaf4748a","resolution":{"observed_at":"2026-08-07T14:47:27.625467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:14.509291Z","title":"Timecma: Towards llm-empowered multivariate time series forecasting via cross-modality alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.509291Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:281d3629ba756e34138b57b1aeac8895c611ada42e16496a57b187c70417cfd8","observation_id":"10788f50-7666-48cf-b82f-6b5c41040519","resolution":{"observed_at":"2026-08-07T14:47:14.509291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:27.302192Z","title":"Knowledge-infused contrastive learning for urban imagery-based socioeconomic prediction","venue":null,"work_id":"c2ad284e-443a-48c1-b1d3-b468b503852b","year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.582881Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:460c31b2ac2b0723bc40a8bc570618d09b4a90290b2920c8b13ec623a7ddfd86","observation_id":"a0ec181d-3d0c-40c4-a3e0-f98ee4e6e9a3","resolution":{"observed_at":"2026-08-07T14:47:27.411860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:27.124374Z","title":"Simulation of urban mobility (sumo), February 4 2025","venue":null,"work_id":"f6c801eb-ad02-4ca7-aad1-ccba801e023d","year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.661472Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:ff8d685c491549a3292dddfbb1fb68e6a9b52d824dd4e1a1186c77d6c97a53ab","observation_id":"422597ef-7eb4-488b-b0b3-4004cea8b6ad","resolution":{"observed_at":"2026-08-07T14:47:27.198446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:26.893966Z","title":"Scats, sydney co-ordinated adaptive traffic system: A traffic responsive method of controlling urban traffic","venue":null,"work_id":"456d2463-7d5f-4799-b703-a545dabb17ea","year":1990},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.750231Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:a73c494ea6a55d7c712e946f4869208467201344f475f411b916f3bccc29ec50","observation_id":"e3b83036-12e7-4dff-ab0a-8f649ede33e4","resolution":{"observed_at":"2026-08-07T14:47:27.016511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05832","last_updated":"2021-04-12T21:37:18Z","snapshot_observed_at":"2026-07-06T10:58:54.293300Z","submitted_at":"2021-04-12T21:37:18Z","title":"SpartQA: : A Textual Question Answering Benchmark for Spatial Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05832","snapshot_observed_at":"2026-08-07T14:47:14.883698Z","title":"Spartqa:: A textual question answering benchmark for spatial reasoning.arXiv preprint arXiv:2104.05832, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.883698Z"},"links":{"cited_paper":"/paper/2104.05832","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:208d1388fcda406242321bc8d0da2a729789a8faa8d24d840f9e6fe2cee64511","observation_id":"f747e7a6-3ced-4808-ac9c-b3c9e30c2a34","resolution":{"observed_at":"2026-08-07T14:47:14.883698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16952","last_updated":"2022-11-03T20:06:21Z","snapshot_observed_at":"2026-07-06T14:12:18.389495Z","submitted_at":"2022-10-30T21:23:34Z","title":"Transfer Learning with Synthetic Corpora for Spatial Role Labeling and Reasoning","version":2},"cited_work":{"arxiv_id":"2210.16952","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.16952","snapshot_observed_at":"2026-08-07T14:47:20.045471Z","title":"Transfer Learning with Synthetic Corpora for Spatial Role Labeling and Reasoning","venue":"cs.CL","work_id":"52669982-e51e-4796-a017-ab942ab6e722","year":2022},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:14.953677Z"},"links":{"cited_paper":"/paper/2210.16952","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:f7650355e33820ba5c6d647c95edd22ca00645a1a48ce18a84bbf68c49b4a203","observation_id":"d259570f-b2c7-4498-b981-7de7b44aa08a","resolution":{"observed_at":"2026-08-07T14:47:20.222720Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:26.662585Z","title":"Towards understanding the spatial literacy of chatgpt","venue":null,"work_id":"5cb7dc64-8a8a-4dd2-83fe-6434350621e2","year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.053874Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:02666d610526ea674aff751bc5ff2bccf843641be114f319bc9e3cd9728e0df3","observation_id":"4828f170-3d74-4f7d-b4a9-e47b21946184","resolution":{"observed_at":"2026-08-07T14:47:26.760392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:26.420416Z","title":"Tlc trip record data, 2025","venue":null,"work_id":"68766622-dac0-465f-b04f-e9022af0bea7","year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.128952Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:837fc90fcb6e8a386f31f30a2624d4ca2c9d860c8cda17f5f01ca6b02863bf84","observation_id":"14f51320-84f5-495e-a4e6-d249685ad8dc","resolution":{"observed_at":"2026-08-07T14:47:26.551616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:15.195897Z","title":"Dima: An llm-powered ride-hailing assistant at didi.arXiv preprint arXiv:2503.04768, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.195897Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:18d8b27a5b0a15102ae3adcf6a3bd158791227313c634f01d6d61e0f4f443012","observation_id":"4cc97432-e7f0-474a-9398-f6319ecbaac2","resolution":{"observed_at":"2026-08-07T14:47:15.195897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06861","last_updated":"2024-10-06T03:40:58Z","snapshot_observed_at":"2026-07-06T17:28:18.945477Z","submitted_at":"2024-02-10T01:50:19Z","title":"UrbanKGent: A Unified Large Language Model Agent Framework for Urban Knowledge Graph Construction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06861","snapshot_observed_at":"2026-08-07T14:47:15.268020Z","title":"Urbankgent: A unified large language model agent framework for urban knowledge graph construction.arXiv preprint arXiv:2402.06861, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.268020Z"},"links":{"cited_paper":"/paper/2402.06861","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:519dd9269e547cab22f5a27c4869d1214d9eaa7eb989ab8ea69c1a07d935fb2c","observation_id":"dec75734-d12d-4434-b73d-9313191c4b88","resolution":{"observed_at":"2026-08-07T14:47:15.268020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:26.172988Z","title":"Openstreetmap planet data, 2025","venue":null,"work_id":"1779b052-09a2-436f-8aad-de64a64c7ba4","year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.353419Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:cb4d8d08f8ddf4e43433f66acbc86d2c430efc11e762acdaaf4168d2db8c79b6","observation_id":"cb413b5a-1f9e-4f3c-9391-efd7c0e6903d","resolution":{"observed_at":"2026-08-07T14:47:26.285455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06682","last_updated":"2024-10-16T23:19:46Z","snapshot_observed_at":"2026-08-09T03:34:21.327905Z","submitted_at":"2024-05-05T18:56:46Z","title":"Self-Reflection in LLM Agents: Effects on Problem-Solving Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06682","snapshot_observed_at":"2026-08-07T14:47:15.428482Z","title":"Self-reflection in llm agents: Effects on problem-solving performance.arXiv preprint arXiv:2405.06682, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.428482Z"},"links":{"cited_paper":"/paper/2405.06682","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:6656dfc2b860731dae0e9971705ea85d95a690f5b3e4389c6b0b41c4fcadd46b","observation_id":"6ad461f8-920f-470c-84de-08b57ba8d8c7","resolution":{"observed_at":"2026-08-07T14:47:15.428482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:25.964329Z","title":"Sparc and sparp: Spatial reasoning char- acterization and path generation for understanding spatial reasoning capability of large language models","venue":null,"work_id":"fbf67303-339b-4637-9119-1b717d98bb80","year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.517387Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:ad0bbf1b902d7633d1b81230543d3dfac447cbba8fb27225801a4fe4e518d841","observation_id":"723dd069-13af-447a-a128-06ea71470315","resolution":{"observed_at":"2026-08-07T14:47:26.080108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:47:15.585405Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.585405Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:a2af3c50dbf096f76070519e68b56ece06c27d44ba2f11552f81a26ac8fef9e2","observation_id":"a69353f3-9ea3-4fe3-bebd-270f11f1adc1","resolution":{"observed_at":"2026-08-07T14:47:15.585405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:25.742186Z","title":"Stepgame: A new benchmark for robust multi- hop spatial reasoning in texts","venue":null,"work_id":"10be4344-2dea-47c4-84e6-4a7bc2643010","year":2022},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.674222Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:9d5915d34a0b2978ca204269662d5677702b27db987bd1558e5f802139a0ce22","observation_id":"4daf5592-2ac2-4e64-8a55-200258dc8fc8","resolution":{"observed_at":"2026-08-07T14:47:25.851533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08952","last_updated":"2023-06-27T05:39:25Z","snapshot_observed_at":"2026-07-06T15:42:52.549767Z","submitted_at":"2023-06-15T08:44:41Z","title":"Towards Benchmarking and Improving the Temporal Reasoning Capability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08952","snapshot_observed_at":"2026-08-07T14:47:15.798080Z","title":"Towards benchmarking and improving the temporal reasoning capability of large language models.arXiv preprint arXiv:2306.08952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.798080Z"},"links":{"cited_paper":"/paper/2306.08952","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:6a0be7329ae169c94ea66fd1aa670ee7942540f6c0b86274dea3b996550f204d","observation_id":"c251b9f7-f9ca-43fe-b35f-5a38e669c87a","resolution":{"observed_at":"2026-08-07T14:47:15.798080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:25.464241Z","title":"Cityflow: A city-scale benchmark for multi-target multi-camera vehicle tracking and re-identification","venue":null,"work_id":"ad758d33-bd11-4d6c-b480-1ecc5f6f74c0","year":2019},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.887239Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:ee5d2c45974d04e561f95e76073668c837a98d84ee52f1c3968beb1902fcfcdf","observation_id":"0f1326f0-41f0-49e4-8514-d1ebba27bd56","resolution":{"observed_at":"2026-08-07T14:47:25.623904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:25.216011Z","title":"Qwq-32b: Embracing the power of reinforcement learning, 2025","venue":null,"work_id":"4951d3a2-9a32-48d8-a18e-0cfa59cd12c5","year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:15.978560Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:b5ee5fd1ca11c3b29b14699f6f4e0066d40381251ed6a70c827ce1cfa8f4bf59","observation_id":"fa4bfccf-fd74-4b0e-a578-54a27441a953","resolution":{"observed_at":"2026-08-07T14:47:25.303061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:24.939841Z","title":"Air quality prediction with physics-guided dual neural odes in open systems.ICLR, 2025","venue":null,"work_id":"d81f7eeb-e9be-468a-9877-57f4e1515111","year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.075275Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:7db7adab940b0343d9f8e0eacb76202a92b0d2a570e90d80a113716f29d479f8","observation_id":"f4af302b-8d6b-4e6b-8601-3ad39f849674","resolution":{"observed_at":"2026-08-07T14:47:25.077903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:24.677368Z","title":"Applications of artificial intelligence and machine learning in smart cities.Computer Communications, 154:313– 323, 2020","venue":null,"work_id":"651d9172-f961-4613-8555-8cae9a303c27","year":2020},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.158597Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:581d1f46abb95e8ce4afb0aa4401d0c4d51bd35889f390b3d0713ff71a3fbce0","observation_id":"2552d402-3c96-4f5b-ad90-9fbdb48000f7","resolution":{"observed_at":"2026-08-07T14:47:24.803848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:24.381176Z","title":"Robust extrema features for time-series data analysis.IEEE transactions on pattern analysis and machine intelligence, 35(6):1464–1479, 2012","venue":null,"work_id":"8942e173-e15a-45e5-9b01-87e8507e5514","year":2012},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.246214Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:e98f0ea187235ed46b0bf595b22885d76ff6530938cfa990e3cba3fc15d5c15e","observation_id":"af1e7ce4-b8e8-4356-a1e3-b3f04352730e","resolution":{"observed_at":"2026-08-07T14:47:24.526996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:24.079261Z","title":"Reinforcement learning-based placement of charging stations in urban road networks","venue":null,"work_id":"9571ae23-4c30-4bd2-adbf-83abbdcb65e3","year":2022},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.325026Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:b46ce75bb9de3c9a300206d1e0c0954c42f4620416d922f95151821a034bbdef","observation_id":"e2e9300c-94fa-4f4f-b587-ac87034a2781","resolution":{"observed_at":"2026-08-07T14:47:24.223000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:16.401542Z","title":"A survey on large language model based autonomous agents.Frontiers of Computer Science, 18(6):186345, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.401542Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:87429319f742dbd808d8de406f2f2da64d09ccecdb1ea96e938b4c651d6646ae","observation_id":"19ad2d6f-34f2-4d09-9f88-daae5c60538b","resolution":{"observed_at":"2026-08-07T14:47:16.401542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:23.819210Z","title":"Global gridded gdp data set consistent with the shared socioeco- nomic pathways.Scientific data, 9(1):221, 2022","venue":null,"work_id":"7ecb5b03-ee34-4070-9703-8f337c4ca614","year":2022},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.480492Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:d4abed25d30469e6da960c6446ff6014a19cc1343eff5345bedaa10b1aa349b7","observation_id":"90c123ca-ef52-4e9c-982c-e2b79595fb2c","resolution":{"observed_at":"2026-08-07T14:47:23.916545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15197","last_updated":"2024-01-09T14:08:03Z","snapshot_observed_at":"2026-07-06T16:11:43.387948Z","submitted_at":"2023-08-29T10:24:23Z","title":"Where Would I Go Next? Large Language Models as Human Mobility Predictors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15197","snapshot_observed_at":"2026-08-07T14:47:16.540853Z","title":"Where would i go next? large language models as human mobility predictors.arXiv preprint arXiv:2308.15197, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.540853Z"},"links":{"cited_paper":"/paper/2308.15197","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:bb4ff2cf69cc45fe9d990d9537d14e8df364bbd309988dfbe7c04ed4b9d64b3e","observation_id":"bc30ab37-8be1-49a4-99da-2284ce663a53","resolution":{"observed_at":"2026-08-07T14:47:16.540853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:16.622503Z","title":"From news to forecast: Integrating event analysis in llm-based time series forecasting with reflection.Advances in Neural Information Processing Systems, 37:58118–58153, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.622503Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:c8a40d9577a63feb5c4c2f92fcabe04aac064b2163ab4c116d25954de5e3f35c","observation_id":"631cb0a6-a581-461d-bb63-c6f357f4aa12","resolution":{"observed_at":"2026-08-07T14:47:16.622503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:23.589765Z","title":"Tram: Benchmarking temporal reasoning for large language models","venue":null,"work_id":"6442c63c-f84e-4a68-9368-ddbea5e1fb2a","year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.712157Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:70f8f424e96709b1231303a5720faf11197d96c98c8a00e0e8c425d98cd16a27","observation_id":"d99b94fc-7b0c-45fb-994c-9ed5ba95a5ac","resolution":{"observed_at":"2026-08-07T14:47:23.698546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:23.380872Z","title":"Colight: Learning network-level cooperation for traffic signal control","venue":null,"work_id":"32c7121b-a1ad-45d6-8655-c4d180456229","year":1913},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.786439Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:9e1b642c1ffe71600db3560bd8ec85252042ef77f95951a04abda129e23fcd6b","observation_id":"3d1eb627-a4e6-4049-aa82-7a20f09596ef","resolution":{"observed_at":"2026-08-07T14:47:23.475729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:16.887823Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.887823Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:a05af73d75c8486d727e09fa6b372ee40907896b7007dffc0b9adffb313a8ff4","observation_id":"92fe0cfb-22d7-44ae-9710-dde0885ad2fb","resolution":{"observed_at":"2026-08-07T14:47:16.887823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:23.146636Z","title":"Coverage location models: alternatives, approximation, and uncertainty.International Regional Science Review, 39(1):48–76, 2016","venue":null,"work_id":"8343d2f7-f141-4c9c-89f1-efcb734ae089","year":2016},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:16.946618Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:4ae894e647823f21900db5e83edca1a7522504e7bb3b16cb79d6224f63dd54c5","observation_id":"505bf480-0890-478b-b977-1c17a5ad767a","resolution":{"observed_at":"2026-08-07T14:47:23.247621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:22.916679Z","title":"Worldpop hub, 2025","venue":null,"work_id":"2904ed7b-a01b-4d4f-aaf5-f4041f3df937","year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.010800Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:a6fb176fcc867a35d2cd013ee7a60bf66cd9695481c27b230b13103e4102e849","observation_id":"0096260e-70f7-423c-baae-ebacf7b67b57","resolution":{"observed_at":"2026-08-07T14:47:23.019759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:17.045214Z","title":"Large language models can learn temporal reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.045214Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:3d4dcd2dd7fd062950f89097461bb0291a8ae60d786b98182918377655092f37","observation_id":"65fc1a15-7390-4d78-90d8-35e328c4f2ab","resolution":{"observed_at":"2026-08-07T14:47:17.045214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14540","last_updated":"2024-04-13T01:59:06Z","snapshot_observed_at":"2026-08-08T09:56:38.377469Z","submitted_at":"2023-10-23T03:44:40Z","title":"Evaluating Spatial Understanding of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14540","snapshot_observed_at":"2026-08-07T14:47:17.109005Z","title":"Evaluating spatial understanding of large language models.arXiv preprint arXiv:2310.14540, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.109005Z"},"links":{"cited_paper":"/paper/2310.14540","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:c27de56f11cfe05db1bcc3172ae15088fdaf4e35a9df6fa61614bd1852a61c87","observation_id":"63d0c6b9-0757-42fd-99dc-eea7f6aee440","resolution":{"observed_at":"2026-08-07T14:47:17.109005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:47:17.170094Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.170094Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:f267394785eeb4d42797fc09f329e53646ff5c7af5c0049884e86ba7f3aa9182","observation_id":"50dc80f6-64a3-494a-bcaa-7b0934374277","resolution":{"observed_at":"2026-08-07T14:47:17.170094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:22.659073Z","title":"Foursquare dataset","venue":null,"work_id":"15d910dd-7aff-4ffe-a5c2-e467a9f41e20","year":2014},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.230652Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:bbd268e48c23d7435015a46328c997df685d8244c3501c8ecdb5525420839b16","observation_id":"a7da1f14-7825-47e0-8d35-858f2469cd3b","resolution":{"observed_at":"2026-08-07T14:47:22.831190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:22.500096Z","title":"Unist: A prompt-empowered universal model for urban spatio-temporal prediction","venue":null,"work_id":"653017f9-269c-4af5-b8e3-0a3d16badd38","year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.315597Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:bfb89a3419335c8af65089b550cd3f26da6401fa46579689dd4f33b9bbfc6873","observation_id":"0947063f-e531-4e33-b803-ac5d06090025","resolution":{"observed_at":"2026-08-07T14:47:22.582495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11739","last_updated":"2025-03-14T15:40:39Z","snapshot_observed_at":"2026-08-07T17:03:36.060680Z","submitted_at":"2025-03-14T15:40:39Z","title":"CoLLMLight: Cooperative Large Language Model Agents for Network-Wide Traffic Signal Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11739","snapshot_observed_at":"2026-08-07T14:47:17.318918Z","title":"Collmlight: Cooperative large language model agents for network-wide traffic signal control.arXiv preprint arXiv:2503.11739, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.318918Z"},"links":{"cited_paper":"/paper/2503.11739","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:01afef30c0a3ca1d206e1c096dc900a3f6116a8bfe3dc2ed6045a3fa7da5bc96","observation_id":"534d8ca3-9355-478c-be5e-d2617d2ce9cb","resolution":{"observed_at":"2026-08-07T14:47:17.318918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12823","last_updated":"2023-10-22T16:19:16Z","snapshot_observed_at":"2026-08-07T22:31:11.195198Z","submitted_at":"2023-10-19T15:19:53Z","title":"AgentTuning: Enabling Generalized Agent Abilities for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12823","snapshot_observed_at":"2026-08-07T14:47:17.428562Z","title":"Agenttuning: Enabling generalized agent abilities for llms.arXiv preprint arXiv:2310.12823, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.428562Z"},"links":{"cited_paper":"/paper/2310.12823","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:275fafd4392acb11f4092f138e91481a6d34bf50012fa5c47dcc490cd3c89c55","observation_id":"a3a05314-e66e-49aa-a2ab-2a28e89ac2ae","resolution":{"observed_at":"2026-08-07T14:47:17.428562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:17.608625Z","title":"Open3dvqa: A benchmark for comprehensive spatial reasoning with multimodal large language model in open space.arXiv preprint arXiv:2503.11094, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.608625Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:c5cfe7f5286ede6e27158e9ce5b29ece3bb655ad630532292d8ddbcdb0bb1a84","observation_id":"48950252-710c-4907-94f0-437c9c7b95d3","resolution":{"observed_at":"2026-08-07T14:47:17.608625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:22.326724Z","title":"Reinforcement learning for traffic signal control","venue":null,"work_id":"0b64fb7d-7cb2-4ae7-aba3-c863b9cd1580","year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.786637Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:937e3984cd76a00a0d8270d44e4a962237e5c9cae0037abed360b60bc62170aa","observation_id":"2d326e74-c59f-4b3e-8183-5e397f5281bb","resolution":{"observed_at":"2026-08-07T14:47:22.404837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:17.931121Z","title":"Urbanvideo-bench: Benchmarking vision- language models on embodied intelligence with video data in urban spaces.arXiv preprint arXiv:2503.06157, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:17.931121Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:3ee9f8ec50492afe488eb81d61545da983f9826f5f5c0c276409f5975b32a144","observation_id":"fabf270e-123f-4fc7-9ce1-332b15430add","resolution":{"observed_at":"2026-08-07T14:47:17.931121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:22.130619Z","title":"Where to go next: A spatio-temporal gated network for next poi recommendation.IEEE Transactions on Knowledge and Data Engineering, 34(5):2512–2524, 2020","venue":null,"work_id":"b315cced-0619-413a-8e22-fb82b3543e01","year":2020},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:18.112245Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:5b156d7f69bf0f765d5f003bf4b8c5a0ea05181db9709a2d56d75e7b54fd70aa","observation_id":"0d75fb69-a602-4e7e-8442-29c2235cce72","resolution":{"observed_at":"2026-08-07T14:47:22.238763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12532","last_updated":"2025-05-22T00:44:13Z","snapshot_observed_at":"2026-08-07T18:10:13.873748Z","submitted_at":"2025-02-18T04:36:15Z","title":"CityEQA: A Hierarchical LLM Agent on Embodied Question Answering Benchmark in City Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12532","snapshot_observed_at":"2026-08-07T14:47:18.279741Z","title":"Cityeqa: A hierarchical llm agent on embodied question answering benchmark in city space.arXiv preprint arXiv:2502.12532, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:18.279741Z"},"links":{"cited_paper":"/paper/2502.12532","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:09fa9fa2f9215e35b1b38b47dfc53aa38f8c8791a93826291ac5795b62f94825","observation_id":"41cab77f-526e-4780-82bd-3ba195d55daf","resolution":{"observed_at":"2026-08-07T14:47:18.279741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:18.409485Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:18.409485Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:fd0506f05f77bb50212fa0b6ce05e65311fa3983e8f071f30f8c26bb5cb25c00","observation_id":"6832a9e1-703e-4f49-b092-d7d0f99a8b58","resolution":{"observed_at":"2026-08-07T14:47:18.409485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:21.925302Z","title":"Spatial planning of urban communities via deep reinforcement learning.Nature Computational Science, 3(9):748– 762, 2023","venue":null,"work_id":"1b619bb5-625d-4c3a-b7b9-2e47bb651ef2","year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:18.533561Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:dda76ef102c593edbdaeaf9286d674ac8f79ee832abdcb043c354392b975d780","observation_id":"19360793-b3c5-4839-83e3-15ec9d74624c","resolution":{"observed_at":"2026-08-07T14:47:22.005609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21027","last_updated":"2025-04-23T13:53:59Z","snapshot_observed_at":"2026-08-07T15:59:53.525006Z","submitted_at":"2025-04-23T13:53:59Z","title":"UrbanPlanBench: A Comprehensive Urban Planning Benchmark for Evaluating Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21027","snapshot_observed_at":"2026-08-07T14:47:18.662366Z","title":"Urbanplanbench: A comprehensive urban planning benchmark for evaluating large language models.arXiv preprint arXiv:2504.21027, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:18.662366Z"},"links":{"cited_paper":"/paper/2504.21027","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:7ad76410de72cda5525c44b6313d1d7875c48e4365bf69468a0e59b75b963455","observation_id":"be5f3e12-424a-4851-9e95-73b5a71994bf","resolution":{"observed_at":"2026-08-07T14:47:18.662366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:21.747218Z","title":"Road planning for slums via deep reinforcement learning","venue":null,"work_id":"b089e13e-88db-41a7-885e-707c11178b58","year":2023},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:18.808980Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:d87c9830f0f110a97e5682ea8542ea8ec859cc9df235e80c2a4327eaf4ed5a62","observation_id":"c5dd61e9-0ffb-464b-97af-6e169aee06af","resolution":{"observed_at":"2026-08-07T14:47:21.838077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:21.524250Z","title":"going on a vacation","venue":null,"work_id":"27f301a3-9c76-4d81-870c-ebaf4aeebade","year":2019},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:18.941064Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:dac5fb47adf53c700c27642f38693ce123e196469f283d4812c7db957589bd9b","observation_id":"61ce2295-ac49-4efe-a6f4-b1a2f38a06a2","resolution":{"observed_at":"2026-08-07T14:47:21.632527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17161","last_updated":"2024-02-27T02:47:50Z","snapshot_observed_at":"2026-07-06T17:35:57.887470Z","submitted_at":"2024-02-27T02:47:50Z","title":"Large Language Model for Participatory Urban Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17161","snapshot_observed_at":"2026-08-07T14:47:19.072276Z","title":"aha moments","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:19.072276Z"},"links":{"cited_paper":"/paper/2402.17161","citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:c883d0ebc57f3805afff711957856736f32b2de5759d3825ad24e831d270ad94","observation_id":"8b91d25d-f6ec-49d2-9dac-c2c543ed9e90","resolution":{"observed_at":"2026-08-07T14:47:19.072276Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:21.274673Z","title":"answer\":","venue":null,"work_id":"385f0264-c2ea-436c-b8ad-f6396d9d1dbd","year":null},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:19.242745Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:112610cca6152d7cc8ae265aa62efb272d2e7f660b121d949c541af2a8ef7118","observation_id":"25e769a7-7f59-4d94-8167-be3f432879db","resolution":{"observed_at":"2026-08-07T14:47:21.417259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:21.058872Z","title":"Miscellaneous Shop","venue":null,"work_id":"64d08864-3a95-49a0-9c5c-e0cea92ec1aa","year":null},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:19.378369Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:6b5774c8269caf4f675137d600fe1c48a95b82dbceeae3f88bb3a141a61c195d","observation_id":"0a1940f9-9f5b-4dcf-a6ce-05b98748b6fb","resolution":{"observed_at":"2026-08-07T14:47:21.155850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:47:20.820406Z","title":"answer\":","venue":null,"work_id":"fd66c9fb-5baf-4806-9300-154f79d36eef","year":null},"citing_paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:47:19.524779Z"},"links":{"citing_paper":"/paper/2505.17572"},"observation_digest":"sha256:76095d2a68866fcd637a649606eb602b8cc65333482f5a2a7f5a8933084c6d48","observation_id":"682dc218-38ba-4888-9e43-f4757dff36fb","resolution":{"observed_at":"2026-08-07T14:47:20.945046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17572","last_updated":"2025-05-23T07:30:57Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T21:56:03.875890Z","submitted_at":"2025-05-23T07:30:57Z","title":"USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":2,"verified_fuzzy":40},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2505.17572."}