Pith. sign in

← back to paper

Review history

arxiv: 2509.05881 · 2 revisions

GeoAnalystBench: A GeoAI benchmark for assessing large language models for spatial analysis workflow and code generation

  1. 2026-08-15 CONDITIONAL MODERATE v1.4.0-alltime-deepseek-medium novelty 5.0
    80931 ms 25835 in 10051 out 2026-08-15T16:19:25.210564+00:00
  2. 2026-08-05 CONDITIONAL MODERATE v1.3.0-alltime-deepseek novelty 5.0
    118740 ms 25809 in 11017 out 2026-08-05T04:53:39.771103+00:00