Capacidade técnicaAutomatização cognitiva2025-09-07
Em 50 tarefas de geoprocessamento, o melhor modelo produziu fluxos de trabalho válidos em 95% das vezes, mas a deteção de relações espaciais e a escolha de localização continuaram a ser o mais difícil, concluiu um teste de referência
Analista de informação geográfica / cartógrafopágina da profissão →Data do facto / publicação
2025-09-07
Categoria da prova
Capacidade técnicaUma demonstração, um referencial ou um artigo mostram que a tarefa pode ser feita. Atualiza o que a tecnologia consegue fazer, não o que as empresas vão fazer.
Tarefas sobre as quais incide
Análise espacial
Fazer sobreposições, áreas de influência, escolha de localizações e outras análises para responder a uma pergunta.
Aumentada pela máquina≈ Inferência da plataforma
Onde é que isto se aplica
Um teste de referência com 50 tarefas de geoprocessamento em Python, derivadas de problemas reais de SIG. Modelos proprietários como o ChatGPT-4o-mini alcançaram 95% de validade dos fluxos de trabalho, enquanto modelos abertos mais pequenos como o DeepSeek-R1-7B chegaram aos 48,5%; as tarefas que exigem um raciocínio espacial mais profundo, como a deteção de relações espaciais ou a escolha da localização ótima, continuaram a ser as mais difíceis, e os autores pedem uma avaliação rigorosa antes de se afirmar a automatização total do SIG. Fluxos de trabalho válidos não são o mesmo que resultados corretos.
O que isto significa
Escrever um fluxo de trabalho de SIG está a ficar fácil para os modelos; raciocinar sobre o espaço não.
O que ainda não mostra
Um teste de referência que avalia a validade dos fluxos de trabalho, não se as respostas estão certas.
O que podes verificar
Abre o arXiv 2509.05881 e procura «before making claims about full GIS automation».
Muda a avaliação?
Não, e esta categoria também não o move. Um registo de «Capacidade técnica» é prova a sério, mas por si só não sobe um juízo de tarefa. 1 juízo ligado em cima ficam onde estavam.
Fonte
GeoAnalystBench: A GeoAI benchmark for assessing large language models for spatial analysis workflow and code generation (arXiv 2509.05881, submitted 7 Sep 2025) · verificado 2026-09-30 · Claude (VOLO agent) · interpretado 2026-09-30 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.