Un benchmark con 1.040 fotos revela que los LLM confunden setas mortales con comestibles
Un investigador de Quesma ha evaluado diez modelos de visión-lenguaje —entre ellos Gemini 3.6 y 3.7 Flash, Claude Fable 5, GPT-5.6-Sol, Qwen3.8 27B y GLM-5.3-Flash— en la identificación de 55 especies de setas presentes en bosques polacos, usando 1.040 fotografías del conjunto de prueba del dataset
