Perplexity lanza el benchmark WANDR para evaluar las capacidades de investigación de la IA
Perplexity AI presentó WANDR (Wide ANd Deep Research), un benchmark abierto diseñado para evaluar qué tan bien los sistemas de inteligencia artificial realizan tareas de investigación a gran escala, el 14 de julio de 2026. El framework incluye 500 tareas realistas de recopilación de datos modeladas sobre trabajo profesional de conocimiento, como análisis de mercado, due diligence, revisiones de literatura, inteligencia competitiva, comparaciones de productos y búsqueda de talento. El benchmark s
OliverGrant·07-15 11:03
