Şevval Alper
Intereses de investigación
Şevval se centra en herramientas de codificación con IA, agentes de IA y tecnologías cuánticas.Forma parte del equipo de benchmark de AIMultiple, realiza evaluaciones y aporta información para ayudar a los lectores a comprender diversas tecnologías emergentes y sus aplicaciones.
Experiencia profesional
Contribuyó a organizar y guiar a los participantes en tres eventos “CERN International Masterclasses - hands-on particle physics” en Türkiye, colaborando con el profesorado para facilitar el aprendizaje.Formación académica
Şevval tiene una licenciatura en Física por la Middle East Technical University.Últimos artículos de Şevval
Benchmark de plataformas de agentes de IA: Claude Managed Agents vs Google Vertex Agent Engine
Evaluamos 4 plataformas de agentes de IA en 3 dimensiones: finalización de tareas (10 tareas de programación × 3 ejecuciones), capacidades específicas del harness (dirección, reconexión, recuperación en conversaciones largas, manejo de archivos grandes) y costo. Claude Managed Agents y Vertex AI Agent Engine logran ambos tasas de aprobación del 100 % en el conjunto de…
MCP Benchmark: Los mejores MCP servidores para acceso web
Evaluamos 8 MCP servidores en tareas de búsqueda y extracción web, así como de automatización de navegadores, ejecutando 4 tareas diferentes 5 veces en todos los MCP adecuados. También realizamos una prueba de carga con 250 agentes de IA concurrentes. *Las tareas de búsqueda y extracción web se ejecutan con el Bright Data servidor MCP…
LLM Parámetros: GPT-5 High, Medio, Bajo y Mínimo
Algunos LLM, como la familia GPT-5 de OpenAI, vienen en diferentes versiones (por ejemplo, GPT-5, GPT-5-mini y GPT-5-nano) y con varios ajustes de parámetros, incluyendo alto, medio, bajo y mínimo. A continuación, exploramos las diferencias entre estas versiones de modelo comparando su rendimiento en benchmarks y los costes para ejecutar dichos benchmarks. Utilizamos la familia…
Mejor editor de código con IA: Cursor vs Windsurf vs Replit
Crear una app sin saber programar es una gran tendencia ahora mismo. ¿Pero pueden estas herramientas construir y desplegar una app con éxito? Evaluamos 6 editores de código con IA en 10 desafíos reales de desarrollo web. Cada tarea requería implementaciones como backend, frontend, autenticación y gestión de estado. Evaluamos la corrección del backend, el…
Comparativa de Speech-to-Text: Deepgram vs. Whisper
Evaluamos a los principales proveedores de speech-to-text (STT), centrándonos específicamente en aplicaciones de atención médica. Nuestro análisis utilizó ejemplos del mundo real para evaluar la precisión de transcripción en contextos médicos, donde la precisión es crucial. Según los resultados de tasa de error de palabras (WER) y tasa de error de caracteres (CER), GPT-4o-transcribe demuestra…
Benchmark de OCR: Precisión en la Extracción / Captura de Texto
La precisión del OCR es crítica para muchas tareas de procesamiento de documentos, y los LLM multimodales SOTA ahora ofrecen una alternativa al OCR. Evaluamos los principales servicios de OCR en DeltOCR Bench para identificar sus niveles de precisión en diferentes tipos de documentos: Los nombres completos de los productos anteriores y sus versiones en…
Recocido cuántico: computación cuántica práctica
El recocido cuántico es una tecnología cuántica prometedora para empresas con problemas de optimización urgentes que los ordenadores tradicionales no pueden resolver rápidamente. Se puede utilizar para resolver problemas de optimización con mayor eficacia que los ordenadores tradicionales. Sin embargo, todavía se utiliza principalmente en el ámbito académico y se requiere más I+D para construir…
Principales Arneses de Agente: Claude Code vs Codex
Los arneses de agente sirven como runtime de producción para los agentes de IA, con decisiones de diseño que crean variaciones de rendimiento entre modelos subyacentes idénticos. Comparamos 17 arneses de agente en 10 tareas de codificación. Para aislar el arnés en lugar del modelo, ejecutamos cada CLI agéntica en un único modelo base, Claude…
Los 8 mejores agentes de programación de IA de código abierto
En evaluaciones anteriores, comparamos tanto agentes de CLI agénticos de código abierto como propietarios, centrándonos en su rendimiento en tareas de desarrollo web, y algunos agentes de código abierto funcionaron con tanto éxito como las opciones de pago. Por lo tanto, también enumeramos los mejores agentes de codificación de código abierto para usuarios con preocupaciones…
Boletín informativo de AIMultiple
Reciba un correo electrónico gratuito a la semana con las últimas noticias tecnológicas B2B y análisis de expertos para impulsar su empresa.