Servicios
Contáctanos
Ekrem Sarı

Ekrem Sarı

Investigador de IA
32 Artículos
Mantente al día sobre tecnología B2B.

Ekrem es investigador de IA en AIMultiple, donde se centra en la automatización inteligente, las GPU, los agentes de IA y las LLMOps para marcos RAG.

Experiencia profesional

Durante su etapa como evaluador en Yandex, evaluó los resultados de búsqueda utilizando marcos de trabajo propios y protocolos automatizados. Implementó pruebas de control de calidad mediante la anotación de datos, la puntuación de relevancia y el mapeo de la intención del usuario en más de 10 000 consultas mensuales, al tiempo que realizaba evaluaciones técnicas, incluyendo la monitorización del rendimiento y la detección de spam mediante bucles de retroalimentación de aprendizaje automático.

Intereses de investigación

En AIMultiple, su investigación se centra en el ciclo de vida de MLOps y en el rendimiento y la evaluación comparativa de sistemas de IA de extremo a extremo. Colabora en una amplia gama de proyectos, incluyendo la optimización de la Generación Aumentada por Recuperación (RAG), la evaluación comparativa exhaustiva de Modelos de Lenguaje a Gran Escala (LLM) y el diseño de marcos de IA basados en agentes. Ekrem se especializa en el desarrollo de metodologías basadas en datos para medir y mejorar el rendimiento de la tecnología de IA en métricas operativas críticas como la precisión, la eficiencia, el coste de la API y la escalabilidad. Su análisis abarca toda la pila tecnológica, desde componentes fundamentales como los modelos de incrustación y las bases de datos vectoriales hasta la GPU de alto rendimiento y la infraestructura en la nube necesarias para implementar agentes de IA.

Educación

Ekrem tiene una licenciatura de Hacettepe Üniversitesi y una maestría de Başkent Üniversitesi.

Últimos artículos de Ekrem

IA
Evaluación en Mundo Abierto
23 de Jul

Los 60+ principales proveedores de GPU en la nube

Los proveedores de GPU en la nube se dividen en tres niveles. Los hyperscalers gestionan plataformas en la nube amplias donde el alquiler de GPU es un producto entre muchos. Las neoclouds especializadas se centran en la infraestructura de GPU y de IA como su producto principal. Los marketplaces comunitarios agregan inventario de muchos operadores…

IA
Evaluación en Mundo Abierto
23 de Jul

Comparación de los 6 mejores servicios gratuitos de Cloud GPU

El mejor nivel free de GPU vale alrededor de $19 al mes en tarifas de alquiler, y ocho plataformas ofrecen una GPU real sin tarjeta de crédito. Seis de ellas limitan el uso free por mes, y hemos valorado esos precios según la tarifa bajo demanda más barata actual para cada GPU en nuestros datos…

Ciberseguridad
Benchmark
21 de Jul

Comparativa de software de copia de seguridad: Acronis vs NinjaOne vs Comet vs MSP360

Comparamos NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup y MSP360 Managed Backup en una infraestructura idéntica de AWS. Cada proveedor realizó una copia de seguridad en modo archivo de la misma carga de trabajo de 625,946 archivos / 50 GB y una copia de seguridad completa de la imagen del disco del sistema,…

IA
Benchmark
20 de Jul

Calculadora de dimensionamiento y selección de bases de datos vectoriales

La pregunta práctica detrás de una base de datos vectorial autogestionada para RAG es qué motor se ajusta a un servidor dado y cuál descarta la carga de trabajo. La calculadora a continuación responde ambas, a partir de nuestro benchmark de siete bases de datos vectoriales autogestionadas ejecutadas con recall emparejado sobre incrustaciones idénticas. Cinco…

Ciberseguridad
Evaluación en Mundo Abierto
20 de Jul

Comparativa de Recuperación ante Desastres: Acronis vs Comet vs MSP360

Probamos Acronis Cyber Protect Cloud, Comet Backup y MSP360 Managed Backup en recuperación ante desastres. Cada proveedor creó una imagen de un servidor Windows Server 2022 activo y de un servidor Ubuntu 24.04 activo con la misma carga de trabajo determinista, un servicio web, una base de datos de 10,000 filas y 50 archivos, y…

Datos
Benchmark
19 de Jul

Scraper de Comercio Electrónico: 6 Proveedores Comparados

Comparamos cinco proveedores de datos web en 100 dominios de comercio electrónico, obteniendo 65.000 páginas de producto y búsqueda cada una, con 5 a 5.000 solicitudes simultáneas. Promediando los niveles de simultaneidad, Decodo registró la mediana de respuesta más rápida, alrededor de 7 segundos, con una tasa de éxito del 59%, mientras que Bright Data…

IA
Benchmark
18 de Jul

Mejores herramientas, frameworks y bibliotecas de RAG

RAG mejora las respuestas de los LLM al basarlas en datos externos en lugar de solo en lo que el modelo memorizó durante el entrenamiento. Hemos evaluado los componentes con los que se construye un sistema RAG y recopilado los resultados en un solo lugar, con una guía práctica para elegir cada parte del stack.…

IA
Benchmark
18 de Jul

Comparativa de Bases de Datos Vectoriales: 7 Motores de Código Abierto para RAG

Comparamos siete bases de datos vectoriales autogestionadas de código abierto como capa de recuperación de un pipeline de RAG, ejecutándose cada una por separado sobre los mismos embeddings bge-m3 y consultas reales médicas y técnicas, de modo que el índice de la base de datos fue la única variable. La carga de trabajo abarcó MedRAG-50k,…

IA
Benchmark
18 de Jul

GPU Benchmark de concurrencia: H100 vs H200 vs B200 vs MI300X

He pasado los últimos 20 años centrándome en la optimización del rendimiento computacional a nivel de sistema. Realizamos un benchmark de las últimas NVIDIA GPUs, incluida la H100 de NVIDIA, H200 y B200, y la MI300X de AMD, para análisis de escalado de concurrencia. Usando el framework vLLM con el gpt-oss-20b model, probamos cómo estas…

IA
Benchmark
17 de Jul

Text-to-SQL: Comparación de la precisión de LLM

He confiado en SQL para el análisis de datos durante 18 años, comenzando en mis días como consultor. Traducir preguntas en lenguaje natural a SQL hace que los datos sean más accesibles, permitiendo a cualquiera, incluso a aquellos sin habilidades técnicas, trabajar directamente con bases de datos. Utilizamos nuestra metodología de referencia text-to-SQL en más…