Servicios
Contáctanos

Modelos de IA

Los modelos de IA realizan predicciones basándose en sus datos de entrenamiento. Pueden funcionar en cualquier ámbito, como números, texto o multimedia.

Explorar: categoría

LLM Comparativa de latencia por casos de uso

LLM
Benchmark
12 de Ago

Evaluamos 11 modelos de lenguaje grandes principales con un total de 1.320 solicitudes, dividiendo modelos de razonamiento y no razonamiento, y medimos la latencia del primer token, la latencia por token y el tiempo de respuesta total. Puede encontrar detalles sobre cómo medimos la latencia aquí. Presentamos por separado los modelos con razonamiento y sin…

Leer más
LLM
Comparación de Funciones
12 de Ago

Herramientas de LLMOps principales y comparación con MLOps

Las plataformas de LLMOps gestionan el aspecto operativo de ejecutar modelos de lenguaje grandes: despliegue, monitoreo, evaluación y gestión de costes. Examinamos las principales herramientas de LLMOps, sus funciones centrales, modelos de precios y cómo se diferencian entre sí para ayudar a identificar la opción más adecuada para diversos casos de uso. A continuación se…

LLM11 de Ago

LLM Precios: Los mejores 15+ proveedores comparados

LLM Los precios abarcan tres órdenes de magnitud: los modelos básicos más baratos cuestan menos de $0.20 por millón de tokens, mientras que los niveles de razonamiento de vanguardia llegaron a costar hasta $262.50. El siguiente gráfico muestra cómo evolucionaron los precios de lanzamiento: cada modelo se sitúa en su fecha de lanzamiento con su…

LLM
Análisis
11 de Ago

LLM Automatización: Las 7 mejores herramientas y 8 casos de estudio 

LLM automation se refiere al cambio hacia herramientas de automatización inteligente que aprovechan los LLMs, incluyendo agentes de IA, LLMs ajustados y modelos RAG para automatizar y coordinar tareas. Explora qué es la automatización con LLM, sus principales aplicaciones en la vida real y las principales herramientas: Los modelos de lenguaje grandes en automación es…

LLM
Benchmark
11 de Ago

Agentic IT: Can LLMs Design a Benchmark

We gave 12 large language models the job a benchmark team does: invent a benchmark, build it, run four models through it, and report the results. Each did it twice. None of the 24 attempts passed every criterion, and six of the rubric’s checks were passed by none of them. The two topics are text-to-SQL,…

Modelos de IA
Análisis
10 de Ago

Modelos Fundamentales del Mundo: 10 Casos de Uso

Entrenar robots y vehículos autónomos (AVs) en el mundo físico puede ser costoso, lento y arriesgado. Los Modelos Fundamentales del Mundo ofrecen una alternativa escalable al permitir simulaciones realistas de entornos del mundo real. Estos modelos aceleran el desarrollo y la implementación en robótica, AVs y otros dominios al reducir la dependencia de las pruebas…

LLM
Benchmark
9 de Ago

Text-to-SQL: Comparación de la precisión de los LLM

Ejecutamos 36 modelos de lenguaje grandes sobre 759 preguntas de BIRD-SQL, cada modelo escribiendo SQL contra una base de datos que tenía que identificar por sí mismo entre 11 candidatas. Cada consulta analizable se ejecutó contra la base de datos real y su conjunto de resultados se comparó con el conjunto de resultados de la…

Modelos de IA
Evaluación en Mundo Abierto
7 de Ago

Mejores proveedores de LLM API de tarifa plana

Los proveedores de LLM de tarifa plana venden uso ilimitado del modelo por un precio mensual fijo en lugar de facturar por token. Este modelo se extendió porque las sesiones de codificación agentiva pueden usar decenas de millones de tokens, por lo que una factura por token es difícil de predecir. Muy pocos proveedores ofrecen…

LLM
Evaluación en Mundo Abierto
6 de Ago

LLM Orquestación: 22 Frameworks y Puertas de Enlace

Optimizar la orquestación de LLM es clave para mejorar el rendimiento manteniendo el uso de recursos bajo control. Para evaluar cómo se desempeñan en la práctica los diferentes enfoques de orquestación, realizamos pruebas de referencia: Descubre herramientas seleccionadas de orquestación de LLM, incluyendo frameworks para desarrolladores y puertas de enlace empresariales: La orquestación de LLM…

LLM
Benchmark
4 de Ago

HALC-Bench: LLM Alucinación en Benchmark de Recuperación de Contexto Largo

HALC-Bench (LLM Hallucination on Long-Context Retrieval Benchmark) mide la resistencia de un LLM a fabricar evidencia para una métrica que no existe en el documento objetivo mediante el uso de 3 pajares colocados al principio, en el medio y al final de la ventana de contexto del modelo, con 204 preguntas. claude-fable-5 respondió correctamente a…

Modelos de IA
Benchmark
4 de Ago

Comparación de modelos fundacionales relacionales

Comparamos SAP-RPT-1-OSS contra el gradient boosting (LightGBM, CatBoost) en 17 conjuntos de datos tabulares que abarcan el espectro semántico-numérico, tablas pequeñas/de alta semántica, conjuntos de datos de negocio mixtos y grandes conjuntos de datos numéricos de baja semántica. Nuestro objetivo es medir dónde los priores semánticos preentrenados de un LLM relacional pueden ofrecer ventajas frente…