RESULTADOS DE BENCHMARKS

Benchmarks de Ox Alpha

Resultados de benchmarks y evaluaciones de Ox Alpha procedentes de Artificial Analysis y de pruebas de la comunidad, que cubren el rendimiento en razonamiento y programación.

¿Qué son los benchmarks de Ox Alpha?

Los benchmarks miden el rendimiento de Ox Alpha en evaluaciones de IA estandarizadas y pruebas diseñadas por la comunidad. Esta categoría registra resultados publicados por Artificial Analysis y evaluadores independientes, con puntuaciones de rendimiento en razonamiento, programación y tareas agénticas.

¿Por qué seguir los benchmarks?

1

Compara el rendimiento real

Observa cómo se compara Ox Alpha con los modelos de vanguardia en evaluaciones estandarizadas de razonamiento y programación.

2

Ve más allá del entusiasmo

Usa resultados de evaluaciones independientes y pruebas de la comunidad para juzgar el modelo más allá de su marketing anónimo.

3

Sigue las actualizaciones de puntuaciones

Observa cómo evolucionan los resultados de los benchmarks a medida que los evaluadores repiten las evaluaciones y OpenRouter actualiza la ficha del modelo.

Destacadas y esenciales

Todos los benchmarks

Ox Alpha deepswe: resultados de DeepSWE y guía de evaluación - benchmarks guide
Guía

Ox Alpha deepswe: resultados de DeepSWE y guía de evaluación

Revisa los resultados de DeepSWE de Ox Alpha, las pistas sobre el modelo, los límites del benchmark, la ventana de contexto, los riesgos de privacidad y los métodos prácticos de prueba.

Análisis de inteligencia artificial de Ox Alpha: capacidades y benchmarks - benchmarks guide
guía

Análisis de inteligencia artificial de Ox Alpha: capacidades y benchmarks

Análisis de inteligencia artificial de Ox Alpha sobre contexto, entrada multimodal, benchmarks de programación, generación 3D y consejos prácticos de evaluación.

Resultados del benchmark de Ox Alpha: puntuaciones y comparaciones de DeepSWE - benchmarks guide
Guía de benchmarks

Resultados del benchmark de Ox Alpha: puntuaciones y comparaciones de DeepSWE

Consulta los resultados del benchmark de Ox Alpha, incluida su puntuación reportada del 80% en DeepSWE, las comparaciones entre modelos, el rendimiento por tarea y las limitaciones de la evaluación.

Benchmark de Ox Alpha: primeras puntuaciones, contexto y comparación de modelos - benchmarks guide
Guía

Benchmark de Ox Alpha: primeras puntuaciones, contexto y comparación de modelos

Revisa los resultados reportados del benchmark de Ox Alpha, su ventana de contexto, funciones multimodales, límites de fiabilidad y comparación con modelos de IA competidores.

Evaluaciones de Ox Alpha: Benchmarks, configuración y consejos de seguridad - benchmarks guide
guía

Evaluaciones de Ox Alpha: Benchmarks, configuración y consejos de seguridad

Explora las evaluaciones de Ox Alpha, los benchmarks publicados, métodos prácticos de prueba, opciones de acceso y precauciones de privacidad para el modelo de IA anónimo.

Rendimiento de Ox Alpha: benchmarks, latencia y pruebas de programación - benchmarks guide
Guía

Rendimiento de Ox Alpha: benchmarks, latencia y pruebas de programación

Revisa el rendimiento de Ox Alpha en rendimiento de generación, latencia, fiabilidad, programación, entrada multimodal y cargas de trabajo agénticas de larga duración.