Noticias, guías y análisis
Grok 4.5 entra en la competencia por código, tareas agénticas y productividad de oficina
SpaceXAI lanzó Grok 4.5 para ingeniería, agentes y conocimiento, con acceso en herramientas de desarrollo y funciones para producir archivos de oficina.
Grok 4.5 amplía su objetivo más allá del chat. SpaceXAI presentó el 16 de julio Grok 4.5 como su modelo más avanzado para programación, tareas agénticas y trabajo de conocimiento. La empresa afirma que fue entrenado junto con Cursor y sobre datos de código, ciencia, ingeniería y matemáticas. El lanzamiento compite en un terreno cada vez más práctico: resolver problemas durante varias etapas, utilizar herramientas y entregar productos que puedan revisarse. Para los negocios, la pregunta relevante no es qué modelo encabeza una tabla, sino cuál completa un flujo concreto con menos intervención y costo predecible.
Las cifras de rendimiento son afirmaciones del proveedor. SpaceXAI publica resultados en evaluaciones de ingeniería y describe una formación sobre decenas de miles de GPU NVIDIA GB300, con filtrado, deduplicación y aprendizaje por refuerzo sobre cientos de miles de tareas. Esos datos ayudan a entender la escala del proyecto, pero no sustituyen una prueba interna. Los benchmarks utilizan entornos, herramientas y criterios que pueden diferir del trabajo cotidiano. Una empresa debe probar repositorios, documentos, políticas y formatos propios, manteniendo separados los resultados declarados por el fabricante de la evidencia obtenida en su operación.
La velocidad se combina con una apuesta por eficiencia. La compañía indica que Grok 4.5 se sirve a unas ochenta unidades de tokens por segundo y que, en SWE Bench Pro, produjo un promedio de 15.954 tokens de salida por tarea, frente a 67.020 atribuidos a otra configuración comparada. SpaceXAI resume esa diferencia como 4,2 veces menos tokens. La cifra no garantiza menor costo total, porque también importan éxito, reintentos, entradas, herramientas y revisión. Sin embargo, confirma que la eficiencia de razonamiento se está convirtiendo en un argumento comercial junto con la capacidad.
El trabajo de oficina pasa al centro del producto. Grok 4.5 es el modelo predeterminado de Grok Build, donde SpaceXAI muestra creación de modelos complejos en Excel con investigación web, fórmulas entre hojas y notas para futuras revisiones. También promociona elaboración de diagramas con formas nativas de PowerPoint y redacción en Word. El detalle de usar elementos nativos es importante: un archivo editable y estructurado tiene más valor que una imagen que parece una hoja o una diapositiva. La utilidad empresarial depende de que el resultado conserve fórmulas, formatos y trazabilidad.
La distribución reduce la distancia entre prueba y uso. El modelo está disponible en Grok Build, en Cursor para todos sus planes y mediante la consola de SpaceXAI. Esa presencia coloca la capacidad dentro de entornos donde desarrolladores y equipos ya trabajan. La tarifa anunciada es de dos dólares por millón de tokens de entrada y seis dólares por millón de salida. El precio facilita comparaciones iniciales, pero cada organización debe añadir herramientas, almacenamiento, supervisión y correcciones. Una integración barata puede resultar costosa si entrega archivos difíciles de mantener o acciones sin registro.
Los agentes necesitan contratos de trabajo explícitos. Un modelo capaz de modificar código, investigar y construir documentos debe recibir límites más precisos que una conversación ocasional. El equipo debe indicar archivos autorizados, pruebas obligatorias, fuentes aceptables, cambios prohibidos y punto de aprobación. En documentos, conviene exigir que cite datos y deje comentarios donde haya supuestos. En código, debe ejecutar pruebas y mostrar diferencias antes de integrar. El modelo puede acelerar una secuencia, pero la empresa conserva la responsabilidad sobre permisos, calidad y consecuencias del producto que finalmente utiliza.
La evaluación correcta es una competencia con casos reales. Un negocio puede preparar veinte tareas representativas: corregir un error, crear una fórmula, resumir fuentes, actualizar una presentación y redactar un informe. Después ejecuta los mismos casos con dos o tres alternativas y mide aprobación al primer intento, tiempo, tokens, ediciones y fallas de herramienta. El modelo ganador no será necesariamente el que produce la respuesta más impresionante, sino el que entrega archivos mantenibles y resultados confiables por menor costo total. Grok 4.5 eleva la competencia; la decisión sigue dependiendo de evidencia propia.