Daily Beirut

IA

SpaceXAI lanza su nuevo modelo Grok 4.7. Conozca sus ventajas y capacidades

SpaceXAI ha lanzado Grok 4.7, un modelo de inteligencia artificial más potente para tareas complejas de programación y trabajo profesional, con mejoras en la autoperseverancia, verificación automática y capacidad de manejar grandes volúmenes de información.

··8 min de lectura
SpaceXAI lanza su nuevo modelo Grok 4.7. Conozca sus ventajas y capacidades
Compartir

La empresa SpaceXAI ha lanzado su nuevo modelo de inteligencia artificial Grok 4.7, en un paso que refuerza su presencia en el mercado de modelos orientados a la programación y la ejecución de tareas profesionales complejas, con un enfoque especial en la capacidad del modelo para operar durante períodos más largos de forma independiente, utilizar herramientas y revisar lo que realiza antes de entregar el resultado final.

La compañía describe a Grok 4.7 como el más potente de sus modelos hasta ahora en programación y tareas cognitivas empresariales, afirmando que ahora es más capaz de continuar ejecutando tareas difíciles, verificar su propio trabajo y manejar grandes cantidades de información dentro de una sola conversación.

El lanzamiento del nuevo modelo se produce tras la transformación de xAI en parte de la empresa SpaceX, que anunció en febrero pasado su adquisición de la empresa de inteligencia artificial fundada por Elon Musk, cuyos productos y servicios ahora se ofrecen bajo el nombre de SpaceXAI.

SpaceXAI ha basado Grok 4.7 en un nuevo modelo base más grande que el utilizado en la versión anterior, Grok 4.6, aunque la empresa no ha revelado el número de parámetros ni los detalles completos de la arquitectura del nuevo modelo.

Este representa un cambio claro respecto a las primeras generaciones de Grok; en 2024, la empresa reveló los detalles de Grok-1, que se basaba en 314 mil millones de parámetros y en una arquitectura de "muestra de expertos" (Mixture-of-Experts o MoE), antes de que las generaciones posteriores se orientaran hacia modelos más avanzados y enfocados al uso comercial y agente.

Pero el aumento de tamaño no es el cambio más importante con Grok 4.7, ya que SpaceXAI afirma que ha sometido el modelo a un período más largo de entrenamiento mediante aprendizaje por refuerzo (Reinforcement Learning), utilizando una colección de problemas más difíciles y otorgando mayor peso a las tareas que pueden tomar horas en completarse.

Esto significa prácticamente que la empresa no solo busca mejorar la capacidad del modelo para responder una pregunta individual, sino entrenarlo para continuar ejecutando tareas largas compuestas por decenas o cientos de pasos.

Por ejemplo, existe una gran diferencia entre pedirle a un modelo inteligente que escriba un pequeño fragmento de código y darle un proyecto de software completo y solicitarle añadir un sistema nuevo de registro de usuarios, modificar todos los archivos afectados, ejecutar pruebas, detectar errores derivados de los cambios, corregirlos y revisar el resultado final.

Este segundo tipo de tareas exige que el modelo mantenga en su memoria la meta original de la tarea todo el tiempo, conozca los pasos ya realizados y pueda retroceder decisiones anteriores si descubre que fueron incorrectas, precisamente este tipo de desafío es el que SpaceXAI afirma haber enfocado durante el entrenamiento de Grok 4.7.

Una de las principales mejoras destacadas por la empresa es la capacidad de Grok 4.7 para verificar su propio trabajo (Self-verification) de manera más eficaz.

Cuando se le encarga, por ejemplo, analizar decenas de archivos financieros y crear una presentación sobre el desempeño de una empresa, se espera que sea más capaz de detectar si hay un número en alguna diapositiva que no concuerda con los datos del archivo original, o notar que la suma de un conjunto de números no coincide con el total registrado en el informe, y regresar a los datos para verificarlos antes de entregar el trabajo.

Pero esto no significa que Grok 4.7 esté inmune a errores o "alucinaciones", sino que el proceso de entrenamiento ahora incentiva al modelo a revisar sus propios pasos y verificarlos más frecuentemente.

SpaceXAI señaló que el modelo presenta tasas limitadas de alucinaciones (Minimal Hallucinations), aunque la empresa no proporcionó en el comunicado de lanzamiento una métrica estándar que permita medir y comparar la tasa de errores informativos con todos sus competidores.

Medio millón de tokens en una sola tarea

Grok 4.7 ofrece una ventana de contexto (Context Window) de hasta 500 mil tokens, la cantidad de información que el modelo puede retener y procesar dentro de una única tarea.

Un "token" es la unidad en la que las IA dividen el texto durante el procesamiento, pudiendo ser una palabra completa o una parte de ella, por lo tanto, no existe una conversión fija entre el número de tokens y el número de palabras.

En la práctica, este nuevo tamaño permite introducir cientos de miles de palabras en el mismo contexto, como presentar un gran conjunto de contratos, informes o amplias partes de un proyecto de software, y luego hacer preguntas que requieren conectar información distribuida entre esos archivos, y SpaceXAI afirma que la mejora no se trata solo del tamaño de la ventana de contexto, sino también de la capacidad del modelo para gestionarla durante periodos más largos.

Esta es una diferencia fundamental: no tiene sentido que el modelo pueda recibir medio millón de tokens si pierde la capacidad de recuperar detalles importantes que aparecieron al inicio de la tarea cuando llega a sus etapas finales.

4 niveles de razonamiento

SpaceXAI permite a los desarrolladores controlar el nivel de esfuerzo de razonamiento (Reasoning Effort) que utiliza Grok 4.7 antes de entregar una respuesta, a través de cuatro niveles: Low, Medium, High y xHigh, siendo el nivel High el predeterminado.

El nivel Low asigna menos procesos de inferencia, haciéndolo adecuado para tareas simples o aplicaciones que requieren una respuesta rápida.

El nivel Medium dirige al modelo a invertir más recursos computacionales en el análisis de datos y tareas que dependen de contextos largos, mientras que el nivel High se enfoca en problemas complejos y operaciones lógicas de múltiples pasos.

El nivel xHigh asigna el máximo esfuerzo de razonamiento del modelo antes de responder, por lo tanto, es ideal para tareas donde la precisión del resultado es más importante que la velocidad de respuesta.

Grok se convierte en un agente inteligente

Grok 4.7 también refleja la tendencia acelerada en el mercado de la inteligencia artificial hacia los agentes de IA (AI Agent).

SpaceXAI describe a su nuevo modelo como preparado para usar herramientas externas mediante una llamada agente a herramientas (Agentic Tool Calling), de modo que su rol no se limita a ofrecer respuestas textuales, sino que puede identificar la herramienta necesaria para realizar una acción específica, utilizarla, analizar el resultado y decidir el siguiente paso.

La empresa ofrece a través de su plataforma para desarrolladores herramientas que permiten al modelo buscar en internet, buscar dentro de la plataforma "X", ejecutar códigos, interactuar con bases de datos y documentos, además de comunicarse con sistemas externos mediante el protocolo MCP.

En lugar de que el usuario simplemente diga "escribe un informe sobre el desempeño de una empresa", en un entorno adecuado, el agente podría buscar los datos más recientes de la empresa, revisar sus documentos internos a los que el usuario tiene acceso, realizar los cálculos necesarios y luego redactar el informe o crear una presentación según los resultados.

SpaceXAI ha enfatizado claramente el uso de Grok 4.7 en tareas oficinales y profesionales, afirmando que el modelo es ahora mejor en crear documentos y presentaciones.

La empresa probó estas capacidades mediante pruebas como GDPval y AA Briefcase, que intentan medir el rendimiento de modelos de IA en tareas similares a las que realizan abogados, analistas financieros, especialistas en salud y otros profesionales.

Ventajas y capacidades de Grok 4.7

Una de las principales ventajas de SpaceXAI con el nuevo modelo es su precio: el uso de Grok 4.7 a través de la interfaz API comienza en 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida, el mismo precio que ofreció la empresa con Grok 4.6. Además, ofrece una versión rápida del modelo que duplica la velocidad de generación de texto a cambio de duplicar el precio.

En contraste, el precio de GPT-6 Astra ronda los 10 dólares por millón de tokens de entrada y 50 dólares por salida, precios similares a los que impone Anthropic para Claude Fable 5.1.

Así pues, Grok es significativamente más barato que estos dos modelos, aunque no puede considerarse el más económico entre todos los competidores, ya que Google Gemini 3.8 Flash actualmente ofrece un precio inicial más bajo.

Junto con el desarrollo de capacidades, SpaceXAI afirmó que ha reconstruido completamente el sistema de protección Safeguard Stack utilizado con Grok 4.7.

La compañía describe al modelo como el más fuerte que ha probado hasta ahora en rechazar solicitudes peligrosas y resistir intentos de burlar los sistemas de seguridad (Jailbreaks).

Además, SpaceXAI ha comenzado a otorgar a un grupo selecto de socios en ciberseguridad acceso especial a las capacidades de equipo rojo (Red Team) en Grok 4.7, para su uso en investigaciones defensivas.

La importancia de este aspecto crece con el aumento de las capacidades de los modelos de IA en ciberseguridad; el último modelo de OpenAI, GPT-6 Astra, se convirtió en el primer modelo de la empresa en alcanzar la clasificación "Critical" en capacidades cibernéticas según su marco de preparación, lo que, según OpenAI, significa que, al proporcionársele las herramientas y permisos adecuados, puede detectar vulnerabilidades desconocidas y desarrollar formas de explotarlas sin necesidad de instrucciones humanas paso a paso.

SpaceXAI establece mayo de 2026 como la fecha límite para la información integrada durante el entrenamiento de Grok 4.7, por lo tanto, el modelo no posee conocimiento automático sobre eventos ocurridos después de esa fecha.

Para acceder a información actualizada, es necesario activar herramientas de búsqueda en internet o buscar dentro de la plataforma "X".

Añade Daily Beirut a tu feed de Google News y recibe lo último primero.
Compartir