{"id":9679,"date":"2026-09-28T11:08:37","date_gmt":"2026-09-28T09:08:37","guid":{"rendered":"https:\/\/www.hostingtg.com\/blog\/?p=9679"},"modified":"2026-09-28T11:11:52","modified_gmt":"2026-09-28T09:11:52","slug":"grok-4-7-novedades-rendimiento-y-precio","status":"publish","type":"post","link":"https:\/\/www.hostingtg.com\/blog\/grok-4-7-novedades-rendimiento-y-precio\/","title":{"rendered":"Grok 4.7: novedades, rendimiento y precio"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\"><a href=\"https:\/\/www.hostingtg.com\/blog\/grok-3\/\">Grok<\/a> 4.7 me parece uno de los lanzamientos m\u00e1s interesantes de SpaceXAI hasta la fecha. Y no precisamente porque llegue con otro pu\u00f1ado de benchmarks para presumir de puntuaciones, sino porque empieza a demostrar que Grok quiere competir en algo bastante m\u00e1s importante: <strong>hacer trabajo real<\/strong>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Con esta generaci\u00f3n, el foco est\u00e1 especialmente puesto en la programaci\u00f3n, el razonamiento prolongado, las tareas de conocimiento y los <a href=\"https:\/\/www.hostingtg.com\/blog\/agentes-de-ia\/\">agentes de IA<\/a>. Grok sigue teniendo esa personalidad que siempre lo ha diferenciado dentro del mercado, pero Grok 4.7 parece perseguir un objetivo bastante m\u00e1s ambicioso que ser simplemente un chatbot llamativo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">El modelo fue lanzado el 21 de septiembre de 2026 y mantiene buena parte de las especificaciones comerciales de Grok 4.6: una ventana de contexto de 500.000 tokens y un precio base de 2 d\u00f3lares por mill\u00f3n de tokens de entrada y 6 d\u00f3lares por mill\u00f3n de salida para prompts por debajo de 200.000 tokens. A partir de ese umbral, las tarifas suben a 4 y 12 d\u00f3lares respectivamente.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Lo verdaderamente interesante est\u00e1 debajo de esas cifras.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">SpaceXAI asegura haber utilizado un modelo base mayor y un proceso de aprendizaje por refuerzo m\u00e1s prolongado, poniendo especial \u00e9nfasis en tareas complejas que pueden requerir mucho tiempo de ejecuci\u00f3n.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y para m\u00ed es precisamente ah\u00ed donde empieza la historia de Grok 4.7.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Qu\u00e9 es Grok 4.7 y por qu\u00e9 esta versi\u00f3n es importante<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 es una nueva generaci\u00f3n del modelo de inteligencia artificial de SpaceXAI orientada especialmente a mejorar la programaci\u00f3n avanzada, el razonamiento y la ejecuci\u00f3n de tareas complejas de conocimiento.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Sobre el papel podr\u00eda parecer una evoluci\u00f3n incremental de Grok 4.6. Comparten una ventana de contexto de 500.000 tokens y la misma estructura b\u00e1sica de precios. Sin embargo, las primeras evaluaciones independientes apuntan a diferencias apreciables en determinadas tareas: Grok 4.7 obtiene 46 puntos frente a los 44 de Grok 4.6 en el Intelligence Index de Artificial Analysis y 56 frente a 47 en su Coding Agent Index.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Pero reducir el lanzamiento a esos dos n\u00fameros ser\u00eda quedarse en la superficie.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En mi caso, lo que m\u00e1s me llama la atenci\u00f3n es el cambio de direcci\u00f3n que representa. Grok ya no parece querer competir solamente por responder mejor una pregunta. El objetivo se acerca cada vez m\u00e1s a conseguir que el modelo <strong>razone, utilice herramientas y mantenga una tarea durante mucho m\u00e1s tiempo<\/strong>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Eso cambia bastante lo que debemos exigirle a una IA.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Resolver un problema de programaci\u00f3n en un benchmark es una cosa. Trabajar sobre un proyecto durante horas, inspeccionar archivos, ejecutar herramientas, descubrir que algo ha salido mal, volver atr\u00e1s y continuar sin perder el objetivo original es otra muy distinta.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 parece construido pensando cada vez m\u00e1s en ese segundo escenario.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Qu\u00e9 novedades trae Grok 4.7<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Las novedades m\u00e1s relevantes no consisten \u00fanicamente en darle al modelo m\u00e1s conocimiento. SpaceXAI ha cambiado tanto la base utilizada como el entrenamiento posterior.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Seg\u00fan la informaci\u00f3n publicada alrededor del lanzamiento, Grok 4.7 utiliza un modelo base m\u00e1s grande que Grok 4.6 y un periodo de aprendizaje por refuerzo m\u00e1s largo, orientado especialmente a tareas complejas de larga duraci\u00f3n.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Esto es importante porque el entrenamiento base y el aprendizaje por refuerzo cumplen papeles diferentes. No basta con que el modelo haya absorbido cantidades enormes de informaci\u00f3n: tambi\u00e9n tiene que aprender a comportarse correctamente cuando debe resolver un problema mediante muchos pasos.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">M\u00e1s capacidad para programaci\u00f3n y tareas complejas<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">La programaci\u00f3n es uno de los campos donde m\u00e1s claramente quiere destacar Grok 4.7.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Las evaluaciones publicadas por el propio proveedor muestran mejoras frente a Grok 4.6 en pruebas como CursorBench, DeepSWE y Terminal-Bench. Conviene poner una advertencia delante de esos resultados: buena parte de las cifras iniciales proceden de SpaceXAI y no todas han sido reproducidas independientemente.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Las mediciones externas disponibles son m\u00e1s interesantes precisamente por eso.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Artificial Analysis sit\u00faa a Grok 4.7 en <strong>56 puntos en su Coding Agent Index<\/strong>, frente a los 47 de Grok 4.6 en sus respectivos entornos nativos.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">La diferencia es considerablemente mayor que los dos puntos que separan a ambos modelos en el \u00edndice general.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y eso nos da una primera pista: <strong>Grok 4.7 puede resultar bastante m\u00e1s interesante en tareas concretas de programaci\u00f3n de lo que su mejora en inteligencia general sugiere a primera vista.<\/strong><\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Razonamiento m\u00e1s prolongado para trabajos que requieren muchos pasos<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Este es probablemente uno de los cambios que m\u00e1s me interesan.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Cada vez importa menos que una IA responda espectacularmente bien a una pregunta aislada y m\u00e1s que pueda permanecer trabajando durante varios minutos \u2014o mucho m\u00e1s\u2014 sin descarrilar.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En una tarea compleja, el modelo puede tener que leer documentaci\u00f3n, modificar c\u00f3digo, comprobar el resultado, utilizar una herramienta, interpretar un error y volver a intentarlo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">El reto deja de ser:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u201c\u00bfConoce la respuesta?\u201d<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y pasa a ser:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u201c\u00bfPuede llegar hasta la respuesta correcta sin que yo tenga que llevarlo de la mano?\u201d<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si el entrenamiento prolongado que SpaceXAI describe consigue trasladarse realmente a este tipo de situaciones, para m\u00ed ser\u00eda bastante m\u00e1s importante que ganar unos cuantos puntos adicionales en un benchmark general.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Grok Bot y la apuesta por los agentes de IA<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Aqu\u00ed aparece otra pieza importante: el entorno ag\u00e9ntico.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Cuando hablamos de agentes, el modelo deja de ser \u00fanicamente un generador de texto. Tiene que decidir qu\u00e9 hacer, utilizar herramientas, observar los resultados y continuar trabajando.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por eso un modelo excelente como chatbot no tiene por qu\u00e9 ser autom\u00e1ticamente un excelente agente.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">El salto importante consiste en pasar de:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>prompt \u2192 respuesta<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">a algo m\u00e1s parecido a:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>objetivo \u2192 planificaci\u00f3n \u2192 herramienta \u2192 resultado \u2192 comprobaci\u00f3n \u2192 correcci\u00f3n \u2192 siguiente acci\u00f3n.<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Para m\u00ed, entrenar y evaluar Grok pensando en este tipo de flujo es una de las partes m\u00e1s interesantes de su evoluci\u00f3n.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Grok 4.7 vs Grok 4.6: cu\u00e1les son las diferencias<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">A primera vista, Grok 4.7 y Grok 4.6 se parecen bastante.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Los dos ofrecen una ventana de contexto de 500.000 tokens y comparten una estructura de precios de 2 d\u00f3lares por mill\u00f3n de tokens de entrada y 6 por mill\u00f3n de salida hasta el umbral de 200.000 tokens de prompt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Las diferencias aparecen cuando miramos el entrenamiento y el rendimiento.<\/p>\n\n\n\n<figure class=\"wp-block-table\"><table class=\"has-fixed-layout\"><tbody><tr><th>Caracter\u00edstica<\/th><th class=\"has-text-align-right\" data-align=\"right\">Grok 4.7<\/th><th class=\"has-text-align-right\" data-align=\"right\">Grok 4.6<\/th><\/tr><tr><td>Contexto<\/td><td class=\"has-text-align-right\" data-align=\"right\">500.000 tokens<\/td><td class=\"has-text-align-right\" data-align=\"right\">500.000 tokens<\/td><\/tr><tr><td>Precio base entrada<\/td><td class=\"has-text-align-right\" data-align=\"right\">$2 \/ mill\u00f3n<\/td><td class=\"has-text-align-right\" data-align=\"right\">$2 \/ mill\u00f3n<\/td><\/tr><tr><td>Precio base salida<\/td><td class=\"has-text-align-right\" data-align=\"right\">$6 \/ mill\u00f3n<\/td><td class=\"has-text-align-right\" data-align=\"right\">$6 \/ mill\u00f3n<\/td><\/tr><tr><td>Intelligence Index<\/td><td class=\"has-text-align-right\" data-align=\"right\">46<\/td><td class=\"has-text-align-right\" data-align=\"right\">44<\/td><\/tr><tr><td>Coding Agent Index<\/td><td class=\"has-text-align-right\" data-align=\"right\">56<\/td><td class=\"has-text-align-right\" data-align=\"right\">47<\/td><\/tr><tr><td>AA-Briefcase<\/td><td class=\"has-text-align-right\" data-align=\"right\">1.657 Elo<\/td><td class=\"has-text-align-right\" data-align=\"right\">1.546 Elo<\/td><\/tr><\/tbody><\/table><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">Las cifras corresponden a las evaluaciones y condiciones recogidas por Artificial Analysis y resumidas en los referentes analizados; no deben interpretarse como una garant\u00eda de id\u00e9ntico rendimiento en cualquier carga de trabajo.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Rendimiento y razonamiento<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">La subida de 44 a 46 puntos en el Intelligence Index puede parecer peque\u00f1a.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">No la interpretar\u00eda de manera aislada.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Cuando los modelos se encuentran ya en la zona alta de determinadas evaluaciones, conseguir mejoras adicionales puede resultar cada vez m\u00e1s dif\u00edcil. Pero, al mismo tiempo, dos puntos tampoco justifican por s\u00ed solos afirmar que la experiencia cotidiana vaya a cambiar radicalmente.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por eso prefiero observar d\u00f3nde aparecen las mejoras.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y programaci\u00f3n ag\u00e9ntica y trabajo profesional son dos \u00e1reas especialmente interesantes.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Programaci\u00f3n y capacidades ag\u00e9nticas<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">El salto de 47 a 56 en el Coding Agent Index es mucho m\u00e1s llamativo que la diferencia observada en inteligencia general. AA-Briefcase tambi\u00e9n pasa de 1.546 Elo en Grok 4.6 a 1.657 en Grok 4.7.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Esto refuerza una de mis impresiones sobre el lanzamiento: quiz\u00e1 la pregunta equivocada sea <strong>\u201c\u00bfcu\u00e1nto m\u00e1s inteligente es Grok 4.7?\u201d<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">La pregunta m\u00e1s \u00fatil puede ser:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u201c\u00bfEn qu\u00e9 trabajos se ha vuelto realmente mejor?\u201d<\/strong><\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Velocidad y eficiencia<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 mantiene la estructura de precio de su predecesor y dispone adem\u00e1s de variantes orientadas a mayor velocidad. Las fuentes analizadas describen una opci\u00f3n r\u00e1pida que aproximadamente duplica la velocidad de salida a cambio de duplicar tambi\u00e9n el precio.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Pero velocidad y eficiencia tampoco son exactamente lo mismo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Un modelo puede generar tokens muy deprisa y, aun as\u00ed, consumir tantos que la tarea completa termine siendo m\u00e1s cara o lenta de lo esperado.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y este detalle va a resultar importante cuando hablemos del precio.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Grok 4.7 para programaci\u00f3n: uno de los grandes saltos de esta generaci\u00f3n<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Si tuviera que elegir una de las \u00e1reas que merece seguir de cerca en Grok 4.7, ser\u00eda la programaci\u00f3n.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">No solamente porque mejore sus resultados, sino porque los modelos de programaci\u00f3n est\u00e1n evolucionando desde el cl\u00e1sico asistente que completa c\u00f3digo hacia sistemas capaces de encargarse de partes cada vez mayores del ciclo de desarrollo.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">C\u00f3mo rinde Grok 4.7 programando<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Los resultados iniciales son prometedores, aunque conviene diferenciar los datos del proveedor de las evaluaciones independientes.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Entre las cifras comunicadas por el proveedor aparecen un 46,3 % en CursorBench 4.0 y un 71 % en DeepSWE v1.1 bajo las condiciones utilizadas en su evaluaci\u00f3n. En Terminal-Bench 4.0, el proveedor comunic\u00f3 un 38 %.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">No tratar\u00eda estas cifras como verdades universales. Un benchmark nos dice c\u00f3mo se comport\u00f3 un modelo en unas condiciones determinadas, no c\u00f3mo funcionar\u00e1 autom\u00e1ticamente sobre nuestro repositorio.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por eso me parece m\u00e1s interesante combinar las pruebas con proyectos reales.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Qu\u00e9 cambia cuando una IA tiene que trabajar durante varios minutos<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Aqu\u00ed est\u00e1, para m\u00ed, el verdadero examen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Cuando utilizo un modelo para resolver una duda puntual, puedo comprobar su respuesta inmediatamente. En cambio, cuando le entrego una tarea compleja, necesito confiar en una cadena de decisiones mucho m\u00e1s larga.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Tiene que entender el proyecto, localizar archivos relevantes, modificar c\u00f3digo, ejecutar pruebas y reaccionar ante lo que encuentre.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Cuantos m\u00e1s pasos a\u00f1adimos, m\u00e1s oportunidades existen de que una peque\u00f1a equivocaci\u00f3n inicial termine desviando completamente el resultado.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por eso cada vez valoro menos una respuesta espectacular aislada y m\u00e1s la capacidad de <strong>trabajar durante mucho tiempo sin perder el contexto ni necesitar supervisi\u00f3n constante<\/strong>.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Herramientas, contexto y capacidad para corregir errores<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">La ventana de contexto de 500.000 tokens proporciona a Grok 4.7 bastante espacio para trabajar con informaci\u00f3n extensa.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Pero tener contexto disponible no significa utilizarlo correctamente.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En tareas reales quiero comprobar tres cosas:<\/p>\n\n\n\n<ol start=\"1\" class=\"wp-block-list\">\n<li>si encuentra la informaci\u00f3n relevante dentro de ese contexto;<\/li>\n\n\n\n<li>si recuerda las decisiones importantes a medida que avanza;<\/li>\n\n\n\n<li>si detecta cu\u00e1ndo una acci\u00f3n anterior ha sido incorrecta.<\/li>\n<\/ol>\n\n\n\n<p class=\"wp-block-paragraph\">La tercera es especialmente importante.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Un agente que nunca se equivoca ser\u00eda fant\u00e1stico, pero no es una expectativa realista. Un agente que <strong>detecta el error y consigue recuperarse solo<\/strong> puede resultar much\u00edsimo m\u00e1s \u00fatil.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Grok 4.7 y los agentes de IA: por qu\u00e9 Grok Bot puede ser importante<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Los agentes est\u00e1n convirti\u00e9ndose en uno de los principales campos de batalla entre los grandes laboratorios de inteligencia artificial.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">La raz\u00f3n es sencilla: un chatbot nos ayuda a trabajar; un buen agente puede empezar a completar partes del trabajo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Esa diferencia tiene enormes implicaciones.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">De responder prompts a completar tareas<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Pensemos en una investigaci\u00f3n.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Un chatbot tradicional puede resumir los documentos que le proporcionemos.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Un agente, en cambio, puede tener que localizar informaci\u00f3n, decidir qu\u00e9 fuentes consultar, comparar datos, identificar contradicciones, preparar un documento y revisar el resultado.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">La calidad de cada respuesta sigue importando, pero ahora aparece una nueva variable: <strong>la continuidad del trabajo<\/strong>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y creo que este es uno de los terrenos donde Grok 4.7 quiere hacerse un hueco.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">El reto de mantener el razonamiento durante muchos pasos<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Los errores se acumulan.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si una tarea requiere veinte decisiones consecutivas y el modelo interpreta mal la quinta, todo lo que ocurra despu\u00e9s puede quedar condicionado.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por eso el entrenamiento en tareas de mayor duraci\u00f3n que SpaceXAI describe me parece m\u00e1s interesante que un simple incremento de tama\u00f1o.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">La autonom\u00eda \u00fatil no consiste en dejar al modelo hacer cosas sin control. Consiste en que pueda avanzar m\u00e1s lejos antes de necesitar una intervenci\u00f3n.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Cu\u00e1ndo importa m\u00e1s la autonom\u00eda que una respuesta perfecta<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Para determinadas consultas, quiero la mejor respuesta posible.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Para otras tareas, prefiero un modelo ligeramente menos brillante en una pregunta aislada si consigue completar correctamente veinte pasos consecutivos.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ah\u00ed cambia la definici\u00f3n de \u201cmejor IA\u201d.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Programaci\u00f3n, investigaci\u00f3n, an\u00e1lisis documental y automatizaci\u00f3n son buenos ejemplos. El resultado final depende de toda la trayectoria, no de un \u00fanico prompt.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Benchmarks de Grok 4.7: cu\u00e1nto ha mejorado realmente<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Los benchmarks son \u00fatiles. El problema aparece cuando intentamos convertir una tabla en una respuesta universal sobre cu\u00e1l es el mejor modelo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 lo demuestra bastante bien porque sus resultados cambian seg\u00fan lo que midamos.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Resultados en Artificial Analysis<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">En el Intelligence Index v4.3.2 citado por los referentes, Grok 4.7 obtiene 46 puntos con esfuerzo xhigh. Grok 4.6 queda en 44.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Pero al compararlo con <a href=\"https:\/\/www.hostingtg.com\/blog\/gpt-6-sol-y-luna\/\">GPT-5.6 Sol<\/a> encontramos resultados muy diferentes dependiendo de la prueba.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por ejemplo, los datos recogidos por OrcaRouter muestran a Grok 4.7 por delante en AutomationBench-AA y en evaluaciones de entregables profesionales como AA-Briefcase y GDPval-AA, mientras GPT-5.6 Sol obtiene mejores resultados en esa comparaci\u00f3n en Terminal-Bench, razonamiento complejo y contexto largo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Eso es bastante m\u00e1s informativo que mirar \u00fanicamente la puntuaci\u00f3n agregada.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Rendimiento en benchmarks de programaci\u00f3n y agentes<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">En el Coding Agent Index independiente recogido por OrcaRouter, Grok 4.7 alcanza 56 puntos frente a los 47 de Grok 4.6.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">AA-Briefcase cuenta una historia parecida: 1.657 Elo para Grok 4.7 frente a 1.546 de su predecesor en las configuraciones citadas.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Es precisamente esta disparidad entre evaluaciones lo que me resulta interesante.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">El modelo no parece mejorar exactamente igual en todo. Hay \u00e1reas donde el salto resulta mucho m\u00e1s visible.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Por qu\u00e9 una puntuaci\u00f3n m\u00e1s alta no siempre significa un modelo mejor para ti<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Personalmente, no elegir\u00eda un modelo \u00fanicamente por su posici\u00f3n en un benchmark.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Los benchmarks sirven para reducir incertidumbre, comparar capacidades bajo condiciones relativamente controladas y detectar tendencias. Pero nuestro trabajo real rara vez se parece exactamente a una prueba estandarizada.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si voy a utilizar Grok 4.7 para programar, quiero probarlo con mi c\u00f3digo.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si lo quiero para investigar, necesito saber c\u00f3mo se comporta con mis fuentes.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y si quiero utilizarlo como agente, me interesa descubrir cu\u00e1nto puede avanzar antes de necesitar que yo intervenga.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">La pregunta final no es:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u201c\u00bfQu\u00e9 puntuaci\u00f3n tiene?\u201d<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Sino:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u201c\u00bfCu\u00e1nto trabajo \u00fatil consigue terminar?\u201d<\/strong><\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Precio de Grok 4.7: cu\u00e1nto cuesta usarlo<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">El precio es uno de los argumentos m\u00e1s atractivos sobre el papel.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 mantiene un coste base de <strong>2 d\u00f3lares por mill\u00f3n de tokens de entrada y 6 d\u00f3lares por mill\u00f3n de tokens de salida<\/strong> para solicitudes por debajo de 200.000 tokens de prompt. Al superar ese nivel, la estructura citada pasa a 4 d\u00f3lares de entrada y 12 de salida.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Precio de entrada y salida<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Esto permite que Grok 4.7 presente un precio nominal agresivo frente a determinados modelos de frontera.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por ejemplo, la comparaci\u00f3n publicada por OrcaRouter utiliza para GPT-5.6 Sol unas tarifas de 4 d\u00f3lares por mill\u00f3n de tokens de entrada y 20 d\u00f3lares por mill\u00f3n de salida, se\u00f1alando adem\u00e1s que esas tarifas de Sol son promocionales en el periodo analizado.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si nos quedamos aqu\u00ed, Grok parece claramente m\u00e1s barato.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Pero nos falta una parte importante.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">C\u00f3mo queda frente a otros modelos de IA<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Comparar modelos \u00fanicamente mediante precio por mill\u00f3n de tokens es parecido a comparar coches mirando exclusivamente el precio del litro de combustible.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Necesitamos saber cu\u00e1nto consume cada uno para completar el trayecto.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">OrcaRouter recoge una diferencia especialmente ilustrativa: en las ejecuciones de Artificial Analysis citadas, Grok 4.7 produjo alrededor de 81.000 tokens de salida por tarea frente a unos 29.000 de GPT-5.6 Sol.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">El token de Grok puede ser considerablemente m\u00e1s barato, pero eso no implica que <strong>cada trabajo terminado<\/strong> vaya a ser proporcionalmente m\u00e1s econ\u00f3mico.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">El precio por token no cuenta toda la historia<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Esta es una de las partes que m\u00e1s tendr\u00eda en cuenta si fuese a utilizar Grok 4.7 de forma intensiva.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Para m\u00ed:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>coste real \u2260 precio por token.<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">El coste efectivo tambi\u00e9n depende de:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>cu\u00e1ntos tokens necesita;<\/li>\n\n\n\n<li>cu\u00e1nto tiempo razona;<\/li>\n\n\n\n<li>cu\u00e1ntos intentos realiza;<\/li>\n\n\n\n<li>cu\u00e1ntas veces falla;<\/li>\n\n\n\n<li>cu\u00e1nto tengo que supervisarlo;<\/li>\n\n\n\n<li>y cu\u00e1nto trabajo \u00fatil termina.<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Un modelo que cuesta el doble por token pero resuelve una tarea correctamente en el primer intento puede terminar saliendo m\u00e1s barato que otro que necesita tres intentos y diez minutos de revisi\u00f3n humana.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En agentes, esta diferencia puede ser todav\u00eda mayor.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">El tiempo humano tambi\u00e9n cuesta dinero.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Velocidad de Grok 4.7: \u00bfrealmente es el doble de r\u00e1pido?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Aqu\u00ed conviene tener cuidado con los titulares.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Las fuentes analizadas describen una variante r\u00e1pida de Grok 4.7 que aproximadamente duplica la velocidad de salida a cambio de aproximadamente duplicar tambi\u00e9n el precio.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por tanto, hablar simplemente de \u201cGrok 4.7 es el doble de r\u00e1pido\u201d puede inducir a error si no especificamos <strong>qu\u00e9 variante estamos comparando y en qu\u00e9 condiciones<\/strong>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Adem\u00e1s, la velocidad de generaci\u00f3n no es sin\u00f3nimo de velocidad para completar una tarea.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Un modelo puede generar 200 tokens por segundo y tardar m\u00e1s en terminar si produce una cantidad enorme de tokens. Otro puede generar m\u00e1s despacio pero llegar antes al resultado.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por eso, para evaluar velocidad en situaciones reales, yo mirar\u00eda:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>latencia inicial + velocidad de generaci\u00f3n + tokens utilizados + n\u00famero de pasos + reintentos.<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ese conjunto se acerca bastante m\u00e1s a la experiencia que realmente tendremos.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Grok 4.7 vs GPT-5.6 Sol: diferencias principales<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Esta es una comparaci\u00f3n especialmente interesante porque ambos modelos pueden estar muy cerca en algunas evaluaciones y bastante separados en otras.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">No hay una \u00fanica m\u00e9trica que resuma correctamente todos los casos de uso.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Programaci\u00f3n y agentes<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Los datos recogidos en las fuentes muestran resultados mixtos.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 destaca en algunas evaluaciones de automatizaci\u00f3n y entregables profesionales, mientras GPT-5.6 Sol presenta mejores resultados en la comparaci\u00f3n citada para Terminal-Bench 4.0.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Eso hace que el caso de uso sea fundamental.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Un benchmark de programaci\u00f3n cient\u00edfica, uno de terminal y uno de automatizaci\u00f3n no est\u00e1n midiendo exactamente la misma habilidad.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Razonamiento y tareas de conocimiento<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">En el Intelligence Index citado, Grok 4.7 obtiene 46 puntos y GPT-5.6 Sol 47 bajo los niveles de esfuerzo comparados.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Pero la diferencia agregada de un punto oculta una dispersi\u00f3n bastante mayor.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En los datos recogidos por OrcaRouter, Sol obtiene mejores resultados en varias pruebas de razonamiento complejo y contexto largo, mientras Grok 4.7 destaca en otras relacionadas con automatizaci\u00f3n, entregables profesionales y la m\u00e9trica de conocimiento\/honestidad incluida en esa comparaci\u00f3n.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por eso evitar\u00eda concluir que uno es universalmente \u201cm\u00e1s inteligente\u201d bas\u00e1ndome en un \u00fanico n\u00famero.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Velocidad, consumo de tokens y coste<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 tiene una ventaja clara en precio nominal por token bajo las tarifas comparadas: 2\/6 d\u00f3lares frente a 4\/20 para GPT-5.6 Sol.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Sin embargo, la medici\u00f3n citada tambi\u00e9n atribuye a Grok 4.7 bastante m\u00e1s consumo de tokens de salida por tarea.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y ah\u00ed volvemos al mismo punto: <strong>precio y coste no son sin\u00f3nimos<\/strong>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Para decidir entre ambos probar\u00eda exactamente la carga de trabajo que vaya a utilizar y medir\u00eda coste por resultado satisfactorio, no \u00fanicamente coste por mill\u00f3n de tokens.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">\u00bfMerece la pena Grok 4.7?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">La respuesta depende mucho m\u00e1s del trabajo que queramos hacer que de una clasificaci\u00f3n general.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si ya utilizas Grok 4.6, Grok 4.7 resulta especialmente interesante porque mantiene la misma estructura b\u00e1sica de precios y contexto mientras mejora en varias evaluaciones de programaci\u00f3n y trabajo profesional.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Para programaci\u00f3n y agentes, el salto merece especialmente atenci\u00f3n.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Para tareas con much\u00edsimo contexto, tambi\u00e9n conviene tener en cuenta que sus 500.000 tokens pueden quedar por debajo de alternativas con ventanas mayores. En la comparaci\u00f3n utilizada anteriormente, GPT-5.6 Sol dispone de una ventana de aproximadamente 1,05 millones de tokens.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y si el criterio principal es el precio, tampoco me quedar\u00eda solamente con la tarifa de API.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Yo har\u00eda una peque\u00f1a prueba con 20 o 30 tareas representativas de mi trabajo y medir\u00eda cuatro cosas:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>tasa de \u00e9xito, tiempo total, tokens consumidos e intervenciones humanas.<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Esa prueba probablemente me dir\u00eda bastante m\u00e1s que diez tablas de benchmarks.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">En mi caso, precisamente eso es lo que m\u00e1s quiero comprobar con Grok 4.7: c\u00f3mo responde programando durante periodos prolongados, investigando informaci\u00f3n, manejando contextos grandes o ejecutando tareas aut\u00f3nomas en las que tenga que darse cuenta de que se ha equivocado y corregirse.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Porque ah\u00ed es donde realmente se decide si estamos delante de un chatbot m\u00e1s inteligente o de una herramienta capaz de asumir una parte mayor del trabajo.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Grok 4.7 muestra hacia d\u00f3nde se dirige la carrera de la IA<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 no me parece interesante simplemente porque consiga mejores resultados que Grok 4.6.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Lo interesante es <strong>d\u00f3nde<\/strong> parece estar mejorando.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Programaci\u00f3n, trabajo de conocimiento, razonamiento prolongado y agentes son precisamente algunas de las \u00e1reas que determinar\u00e1n cu\u00e1nto valor pr\u00e1ctico pueden generar los pr\u00f3ximos modelos.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">OpenAI, Anthropic, Google y SpaceXAI est\u00e1n empujando cada vez m\u00e1s hacia sistemas que no solo respondan preguntas, sino que utilicen herramientas y ejecuten tareas completas.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Eso tambi\u00e9n cambia la manera en que deber\u00edamos compararlos.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ya no basta con preguntar cu\u00e1l tiene el benchmark m\u00e1s alto.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Hay que preguntar cu\u00e1l termina antes el trabajo, cu\u00e1l comete menos errores, cu\u00e1l necesita menos supervisi\u00f3n y cu\u00e1nto cuesta obtener un resultado que realmente podamos utilizar.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Para m\u00ed, Grok 4.7 es otra se\u00f1al clara de esa transici\u00f3n.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>La siguiente carrera de la IA no consiste \u00fanicamente en construir el modelo m\u00e1s inteligente. Consiste en conseguir que esa inteligencia sea r\u00e1pida, econ\u00f3mica, fiable y suficientemente aut\u00f3noma para hacer trabajo real.<\/strong><\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Dudas de la comunidad<\/h2>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfQu\u00e9 es Grok 4.7?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 es una generaci\u00f3n del modelo de inteligencia artificial de SpaceXAI presentada el 21 de septiembre de 2026. Est\u00e1 especialmente orientada a mejorar programaci\u00f3n, razonamiento y tareas complejas de conocimiento y agentes.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfCu\u00e1ndo se lanz\u00f3 Grok 4.7?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Las fuentes analizadas sit\u00faan su lanzamiento el <strong>21 de septiembre de 2026<\/strong>.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfQu\u00e9 diferencias hay entre Grok 4.7 y Grok 4.6?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Mantienen una ventana de contexto y estructura de precios similares, pero Grok 4.7 utiliza un modelo base mayor y un entrenamiento por refuerzo m\u00e1s prolongado seg\u00fan la informaci\u00f3n publicada sobre el lanzamiento. En evaluaciones independientes citadas, pasa de 44 a 46 en Intelligence Index y de 47 a 56 en Coding Agent Index frente a Grok 4.6.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfCu\u00e1nto cuesta Grok 4.7?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">El precio base recogido en las fuentes es de <strong>2 d\u00f3lares por mill\u00f3n de tokens de entrada y 6 d\u00f3lares por mill\u00f3n de tokens de salida<\/strong> por debajo de 200.000 tokens de entrada. Al superar ese umbral se citan tarifas de 4 y 12 d\u00f3lares respectivamente.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfGrok 4.7 es bueno para programar?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Las primeras evaluaciones apuntan a una mejora importante frente a Grok 4.6 en programaci\u00f3n ag\u00e9ntica. En el Coding Agent Index citado, Grok 4.7 obtiene 56 puntos frente a 47 de Grok 4.6. El rendimiento sobre un proyecto concreto puede diferir, por lo que conviene probarlo con tareas representativas del flujo de trabajo real.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfQu\u00e9 es Grok Bot?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Grok Bot forma parte del enfoque ag\u00e9ntico alrededor de Grok: la idea relevante para este tipo de sistemas es que el modelo no se limite a generar respuestas, sino que pueda trabajar dentro de flujos donde utiliza herramientas y ejecuta varios pasos. Las fuentes analizadas aqu\u00ed ofrecen m\u00e1s detalle cuantitativo sobre los benchmarks ag\u00e9nticos que sobre una especificaci\u00f3n exhaustiva de Grok Bot, por lo que evitar\u00eda atribuirle funciones concretas adicionales sin documentaci\u00f3n espec\u00edfica.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfQu\u00e9 ventana de contexto tiene Grok 4.7?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Las fuentes consultadas sit\u00faan la ventana de contexto de Grok 4.7 en <strong>500.000 tokens<\/strong>, igual que Grok 4.6.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfGrok 4.7 es m\u00e1s r\u00e1pido que Grok 4.6?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">No conviene resumirlo simplemente de esa forma. Europa Press recoge que el modelo mantiene la velocidad de ejecuci\u00f3n de su predecesor, mientras las fuentes t\u00e9cnicas analizadas describen adem\u00e1s una variante r\u00e1pida de Grok 4.7 que aproximadamente duplica la velocidad de salida a cambio de duplicar el precio. Hay que distinguir la variante y condiciones concretas antes de comparar.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfEn qu\u00e9 benchmarks destaca Grok 4.7?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Entre las evaluaciones citadas aparecen mejoras destacables en programaci\u00f3n ag\u00e9ntica y trabajo profesional. Los referentes recogen 56 puntos en el Coding Agent Index y 1.657 Elo en AA-Briefcase, aunque los resultados cambian considerablemente seg\u00fan la prueba utilizada.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">\u00bfQu\u00e9 diferencias hay entre Grok 4.7 y GPT-5.6 Sol?<\/h3>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 presenta un precio nominal por token inferior bajo las tarifas comparadas y obtiene mejores resultados en algunas evaluaciones de automatizaci\u00f3n y entregables profesionales. GPT-5.6 Sol obtiene mejores resultados en otras pruebas de razonamiento, agentes de terminal y contexto largo, adem\u00e1s de ofrecer una ventana de contexto mayor en la comparaci\u00f3n analizada. Por eso la elecci\u00f3n depende especialmente de la carga de trabajo concreta.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Opini\u00f3n Personal<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Grok 4.7 me parece uno de los movimientos m\u00e1s interesantes que hemos visto \u00faltimamente en la carrera de la inteligencia artificial. No tanto porque consiga unos puntos m\u00e1s en determinados benchmarks, sino porque refleja bastante bien hacia d\u00f3nde est\u00e1 evolucionando el sector.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Personalmente, cada vez me interesa menos saber qu\u00e9 modelo ocupa el primer puesto de una clasificaci\u00f3n durante unas semanas. Lo que realmente quiero comprobar es <strong>cu\u00e1nto trabajo puede hacer por m\u00ed antes de necesitar mi intervenci\u00f3n<\/strong>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Y creo que ah\u00ed estar\u00e1 la verdadera prueba para Grok 4.7.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si consigue mantener el contexto durante tareas largas, programar durante horas, utilizar herramientas correctamente, detectar sus propios errores y continuar trabajando sin necesitar supervisi\u00f3n constante, el salto frente a generaciones anteriores ser\u00e1 mucho m\u00e1s importante que cualquier peque\u00f1a diferencia en una tabla de resultados.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Tambi\u00e9n me parece especialmente interesante la batalla del precio. Tener modelos cada vez m\u00e1s potentes est\u00e1 muy bien, pero para utilizarlos diariamente tambi\u00e9n necesitamos que sean r\u00e1pidos y econ\u00f3micamente sostenibles. Eso s\u00ed, no me dejar\u00eda convencer \u00fanicamente por un precio por token m\u00e1s bajo: <strong>lo que realmente importa es cu\u00e1nto cuesta conseguir un trabajo correctamente terminado<\/strong>.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Por eso creo que Grok 4.7 merece atenci\u00f3n, especialmente para programaci\u00f3n, agentes y tareas profesionales complejas. Ahora queda comprobar hasta qu\u00e9 punto todas esas mejoras sobre el papel se mantienen cuando dejamos los benchmarks y empezamos a trabajar con proyectos reales.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u00bfQu\u00e9 opinas t\u00fa de Grok 4.7?<\/strong> \u00bfCrees que puede competir de t\u00fa a t\u00fa con los modelos de OpenAI, Anthropic y Google? Y si ya lo has probado, <strong>cu\u00e9ntame tu experiencia en los comentarios<\/strong>: qu\u00e9 te ha sorprendido, d\u00f3nde te ha fallado y para qu\u00e9 tareas lo est\u00e1s utilizando. Me interesa especialmente conocer c\u00f3mo se est\u00e1 comportando fuera de los benchmarks.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Grok 4.7 me parece uno de los lanzamientos m\u00e1s interesantes de SpaceXAI hasta la fecha. Y no precisamente porque llegue con otro pu\u00f1ado de benchmarks para presumir de puntuaciones, sino porque empieza a demostrar que Grok quiere competir en algo bastante m\u00e1s importante: hacer trabajo real. Con esta generaci\u00f3n, el foco est\u00e1 especialmente puesto en [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":9680,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"site-sidebar-layout":"default","site-content-layout":"","ast-site-content-layout":"default","site-content-style":"default","site-sidebar-style":"default","ast-global-header-display":"","ast-banner-title-visibility":"","ast-main-header-display":"","ast-hfb-above-header-display":"","ast-hfb-below-header-display":"","ast-hfb-mobile-header-display":"","site-post-title":"","ast-breadcrumbs-content":"","ast-featured-img":"","footer-sml-layout":"","ast-disable-related-posts":"","theme-transparent-header-meta":"","adv-header-id-meta":"","stick-header-meta":"","header-above-stick-meta":"","header-main-stick-meta":"","header-below-stick-meta":"","astra-migrate-meta-layouts":"set","ast-page-background-enabled":"default","ast-page-background-meta":{"desktop":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"ast-content-background-meta":{"desktop":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"footnotes":""},"categories":[1],"tags":[825,606,605,1499],"class_list":["post-9679","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-noticias","tag-grok","tag-ia","tag-inteligencia-artificial","tag-spacex"],"_links":{"self":[{"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/posts\/9679","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/comments?post=9679"}],"version-history":[{"count":2,"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/posts\/9679\/revisions"}],"predecessor-version":[{"id":9682,"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/posts\/9679\/revisions\/9682"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/media\/9680"}],"wp:attachment":[{"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/media?parent=9679"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/categories?post=9679"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.hostingtg.com\/blog\/wp-json\/wp\/v2\/tags?post=9679"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}