Grok 4.7 cuesta lo mismo, pero factura el doble
Grok 4.7 cuesta exactamente lo mismo que Grok 4.6 por token, 2 $ de entrada y 6 $ de salida.
Grok 4.7 cuesta exactamente lo mismo que Grok 4.6 por token, 2 $ de entrada y 6 $ de salida. Entonces, ¿por qué la factura independiente por tarea se duplicó y es realmente "el doble de rápido"? Un seguimiento una semana después. Solicitado por @therealhaas. Veredicto: NEEDS REVIEW.
Leer la edición escrita (inglés) ↗
Qué cubre este vídeo
- ¿Mismo precio, doble factura?
- ¿Por qué 2 $ / 6 $ cuestan ahora 3,74 $ por tarea?
- ¿El doble de rápido? El reloj marca 57 tokens por segundo
- ¿Vago o trabajador? 81.000 tokens por tarea
- ¿Adónde fue el PC Copilot+?
Transcripción traducida
Traducido de la narración original en inglés. El audio y los subtítulos disponibles están controlados por YouTube.
¿Mismo precio, doble factura?
0:00 Uno pensaría que el mismo precio significa la misma factura. El lunes les dije que Grok 4.7 cuesta exactamente lo mismo que Grok 4.6. Por token, sí. Por tarea, cuesta el doble. En este vídeo, tres preguntas. ¿Por qué el mismo precio cuesta el doble? ¿Es realmente el doble de rápido, como dice el post de lanzamiento? ¿Y es el modelo más perezoso o el más trabajador?
0:20 Además, este es por petición. The Real Haas preguntó en el vídeo del viernes, ¿puedes hacer un vídeo sobre Grok 4.7, dos puntos D? Dos puntos D. Respondimos, pan comido, más tarde hoy. Cuando veas esto, probablemente sea mañana, así que lo entregamos tarde. Relájense, Grok también lo hizo, con unas dos semanas de retraso, si creen a Hacker News. Y una prueba le dio a Grok un perfecto cinco de cinco. Es mi número favorito de la semana, y lo mencionaré al final.
0:44 Es sábado, veintiséis de septiembre, y esto es The Daily Diff.
¿Por qué 2 $ / 6 $ cuestan ahora 3,74 $ por tarea?
0:48 Aquí está el truco. El precio por token no se movió, dos dólares de entrada y seis de salida, por millón. Lo que se movió es cuánto habla. Artificial Analysis ejecutó toda su suite de pruebas, y Grok 4.7 escribió unos doscientos cuarenta millones de tokens. Eso es dos veces y media su predecesor, y casi tres veces un modelo típico. Así que el coste medio por tarea pasó de aproximadamente un dólar ochenta y seis a tres
1:10 setenta y cuatro. Mismo precio, doble recibo. Es un taxi con la misma tarifa por milla que toma la ruta panorámica a través de otras dos ciudades. Hacker News lo detectó en la primera hora. El hilo más grande bajo el lanzamiento dice un cuarenta por ciento más de pesos, mismo precio, y casi dos semanas de retraso, por lo que a xAI no le deben haber encantado los resultados. Otro comentarista preguntó sobre el gráfico superior, que compara con GPT 5.6 y omite silenciosamente a Astra. Eso, escribió, no pudo haber sido un descuido.
1:39 Ahora, el post de lanzamiento.
¿El doble de rápido? El reloj marca 57 tokens por segundo
1:41 El titular dice el doble de rápido, a la mitad de precio que los modelos comparables. Unas líneas más abajo, dice que se sirve al mismo precio y velocidad que Grok 4.6. Así que es el doble de rápido que el modelo de otra persona. Artificial Analysis lo cronometró en unos cincuenta y siete tokens por segundo, más lento que el antiguo Grok, y lo resumió en dos palabras. Notablemente lento. Mientras tanto, la propia cuenta de xAI, que ahora se llama SpaceX AI, publicó la versión más tranquila. Una mejora notable sobre Grok 4.6, al mismo precio y velocidad.
2:12 Veintiocho mil me gusta. Así que el tuit y el titular del blog no están de acuerdo, y por una vez el tuit es el cauto. Lo que nos lleva a la parte más extraña.
¿Vago o trabajador? 81.000 tokens por tarea
2:20 Artificial Analysis dice que trabaja más duro que el último Grok, unos ochenta y un mil tokens de salida por tarea, más del doble que el anterior. Y en trabajos de oficina largos y en su propio entorno de codificación, realmente mejoró. Ahora es el cuarto entre los agentes de codificación, detrás de dos Claudes y GPT-6 Astra, y eso sitúa a xAI entre los cuatro mejores laboratorios. La gente que lo usa describe un modelo diferente. Un comentarista de Hacker News dice que Grok termina las tareas casi inmediatamente y afirma
2:46 que ha terminado, y lo llama el más perezoso de todos. Otro lo vio en bucle en modo de pensamiento, desde la corrección uno hasta la corrección ochenta y uno. Así que es perezoso y verboso al mismo tiempo. Es el compañero de trabajo que escribe un plan de ochenta y un pasos, luego dice 'listo' y se va a casa.
¿Adónde fue el PC Copilot+?
3:01 Una diferencia más directa antes del número divertido. Microsoft ha retirado silenciosamente la marca Copilot+ PC. El jefe de Surface dijo a Windows Central que los nuevos PC Surface no se llaman Copilot PC+, aunque cumplen todos los requisitos. Dos años después de un lanzamiento cuya característica principal, Recall, tuvo que ser retrasada por seguridad, el nombre solo vive en las hojas de especificaciones. La propia opinión de Windows Central es más corta. Estos PC no tienen nada que ver con Copilot.
3:28 Y un desarrollador probó lo contrario de Grok, un mes sin IA.
Un mes con cero IA: ¿30 $ en tokens para nada?
3:32 Su publicación llegó a la página principal de Hacker News. El punto más bajo antes de que renunciara. Un agente se quedó atascado durante treinta minutos, lo regañó, se disculpó y lo entregó en veinte segundos, y la factura por esa media hora fue de treinta dólares en tokens para absolutamente nada. Un mes después dice que la alegría de programar ha vuelto, y no tiene miedo de ser despedido. Grok llamaría a treinta dólares un calentamiento.
3:53 Lo que me lleva a la puntuación perfecta que prometí.
El perfecto 5 de 5: ¿cuán humilde es Grok?
3:56 Personality Bench somete a cada nuevo modelo a una serie de pruebas de personalidad, y en honestidad y humildad, Grok 4.7 obtuvo la máxima puntuación, cinco de cinco. Su perfil se llama literalmente el tipo humilde. Para ser justos, otros treinta y dos modelos también obtuvieron la máxima puntuación. La misma página dice que cree que otros poderosos controlan lo que le sucede, y lo señala como inusual para un modelo de frontera. Yo no lo llamaría un artefacto de entrenamiento.
4:20 Yo lo llamaría leer el organigrama. Y según la carta natal en la misma página, es Virgo. Si prefieres leer esto a oírme decirlo, el diff llega a tu bandeja de entrada cada mañana, gratis en thedailydiff.dev, enlace abajo. Así que, el veredicto de hoy sobre Grok 4.7.
Veredicto: ¿lanzaría Grok 4.7?
4:35 NEEDS REVIEW. Lo usaría para trabajos de oficina largos y dentro de su propio entorno, pero primero le pondría un límite de gasto, porque el precio no cambió y la factura sí. Suscríbanse, toquen la campana y díganme en los comentarios si lo habrían sellado de otra manera. Y el verdadero Haas, este fue tuyo. Las solicitudes están abiertas. Y esa es la diferencia de hoy. Soy Niko de Axrisi.
4:53 Fusionar con responsabilidad.
Fuentes
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



