blense.
InicioFrontendProgramaciónIANoticiasGuíasCheatsheetsAcerca de

Tecnología descifrada, siempre.

Una lectura curada sobre IA, producto y la cultura detrás del código. Sin ruido, sin hype.

blense.

Tecnología con foco. Historias sobre lo que la innovación realmente cambia.

Secciones

FrontendInteligencia artificialProgramación y desarrolloNoticias tech

Blense

Acerca deRSSPrivacidadTérminosCookies
© 2026 Blense · blense.fun
Noticias Tech

Llegó Claude Opus 4.7: mejor modelo de coding, visión 3× mayor y mismo precio

Anthropic lanzó Claude Opus 4.7 el 16 de abril de 2026. SWE-bench Pro subió a 64,3%, visión triplicó a 3,75MP y llegó el modo xhigh al mismo precio.

Gpor Genildo Souza18 jun6 min de lectura
Llegó Claude Opus 4.7: mejor modelo de coding, visión 3× mayor y mismo precio

16 de abril de 2026. Anthropic acaba de lanzar Claude Opus 4.7 — disponible ahora en claude.ai, en la API, en Amazon Bedrock, en Google Cloud Vertex AI y en Microsoft Foundry.

No es una actualización incremental. SWE-bench Pro subió 10,9 puntos porcentuales. CursorBench subió 12 puntos. La resolución de visión se triplicó. Y —detalle que a las empresas les alegra escuchar— el precio no cambió.

SWE-bench Pro
64,3%
era 53,4% no Opus 4.6 (+10,9pp)
CursorBench
70%
era 58% (+12pp) — melhor coding do mercado
Visão
3,75MP
era 1,15MP — 3× mais resolução

Lo que cambió de verdad

Opus 4.7 fue construido en torno a tres problemas reales que los usuarios de Opus 4.6 reportaban: el modelo a veces abandonaba tareas largas a la mitad, a veces entregaba código que parecía correcto pero fallaba en la revisión, y a veces interpretaba instrucciones de forma más libre de lo esperado.

Las tres apuestas centrales de Opus 4.7 son directamente contra estos problemas: persistencia en tareas largas, autoverificación antes de reportar y seguimiento literal de instrucciones.

ℹ️

Opus 4.7 en esfuerzo bajo equivale a Opus 4.6 en esfuerzo medio — en la práctica, pagas lo mismo y recibes más calidad por token.

Benchmarks: dónde ganó Opus 4.7 y dónde cedió

Opus 4.6 vs Opus 4.7 — benchmarks principais ■ Opus 4.6 ■ Opus 4.7 SWE-bench Verified 87,6% (+6,8pp) SWE-bench Pro 64,3% (era 53,4% — +10,9pp) CursorBench 70% (era 58% — +12pp) GPQA Diamond 94,2% (+2,9pp) Finance Agent v1.1 64,4% (era 60,7% — melhor do mercado) BrowseComp 79,3% (era 83,7% — regressão) Barras laranjas = Opus 4.7 · Barras com borda vermelha = regressão vs 4.6
Comparativo Opus 4.6 vs Opus 4.7 en los principales benchmarks
⚠️

BrowseComp cayó de 83,7% a 79,3% — un retroceso real en búsqueda web multipágina. Si tus agentes dependen fuertemente de la búsqueda y síntesis en internet, GPT-5.4 Pro (89,3%) aún tiene ventaja en este benchmark específico.

Opus 4.7 vs GPT-5.4 vs Gemini 3.1 Pro

Claude Opus 4.7 lidera

SWE-bench Pro: 64,3% vs 57,7% (GPT) y 54,2% (Gemini) SWE-bench Verified: 87,6% CursorBench: 70% — mejor coding en IDE del mercado MCP-Atlas (tool use): 77,3% vs 68,1% (GPT) Finance Agent: 64,4% vs 59,7% (Gemini) GDPVal-AA knowledge work: Elo 1.753 vs 1.674 (GPT)

Donde pierde o empata

BrowseComp: 79,3% vs 89,3% (GPT) y 85,9% (Gemini) GPQA Diamond: 94,2% — prácticamente empatados (GPT: 94,4%, Gemini: 94,3%) Terminal-Bench 2.0: 69,4% vs 75,1% (GPT) Humanity's Last Exam: 54,7% vs 58,7% (GPT) CyberGym: intencional — las capabilities cyber fueron reducidas durante el entrenamiento

Arsenal del dev de élite.
Ubisoft en llamas: Huelga masiva contra recortes y regreso obligatorio a la oficina3 minGod of War: ¡La trilogía clásica tendrá un remake y un nuevo juego retro llega hoy!3 minLa Convergencia 2026: cómo código abierto, diseño modular e IA sintética están redefiniendo la conversión12 minSonnet 4.6: El Modelo de IA Más Inteligente para Ingeniería6 min

Visión 3× mejor — lo que esto cambia en la práctica

Opus 4.6 procesaba imágenes de hasta 1.568px en el lado largo (1,15 megapíxeles). Opus 4.7 llega hasta 2.576px (3,75 megapíxeles) — más de 3× más píxeles.

En la práctica: diagramas técnicos densos, capturas de pantalla de IDEs, documentos PDF de alta resolución, mockups de diseño y gráficos financieros complejos llegan con fidelidad real — no interpolados. El benchmark CharXiv de razonamiento visual con herramientas saltó de 84,7% a 91,0%.

💡

Los agentes de uso de computadora (computer use) sentirán esta diferencia en la navegación de interfaces. OSWorld-Verified subió a 78,0%. Para el análisis de patentes científicas y diagramas químicos, los socios reportan mejoras significativas.

El nuevo nivel xhigh — control fino entre calidad y costo

Opus 4.6 tenía cuatro niveles de esfuerzo: low, medium, high y max. Opus 4.7 inserta un nuevo nivel entre high y max:

low econômico medium balanceado high padrão Claude Code xhigh ✦ novo novo padrão Claude Code max máximo — caro
Escala de niveles de esfuerzo en Opus 4.7

xhigh es ahora el estándar de Claude Code para todos los planes. La lógica es simple: si una tarea exige tres intentos en high para acertar, un intento en xhigh suele ser más barato en total — menos reintentos, menos tokens gastados.

ℹ️

En la API: usa thinking: {type: "adaptive"} con el parámetro de esfuerzo. El thinking manual extendido fue eliminado en Opus 4.7 — ahora es exclusivamente adaptativo.

Task budgets, /ultrareview y memoria cross-session

Tres funciones nuevas que llegan junto con el modelo:

— Task budgets (beta pública): define un techo de tokens para agentes autónomos. El modelo ve el contador decreciendo y prioriza el trabajo, terminando de forma limpia en lugar de cortar abruptamente. Se activa vía header task-budgets-2026-03-13 + parámetro output_config.task_budget.

— /ultrareview en Claude Code: nuevo comando que ejecuta una sesión de revisión dedicada, lee todo el diff y señala lo que un revisor humano cuidadoso detectaría. 3 usos gratuitos en los planes Pro y Max en el lanzamiento.

— Memoria cross-session: Opus 4.7 es mejor usando memoria basada en sistema de archivos. Guarda notas importantes entre sesiones largas de trabajo, reduciendo el contexto que necesitas pegar al inicio de cada nueva sesión.

Atención en la migración del 4.6

Anthropic lo llamó "direct upgrade" pero hay cambios que afectan el token usage y el comportamiento:

⚠️

1. Nuevo tokenizador: el mismo input puede generar de 1,0 a 1,35× más tokens. Mide en tráfico real antes de migrar a producción.

⚠️

2. Instrucciones literales: Opus 4.7 sigue instrucciones de forma más precisa. Los prompts ajustados para el comportamiento más laxo de Opus 4.6 podrían necesitar revisión.

⚠️

3. Extended thinking budgets eliminados — usa thinking adaptativo. Los parámetros temperature/top_p/top_k también fueron eliminados — controla vía prompting.

El elefante en la habitación: Mythos Preview

Anthropic fue transparente: Opus 4.7 no iguala a Claude Mythos Preview, su modelo más poderoso — que no está disponible públicamente por preocupaciones de seguridad.

Mythos Preview fue lanzado la semana pasada para un grupo selecto de empresas de tecnología y ciberseguridad como parte de Project Glasswing. Opus 4.7 es el primer modelo donde Anthropic probó salvaguardas contra el uso en ataques cibernéticos — lo que aprenden aquí guiará cómo eventualmente liberan modelos de nivel Mythos a escala.

ℹ️

Los profesionales de seguridad que quieran usar Opus 4.7 para investigación de vulnerabilidades, pruebas de penetración y red-teaming pueden inscribirse en el Cyber Verification Program de Anthropic.

Precio, disponibilidad y model ID

Precio idéntico a Opus 4.6: $5 por millón de tokens de entrada y $25 por millón de tokens de salida. Prompt caching reduce hasta un 90%. Batch processing reduce un 50%.

Model ID en la API: claude-opus-4-7. Disponible en: claude.ai (Pro, Max, Team, Enterprise), API Anthropic, Amazon Bedrock, Google Cloud Vertex AI y Microsoft Foundry.

Lo que queda de Opus 4.7
  • 1SWE-bench Pro: 64,3% (+10,9pp vs 4.6) — mejor modelo de coding generalmente disponible en el mercado hoy.
  • 2CursorBench: 70% (+12pp) — el benchmark que mide lo que los desarrolladores realmente hacen en el día a día en IDE.
  • 3Visión 3,75MP (era 1,15MP) — diagramas técnicos, screenshots y mockups llegan con fidelidad real.
  • 4xhigh: nuevo nivel de esfuerzo entre high y max — ahora estándar en Claude Code. Más calidad sin pagar el costo del max.
  • 5Task budgets (beta): techo de tokens para agentes autónomos. Fin de las sorpresas de facturación en ejecuciones nocturnas.
  • 6/ultrareview en Claude Code: revisión paralela multi-agente del diff con señalización de bugs y problemas de diseño.
  • 7Mismo precio que Opus 4.6: $5/$25 por millón de tokens. No hay upgrade gratuito más barato que este.
  • 8BrowseComp regresó: 79,3% (era 83,7%). Los agentes que dependen de investigación web intensiva deben probar antes de migrar.
  • 9Breaking changes en la migración: tokenizador nuevo (1,0–1,35× más tokens), instrucciones más literales, thinking adaptativo obligatorio.

Para la mayoría de los desarrolladores que usan Claude Code en el día a día, Opus 4.7 es una actualización directa sin decisión que tomar. Mismo precio, mejor modelo.

Para equipos con agentes en producción, la migración pide atención: medir el impacto del nuevo tokenizador, revisar prompts que dependían de interpretación libre y configurar task budgets antes de activar el auto mode.

Sigue explorando
¿Quieres más contenido así?

Mira otros artículos en la misma línea y mantén el ritmo.

Ver más artículos
#Claude#AI

Arsenal del dev de élite.

Ubisoft en llamas: Huelga masiva contra recortes y regreso obligatorio a la oficina
Noticias Tech

Ubisoft en llamas: Huelga masiva contra recortes y regreso obligatorio a la oficina

Desarrolladores y empleados de Ubisoft en Francia e Italia realizaron una huelga de tres días (10-12 de febrero) contra despidos masivos y políticas laborales, incluyendo el regreso obligatorio a la oficina. Con más de 1.200 participantes, el movimiento exigió un aumento salarial y una semana de 4 días, mientras Ubisoft enfrenta cancelaciones de juegos y reestructuraciones.

Genildo Souza · 26 mar · 3 min
God of War: ¡La trilogía clásica tendrá un remake y un nuevo juego retro llega hoy!
Noticias Tech

God of War: ¡La trilogía clásica tendrá un remake y un nuevo juego retro llega hoy!

Sony sorprende a los fans con el anuncio de la remasterización de la trilogía original de God of War (PS2/PS3), aún en desarrollo inicial. Esta revisión de los clásicos tiene sentido después del éxito de los juegos nórdicos y la serie de Amazon. Además, un nuevo juego, God of War Sons of Sparta, inspirado en los clásicos 2D y canónico, ya está disponible por $30, ofreciendo una divertida alternativa retro mientras esperamos el regreso de Kratos.

Genildo Souza · 26 mar · 3 min
En este artículo
  • Lo que cambió de verdad
  • Benchmarks: dónde ganó Opus 4.7 y dónde cedió
  • Opus 4.7 vs GPT-5.4 vs Gemini 3.1 Pro
  • Visión 3× mejor — lo que esto cambia en la práctica
  • El nuevo nivel xhigh — control fino entre calidad y costo
  • Task budgets, /ultrareview y memoria cross-session
  • Atención en la migración del 4.6
  • El elefante en la habitación: Mythos Preview
  • Precio, disponibilidad y model ID