Google lanzó la serie de modelos Gemini 3. El Gemini 3 Pro obtuvo buenos resultados en una serie de pruebas comparativas, con una puntuación de 37,51 TP3T en la prueba HLE y 31,11 TP3T en la prueba ARC-AGI-2.El Gemini 3 Deep Think obtuvo resultados aún mejores, con una puntuación de 411 TP3T en la prueba HLE y 45,11 TP3T en la prueba ARC-AGI-2.Al mismo tiempo, se lanzó Grok 4.1 de forma gratuita, y el modelo Claude se amplió a las plataformas Azure y Microsoft 365. 45,11 TP3T.Al mismo tiempo, Grok 4.1 se lanzó de forma gratuita y el modelo Claude se extendió a las plataformas Azure y Microsoft 365.
- 此摘要由AI分析文章内容生成,仅供参考。

Hace poco, se filtraron accidentalmente los datos de rendimiento del Gemini 3 Pro, lo que despertó una gran inquietud en el sector.

Según los datos filtrados, el Gemini 3 Pro obtiene buenos resultados en varias pruebas de rendimiento:Puntuación de 37,5% en la prueba HLE, 31,1% en la prueba ARC-AGI-2, 2439 Elons en la prueba LiveCodeBench Pro, 85,4% en la prueba Tau-Bench, prueba SimpleQA Verified 72,1%Gemini 3 Pro es el primero de su clase en el sector. Este excelente conjunto de resultados demuestra que el Gemini 3 Pro ha alcanzado un nivel líder en el sector en varios aspectos.
A pesar de un rendimiento algo menos impresionante en la prueba SWE-Bench Verified, en general el Gemini 3 Pro sigue obteniendo las mejores puntuaciones en la mayoría de las pruebas clave.Esto marca su avance en inteligencia artificial.
Estas extraordinarias prestaciones de Gemini 3 Pro presagian su gran potencial para futuras aplicaciones de IA. Ya se trate de procesamiento de lenguaje natural, generación de código o resolución de problemas complejos, Gemini 3 Pro ha demostrado unas capacidades excepcionales que prometen revolucionar varios ámbitos.
---

Google ha presentado su último modelo de IA, Gemini 3, el más inteligente hasta la fecha, que combina capacidades de razonamiento de última generación, comprensión multimodal y potentes acciones autónomas.
El Gemini 3 Pro encabezó las listas de LMArena con 1501 Elo, y sin herramientas obtuvo 37,5% en The Last Exam of Man, 91,9% en la prueba GPQA Diamond, y 23,41 en la prueba MathArena Apex. Estas puntuaciones demuestran la excelencia del Gemini 3 en varias áreas.
Disponibilidad y precios
- Gemini 3 ya está disponible en la aplicación Gemini (seleccione el modo "Pensar"), el modo Google Search AI (para suscriptores estadounidenses de Google AI Pro y Ultra, que pronto se ampliará a todos los usuarios estadounidenses), Vertex AI, Google AI Studio (nivel gratuito y tarifa limitada), Gemini CLI (para suscriptores Ultra y titulares de claves API de pago, otros en lista de espera) y Android Studio Otter.
- El precio es de 2 dólares por millón de tokens de entrada y de 12 dólares por millón de tokens de salida para palabras clave de menos de 200.000 tokens.
Nuevas funciones y prestaciones
- El modo Deep Think de Gemini 3 obtuvo una puntuación de 41,01 TP3T en The Last Human Exam, 93,81 TP3T en la prueba GPQA Diamond y 45,11 TP3T en la prueba ARC-AGI-2. que se pondrá a disposición de los suscriptores de Google AI Ultra en las próximas semanas. Tras una evaluación de seguridad.
- Las nuevas funciones incluyen una interfaz de generación de experimentos con vista dinámica y diseño visual, el agente Gemini para tareas de varios pasos, limitado a los suscriptores de Ultra en EE.UU., y una aplicación rediseñada con la carpeta Mis Cosas para encontrar fácilmente los contenidos creados.
- Gemini 3 Pro obtuvo 1487 Elo en WebDev Arena, 54,21 TP3T en Terminal-Bench 2.0, y 76,21 TP3T en SWE-bench Verified coding tasks.Integration está disponible en Cursor, GitHub, JetBrains, Manus, Replit, Cline y Google Antigravity, que ofrece una vista previa pública gratuita en MacOS, Windows y Linux.
Los clientes empresariales pueden acceder a estas funciones a través de Gemini Enterprise y Vertex AI, y los estudiantes universitarios estadounidenses que cumplan los requisitos pueden obtener una prueba gratuita de un año de Google AI Pro, mientras que los suscriptores de Google AI Pro y Ultra disfrutarán de límites de uso más elevados.
---

Recientemente se han hecho públicos los resultados del Gemini 3 Pro en las pruebas de rendimiento, que demuestran que ha superado con creces las expectativas en una serie de tareas críticas. Según los datos recién publicados, elEl último examen de la humanidadEn la prueba comparativa, el Gemini 3 Pro obtuvo 37,51 TP3T, mientras que elARC-AGI-2La prueba alcanzó entonces 31,1%.Estos resultados demuestran que el Gemini 3 Pro está a la vanguardia del campo actual de la IA.

Al mismo tiempo, se filtró accidentalmente la documentación detallada del modelo, lo que despertó aún más la atención de la industria.El extraordinario rendimiento de Gemini 3 Pro no sólo se refleja en las pruebas teóricas, sino también en la amplia gama de escenarios de aplicación, como el procesamiento del lenguaje natural, el reconocimiento de imágenes y el apoyo a decisiones complejas, etc.

- Último examen de la humanidad: 37.5%
- arc-agi-2: 31.1%
Esta serie de avances dará un nuevo impulso al desarrollo de la tecnología de IA.
---

Recientemente se ha lanzado la versión 4.1 de Grok, gratuita para todos los usuarios.

La nueva versión de Grok se ha mejorado considerablemente en varios aspectos:
- Se ha clasificado en primer lugar en las listas de LMArena, con una puntuación Elo de 1483.
- Mejora de la inteligencia emocional para comprender y gestionar mejor las tareas emocionalmente relevantes.
- Capacidades de escritura creativa mejoradas para ofrecer a los usuarios opciones creativas más ricas y variadas.
- Reducción de los fenómenos ilusorios y aumento de la precisión y fiabilidad de los contenidos generados.
Además, Grok 4.1 es compatible con múltiples plataformas, como Web, X (antes Twitter), iOS y Android, para que los usuarios puedan acceder a él y utilizarlo en cualquier momento y lugar.

Características principales:
- Alta inteligencia emocional para el análisis de sentimientos y la atención al cliente.
- Potente ayuda a la escritura creativa para escritores y creadores de contenidos.
- Mayor precisión y fiabilidad con menos salidas falsas.
- Compatibilidad multiplataforma para facilitar el uso en distintos dispositivos.
Esta actualización no sólo mejora la experiencia del usuario, sino que refuerza aún más la posición de Grok como líder en inteligencia artificial.
---

El equipo de desarrolladores de IA de Google ha lanzado Gemini 3 Pro, la última generación de modelos inteligentes líderes del sector en capacidad de razonamiento y comprensión multimodal.Gemini 3 Pro no sólo cuenta con potentes agentes (capacidades de los agentes) y también tiene una capacidad única de codificación ambiental (codificación vibe), para poder comprender y procesar mejor la información compleja.
Estas funciones avanzadas permiten a Gemini 3 Pro destacar en varios escenarios de aplicación, como el procesamiento del lenguaje natural, el reconocimiento de imágenes y las tareas intermodales. Para los desarrolladores, Gemini 3 Pro proporciona un rico conjunto de interfaces API y herramientas de desarrollo que facilitan una rápida integración en los sistemas existentes.
Además, Gemini 3 Pro es compatible con una amplia gama de lenguajes y marcos de programación, lo que proporciona una gran flexibilidad a los desarrolladores de distintos entornos. Con Gemini 3 Pro, los desarrolladores pueden crear soluciones más inteligentes y eficientes que amplían los límites de la tecnología de IA.
---

Las últimas noticias muestran que Gemini 3 es ahora el mejor modelo de codificación Vibe y de codificación proxy. La potencia de esta herramienta reside en su capacidad para construir casi cualquier tipo de proyecto, ya sea una aplicación compleja o un entorno virtual muy interactivo.
Gemini 3 es especialmente bueno en la creación de mundos de ciencia ficción jugables. Mediante el uso de una avanzada tecnología de sombreado, los desarrolladores pueden conseguir efectos visuales realistas que crean una experiencia envolvente. Como ejemplo concreto, los usuarios pueden explorar un mundo de ciencia ficción construido con Gemini 3 en el siguiente enlace:
https://t.co/T55LofFGN3
Las características clave incluyen:
- Potente soporte de codificación Vibe
- Modelo de codificación agenética eficiente
- Biblioteca de sombreadores enriquecida
- Adecuado para una amplia gama de escenarios de desarrollo
Estas características convierten a Gemini 3 en la herramienta preferida por los desarrolladores, ya sea para el desarrollo de juegos, realidad virtual u otros proyectos que requieran un procesamiento gráfico de alto rendimiento.
---

Sorprendentemente, el último modelo de IA de Google, Gemini 3 Deep Think, supera a su predecesor, Gemini 3 Pro, en varias pruebas de referencia.
En concreto, en Humanity's Last Exam, Deep Think superó a la versión Pro en 411 TP3T; en la prueba ARC-AGI-2, esta diferencia fue de 45,11 TP3T.Estos datos indican que Deep Think ha mejorado significativamente su capacidad para comprender y resolver problemas complejos ha mejorado significativamente.
Google reafirma su liderazgo en IA con Deep Think. Esto podría marcar el amanecer de una nueva era, especialmente en el procesamiento del lenguaje natural y el aprendizaje automático. Si OpenAI será capaz de ponerse al día ante este reto es el centro de atención de la industria.
Este avance no sólo demuestra la gran fortaleza de Google en el desarrollo tecnológico, sino que también ofrece nuevas posibilidades para futuras aplicaciones de IA. Con el progreso continuo de la tecnología, se espera que veamos más escenarios de aplicación innovadores, desde asistentes inteligentes hasta complejos sistemas de apoyo a la toma de decisiones.
---

Actualización: Gemini 3 Deep Think obtuvo 411 TP3T en la prueba HLE (Humanity's Last Exam) y 45,11 TP3T en la prueba ARC_AGI-2.
Estos resultados demuestran que Gemini 3 Deep Think supera a su predecesor, Gemini 3 Pro, en una serie de pruebas comparativas.La prueba HLE se centra en evaluar la capacidad del modelo para enfrentarse a problemas complejos y tareas de razonamiento, mientras que la ARC_AGI-2 se centra en las capacidades de IA de propósito general del modelo.
Géminis 3 Pensamiento profundoNo sólo obtuvo buenos resultados en estas pruebas, sino que también progresó notablemente en la prueba GPQA Diamond. Estos logros demuestran su gran potencial en los ámbitos del procesamiento del lenguaje natural, el razonamiento y la inteligencia artificial en general.
Este avance es importante para el progreso de la tecnología de IA, especialmente en escenarios de aplicación que requieren razonamiento y comprensión avanzados, como los asistentes inteligentes, los sistemas automatizados de preguntas y respuestas y el análisis de datos complejos.
---

Se ha inaugurado oficialmente la Era Gemini 3, un hito que marca un nuevo capítulo en la tecnología inteligente.

Gemini 3 Pro, uno de los modelos más inteligentes del mundo, se utilizará ampliamente en múltiples plataformas y aplicaciones, incluidas Google y sus productos y servicios de terceros. El modelo ha obtenido buenos resultados en varias pruebas comparativas, demostrando especialmente su potencia en productos como AI Studio, Gemini API y Gemini App.
Características principales:
- Rendimiento superior: El Gemini 3 Pro obtiene buenos resultados en una serie de pruebas comparativas.
- Amplia gama de escenarios de aplicación: compatible con varios productos y servicios como AI Studio, Gemini API y Gemini App.
- Integración perfecta: puede integrarse fácilmente en los sistemas existentes para mejorar la eficacia y la experiencia del usuario.
El lanzamiento de Gemini 3 Pro proporcionará a desarrolladores y usuarios una capacidad de innovación sin precedentes que les ayudará a abrirse camino en todos los ámbitos.
---
Anthropic ha anunciado la plena extensión del modelo Claude a múltiples plataformas, impulsando aún más su popularidad en las aplicaciones empresariales.
Los clientes de Azure ya tienen acceso a las versiones Claude Sonnet 4.5, Haiku 4.5 y Opus 4.1. Los desarrolladores pueden utilizar estos modelos en Foundry con Claude Code para un desarrollo de aplicaciones más eficiente.
Esta es la cuestión., el modelo Claude también está integrado en Microsoft 365 Copilot y en el Modo Agente de Excel para ofrecer a los usuarios una experiencia ofimática más inteligente.
Anthropic se ha asociado con NVIDIA y Microsoft, lo que convierte a Claude en el único modelo de vanguardia disponible en los tres principales servicios en la nube (es decir, AWS, Google Cloud y Azure).
Además, NVIDIA y Microsoft invertirán hasta 10.000 y 5.000 millones de dólares, respectivamente, en Anthropic para apoyar su innovación y desarrollo continuos en el campo de la inteligencia artificial.
Estas iniciativas no sólo mejoran la accesibilidad y utilidad del modelo de Claude, sino que consolidan la posición de Anthropic como líder en inteligencia artificial.


评论功能已关闭。