A Google lançou a série de modelos Gemini 3, com o Gemini 3 Pro a ter um bom desempenho em vários benchmarks, com uma pontuação de 37,51 TP3T no teste HLE e 31,11 TP3T no teste ARC-AGI-2. O Gemini 3 Deep Think tem um desempenho ainda melhor, com 411 TP3T no teste HLE e 45,11 TP3T no teste ARC-AGI-2. 45,11 TP3T.Entretanto, o Grok 4.1 foi lançado gratuitamente e o modelo Claude foi alargado às plataformas Azure e Microsoft 365.
- 此摘要由AI分析文章内容生成,仅供参考。

Recentemente, os dados de referência de desempenho do Gemini 3 Pro foram acidentalmente divulgados, suscitando uma preocupação generalizada no sector.

De acordo com os dados divulgados, o Gemini 3 Pro tem um bom desempenho em vários testes de referência:Pontuação de 37,5% no teste HLE, 31,1% no teste ARC-AGI-2, 2439 Elons no teste LiveCodeBench Pro, 85,4% no teste Tau-Bench, teste SimpleQA Verified 72.1%O Gemini 3 Pro é o primeiro do seu género na indústria. Este excelente conjunto de resultados demonstra que o Gemini 3 Pro atingiu um nível de liderança no sector em vários aspectos.
Apesar de um desempenho um pouco menos impressionante no teste SWE-Bench Verified, em geral o Gemini 3 Pro continua a obter as melhores notas na maioria dos testes principais.Isto marca o seu avanço no domínio da inteligência artificial.
Estes desempenhos excepcionais do Gemini 3 Pro prenunciam o seu grande potencial para futuras aplicações de IA. Quer se trate de processamento de linguagem natural, geração de código ou resolução de problemas complexos, o Gemini 3 Pro demonstrou capacidades excepcionais que prometem revolucionar várias áreas.
---

A Google revelou o seu mais recente modelo de IA, o Gemini 3, que é o modelo mais inteligente de sempre, combinando capacidades de raciocínio de última geração, compreensão multimodal e poderosas acções autónomas.
O Gemini 3 Pro liderou as tabelas da LMArena com 1501 Elo e, sem ferramentas, obteve 37,51 TP3T no The Last Exam of Man, 91,91 TP3T no teste GPQA Diamond e 23,41 no teste MathArena Apex. TP3T, e uma pontuação de exatidão factual de 72,11 TP3T no teste SimpleQA Verified. Estas pontuações demonstram a excelência do Gemini 3 em várias áreas.
Disponibilidade e preços
- O Gemini 3 está agora disponível na aplicação Gemini (selecione o modo "Think"), no modo de IA da Pesquisa Google (para os subscritores do Google AI Pro e Ultra dos EUA, que em breve será alargado a todos os utilizadores dos EUA), no Vertex AI, no Google AI Studio (nível gratuito e limitado por taxa), Gemini CLI (para assinantes Ultra e detentores de chaves API pagas, outros em lista de espera) e Android Studio Otter.
- O preço é de 2 dólares por milhão de tokens de entrada e de 12 dólares por milhão de tokens de saída para palavras-chave com menos de 200 000 tokens. O acesso gratuito ao Google AI Studio tem uma taxa limitada.
Novas funcionalidades e desempenho
- O modo Deep Think do Gemini 3 obteve 41,01 TP3T no The Last Human Exam, 93,81 TP3T no teste GPQA Diamond e 45,11 TP3T no teste ARC-AGI-2. que será lançado para os subscritores do Google AI Ultra nas próximas semanas. Após uma avaliação de segurança.
- As novas funcionalidades incluem uma interface de geração de experiências com visualização dinâmica e disposição visual, o Gemini Agent para tarefas em várias etapas, limitado a assinantes Ultra nos EUA, e uma aplicação redesenhada com a pasta O meu material para encontrar facilmente o conteúdo criado.
- O Gemini 3 Pro obteve 1487 Elo no WebDev Arena, 54,21 TP3T no Terminal-Bench 2.0 e 76,21 TP3T no SWE-bench Verified coding tasks.Integration está disponível no Cursor, GitHub, JetBrains, Manus, Replit, Cline e Google Antigravity, que oferece uma pré-visualização pública gratuita em MacOS, Windows e Linux.
Os clientes empresariais podem aceder a estas capacidades através do Gemini Enterprise e do Vertex AI, e os estudantes universitários elegíveis dos EUA podem obter uma avaliação gratuita de um ano do Google AI Pro, enquanto os subscritores do Google AI Pro e do Ultra beneficiarão de limites de utilização mais elevados.
---

Recentemente, os resultados dos testes de referência do Gemini 3 Pro foram tornados públicos, mostrando que o seu desempenho foi muito superior às expectativas numa série de tarefas críticas. De acordo com os dados recentemente divulgados, oO último exame da humanidadeNo teste de benchmark, o Gemini 3 Pro obteve 37,5%, enquanto no teste deARC-AGI-2O teste atingiu então 31.1%.Estes resultados mostram que o Gemini 3 Pro está na vanguarda do atual campo da IA.

O excelente desempenho do Gemini 3 Pro não se reflecte apenas nos testes teóricos, mas também na vasta gama de cenários de aplicação, incluindo o processamento de linguagem natural, o reconhecimento de imagens e o apoio a decisões complexas, etc. O Gemini 3 Pro pode ser utilizado numa vasta gama de aplicações, incluindo o processamento de linguagem natural, o reconhecimento de imagens e o apoio a decisões complexas.

- Último exame da humanidade: 37.5%
- arc-agi-2: 31.1%
Esta série de descobertas dará um novo impulso ao desenvolvimento da tecnologia de IA.
---

Recentemente, a versão 4.1 do Grok foi lançada e é gratuita para todos os utilizadores.

A nova versão do Grok foi significativamente melhorada em vários aspectos:
- Ficou em primeiro lugar nas tabelas da LMArena, com uma pontuação Elo de 1483.
- Inteligência emocional reforçada para melhor compreender e lidar com tarefas emocionalmente relevantes.
- Capacidades de escrita criativa melhoradas para proporcionar aos utilizadores opções criativas mais ricas e variadas.
- Redução dos fenómenos de ilusão e aumento da precisão e fiabilidade dos conteúdos gerados.
Além disso, o Grok 4.1 suporta várias plataformas, incluindo Web, X (antigo Twitter), iOS e Android, para que os utilizadores possam aceder e utilizar o Grok 4.1 em qualquer altura e em qualquer lugar.

Caraterísticas principais:
- Elevada inteligência emocional para análise de sentimentos e serviço ao cliente.
- Poderoso auxiliar de escrita criativa para escritores e criadores de conteúdos.
- Maior precisão e fiabilidade com menos saídas falsas.
- Suporte multiplataforma para facilitar a utilização em diferentes dispositivos.
Esta atualização não só melhora a experiência do utilizador, como também reforça ainda mais a posição da Grok como líder em inteligência artificial.
---

A equipa de programadores de IA da Google lançou o Gemini 3 Pro, a mais recente geração de modelos inteligentes que são líderes de mercado em termos de capacidade de raciocínio e compreensão multimodal.capacidades agênticas) e possui também uma capacidade única de codificação ambiente (codificação de vibrações), para poderem compreender e processar melhor informações complexas.
Estas caraterísticas avançadas permitem que o Gemini 3 Pro se destaque em vários cenários de aplicação, tais como processamento de linguagem natural, reconhecimento de imagem e tarefas multimodais. Para os programadores, o Gemini 3 Pro fornece um conjunto rico de interfaces API e ferramentas de desenvolvimento que facilitam a rápida integração nos sistemas existentes.
Além disso, o Gemini 3 Pro suporta uma vasta gama de linguagens e estruturas de programação, proporcionando uma grande flexibilidade para programadores de diferentes origens. Ao utilizar o Gemini 3 Pro, os programadores podem criar soluções mais inteligentes e eficientes que ultrapassam os limites da tecnologia de IA.
---

As últimas notícias mostram que o Gemini 3 é atualmente o melhor modelo de codificação Vibe e de codificação proxy. O poder desta ferramenta reside na sua capacidade de construir praticamente qualquer tipo de projeto, quer se trate de uma aplicação complexa ou de um ambiente virtual altamente interativo.
Em particular, o Gemini 3 é particularmente bom na criação de mundos de ficção científica jogáveis. Através da utilização de tecnologia de sombreamento avançada, os programadores podem obter efeitos visuais realistas que criam uma experiência imersiva. Como exemplo concreto, os utilizadores podem explorar um mundo de ficção científica construído com o Gemini 3 na seguinte ligação:
https://t.co/T55LofFGN3
As principais caraterísticas incluem:
- Suporte potente para codificação de vibrações
- Modelo de codificação agêntica eficiente
- Biblioteca de sombreamento rica
- Adequado para uma vasta gama de cenários de desenvolvimento
Estas caraterísticas fazem do Gemini 3 a ferramenta de eleição para os programadores, quer seja para o desenvolvimento de jogos, realidade virtual ou outros projectos que exijam um processamento gráfico de elevado desempenho.
---

Surpreendentemente, o mais recente modelo de IA da Google, o Gemini 3 Deep Think, supera o seu antecessor, o Gemini 3 Pro, em vários testes de referência.
Especificamente, no Último Exame da Humanidade, o Deep Think superou a versão Pro em 411 TP3T; no teste ARC-AGI-2, essa diferença foi de 45,11 TP3T. Esses dados indicam que o Deep Think fez melhorias significativas em sua capacidade de entender e resolver problemas complexos foi significativamente melhorada.
A Google restabelece a sua liderança na IA com o Deep Think. Isto pode marcar o início de uma nova era, especialmente no domínio do processamento da linguagem natural e da aprendizagem automática. A questão de saber se a OpenAI será capaz de fazer face a este desafio está no centro das atenções do sector.
Esta descoberta não só demonstra a forte força da Google no desenvolvimento tecnológico, como também oferece novas possibilidades para futuras aplicações de IA. Com o progresso contínuo da tecnologia, espera-se que surjam cenários de aplicação mais inovadores, desde assistentes inteligentes a sistemas complexos de apoio à decisão.
---

Atualização: O Gemini 3 Deep Think obteve 411 TP3T no teste HLE (Humanity's Last Exam) e 45,11 TP3T no teste ARC_AGI-2.
Estes resultados mostram que o Gemini 3 Deep Think supera o seu antecessor, o Gemini 3 Pro, numa série de testes de referência. O teste HLE centra-se na avaliação da capacidade do modelo para lidar com problemas complexos e tarefas de raciocínio, enquanto o ARC_AGI-2 se centra nas capacidades de IA de uso geral do modelo.
Gémeos 3 Pensamento profundoNão só teve um bom desempenho nestes testes, como também registou progressos significativos no teste GPQA Diamond. Estes resultados demonstram o seu forte potencial nos domínios do processamento da linguagem natural, do raciocínio e da inteligência artificial geral.
Esta descoberta é importante para o avanço da tecnologia de IA, especialmente em cenários de aplicação que exigem raciocínio e compreensão avançados, como assistentes inteligentes, sistemas automatizados de perguntas e respostas e análise de dados complexos.
---

A Era Gemini 3 foi oficialmente inaugurada, um marco que assinala um novo capítulo na tecnologia inteligente.

O Gemini 3 Pro, um dos modelos mais inteligentes do mundo, será amplamente utilizado em várias plataformas e aplicações, incluindo a Google e os seus produtos e serviços de terceiros. O modelo teve um bom desempenho em vários testes de referência, demonstrando particularmente o seu poder em produtos como o AI Studio, a Gemini API e a Gemini App.
Caraterísticas principais:
- Desempenho superior: O Gemini 3 Pro tem um bom desempenho numa série de testes de referência.
- Vasta gama de cenários de aplicação: suporta vários produtos e serviços, como o AI Studio, a Gemini API e a Gemini App.
- Integração perfeita: Pode ser facilmente integrado nos sistemas existentes para melhorar a eficiência e a experiência do utilizador.
O lançamento do Gemini 3 Pro proporcionará aos programadores e utilizadores capacidades de inovação sem precedentes que os ajudarão a destacar-se em todas as áreas.
---
A Anthropic anunciou a extensão total do modelo Claude a várias plataformas, aumentando ainda mais a sua popularidade nas aplicações empresariais.
Os clientes do Azure têm agora acesso às versões Claude Sonnet 4.5, Haiku 4.5 e Opus 4.1. Os programadores podem utilizar estes modelos no Foundry com o Claude Code para um desenvolvimento de aplicações mais eficiente.
é o seguinte.O modelo Claude também está integrado no Microsoft 365 Copilot e no Modo de Agente do Excel para proporcionar aos utilizadores uma experiência de escritório mais inteligente.
A Anthropic estabeleceu parcerias com a NVIDIA e a Microsoft, tornando o Claude o único modelo de ponta disponível nos três principais serviços de nuvem (ou seja, AWS, Google Cloud e Azure).
Além disso, a NVIDIA e a Microsoft investirão até 10 mil milhões de dólares e 5 mil milhões de dólares, respetivamente, na Anthropic para apoiar a sua inovação e desenvolvimento contínuos no domínio da inteligência artificial.
Estas iniciativas não só aumentam a acessibilidade e a utilidade do modelo de Claude, como também solidificam ainda mais a posição da Anthropic como líder em inteligência artificial.


评论功能已关闭。