Google hat die Gemini 3 Modellreihe veröffentlicht, wobei der Gemini 3 Pro in einer Reihe von Benchmarks gut abgeschnitten hat, mit einer Punktzahl von 37,51 TP3T im HLE-Test und 31,11 TP3T im ARC-AGI-2-Test.Der Gemini 3 Deep Think schneidet sogar noch besser ab, mit 411 TP3T im HLE-Test und 45,11 TP3T im ARC-AGI-2-Test.Gleichzeitig wurde Grok 4.1 kostenlos veröffentlicht, wobei das Claude-Modell auf Azure- und Microsoft 365-Plattformen erweitert wurde. 45.11 TP3T.In der Zwischenzeit wurde Grok 4.1 kostenlos veröffentlicht und das Claude-Modell auf Azure- und Microsoft 365-Plattformen ausgeweitet.
- 此摘要由AI分析文章内容生成,仅供参考。

Kürzlich wurden versehentlich die Leistungs-Benchmark-Daten des Gemini 3 Pro veröffentlicht, was in der Branche große Besorgnis auslöste.

Den durchgesickerten Daten zufolge schneidet das Gemini 3 Pro in mehreren Benchmarks gut ab:37,5% im HLE-Test, 31,1% im ARC-AGI-2-Test, 2439 Elons im LiveCodeBench Pro-Test, 85,4% im Tau-Bench-Test, SimpleQA Verified-Test 72.1%Der Gemini 3 Pro ist der erste seiner Art in der Branche. Diese hervorragenden Ergebnisse zeigen, dass der Gemini 3 Pro in mehrfacher Hinsicht ein branchenführendes Niveau erreicht hat.
Trotz einer etwas weniger beeindruckenden Leistung im SWE-Bench Verified Test, hat das Gemini 3 Pro in den meisten wichtigen Tests immer noch Bestnoten erzielt.Dies ist ein Durchbruch im Bereich der künstlichen Intelligenz.
Diese herausragenden Leistungen von Gemini 3 Pro lassen sein großes Potenzial für zukünftige KI-Anwendungen erahnen. Ob es um die Verarbeitung natürlicher Sprache, die Codegenerierung oder die Lösung komplexer Probleme geht, Gemini 3 Pro hat außergewöhnliche Fähigkeiten bewiesen, die mehrere Bereiche zu revolutionieren versprechen.
---

Google hat sein neuestes KI-Modell, Gemini 3, vorgestellt. Es ist sein bisher intelligentestes Modell, das modernste Denkfähigkeiten, multimodales Verständnis und leistungsstarke autonome Aktionen vereint.
Der Gemini 3 Pro führte die LMArena-Charts mit 1501 Elo an und erzielte ohne Hilfsmittel 37,5% bei The Last Exam of Man, 91,9% beim GPQA Diamond Test und 23,41 beim MathArena Apex Test. TP3T, und eine faktische Genauigkeit von 72.11 TP3T auf dem SimpleQA Verified Test. diese Ergebnisse zeigen die Exzellenz des Gemini 3 in einer Reihe von Bereichen.
Verfügbarkeit und Preisgestaltung
- Gemini 3 ist jetzt in der Gemini-App (wählen Sie den "Think"-Modus), im Google Search AI-Modus (für US-amerikanische Google AI Pro- und Ultra-Abonnenten, demnächst auch für alle US-Nutzer), in Vertex AI, Google AI Studio (kostenloses Tier und gebührenbegrenzt), Gemini CLI (für Ultra-Abonnenten und Inhaber von bezahlten API-Schlüsseln, andere auf einer Warteliste) und Android Studio Otter.
- Der Preis beträgt $2 pro Million Input-Token und $12 pro Million Output-Token für Cue-Wörter mit weniger als 200.000 Token. Der kostenlose Zugang zu Google AI Studio ist zeitlich begrenzt.
Neue Funktionen und Leistung
- Der Deep Think-Modus von Gemini 3 erzielte 41,01 TP3T bei der letzten menschlichen Prüfung, 93,81 TP3T beim GPQA-Diamant-Test und 45,11 TP3T beim ARC-AGI-2-Test, der in den kommenden Wochen für Google AI Ultra-Abonnenten eingeführt wird. Nach einer Sicherheitsüberprüfung.
- Zu den neuen Funktionen gehören eine dynamische Ansicht und ein visuelles Layout für die Generierung von Experimenten, ein Gemini-Agent für mehrstufige Aufgaben, der auf Ultra-Abonnenten in den USA beschränkt ist, sowie eine neu gestaltete App mit dem Ordner My Stuff zum einfachen Auffinden der erstellten Inhalte.
- Gemini 3 Pro erzielte 1487 Elo auf WebDev Arena, 54,21 TP3T auf Terminal-Bench 2.0 und 76,21 TP3T auf SWE-Bench Verified coding tasks.Integration ist verfügbar bei Cursor, GitHub, JetBrains, Manus, Replit, Cline und Google Antigravity, das eine kostenlose öffentliche Vorschau auf MacOS, Windows und Linux bietet.
Unternehmenskunden können über Gemini Enterprise und Vertex AI auf diese Funktionen zugreifen. Berechtigte US-College-Studenten können Google AI Pro ein Jahr lang kostenlos testen, während Abonnenten von Google AI Pro und Ultra höhere Nutzungslimits erhalten.
---

Kürzlich wurden die Benchmark-Ergebnisse des Gemini 3 Pro veröffentlicht, die zeigen, dass das Gerät in einer Reihe von kritischen Aufgaben weit über den Erwartungen liegt. Den neu veröffentlichten Daten zufolge, hat dasDie letzte Prüfung der MenschheitIm Benchmark-Test erzielte das Gemini 3 Pro 37,5%, während dasARC-AGI-2Der Test ergab dann 31,1%.Diese Ergebnisse zeigen, dass das Gemini 3 Pro an der Spitze des aktuellen KI-Bereichs steht.

Die herausragende Leistung von Gemini 3 Pro zeigt sich nicht nur in den theoretischen Tests, sondern auch in den vielfältigen Anwendungsszenarien, einschließlich der Verarbeitung natürlicher Sprache, der Bilderkennung und der komplexen Entscheidungsunterstützung usw. Das Gemini 3 Pro kann in einer Vielzahl von Anwendungen eingesetzt werden, einschließlich der Verarbeitung natürlicher Sprache, der Bilderkennung und der komplexen Entscheidungsunterstützung.

- Die letzte Prüfung der Menschheit: 37.5%
- arc-agi-2: 31.1%
Diese Reihe von Durchbrüchen wird der Entwicklung der KI-Technologie neuen Schwung verleihen.
---

Vor kurzem wurde die Version 4.1 von Grok veröffentlicht, die für alle Benutzer kostenlos ist.

Die neue Version von Grok wurde in vielerlei Hinsicht erheblich verbessert:
- In den LMArena-Charts belegte es mit einer Elo-Zahl von 1483 den ersten Platz.
- Verbesserte emotionale Intelligenz, um gefühlsrelevante Aufgaben besser zu verstehen und zu bewältigen.
- Verbesserte kreative Schreibfunktionen, um den Nutzern mehr und vielfältigere kreative Möglichkeiten zu bieten.
- Weniger Täuschungsphänomene und höhere Genauigkeit und Zuverlässigkeit der generierten Inhalte.
Darüber hinaus unterstützt Grok 4.1 mehrere Plattformen, darunter Web, X (ehemals Twitter), iOS und Android, so dass die Benutzer jederzeit und überall darauf zugreifen und es nutzen können.

Wesentliche Merkmale:
- Hohe emotionale Intelligenz für Stimmungsanalyse und Kundenservice.
- Leistungsstarke kreative Schreibhilfe für Autoren und Verfasser von Inhalten.
- Höhere Genauigkeit und Zuverlässigkeit mit weniger falschen Ergebnissen.
- Plattformübergreifende Unterstützung für die einfache Nutzung auf verschiedenen Geräten.
Dieses Update verbessert nicht nur die Benutzerfreundlichkeit, sondern stärkt auch die Position von Grok als führendes Unternehmen im Bereich der künstlichen Intelligenz.
---

Das Google AI Developer Team hat Gemini 3 Pro auf den Markt gebracht, die neueste Generation intelligenter Modelle, die in Bezug auf Denkleistung und multimodales Verständnis branchenführend sind.agenturische Fähigkeiten) und verfügt außerdem über eine einzigartige Fähigkeit zur Umgebungscodierung (Vibrierende Codierung), um komplexe Informationen besser verstehen und verarbeiten zu können.
Dank dieser fortschrittlichen Funktionen eignet sich Gemini 3 Pro hervorragend für verschiedene Anwendungsszenarien, z. B. für die Verarbeitung natürlicher Sprache, die Bilderkennung und multimodale Aufgaben. Für Entwickler bietet Gemini 3 Pro eine Vielzahl von API-Schnittstellen und Entwicklungswerkzeugen, die eine schnelle Integration in bestehende Systeme ermöglichen.
Darüber hinaus unterstützt Gemini 3 Pro eine breite Palette von Programmiersprachen und Frameworks, was Entwicklern mit unterschiedlichem Hintergrund große Flexibilität bietet. Durch die Verwendung von Gemini 3 Pro können Entwickler intelligentere und effizientere Lösungen erstellen, die die Grenzen der KI-Technologie erweitern.
---

Die neuesten Nachrichten zeigen, dass Gemini 3 jetzt das beste Vibe Coding und Proxy Coding Modell ist. Die Stärke dieses Tools liegt in seiner Fähigkeit, fast jede Art von Projekt zu erstellen, egal ob es sich um eine komplexe Anwendung oder eine hochgradig interaktive virtuelle Umgebung handelt.
Besonders hervorzuheben ist, dass Gemini 3 besonders gut darin ist, spielbare Sci-Fi-Welten zu erschaffen. Durch den Einsatz fortschrittlicher Shader-Technologie können die Entwickler realistische visuelle Effekte erzielen, die ein fesselndes Erlebnis schaffen. Als konkretes Beispiel können Benutzer eine mit Gemini 3 erstellte Sci-Fi-Welt unter dem folgenden Link erkunden:
https://t.co/T55LofFGN3
Die wichtigsten Merkmale sind:
- Leistungsstarke Vibe-Codierungsunterstützung
- Effizientes agentenbasiertes Kodierungsmodell
- Reichhaltige Shader-Bibliothek
- Geeignet für ein breites Spektrum von Entwicklungsszenarien
Diese Funktionen machen Gemini 3 zum Tool der Wahl für Entwickler, sei es für die Entwicklung von Spielen, virtueller Realität oder anderen Projekten, die eine leistungsstarke Grafikverarbeitung erfordern.
---

Erstaunlicherweise übertrifft Googles neuestes KI-Modell, Gemini 3 Deep Think, seinen Vorgänger, Gemini 3 Pro, in mehreren Benchmark-Tests.
Insbesondere beim Humanity's Last Exam übertraf Deep Think die Pro-Version um 411 TP3T; beim ARC-AGI-2-Test betrug dieser Unterschied 45,11 TP3T. Diese Daten zeigen, dass Deep Think seine Fähigkeit, komplexe Probleme zu verstehen und zu lösen, erheblich verbessert hat. komplexen Problemen deutlich verbessert wurde.
Google stellt mit Deep Think seine Führungsrolle im Bereich KI wieder her. Dies könnte den Beginn einer neuen Ära markieren, insbesondere bei der Verarbeitung natürlicher Sprache und beim maschinellen Lernen. Ob OpenAI in der Lage sein wird, angesichts dieser Herausforderung aufzuholen, steht im Mittelpunkt der Aufmerksamkeit der Branche.
Dieser Durchbruch beweist nicht nur Googles Stärke in der Technologieentwicklung, sondern eröffnet auch neue Möglichkeiten für zukünftige KI-Anwendungen. Mit dem kontinuierlichen Fortschritt der Technologie sind weitere innovative Anwendungsszenarien zu erwarten, von intelligenten Assistenten bis hin zu komplexen Entscheidungsunterstützungssystemen.
---

Update: Gemini 3 Deep Think erzielte 411 TP3T beim HLE-Test (Humanity's Last Exam) und 45,11 TP3T beim ARC_AGI-2-Test.
Die Ergebnisse zeigen, dass Gemini 3 Deep Think sein Vorgängermodell Gemini 3 Pro in einer Reihe von Benchmarks übertrifft: Der HLE-Test konzentriert sich auf die Bewertung der Fähigkeit des Modells, mit komplexen Problemen und logischen Aufgaben umzugehen, während der ARC_AGI-2-Test sich auf die allgemeinen KI-Fähigkeiten des Modells konzentriert.
Zwillinge 3 Deep ThinkEs hat nicht nur in diesen Tests gut abgeschnitten, sondern auch beim GPQA-Diamond-Test erhebliche Fortschritte gemacht. Diese Leistungen zeigen sein großes Potenzial in den Bereichen natürliche Sprachverarbeitung, logisches Denken und allgemeine künstliche Intelligenz.
Dieser Durchbruch ist wichtig für die Weiterentwicklung der KI-Technologie, insbesondere in Anwendungsszenarien, die fortgeschrittenes Denken und Verstehen erfordern, wie z. B. intelligente Assistenten, automatische Frage- und Antwortsysteme und komplexe Datenanalysen.
---

Das Zeitalter von Gemini 3 ist offiziell angebrochen, ein Meilenstein, der ein neues Kapitel in der intelligenten Technologie markiert.

Gemini 3 Pro, eines der intelligentesten Modelle der Welt, wird über mehrere Plattformen und Anwendungen hinweg eingesetzt werden, einschließlich Google und seiner Produkte und Dienste von Drittanbietern. Das Modell hat in mehreren Benchmarks gut abgeschnitten und seine Leistungsfähigkeit insbesondere in Produkten wie AI Studio, Gemini API und Gemini App unter Beweis gestellt.
Wesentliche Merkmale:
- Überragende Leistung: Das Gemini 3 Pro schneidet in einer Reihe von Benchmarks gut ab.
- Breites Spektrum an Anwendungsszenarien: unterstützt verschiedene Produkte und Dienste wie AI Studio, Gemini API und Gemini App.
- Nahtlose Integration: Kann problemlos in bestehende Systeme integriert werden, um Effizienz und Benutzerfreundlichkeit zu verbessern.
Die Veröffentlichung von Gemini 3 Pro bietet Entwicklern und Anwendern noch nie dagewesene Innovationsmöglichkeiten, die ihnen in jedem Bereich zum Durchbruch verhelfen.
---
Anthropic hat die vollständige Ausweitung des Claude-Modells auf mehrere Plattformen angekündigt, was seine Beliebtheit bei Unternehmensanwendungen weiter steigert.
Azure-Kunden haben jetzt Zugriff auf die Versionen Claude Sonnet 4.5, Haiku 4.5 und Opus 4.1. Entwickler können diese Modelle in Foundry mit Claude Code für eine effizientere Anwendungsentwicklung nutzen.
Die Sache ist die.Das Claude-Modell ist auch in den Microsoft 365 Copilot und den Excel-Agentenmodus integriert, um den Nutzern ein intelligenteres Büroerlebnis zu bieten.
Anthropic ist Partnerschaften mit NVIDIA und Microsoft eingegangen, wodurch Claude das einzige hochmoderne Modell ist, das für alle drei großen Cloud-Dienste (AWS, Google Cloud und Azure) verfügbar ist.
Darüber hinaus werden NVIDIA und Microsoft bis zu 10 Mrd. $ bzw. 5 Mrd. $ in Anthropic investieren, um dessen kontinuierliche Innovation und Entwicklung im Bereich der künstlichen Intelligenz zu unterstützen.
Diese Initiativen verbessern nicht nur die Zugänglichkeit und den Nutzen von Claudes Modell, sondern festigen auch die Position von Anthropic als führendes Unternehmen im Bereich der künstlichen Intelligenz.


评论功能已关闭。