Gerade wurde das brandneue Gemini 4 Pro geleakt, und die praktischen Leistungstests übertreffen Opus 5.5 bei weitem.
Gemini 4 Pro hat wieder neue Checkpoints hervorgebracht!
Kürzlich wurden zwei brandneue Checkpoints (interner Codename „barium-b“ oder Checkpoint 2) von Entwicklern entdeckt. Nach praktischen Tests stellte sich heraus, dass Gemini 4 Pro unglaublich leistungsstark ist!
Ein Entwickler rief aus: „Nach 400 Stunden intensiver Nutzung von Opus 5.5 und GPT-6 lässt mich Gemini 4 Pro immer noch sprachlos vor Erstaunen zurück!“
Googles neue Generation von Spitzenprodukten zeigt eine überlegene Fähigkeit zur 3D-Physiksimulation, Codegenerierung und Schlussfolgerung aus langen Texten.
Ein Entwickler rief aus: „Nach 400 Stunden intensiver Nutzung von Opus 5.5 und GPT-6 lässt mich Gemini 4 Pro immer noch sprachlos vor Erstaunen zurück!“
Zudem ist die Haltung der hochrangigen Mitarbeiter bei Google sehr eindeutig.
Der neue Leiter von Google DeepMind, Koray Kavukcuoglu, bestätigte erstmals öffentlich, dass Gemini 4 bereits in der frühen Phase des Post-Trainings angekommen ist.
Sein Trainingsfortschritt ist weit vorausgeplant: Die frühe Vorabtrainingsphase wurde nach nur zwei Monaten im Wesentlichen abgeschlossen.
Macht euch bereit: Eine Welle von harten Praxistests steht bevor!
Große Ausstellung der Kernpraxistests: 7 herausfordernde Demos
Über Nacht scheint es, dass jeder Gemini 4 Pro nutzen kann.
Aus den veröffentlichten Demos geht hervor, dass seine Leistung bei 3D-Generierung, Physik-Engine-Simulation und Codeerstellung für lange Texte erstaunlich ist.
Der Pfau-SVG-Test ist ebenfalls erschienen und zeigt einen riesigen Fortschritt.
Start des Wasserflugzeugs: Opus 5.5 weit überlegen
Der bekannte Testblogger @AI_Screening forderte es und Opus 5.5 auf, mit Code eine Physiksimulation zu erstellen, bei der ein 3D-Schwimmerflugzeug auf der Wasseroberfläche gleitet und startet.
Zuvor hat das von Opus 5.5 generierte Video viele Menschen schockiert, aber unerwarteterweise hat die Leistung von Gemini 4 Pro es dieses Mal vollständig übertroffen!
Man sieht, dass das von Opus 5.5 generierte Flugzeug zwar bewegt wird, aber der Rumpf stark wackelt, als würde er jederzeit auseinanderfallen, und die physikalische Rückmeldung der Wasseroberfläche ist steif.
Aber Gemini 4 Pro läuft viel reibungsloser: Die Beschleunigung ist stabil, die Wasserspiegelung ist klar und die Darstellung des „Spritzwassereffekts“ ist sehr realistisch.
Aus Sicht der Strömungsmechanik-Logik und Bildsauberkeit schlägt es Opus 5.5 mit Leichtigkeit.
Erstellung der 3D-Internationalen Raumstation in 16 Minuten per Hand
Der Entwickler @thtbee_ hat ein überwältigendes Ergebnis vorgelegt.
Ohne Import von 3D-Modellen generierte Gemini 4 Pro in nur 16 Minuten durch reinen Code ein interaktives Simulationsprogramm, bei dem die 3D-Internationale Raumstation die Erde umkreist!
Überraschenderweise hat es nicht nur das Modell der Raumstation selbst mit Three.js erstellt, sondern auch intelligent die korrekten Erdentexturen aus dem Internet abgerufen, um sicherzustellen, dass Breitengrad, Längengrad und Farbe absolut korrekt sind.
Diese Fähigkeit zur Modellierung aus dem Nichts ist erstaunlich.
Natürlich gibt es auch Kritiken, dass die generierte UI-Oberfläche etwas unschön ist und es noch Perspektivfehler auf der Rückseite gibt.
Vom Leuchtturm zum Raketenstart (Three.js-Rendering)
Der Netznutzer @HarshithLucky3 gab ihm eine schwierige Anweisung: „Verwende Three.js, um einen Leuchtturm in einen Raketenstart umzuwandeln, und füge keine UI-Elemente hinzu.“
Das Ergebnis: Gemini 4 Pro hat die Anweisung perfekt befolgt!
Die Tester lobten seinen „Geschmack“ sehr: Er fügte allen Elementen im Bild Texturen mit ausgezeichneter Qualität hinzu, und die gesamte 3D-Ausgabequalität ist unglaublich gut.
Hochpräzise Nachbildung der 3D-Wii-Fernbedienung
Der Entwickler @LuminaBench testete seine Fähigkeit zur Modellierung von Industriedesign und ließ es eine 3D-Nintendo-Wii-Fernbedienung generieren.
Das Ergebnis zeigt, dass es die Details von 3D-Objekten sehr gut erfasst und die Generierungsgeschwindigkeit „unglaublich schnell“ ist!
Wenn es etwas Unvollkommenes gibt: Es scheint die Anweisungen bei der Verarbeitung von Prompts übermäßig zu verfeinern und bemüht sich, Details zu ergänzen, auch wenn dies nicht gefordert ist.
Allerdings ist sein Designgeschmack bei verschiedenen Komponenten nicht stabil: Einige Teile sind ausgezeichnet, andere wirken etwas unpassend.
Laut Tests ist die Dichte der Details von Checkpoint 2 hervorragend, die Genauigkeit ist viel höher und es ist derzeit das schnellste Spitzenmodell, das von keinem anderen übertroffen wird.
Mechanischer Kolibri: GPT-6 Sol weit überlegen
Der Blogger @TimJayas gab seinen „alten“ Prompt für einen mechanischen Kolibri ein, um das Modell auf sein Verständnis komplexer mechanischer Strukturen und dynamischen Verhaltens zu prüfen.
Das Fazit lautet: „Die Leistung von Gemini 4 Pro ist einfach großartig! Ehrlich gesagt ist die Qualität mit der von Fable vergleichbar, aber weit besser als die von GPT-6 Sol!“
Natürlich wird es manchmal von GPT-6 Astra übertroffen.