Google zaprezentował w środę model Gemini 3.8 Flash – system, który osiąga 59 punktów w niezależnym indeksie inteligencji, kosztując przy tym ułamek ceny wiodących modeli konkurencji. Jednocześnie firma pokazała odseparowany, ściśle reglamentowany wariant ukierunkowany na cyberbezpieczeństwo.
Kluczowe informacje:
- Gemini 3.8 Flash uzyskał 59 punktów w Artificial Analysis Intelligence Index, o trzy więcej niż wersja wprowadzona trzy tygodnie wcześniej.
- Ceny tokenów pozostają na poziomie 0,75 USD i 3,75 USD za milion odpowiednio dla wejścia i wyjścia do 31 grudnia, choć koszt pojedynczego zadania jest o ok. 40% wyższy niż w poprzednim modelu.
- Osobny wariant do cyberbezpieczeństwa trafia wyłącznie do zweryfikowanych rządów, operatorów infrastruktury krytycznej i utrzymujących oprogramowanie w ramach nowego programu Fairwind.
Wyniki benchmarków Gemini 3.8 Flash
Obie wersje modelu Google zaprezentował 2 września – to już trzecie wydanie z rodziny Flash w ciągu sześciu tygodni. Konstrukcyjnie opierają się na jednym rdzeniowym systemie, intensywnie szkolonym na zadaniach związanych z cyberbezpieczeństwem.
Jeden model jest przeznaczony głównie do kodowania i zadań agentskich, drugi – do wyszukiwania błędów w dużych bazach kodu, objęty znacznie ostrzejszymi rygorami dostępu.
Przy ustawieniu na wysoki poziom rozumowania Gemini 3.8 Flash osiąga 59 punktów w Artificial Analysis Intelligence Index – o trzy więcej niż 3.7 Flash i tyle samo co GPT-5.6 Sol oraz Grok 4.6. W teście HLE-Verified, badającym wieloetapowe rozumowanie w naukach ścisłych, humanistyce i wybranych profesjach, wynik wyniósł 54,9%. Google wskazuje na długoterminowe projekty inżynierii oprogramowania jako obszar największego skoku jakości.
Do 31 grudnia firma utrzymuje promocyjną stawkę 0,75 USD za milion tokenów wejściowych i 3,75 USD za milion tokenów wyjściowych. Od Nowego Roku obie ceny mają zostać podwojone.
Zobacz też: Claude Fable 5.1 wchodzi na rynek z odczytami cache po 0,25 USD i mechanizmami antyplagiatowymi
Dlaczego Gemini jest droższy w przeliczeniu na zadanie
Tańsze tokeny nie oznaczają niższego rachunku za pojedyncze zlecenie. Średni koszt zadania benchmarkowego sięga 0,58 USD – około 40% więcej niż w przypadku poprzedniego modelu. Powód: przeciętna długość odpowiedzi wzrosła o około 30%, do 48 tys. tokenów, a agentowe przebiegi wymagają większej liczby tur.
Flagowy konkurent, Anthropic, pobiera według szacunków niemal sześciokrotnie więcej za porównywalne zadanie, co mimo podwyżki nadal plasuje ofertę Google na froncie kosztowym.
Jak tłumaczą Tulsee Doshi, dyrektorka ds. produktu, oraz Raluca Ada Popa, szefowa bezpieczeństwa Gemini w Google DeepMind, model „pracuje ciężej”: dodaje kolejne kroki rozumowania i częściej wywołuje narzędzia. Zespoły, które wolą dotychczasowy profil kosztowy, mogą dalej korzystać z 3.7 Flash, natomiast abonenci wersji Pro i Ultra uzyskują dostęp do 3.8 Flash w aplikacji Gemini, w trybie AI Mode oraz w Arkuszach Google.
Program Fairwind ogranicza dostęp do wariantu cyber
Wersja nastawiona na cyberbezpieczeństwo została zamknięta w ramach nowego programu Fairwind, dostępnego jedynie dla ściśle zweryfikowanych rządów, operatorów infrastruktury oraz zespołów utrzymujących kluczowe oprogramowanie.
W wewnętrznym teście obejmującym 20 języków programowania model wykrywał luki z ponad 70‑procentową skutecznością. Według Google, zespół odpowiedzialny za bezpieczeństwo Chrome z jego pomocą przygotowywał 2,6 razy więcej poprawnych łatek niż w przypadku znacznie większych, komercyjnych konkurentów. Badacze chmurowi zlokalizowali krytyczną podatność w mniej niż dwie godziny – zadanie, które zazwyczaj zajmuje miesiące.
Szybkie tempo premier następuje po trudniejszym okresie dla jednostki AI: czerwcowy termin wprowadzenia Gemini 3.5 Pro minął bez realizacji.
Demis Hassabis na początku sierpnia zrezygnował z funkcji dyrektora generalnego DeepMind, obejmując stanowisko prezesa rady, a stery operacyjne przejął Koray Kavukcuoglu, ale z niższym rangą tytułem starszego wiceprezesa.
Czytaj dalej: Bitcoinowe ETF-y przyciągają 216,7 mln USD, odrabiając jednodniowy odpływ środków





