Google a prezentat Gemini 3.6 Flash, un nou model AI destinat aplicațiilor și agenților care trebuie să combine performanța cu un consum mai redus de tokeni. Compania lansează simultan Gemini 3.5 Flash-Lite și pregătește un model specializat în securitate cibernetică, numit Gemini 3.5 Flash Cyber. Primele două modele sunt disponibile începând cu 21 iulie prin Gemini API, Google AI Studio și Android Studio. Gemini 3.6 Flash poate fi folosit și prin Google Antigravity, Gemini Enterprise și aplicația Gemini, în timp ce Flash-Lite începe să fie integrat inclusiv în Google Search.
Gemini 3.6 Flash este mai eficient decât Gemini 3.5 Flash, lansat recent
Gemini 3.6 Flash este prezentat drept succesorul direct al modelului 3.5 Flash, cu îmbunătățiri pentru programare, analiză de documente, lucrul cu date și sarcini multimodale. Potrivit Artificial Analysis Index, noul model utilizează cu 17% mai puțini tokeni de ieșire decât generația anterioară. Google susține că modelul are nevoie și de mai puțini pași de raționament sau apeluri către instrumente pentru finalizarea fluxurilor complexe. În testul DeepSWE, Gemini 3.6 Flash a obținut 49%, față de 37% pentru 3.5 Flash, iar în OSWorld-Verified scorul a crescut de la 78,4% la 83%.


Prețul prin API este de 1,50 dolari pentru un milion de tokeni de intrare și 7,50 dolari pentru un milion de tokeni de ieșire. Modelul include și funcția computer use, prin care un agent AI poate interacționa cu interfețe software, disponibilă prin Gemini API și Gemini Enterprise.
Google afirmă că a introdus și protecții suplimentare împotriva utilizării abuzive în domeniile chimic, biologic, radiologic, nuclear și al atacurilor informatice. Acestea sunt concepute inclusiv pentru a crește rezistența modelului la tentativele de jailbreak.
Flash-Lite pune accentul pe viteză și volum
Gemini 3.5 Flash-Lite este destinat operațiunilor cu latență redusă și volum mare, precum căutarea prin agenți AI și procesarea documentelor. Modelul generează 350 de tokeni pe secundă în măsurătorile Artificial Analysis și costă 0,30 dolari pentru un milion de tokeni de intrare, respectiv 2,50 dolari pentru un milion de tokeni de ieșire. Dezvoltatorii pot ajusta nivelul de raționament în funcție de sarcină. Configurațiile minimale prioritizează viteza și costul, în timp ce nivelurile superioare sunt destinate operațiunilor cu mai mulți pași sau subagenți.


În Terminal-Bench 2.1, Flash-Lite a obținut 54%, comparativ cu 31% pentru generația 3.1. Google susține că modelul depășește chiar și Gemini 3 Flash în anumite teste de programare și control al computerului.

Gemini 3.5 Flash Cyber va avea acces restricționat
Gemini 3.5 Flash Cyber este o versiune specializată a modelului 3.5 Flash, optimizată pentru identificarea, validarea și corectarea vulnerabilităților software. Acesta va funcționa prin CodeMender, unde mai mulți agenți analizează o problemă și generează un raport comun. Din cauza posibilității ca tehnologia să fie folosită atât defensiv, cât și pentru atacuri, modelul nu va fi lansat public. Google îl va oferi în curând exclusiv guvernelor și partenerilor aprobați, printr-un program pilot cu acces limitat.

Compania confirmă și că Gemini 3.5 Pro se află în teste cu parteneri, fără să ofere o dată de lansare. În paralel, Google a început cel mai ambițios proces de pre-antrenare realizat până acum de echipa Gemini, destinat viitoarei generații Gemini 4.