Всередині Google частина співробітників скептично оцінює можливості нової флагманської моделі штучного інтелекту Gemini 4, незважаючи на високі результати в галузевих тестах. На практиці модель, зокрема, стикається з труднощами при виконанні деяких завдань з програмування. Про це повідомляє Bloomberg з посиланням на співробітників, які мають безпосередній доступ до розробки.

За даними агентства, Gemini 4 демонструє хороші показники в стандартних бенчмарках, якими технологічні компанії вимірюють можливості нових ШІ-моделей. Проте деякі співробітники Google вважають, що результати гірше переносяться на реальні робочі завдання, особливо пов'язані з написанням та аналізом програмного коду. Сама Google не погодилася з такою характеристикою.

Представники компанії заявили Bloomberg, що було б неправильно говорити про слабкі результати Gemini 4 у програмуванні. Один із співробітників, знайомих з розробкою, також повідомив агентству, що всередині компанії існує «широкий консенсус» про те, що Gemini 4 знаходиться на передовому рівні серед сучасних ШІ-моделей. При цьому частина фахівців вважає, що конкуруючі розробки OpenAI і Anthropic останнім часом вдосконалюються швидше.

Сумніви навколо Gemini 4 особливо чутливі для Google після проблем з попередньою флагманською моделлю. Компанія планувала випустити Gemini 3.5 Pro ще влітку, однак у результаті відмовилася від запуску. Раніше повідомлялося, що модель не змогла досягти внутрішніх цілей Google, у тому числі в програмуванні.

На Google I/O у травні компанія заявляла, що Gemini 3.5 Pro вже тестується всередині Google і має вийти наступного місяця. Однак замість цього розробник зосередився на швидших і дешевших моделях сімейства Flash. У липні глава Alphabet Сундар Пічаї підтвердив, що Google почала навчання Gemini 4, назвавши його наймасштабнішим циклом попереднього навчання моделі в історії компанії.

Минулого тижня новий керівник Google DeepMind Корай Кавукчуоглу повідомив, що Gemini 4 вже перейшла на стадію постнавчання — фінального налаштування після основного процесу тренування. За його словами, результати розробки викликають у команди оптимізм, і Google розраховує вивести модель на ринок значно раніше кінця року. Gemini має особливе значення для Google, оскільки моделі цього сімейства поступово впроваджуються практично в усі найбільші продукти компанії — від пошуку і Gmail до Chrome, Android і хмарних сервісів.

Тому від можливостей нового покоління залежить позиція Google у конкуренції з OpenAI і Anthropic. За матеріалами: Bloomberg, Google, The Verge

Від