Умная лента · Россия и мир Новости
Закрытый серверный зал с длинным светящимся «поводком» из документов и кода ведёт к запертой зоне кибердоступа, показывая Gemini 4 Argon как мощную длинноконтекстную модель, пока д

Google показала Gemini 4 Argon: модель с длинным поводком, но пока не для всех

Google вытащила на свет Gemini 4 Argon — новую модель для длинных рабочих задач: код, юридические и финансовые документы, корпоративная рутина, киберзащита. Но ключ тут не в слове «frontier», а в режиме доступа: сначала модель дают доверенным киберзащитникам через Fairwind Program, а широкий запуск обещают потом.

Главная железка в истории — лимит вывода до 1 млн токенов вместо прежних 64K. По-бытовому: модель должна не бросать короткий ответ через плечо, а тянуть длинную работу одним заходом — разбор большой кодовой базы, пачки документов или многошаговой задачи. Звучит вкусно. Только чай пока рано ставить: массового доступа нет, регионы и точные условия широкого релиза не раскрыты.

Цена уже есть. Стартовый тариф — $2 за миллион входных токенов и $10 за миллион выходных. Кэшированный ввод обещают на 95% дешевле обычного. Это важно не для «спросить рецепт борща», а для компаний, которые снова и снова скармливают модели здоровенные контексты: репозитории, договоры, внутренние базы знаний. Там экономия на кэше — не мелочь, а нормальная строка в счёте.

Google отдельно ставит Argon в киберзащиту. Сейчас ранний доступ идёт именно туда, плюс компания участвует в добровольном американском процессе pre-release model access. Перевод с аккуратного корпоративного: модель достаточно мощная и нервная, чтобы сначала показать её ограниченному кругу, собрать обратную связь и подкрутить ограждения.

Внутри Google Argon уже гоняют на своих задачах. В примерах — оптимизация квантовых алгоритмов с результатом на 40% лучше опубликованной базы, поиск экономии памяти в дата-центрах с уже высвобожденными 300 TiB и оценкой до 500 TiB–1 PiB, миграции C/C++ на Rust вплоть до 800K+ строк для Fuchsia Zircon. Ещё есть кейс с libgav1: агенты заменили 32K строк SIMD-кода, и Rust-декодер стал в 2,7 раза быстрее прежнего Rust-порта при одинаковом видео на выходе.

Но это всё витрина Google, а не независимый тест со стороны. Полезный вывод такой: Argon выглядит как ставка на длинные агентные рабочие цепочки, где модель не просто пишет кусок текста, а копается в большом контексте и двигает задачу дальше. Для обычных разработчиков, компаний и потребителей история пока в режиме «скоро». Что именно откроют, с какими лимитами и насколько жёсткими кибер-ограничениями — ещё не расписали.

Источник: Google DeepMind Blog

← Ко всем новостям