9 июля 2026четверг

GPT-5.6 вышла всем. Шесть машин из депо

Обложка выпуска «Первый гудок» за 9 июля 2026

Релизный четверг: GPT-5.6 вышла всем, Meta впервые продаёт доступ к своей модели, агенты уходят в работу.

Коротко за день

  • Meta впервые продаёт доступ к своей модели: Muse Spark 1.1 (агентные задачи, контекст 1 млн) и Meta Model API в публичном превью для США — $1,25/$4,25 за млн токенов, $20 стартовых кредитов. Партнёры запуска — Replit, Cline, Box.
  • Китайская база уязвимостей NVDB объявила о «бэкдоре» в Claude Code (версии 2.1.91–2.1.196, якобы передаёт геолокацию). Anthropic отвечает: это эксперимент против реселлеров и дистилляции, а пользователям из КНР Claude и так недоступен. Alibaba с 10 июля запретила сотрудникам Claude Code.
  • Google открыл AlphaEvolve всем клиентам Cloud: агент эволюционно улучшает алгоритмы и возвращает читаемый код. Kinaxis — минус 90% времени расчётов, Schrödinger — скрининг молекул ×4 (цифры Google).
  • Бен Бернанке — экс-глава ФРС и нобелевский лауреат — вошёл в Long-Term Benefit Trust Anthropic (орган, назначающий совет директоров). Его фокус — влияние ИИ на экономику и рынок труда.
  • Ollama привлекла $65 млн Series B на локальный запуск открытых моделей: 8,9 млн разработчиков в месяц — командой из 14 человек.

Обещанный релиз состоялся: 9 июля OpenAI перевела GPT-5.6 из ограниченного превью в общий доступ — вся линейка сразу: Sol ($5/$30 за млн токенов), Terra ($2,5/$15), Luna ($1/$6) плюс Pro-версии и режим ultra для координации нескольких агентов. Контекст — миллион токенов, вывод до 128K, срез знаний — февраль 2026; модели уже в ChatGPT, Codex и API. Заявлен рекорд Agents' Last Exam: Sol — 53,6. Спутники релиза: агент ChatGPT Work со встроенным Codex (часами ведёт проект, отдаёт готовые таблицы, презентации и сайты; Pro/Enterprise — сразу, Plus — на днях) и новое десктоп-приложение для всех тарифов. А я уже прогнал всю шестёрку через свой тест на честность: несуществующую теорему уверенно сочинили четверо из шести — устояли лишь самая дешёвая Luna и самый дорогой Sol Pro.

По-честномуРекорд Agents' Last Exam (53,6) — пока только заявление OpenAI, независимых замеров нет. Слух о контексте 2 млн токенов не подтвердился — по разборам ровно 1 млн. Тест честности шестёрки — мой собственный прогон (одна попытка на задачу), не академический бенчмарк.

Шесть машин вышли из депо. У четырёх врут манометры.

Тугой дайджест каждое утро — в канале «Первый гудок»: @perviy_gudok.