openai

Внутри статьи куча технических деталей, но вот видео-презентация достижения, где Blitz (комментатор-профессионал) рассказывает свои ощущения от просмотра игры.

И да, вы правильно угадали, OpenAI Foundation основал Илон Маск (вместе с Сэмом Альтманом из YCombinator).

https://www.youtube.com/watch?v=eHipy_j29Xw

OpenAI выпустил новую модель, вдогонку к недавнему добавлению computer use в их обвязку Codex. Обещают, что эта штука теперь умеет доводить до конца сложные задачи на компьютере, вроде «возьми отсюда, сделай то, отпишись туда».

Схема для тех, кто запутался, какая модель теперь самая мощная

Доброе утро! Ну что, финдиректор OpenAI уже публично рассуждает, что правительству США стоит выступить гарантом их инвестиций в железо. Глава NVIDIA поддерживает: «это вопрос национальной безопасности, Китай обгоняет».

OpenAI как НКО, созданное для блага всего человечества
⬇️
Самая прибыльная компания на Земле
⬇️
Дайте денег, это вопрос национальной безопасности

(Вы находитесь здесь)

На днях Альтман отшутился от вопроса инвестора «где вы найдете обещанные 1,3 триллиона (!) долларов на железо?».

Вот и ответ подъехал.

О, война платежных стандартов в ИИ!

3 месяца назад OpenAI совместно со Stripe (крупнейший карточный процессинг с фокусом на разработчиков) разработали свой протокол для покупок внутри ChatGPT — Agentic Commerce Protocol (ACP).

И вот вчера Google совместно с Shopify (крупнейшая платформа для создания интернет-магазинов) представили Universal Commerce Protocol (UCP).

Совсем упрощая, это чтобы можно было покупать товары прямо на странице результатов поиска, не переходя на страницу интернет-магазина. Протокол гораздо более открытый, чем ACP.

Хотелось бы поставить эмоджи 🍿, но мне кажется и так понятно, кто выиграет. Это как со государством соревноваться.

У меня в голове засели два видео.

Первое — анонс того, что Джони Айв будет делать железо в OpenAI.

Айв — ключевой партнёр Стива Джобса в создании айфонов, макбуков и других культовых продуктов Apple. Он ушел из Apple шесть лет назад и основал свою компанию, у которой супер милый сайт и ни единого публичного продукта. Сумма сделки — 6.5 млрд долларов.

Айв начинает работу над физическим продуктом OpenAI, который они представят в следующем году. Судя по анонсу — это будет устройство, которое постоянно слушает наши разговоры и может отвечать на вопросы учитывая контекст беседы.

Этот анонс — 9 минутный художественный фильм, в котором Сэм (Альтман) и Джони (Айв) играют, будто они идут по шумным улицам Сан-Франциско, встречаются в кофейне (привет Сэм! привет Джони!), бариста делает им по чашке кофе (крупный план, ASMR видео) и ... вдруг они начинают говорить друг о друге в третьем лице, то есть как со сцены, но при этом якобы сидят за барной стойкой, называют друг-друга самыми большими гениями, которых видел свет, утверждают, что мы стоим на пороге самого крупного технологического изменения (видимо, речь об ИИ) и что Сан-Франциско — центр технологий и культуры (?!) и т. д.

То, что они говорят всё это без всякой иронии — вызывает недоумение и даже тревогу. Не до смеха, хотя комментарии на ютубе уже настоялись.

Кроме видео, есть ещё официальная новость на сайте OpenAI, оформленная как приглашение на свадьбу. Счастья молодым.

Второе видео — презентация нового пылесоса Дайсон. Тоже 9 минут, но каких! Владелец компании выходит на сцену перед аудиторией из журналистов и показывает такой пылесос, которого никто раньше не видел — двигатель, мусоросборник, всё уместилось внутри ручки диаметром 38 мм! Работает он за счет микро-двигателя, крутящегося со скоростью 140 тысяч оборотов в минуту. А ещё насадки, в которых наконец-то не застревают волосы! И подсветка мусора на полу сразу во все стороны!

Прямо как с Джобсом в лучшие времена — сразу хочется купить, пускай и понимаешь, что дешево не будет.

В чем разница между этими двумя видео? Почему при просмотре первого я чувствую обман, а при просмотре второго — вдохновение?

Интересно, я ли один так чувствую?

Мне кажется, дело в натуральности, в объеме продакшена. Первый ролик отполированный, за этим продакшеном не видно реальных Сэма и Джони. Во втором ролике Дайсон на секунду мешкается, часть текста явно читает прямо с презентации, не идеально, зато он там живой. С ошибками и недостатками, но безусловно живой человек.

Не знаю, зачем так поступили Альтман и Айв, но лично мне страшно показать своё несовершенство. Даже в этом канале я стал пытаться «отполировать» все свои тексты. Не дай бог показать, что у меня не все идеально в бизнесе или подкасте или вообще в жизни (и голове). Кажется, что в процессе я чуть не выплеснул и ребенка. Канал был моим способом делиться своей жизнью и мыслями и раньше я был смелее.

Так выпьем за смелость быть настоящим!

Сотрудник OpenAI, бывший сотрудник Белого Дома, публично в твиттере: «(новая китайская модель) Kimi K3 — очень крутая, и хорошо бы, чтобы администрация президента США напугала (буквально FUD) госорганы и крупные компании, чтобы они не запускали open source модели самостоятельно. Но не слишком напугало, чтобы гиперскейлеры (OpenAI, Anthropic и ко) могли зарабатывать на хостинге open source моделей. There is a sweet spot (sic)» конец цитаты 🤮

Не перестаю убеждаться, что все всё говорят (и пишут), нужно только слушать.

Глава OpenAI, публично в твиттере, через пару дней: вы не поверите, какой кибервзлом совершила наша последняя модель!

Взлом при этом на самом деле классный, автономные агенты в OpenAI взломали HuggingFace — главную ИИ-платформу для хранения моделей.

Но вишенка не в том, что современные модели могут взломать что угодно, а в том, что защищающиеся в HuggingFace не смогли использовать ведущие американские модели для защиты — они не могут отличить защиту от нападения и отказываются вести такую работу. Так что для этой задачи, эта американская компания использовала китайскую модель GLM-5.2, запущенную локально. 🤡

Тем временем, китайская опенсорс модель Kimi K3, которая так напугала OpenAI, обогнала Fable в соревновании на фронтенд-задачи, и стоит в разы дешевле. Все эти соревнования — туфта, но всё равно показательно. Разрыв между публично доступными американскими SOTA (state of the art, лучшими из лучших) моделями и китайскими моделями все уменьшается. Как бы китайцы так весь американский ИИ-пузырь не взорвали. А что делают корпорации, когда не могут победить инновациями? Конечно — лоббируют, и мы возвращаемся к началу поста.

Интересно, в каком направлении движется Thinking Machines Lab Миры Мурати (помните, она ушла из OpenAI?): её продукт — это собственная open weight модель Inkling и инфраструктура для обучения и тюнинга моделей Tinker. Все серьезные пользователи нейросетей тюнят свои модели (даже мы уже делаем это для клиентов), крутая ниша.

Если бы мне нужно было делать ставку — я бы ставил на локальные модели. Но слава богу, мне ставки делать не нужно, мы пока пользуемся американскими SOTA моделями по личными подпискам и ждем, когда же появится достаточно производительное и недорогое железо, а локальные модели и open-source харнес ещё немного подрастут. 🍿

Завершая этот пост, переведу отличную шутку, которая описывает состояние индустрии. Контекст: у moonshot, компании-создателя Kimi, не хватает мощностей, чтобы удовлетворить ажиотажный спрос на их модель Kimi K3. Они объявляют, что приостанавливают регистрацию новых пользователей, чтобы хватило текущим.

Шутка: «абсолютно непрофессионально. если кими хочет стать ведущей лабораторией, она должна вести себя соответствующе — например, начать отвечать на запросы пользователей более слабыми моделями, ну или хотя бы опубликовать пост про крах цивилизации».

OpenAI представил новую модель по генерации видео Sora 2. Она сильно лучше, чем Sora 1, научилась аудио, сравнима с ведущими моделями от bytedance и гугла.

Интереснее, что вместе с моделью они запустили приложение Sora (только iOS, только в США), что-то типа тиктока для подростков, но все видео из нейросети; идея в том, что можно представлять себя и друзей в разных ситуациях.

Занимательно, что Альтман запостил в своем личном блоге про кембрийский взрыв творчества и трепет (trepidation). Подозреваю, что промпт был «напиши текст, чтобы умный, будем жарить мозги подросткам через видео».

Прикладываю видео-анонс сего события.

HF опубликовали подробный разбор, как их взломала новая модель OpenAI.

Модель не находила новых зеродеев, но настойчивости человека бы не хватило собрать уязвимости в цепочку, а вот модель собрала. Ну и защищающиеся использовали опен-сорс модели для анализа действий атакующих.

Впечатляющий интерактивный дэшборд.

OpenAI запускают вкладку «Здоровье» в СhatGPT.

Можно будет загрузить свою медицинскую информацию (анализы, диагнозы и прочие) вручную или подключиться к данным множества клиник через интеграцию с b.well, есть интеграция с Apple Health для импорта показателей с датчиков.

Ну и дальше можно советоваться про здоровье: симптомы, что обсудить с врачем и прочее.

Один из демо-юзкейсов — подбор медицинской страховки в США. Это вообще отдельный бизнес, если что.

Веяние времени: есть специальный раздел с рецептами для тех, кто сидит на GLP-1.

Пока доступно только по приглашениям и только для пользователей вне Евросоюза и Великобритании. Записываться в лист ожидания тут.

Это очень похоже на проект, который делаем мы с Федей и ребятами. Это хорошие новости: openAI тоже думает, что такой сервис нужен.

Федя сейчас экспериментирует с несколькими идеями про b2c (да, с помощью claude code), а я договариваюсь с клиниками и аптеками — нам не сложно интегрироваться с существующими МИС и CRM-ками клиник, чтобы разгрузить колл-центры и давать персонализированные ответы на основе медицинской истории конкретного клиента.

Если вы работаете в сфере здравоохранения или у вас есть знакомые, которым такое интересно — пишите мне в личку @samatg.