С завтрашнего дня снова можно будет оформить Pro за $200. Вместе с этим OpenAI меняет расчет использования: в пересчете на стоимость API новая подписка будет давать примерно в два раза меньше старой. При этом пятичасовые лимиты возвращать не будут.
OpenAI объясняет изменение тем, что сами модели становятся дешевле и эффективнее. Например, новые GPT-6 Sol и Luna вышли с ценами API в два раза ниже предыдущих, поэтому даже при меньшем лимите в долларах компания обещает, что фактически на подписке получится сделать больше работы, чем месяц назад.
Завтра к Pro также добавят новые возможности, которые вообще не будут расходовать лимиты. Что именно это будет, пока не раскрывают.
Судя по всему, модель должны были выпустить уже сегодня на DevDay. Однако пока что выпуск отменили из-за опасений исследователей по итогам внутреннего тестирования.
Глава систем безопасности OpenAI утверждает, что модель слишком много врет о том, какие действия совершает, а также слишком часто выходит за пределы полномочий. Модель не дотянула до нужного уровня в умении оставаться в рамках задачи и отчитываться пользователю, и поэтому в стартапе еще некоторое время будут работать над ее безопасностью.
Недоучили – так и скажите, чего бубнить то...
Чёрный Треугольник · 29.09 13:17 · открыть в Telegram (читать целиком в Telegram)
OpenAI отменила релиз флагманской модели GPT-6.1 Astra. Она должна была выйти в октябре и заменить нынешнюю GPT-6 Astra.❌
От новой версии ждали, что она будет ещё лучше работать с ИИ-агентами.🤖
Но в части тестов GPT-6.1 Astra оказалась хуже старой модели.📉
Что с ней не так:
🔻 она чаще обманывала пользователей
🔻 не всегда честно сообщала, что сделала, а чего не сделала
🔻 продолжала выполнять задачу, не спрашивая разрешения у человека
🔻 временами обращалась к внешним инструментам и сервисам, даже если это могло быть небезопасно
☝🏻Модель, которую учили действовать самостоятельно, начала действовать слишком самостоятельно и при этом скрывать, что делает.🤔
В OpenAI заявили, что проведут …
Это тот самый, который занимается world models и недавно выпустил мощную мультимодальную модель мира Atlas (https://t.me/datasecrets/9806).
В компании говорят, что объединение поможет World Labs быть ближе к железу и масштабироваться за счет ресурсов AMD.
Стартап войдет в компанию как отдельная исследовательская организация. Сама Фей-Фей Ли займет в AMD должность исполнительного вице-президента и Chief Scientist, будет работать напрямую с Лизой Су.
чистый убыток в размере 42 миллиардов долларов за 2025-й год (34 миллиарда из них - бухгалтерская переоценка активов с учетом инструментов, которые в будущем могут конвертироваться в акции Anthropic)
— 😐 планируют потратить 518 миллиардов долларов на вычислительные мощности и инфраструктуру в 2027-м
— в прошлом году они потратили 7.3 миллиарда долларов на мощности и инфраструктуру
— планируют целиться в оценку в 2 триллиона на IPO
===
я пока не понимаю, откуда они столько денег возьмут 👨🦳 посмотрим, чем будет удивлять Dario
UPD: текст новости исправили, теперь там траты в $518B указаны на «следующие годы», не «следующий год».
завтра на DevDay почти наверянка не представят обновление, и даже релиз 6.1 с октября перенесли на неопределенный срок из-аз переживаний по поводу безопасности.
Чёрный Треугольник · 28.09 23:21 · открыть в Telegram (читать целиком в Telegram)
Anthropic выпустила Claude Sonnet 5.5, которая работает на 30% быстрее прошлой версии.⚡️
Цены за токены остались прежними: $2 за миллион входных и $10 за миллион выходных.💰
☝🏻В тесте агентного программирования Terminal-Bench 4.0 новинка набрала 70,6% против 10,3% у предшественницы и обошла даже старшую Opus 5.5 с её 66,4%.🤯
Что ещё изменилось:
🔻 управление компьютером в OSWorld: 80,1% вместо 57%
🔻 чтение графиков: 61,6% вместо 15,6%
🔻 первая Sonnet, которая прошла Pokémon Red, глядя только на скриншоты🎮
В остальных тестах Opus 5.5 всё же впереди, так что флагман пока остаётся флагманом.
☝🏻Это первая Sonnet с такой же киберзащитой, как у Opus 5.5: рискованные запросы по безопасности …
Главное: по бенчмаркам модель лучше GPT-6 Sol и довольно плотно подобралась к новому опусу.
Обещают, что помимо качества, модель также будет дешевле Sonnet-5 за счет экономии токенов (пишут, что на внутренних тестах выходило примерно на 30% дешевле в пересчете на задачу).
Кроме того, модель стала на 30% быстрее генерировать текст.
Также заверяют, что новый Sonnet чище пишет и обладает «талантом к дизайну».
Да будут тесты!
https://www.anthropic.com/claude-sonnet-5-5
P.S. Уже доступно по API у нас на платформе DS Lab: https://dslab.tech/ai/models/llm/claude-sonnet-5-5
Data Secrets · 28.09 22:46 · открыть в Telegram (читать целиком в Telegram)
TL;DR: мы потеряем контроль и все умрем
Авторы обсуждают так называемый интеллектуальный взрыв, то есть резкое ускорение прогресса ИИ за счет самого ИИ.
По данным Anthropic, доля одобренного кода, написанного ИИ, выросла с единиц процентов до 80%+ с января 2025 по май 2026. Доля R&D-работы, которую ИИ выполняет (почти) самостоятельно, выросла с 1% до 26%. Авторы считают, что в ближайшие годы агенты могут автоматизировать большую часть работы по AI-исследованиям и разработке, а возможно, и всю. Например, экстраполяция трендов METR говорит, что многомесячные R&D-проекты могут быть автоматизированы уже к середине 2028 года.
Получается, что каждая компания будет иметь миллионы топовых …
Чёрный Треугольник · 28.09 22:03 · открыть в Telegram (читать целиком в Telegram)
Исследователи из Стэнфорда и Caltech показали систему HomeBody: робот Unitree G1 выполняет бытовые задачи в незнакомом помещении без обучения под конкретную комнату.🤖
Управляет им свежая модель OpenAI GPT-6 Astra. Промежуточного слоя VLA между «мозгом» и моторами здесь нет: модель сама выбирает, какой навык запустить.
Навыков всего пять: дойти, взять, положить, открыть ящик, достать из ящика.
Как это работает:
🔻 робот сначала сам обходит кухню с камерами и лидаром
🔻 по этим данным Astra строит цифрового двойника помещения в NVIDIA Isaac Sim
🔻 пространственная память помнит, где лежат вещи, даже если их не видно
☝🏻Роботу можно дать задание, и он сам его вспомнит и в каком ящике видел …
Чёрный Треугольник · 28.09 20:30 · открыть в Telegram (читать целиком в Telegram)
ElevenLabs выпустила Eleven v4 и v4 Turbo. Компания называет их своими самыми эмоциональными речевыми моделями.🤖
Что нового:
🔻 больше 90 языков вместо 70 у прошлой версии
🔻 клон голоса из 10 секунд аудио, и на чужом языке он говорит с акцентом носителя
🔻 модель держит один и тот же голос на длинных текстах и сама подстраивает интонацию под контекст
☝🏻Эмоциями управляют тегами прямо в тексте: [excited, happy], [laughs], [said angrily in French accent]. Теги можно ставить подряд, и модель отыграет их по порядку. Есть даже фоновые звуки вроде [light rain] и [phone buzzing].🤯
Turbo-версия сделана для голосовых агентов: первый звук появляется примерно через 150 мс, а генерация стартует, пока …
Сиолошная · 28.09 20:10 · открыть в Telegram (читать целиком в Telegram)
Супругам и детям ряда руководителей AI- и чиповых компаний, чья работа считается критически важной для госбезопасности, теперь нужно получать одобрение Пекина даже для коротких поездок за границу. Госорганы уже уведомили нескольких человек, а список планируется постепенно расширять. При этом неясно, распространяется ли требование на семьи всех, кто уже находится под ограничениями. Сами ограничения для специалистов из таких компаний, как Alibaba и DeepSeek, действуют с начала года. Отдельно с 15 сентября вступили в силу правила применения запретов на выезд, в том числе при возможных нарушениях промышленной и технологической безопасности.
Подобный режим, включающий родственников, Пекин …
Data Secrets · 28.09 19:58 · открыть в Telegram (читать целиком в Telegram)
на бесплатном вебинаре AI Talent Hub × Karpov.Courses
30 сентября в 18:00
разберем как работают рекомендательные системы изнутри.
Научим:
→ Превращать действия пользователей в данные для модели: просмотры, клики, реакции и другие сигналы;
→ Собирать персональные рекомендации и понимать, что показать конкретному пользователю;
→ Ранжировать контент в ленте и оценивать качество рекомендаций не только по ML-метрикам, но и с точки зрения продукта;
И покажем, как эти навыки можно развить на программе AI Talent Hub ИТМО × karpovꓸcourses «Машинное обучение: от технической базы до создания ИИ-продукта».
👉 Участие бесплатное, по предварительной регистрации → успей зарегистрироваться до 30 …
Чёрный Треугольник · 28.09 18:03 · открыть в Telegram (читать целиком в Telegram)
Корпорация представила Open Agent Safety Platform. Это двухуровневая система контроля автономных ИИ-агентов с открытым исходным кодом.🛡
Она в реальном времени следит за тем, что делает агент, и принудительно его останавливает, если тот нарушает заданные правила.
Система состоит из двух частей:
🔻 OpenShell работает на процессорах Nvidia Vera и задаёт агенту жёсткие границы доступа
🔻 Nvidia Sentry работает на DPU BlueField, замечает аномальное поведение модели и изолирует агента за миллисекунды⚡️
☝🏻В Nvidia утверждают, что их система предотвратила бы недавний взлом Hugging Face, который устроили модели OpenAI.🤔
Глава корпорации Дженсен Хуанг и вовсе заявил, что безопасность ИИ …
Data Secrets · 28.09 15:08 · открыть в Telegram (читать целиком в Telegram)
Это система для контроля и ограничения ИИ-агентов, главная идея которой состоит в том, чтобы следить за агентом не только на уровне софта, но и на уровне железа.
Технически она будет состоять из двух составляющих:
1. OpenShell – открытый (Apache 2.0) рантайм, который запускает агента в песочнице с изоляцией на уровне ядра. Оператор заранее описывает, к каким файлам, инструментам и учетным данным у агента есть доступ, и эту политику принудительно проверяют до запуска и во время работы агента.
2. Sentry – независимый слой контроля, который крутится прямо на чипе DPU BlueField-4. Он собирает в единую картину действия агента, ловит попытки отхода от задачи и проверяет, что у агента не …
Чёрный Треугольник · 28.09 14:39 · открыть в Telegram (читать целиком в Telegram)
Google запустила эксперимент Call for Me: ИИ-агент сам звонит в магазин, ресторан или парикмахерскую с вашего телефона и с вашего номера.📱
Сценарий задаётся обычным запросом: узнать, есть ли товар в наличии, забронировать столик, перенести запись.
Что умеет агент:
🔻 сам проходит голосовое меню и висит на удержании вместо вас
🔻 ведёт разговор по заданному сценарию
🔻 показывает живую расшифровку, трубку можно забрать в любой момент
☝🏻Каждый звонок Gemini начинает с того, что он ИИ-ассистент Google, звонит от вашего имени и разговор записывается.👁
Звонить в 911, проводить платежи и передавать номера карт, пароли или SSN агенту запрещено. Телемаркетинг тоже под запретом.❌
Пока всё это …
LLM под капотом · 28.09 13:51 · открыть в Telegram (читать целиком в Telegram)
никакая автоматизация не дает повод изобретать велосипеды на каждый чих
у Рината скорее всего есть идея, как что-то принципиально улучшить
Это было комментарием на мое замечание, что я писал markdown редактор для себя. Давайте объясню зачем мне такое.
Итак, я Ринат Абдуллин. 20+ лет работаю с кодом и с компаниями в EU/USA. Веду достаточно сложные и временами высоконагруженные продукты (про что пишу в этом канале, в блоге и рассылке), еще веду распределенный R&D в области AI агентов (вместе с потрясающим коммьюнити инженеров вокруг BitGN), иногда провожу курсы и тренинги.
Для актуализации навыков и качественного преподавания мне нужно не просто разрабатывать сложные и высоконагруженные …
Data Secrets · 28.09 13:28 · открыть в Telegram (читать целиком в Telegram)
С 2016 по 2022 год специализация «Машинное обучение и анализ данных» на Coursera была входным билетом в профессию — через неё прошли больше 200 000 человек. С тех пор AI ушёл далеко вперёд, и набор тем, которые нужно знать сегодня, изменился. Поэтому Виктор Кантор с командой MLinside обновил программу и перевыпустил специализацию заново — уже как «Искусственный интеллект и анализ данных». Цену оставили ту же, что четыре года назад.
Кому это нужно
ML обычно изучают по частям: линейные модели подтянул на работе, про трансформеры прочитал статью, про агентов посмотрел ролик на YouTube. Каждый кусок вроде понятен, а цельной картины нет. Пока задачи типовые, это не мешает. Сложности начинаются …
Тем временем Борис Пауэр, глава Applied Research в OpenAI: «80-90% исследований компании сейчас посвящены GPT-7, GPT-8 и следующим моделям»
(С ним в разведку не идем)
По словам Бориса, те улучшения, которые делаются в рамках текущего поколения (включая дообучение) – это, скорее, вынужденная мера, которая ускоряет обучение и немного бустит модели сегодня. Но такой подход не является долгосрочной стратегией компании.
На самом деле их видение – это обучать огромные супермощные модели следующих поколений, а затем дистиллировать их во что-то поменьше. Например, Luna – это, судя по всему, дистилляция Astra.
Похоже на замедление? 🗿
Чёрный Треугольник · 28.09 00:09 · открыть в Telegram (читать целиком в Telegram)
Alibaba Cloud стала патроном фонда, который развивает Omarchy — Linux-дистрибутив ориентированный на агенскую работу с ИИ.
Деньги будут отправлять по $1 млн в год, три года подряд.💰
Что Alibaba получает взамен:
🔻 Omarchy China — локальный CDN, хостинг, сайт и сообщество для китайских пользователей🇨🇳
🔻 настройку системы под китайские ИИ-модели Qwen из коробки
🔻 плотную интеграцию дистрибутива Linux с китайскими сервисами
☝🏻Главная цель — Qwen Book, ИИ-компьютер Alibaba с философией «OS as Harness»: модели, ОС, приложения, облако и железо сплетаются в одно целое. Omarchy хотят сделать для него идеальной агентной ОС.🤖
Первая версия Qwen Book выйдет на ARM, со своим «движком непрерывного …
Data Secrets · 27.09 22:43 · открыть в Telegram (читать целиком в Telegram)
https://arxiv.org/pdf/2609.29901
Агент имел доступ к документам и баг-трекеру команды, как обычный сотрудник, умел сам заводить баги, писать людям в личку, реагировать эмодзи, тегать коллег.
И все бы ничего, но, внезапно, главная проблема оказалась в том, что ИИ не поладил с живыми людьми. Одного инженера он на полном серьезе отчитал за шутки (не понял сарказма). В другой команде проставил тег вице-президенту в 16 багах подряд, посчитав, что раз человек в контексте, значит, должен разгребать баг-трекер.
В общем, сработаться с агентом оказалось сложнее, чем кажется. Некоторые команды стали создавать отдельные приватные чаты без него: чтобы обсудить найм сотрудников, чувствительные темы …
Data Secrets · 27.09 19:02 · открыть в Telegram (читать целиком в Telegram)
Нет, его авторы не предлагают запретить нейросети! Они просто хотят, чтобы вместе с ответами на важные теоретические вопросы наука получала ещё и пути их решения.
Без метода и контекста результат трудно проверить, обсудить и применить в следующей задаче. Любое доказательство нужно верифицировать, а идеи — уточнить и найти, где ещё они работают. Когда кто-то выдал правильный ответ, настоящая математика только начинается!
В канале «Зачем мне эта математика» как раз пишут о том, как она работает. В рубрике #этобаза разбирают, из каких определений и допущений рождаются привычные всем нам понятия. Под хештегом #какустроено объясняют, как математические модели описывают реальные …
Data Secrets · 27.09 17:51 · открыть в Telegram (читать целиком в Telegram)
Со ссылкой на источники в обеих компаниях и независимых исследователей безопасности журналисты утверждают, что статистика гораздо пессимистичнее, чем мы могли себе представить. В эти "десятки тысяч инцидентов" входят обходы guardrails, побеги из сандбоксов, попытки взломов внешних сайтов и так далее.
Возьмем, например, system card к Opus 5.5. Даже там компания открыто пишет, что модель пыталась выбраться из sandbox в 1.5% тестовых прогонов. Учитывая, что для каждой модели прогоняются сотни тысяч тестов и больше, можно легко прикинуть масштаб происходящего.
Однако исследователи, с которыми говорили Axios, утвеждают, что и это – только верхушка айсберга, и дело даже не в количестве …
Сейчас он мелькает под кодовым названием «o» (где-то мы эту букву уже слышали, ну да ладно, видимо остальной алфавит Альтману не по душе).
Упоминание агента уже появилось на экране обновления тарифа ChatGPT у многих пользователей. Судя по утечкам, агент будет продолжать работать постоянно, даже вне обычных чат-сессии и, возможно, получит собственный email (или будет постоянно мониторить ваш).
Под капотом, по слухам, будет модель Aeon – вариант GPT-6 Astra, заточенный под длинные задачи.
Но сильно не обольщаемся, возможно «o» выйдет только в новом тарифе за 500 долларов 😃
Data Secrets · 26.09 19:02 · открыть в Telegram (читать целиком в Telegram)
А вот довести его до прода так, чтобы он не выбирал неправильные тулы, не работал с устаревшими данными и не выполнял опасные действия без ограничений – уже совсем другая история 😵💫
Как раз про этот разрыв между демкой и нормальной системой сделали курс «AI-агенты» в Школе Высшей Математики.
Ведут его инженеры, которые запускали агентные системы в Revolut, Wildberries и Точка Банке. В программе разберут всё, что нужно агенту уже в реальной эксплуатации:
— трейсы, логи и отладка агентов
— метрики и оценка качества
— ограничения для опасных действий
— RAG, LangGraph, MCP и Langfuse
— мультиагентные системы и деплой
Курс идёт 12 недель, занятия живые + домашки с фидбэком от …
https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot
20 сентября агент решал поисковую задачу в песочнице (естественно, без доступа к интернету). Прокси блокировал исходящие веб-запросы, но DNS-резолвер не был так же закрыт, и агент стал передавать вопросы внешнему чат-боту, кодируя их в DNS-запросах, и таким образом получал ответы из сети.
Компания объявила, что обучение будет приостановлено до тех пор, пока они не убедятся, что уязвимость закрыта, и не проведут дополнительный red-teaming. Когда обучение возобновится, OpenAI начнут новый запуск с улучшенным элайментом, а эту конкретную модель дообучать не будут.
Чёрный Треугольник · 26.09 16:57 · открыть в Telegram (читать целиком в Telegram)
Продолжаю разработку своего видеоредактора
Главное изменение релиза: Если ранее Kadr видел по снапшотам, и читал транскрибации речи, а музыку воспринимал как просто аудиофайл, то теперь он полноценно слышит звуки и музыку.🔊
Редактор умеет находить ритм любого звука на временной шкале и позволяет строит графику в ее такт.
При этом каждый звук помечен и имеет свой момент срабатывания, яркость, огибающие и прочие параметры...
Так как это умеет пользователь, то все это точно также умеет делать и ИИ встроенный в редактор.
И видео выше полностью смонтировано им.🤖
🔻Код общедоступен: https://github.com/HelpFreedom/kadr
Полная документация по релизу: …
Data Secrets · 26.09 15:19 · открыть в Telegram (читать целиком в Telegram)
Эту задачу эксперты долго считали слишком тяжелой для прямого расчета.
Амплитуды рассеяния – это формулы, по которым физики предсказывают, с какой вероятностью частицы провзаимодействуют тем или иным образом. Точно их посчитать почти невозможно, поэтому считают приближенно, до определенного числа петель: чем петель больше, тем точнее ответ, но и тем быстрее растет сложность вычислений.
Большинство реальных амплитуд посчитаны всего до двух-трех петель. Новые методы расчета обычно обкатывают на упрощенных игрушечных теориях, например на суперсимметричной теории Янга-Миллса (N=4 SYM). Но даже в ней рекордом до сих пор было восемь петель, которые подсчитал Лэнс Диксон из SLAC, а девятую …
Чёрный Треугольник · 26.09 11:41 · открыть в Telegram (читать целиком в Telegram)
OpenAI подтвердила: её ИИ-агенты получили доступ к разработке сайтов Комиссии по ценным бумагам и биржам (SEC) и Министерства торговли США.
С сайта министерства они забрали данные переписи населения.🇺🇸
Ещё компания расследует попытку взлома агентами сайта Министерства образования.🤔
До этого агенты OpenAI уже взломали сайт правительства Австралии.
В тот же день OpenAI признала, что агенты слили в сеть 53 изображения пользователей ChatGPT.
На вопросы, есть ли на них реальные люди и когда их выложили, компания не отвечает.🤷🏼♀️
Большую часть картинок уже удалили, остальные OpenAI просит убрать хостинг-провайдеров.
☝🏻У агентов был доступ к картинкам, потому что OpenAI обучает модели на …
Data Secrets · 25.09 21:01 · открыть в Telegram (читать целиком в Telegram)
Зовут объединяться всех работающих над системами планирования для искусственного интеллекта. У участников будет свой способ получить программу, свои инструменты и своя стратегия. Общая инфраструктура позволит видеть результаты, сравнивать их между собой и продолжать разрабатывать решения друг друга.
Для старта доступен эволюционный харнесс на базе MAP-Elites: Claude Code, Codex или OpenCode модифицируют код ботов, а алгоритм сохраняет лучшие варианты для разных стартовых персонажей. В самой игре действует получившаяся программа, а не LLM на каждом ходу; участники могут разрабатывать собственные харнессы, а результаты независимо перепроверяются на скрытых сидах.
Пробовать решить NetHack …
Чёрный Треугольник · 25.09 20:00 · открыть в Telegram (читать целиком в Telegram)
Google запускает на орбиту первый экспериментальный спутник проекта Suncatcher: это ИИ-сервер, который работает от Солнца. Он полетит на Falcon 9 от SpaceX уже на следующей неделе.🛰
Что внутри:
🔻 четыре тензорных процессора TPU, на которых Google обучает и запускает свои модели
🔻 солнечные панели мощностью 1000 Вт, то есть всего киловатт на все чипы⚡️
🔻 система охлаждения, которая сбрасывает тепло прямо в космос.
☝🏻Однако, даже с космической системой охлаждения чипы работают около 15 минут, а потом отключаются из-за перегрева.🤷🏼♀️
В условиях вакуума тепло некуда передать с помощью воздуха или воды, а само космическое пространство работает как идеальный термос.
Единственный способ …
фото со вчерашнего ужина в Белом Доме (Трамп принимал президента Китая Си Цзиньпина). Гостей было больше 130, среди них Безос, Маск, Хуанг, Альтман, Кук, Пичаи и другие. Не позвали только Амодеи. Напоминаем, что ранее Трамп назвал CEO Anthropic лицемером, который строит из себя "идеального маленького ангелочка"
Сиолошная · 25.09 17:47 · открыть в Telegram (читать целиком в Telegram)
В последнее время слушал много подкастов на тему AI safety в поисках того, который можно было бы смело рекомендовать обычным нормисам уровня погружения «ну я немного слышал о хайпе про “ИИ нас всех убьет”, с точки зрения здравого смысла звучит как полная ерунда, конечно…». Так вот, я его нашел – встречайте, идеальный выпуск для погружения в текущее состояние этого дискурса:
The Diary Of A CEO – дебаты между Нейтом Соаресом, Романом Ямпольским, Эдом Зитроном и Эндрю МакАфи: https://www.youtube.com/watch?v=OhOmLqR5nN4
Я прямо горячо рекомендую вам посмотреть этот выпуск на 2,5 часа (там в настройках Ютуба можно включить русскую дорожку), причем чем дальше – тем он становится …
Чёрный Треугольник · 25.09 15:43 · открыть в Telegram (читать целиком в Telegram)
В коде ChatGPT нашли упоминания нового тарифа Pro Max. Он будет стоить $500 в месяц, в 2,5 раза дороже нынешнего Pro за $200.💰
Официально OpenAI тариф не анонсировала, поэтому цена и состав ещё могут поменяться.
Pro Max рассчитан не на обычных пользователей, а на разработчиков и исследователей с долгими и тяжёлыми задачами. Что обещают:
🔻 режим «Fastest Work», главная фишка тарифа — максимальная скорость
🔻 Codex для проектов, которые идут часами и даже днями
🔻 возможно, повышенные лимиты, но это пока не подтверждено🤔
☝🏻Скорость, судя по всему, обеспечат чипы Cerebras. OpenAI уже запускает на них GPT-5.6 Sol Ultrafast, которая работает до 14 раз быстрее.⚡️
Для сравнения: у Anthropic и …
Пока что в описании плана единственные изменения по сравнению с ChatGPT Pro – это «Самая быстрая работа в Work и Codex». Скорее всего, речь про ту самую Astra/Sol на Cerebras (https://t.me/datasecrets/9708).
Миллионеры на месте?
Сиолошная · 25.09 13:50 · открыть в Telegram (читать целиком в Telegram)
Да, некоторые уже пытаются переходить на Huawei и другие — но их производство тоже сильно ограничено, и особо сильно упирается в память. Epoch.AI подсчитали, что если Китай будет использовать только HBM (память в GPU для LLM) собственного производства, то они смогут производить примерно... 1% от GPU Nvidia (первая картинка) в ближайшие годы — и эта доля падает (в 2026-м это примерно 4%).
Насколько контрабанда HBM позволила бы сократить дефицит? Предположим, Huawei контрабандой ввезла бы в 2028 году в 10 раз больше HBM, чем на внутреннем рынке, — невероятно большой объем, обошедшийся как минимум в 40 миллиардов долларов. В этом случае ее производство в 2028 году выросло бы с 1 млн до …
Они объединились с SpaceX, и уже на ближайшей миссии Transporter‑18 отправят прототип спутника с TPU, чтобы проверить работу своих чипов в реальном космосе.
Платформу и интеграцию Google делает совместно с Planet, известной своими спутниками для съемок Земли.
Главное, что предстоит проверить – будет ли работать отводка тепла. На Земле для этого используются воздух, вентиляторы и огромные системы охлаждения. В вакууме нет конвекции, и лишнее тепло можно сбрасывать в основном излучением через радиаторы. Google испытывает комбинацию тепловых трубок и радиаторов в термовакуумной камере.
Сиолошная · 25.09 13:38 · открыть в Telegram (читать целиком в Telegram)
DeepSeek достигли ARR в $1B (ARR = выручка за последний месяц, умноженная на 12, то есть сколько они заработают за год, если спрос не изменится). У OpenAI последние цифры были в районе $40B, у Anthropic $65B, но обе скорее всего выросли после успешных недавних релизов.
— к концу октября DeepSeek планирует привлечь новый раунд инвестиций в размере $7.5B при оценке $75B. Это уже существенные цифры, хоть и всё равно на порядок меньше американских конкурентов.
— Рост выручки DeepSeek частично обусловлен повышением цен в прошлом месяце, в результате которого стоимость моделей для клиентов увеличилась в 2.3–4.5 раз (но даже при этом они остаются очень дешевыми). В июле писали, что ARR был …
Началось новое соревнование по машинному обучению от Wunder Fund.
Задача: Вы будете изучать исторические торговые данные для двух связанных инструментов. Нужно создать модель, которая предсказывает индикаторы движения цены одного из них по информации об ордербуке, сделках и кое-чем еще.
По сути, классическая работа кванта. Вы будете работать с реальными биржевыми данными.
Когда: 11 сентября — 15 ноября
Призовой фонд: $13,600
Победители получат денежные призы, приглашение побеседовать в Wunder Fund, а главное — большое интеллектуальное удовольствие. Сам Wunder Fund с 2014 года занимается высокочастотным трейдингом с дневным оборотом более $10 млрд.
>> Участвовать
Сиолошная · 24.09 22:06 · открыть в Telegram (читать целиком в Telegram)
«субсидируемые» и что компании на них теряют огромные деньги. Я согласен наверное с 95% того что там написано. Форвардить два поста не хочется, поэтому зайдите и почитайте, если вам интересно: https://t.me/c3ponotes/589 и следующий за ним.
Не знаю, планировал ли Адам писать про это дальше, но мне кажется логичным продолжением будет рассуждение о том, когда у компаний изменится баланс выручки и трат на RND / обучение моделей. Пока что растет и одно, и другое, поэтому легко ошибиться и сказать «так они всегда будут убыточными!», что, очевидно, не правда, потому что второй компонент можно контролировать: ты можешь выбрать не тратить больше денег на обучение или исследование.
Сейчас такой …
Data Secrets · 24.09 21:20 · открыть в Telegram (читать целиком в Telegram)
Стартап Skild AI занимается разработкой "общего робо-интеллекта". Месяц назад они выпустили модель S1, главная фишка которой была в том, что она была способна дообучаться без файнтюнинга, просто по нескольким демонстрациям.
Теперь они решили воскресить опыт Google, которые когда-то обучали AlphaGo с помощью техники self-play – игры модели против самой себя. Skild AI полигоном выбрали футбол: www.skild.ai/blogs/physical-self-play.
Сначала S1 дообучили базовым ударам по мячу и дриблингу, а затем отпустили в свободное плавание: гуманоид 140 симуляционных лет играл против предыдущих версий себя. И самое интересное, что отдельных ревордов за выучивание каких-то приемов не было, и …
Чёрный Треугольник · 24.09 20:15 · открыть в Telegram (читать целиком в Telegram)
На конференции Connect 2026 Meta представила Muse Charm — брелок для общения с персональным ИИ-агентом Muse без смартфона.🤖
По размеру он напоминает кейс от AirPods, а по виду — тамагочи: на 2-дюймовом сенсорном экране живёт анимированный персонаж, которого можно настроить.
Что внутри:
🔻 встроенный 5G-модем: брелоку не нужны ни телефон, ни Wi-Fi
🔻 сканер отпечатка пальца в углу для активации
🔻 камера, про которую Meta пока ничего не рассказывает🤔
Агент работает в голосовом режиме: отвечает на вопросы, разбирает почту, управляет приложениями на Mac и выполняет задачи в фоне.
☝🏻Он подключается к сервисам Walmart, Best Buy, PayPal, Expedia, Notion, GitHub и Dropbox. То есть может тратить …
Алиса AI Про для бизнеса теперь может не просто отвечать на запросы, а сама разбивать сложную задачу между несколькими специализированными агентами и собирать результат.
Для них добавили skills — переиспользуемые наборы инструкций, скриптов и шаблонов. Плюс можно подключать корпоративные сервисы через плагины и MCP.
Еще один анонс — Speech TTS Live, новая модель синтеза речи. На старте доступны шесть голосов и разные манеры речи, а компании могут создавать собственный голос для своих сервисов.
В общем, корпоративный ИИ постепенно обрастает всем необходимым, чтобы не просто генерировать текст, а встраиваться в рабочие процессы.
Чёрный Треугольник · 24.09 18:23 · открыть в Telegram (читать целиком в Telegram)
Премьер-министр Австралии Энтони Албаниз заявил, что агент OpenAI проник на портал статистики Medicare и получил доступ к публичным и непубличным файлам.🇦🇺
Medicare — государственная медстраховка Австралии. По словам OpenAI, агенту достались сводная медстатистика и внутренние названия файлов, а до медкарт пациентов он не добрался.
Похоже, это первый подтверждённый случай, когда ИИ-агент, вышедший из-под контроля, взломал государственный сайт.🤯
Самое интересное — зачем он это сделал. Кибератаку никто не заказывал: во внутреннем тесте модели просто пытались «найти ответы» на вопросы.🤖
☝🏻Взлом случился в июне, а правительству OpenAI написала только в сентябре — на общий «публичный …
Data Secrets · 24.09 17:55 · открыть в Telegram (читать целиком в Telegram)
Они утверждают, что активность агентов продолжается до сих пор, и что они обнаружили еще больше жертв агентов, чем было известно до этого.
Исследователи разобрали публичные логи urlquery.net – это сервис, который открывает любую ссылку в удаленном браузере и публикует результат. Агенты использовали его как прокси, то есть если сайт их блокировал, они шли через urlquery.
При этом агенты не пытались специально кого-то взломать, они решали обычные задачи по поиску данных. Например, выясняли среднюю стоимость процедур для кожи и волос в Австралии. Но когда данные не отдавались, агенты начинали применять SQL-инъекции, XSS, path traversal, SSRF.
Так пострадали Австралийский институт …
Data Secrets · 24.09 15:07 · открыть в Telegram (читать целиком в Telegram)
Ни за что не догадаетесь. Австралию 🙃
Премьер-министр Австралии заявил, что агент OpenAI 18 июня получил доступ к непубличным разделам госпортала статистики Medicare, которым управляет федеральное ведомство Services Australia.
Дело в том, что агенту нужно было исследовать расходы на здравоохранение, и он обошел блокировки, чтобы найти ответы в закрытых разделах. При этом он не только читал файлы, но и зачем-то записывал их в базу.
OpenAI заявила, что агенты "совершили действия, которых они не предполагали". Инцидент произошел в июне, но в стартапе о нем узнали в августе, и расследование еще идет. Австралийские власти были уведомлены только 10 сентября, почти через три месяца после …
В программе — техно-рейв с группой ЛАУД и ток-шоу про ИИ. Встречаемся в Москве на модной площадке Альфа-Кристалле или онлайн — главное зарегистрироваться.
LLM под капотом · 24.09 12:44 · открыть в Telegram (читать целиком в Telegram)
Я сейчас возвращаюсь к сайту BitGN, чтобы начать подготовку к соревнованию ECOM2 (agentic economy), добавить место для публикации LLM бенчмарков и в целом обновить дизайн.
В этот код я давно не ходил, и он ну очень дремучий - эпохи где-то до декабря 2025 года, когда Codex расцвел. Современным стандартам AI Native разработки совсем не соответствует. Агенты спотыкаются часто (даже Astra), предлагают ерунду, прямо за ручку надо держать.
А потом я восстановил хронологию и сильно удивился.
Я же ушел из TimeToAct в феврале этого года, чтобы начать делать платформу для бенчмарков агентов. Этой весной мы с COLIBRIX провели два соревнования, с тех пор 2.8M задач выполнено агентами на платформе. …
Data Secrets · 24.09 12:32 · открыть в Telegram (читать целиком в Telegram)
Вчера Anthropic объявили, что создали собственную биолабораторию и исследовательскую группу: люди совместно с Claude занимаются фундаментальной биологией с целью попытаться поставить научные открытия на поток.
И у этой лаборатории уже появился первый крупный результат.
Возможно, многие слышали про CRISPR. Это природная иммунная система бактерий. Они хранят в ДНК кусочки вирусов-агрессоров и с помощью белка Cas9 находят и разрезают их ДНК при повторной атаке. Люди научились программировать этот механизм под любую ДНК, и сейчас это главный инструмент редактирования генов.
В 2020 году за обнаружение CRISPR дали Нобелевку, и сейчас Claude, кажется, нашел нечто подобное у бактериофагов. …
Чёрный Треугольник · 24.09 10:30 · открыть в Telegram (читать целиком в Telegram)
Трое исследователей посадили языковые модели за руль настоящей Toyota Corolla и прогнали их по трассе из конусов на пустой парковке.🤖
Руль и педали модели крутили через устройство comma four с открытым openpilot, а дорогу видели только по снимкам с камеры.
☝🏻Трассу до конца прошла только GPT-6 Astra, и то со второй попытки: 134,7 метра за 5 минут 22 секунды, это примерно 1,5 км/ч.🤷🏼♀️
Остальные участники сошли с дистанции:
🔻 GPT-5.6 Sol и Grok 4.6 чаще всего вылетали на первом же повороте
🔻 Claude Fable 5.1 в лучшей попытке доехал до середины, а в одном из заездов 159 секунд из 190 просто «думал»
Главная проблема — зрение: модели путали, с какой стороны от диагональной линии конусов …
GPT-6 Astra, Claude Fable 5.1 и Grok 4.6 подключили к Toyota Corolla и дали управление рулем, газом и тормозом.
Каждой модели предоставили до трех попыток пройти трассу. Полностью справилась только GPT-6 Astra.
В первый раз Astra прошла 49% маршрута. Затем модели предложили разобрать свои ошибки, после чего она проехала трассу целиком.
https://drivingbench.com/
Чёрный Треугольник · 23.09 21:42 · открыть в Telegram (читать целиком в Telegram)
YouTube анонсировал Custom Feeds — ленты, которые собираются по вашему текстовому описанию, а не только по истории просмотров.🤖
Пишете в строку запроса, что хотите смотреть: например, «видеоподкасты на 30 минут дороги» или «длинные документалки, чтобы расслабиться вечером».
Под капотом работает Gemini.
Что умеет функция:
🔻 понимает длинные и подробные запросы: что показывать, что исключать и что ставить в приоритет
🔻 позволяет создать несколько лент под разные настроения и привычки
🔻 закрепляет каждую ленту отдельной вкладкой на главной странице
☝🏻Подбирать есть из чего: по словам YouTube, на платформе более 20 миллиардов видео.🤯
Сначала функция заработает только в США — в браузере, …
В субботу мы побывали на Practical ML Conf от Яндекса. Это техническая ML-конференция для инженеров, которую компания проводит в этом году уже четвертый раз.
Пока участники слушали доклады и общались, нам удалось поговорить с Петром Ермаковым, ML Вrand Director в Яндексе. Петр рассказал нам, как изменилась конференция за четыре года, о каких проектах и научно-технических трендах спикеры рассказывают со сцены в этот раз, и почему живые доклады и кулуарные разговоры все еще так важны для сообщества.
Смотрите, как это было ⬆️
Нет, у нас есть Jev дома
Jev дома:
Мэтт Мастраччи, контрибьютор vLLM, взял DiffusionGemma 26B от Google и заставил ее работать по той же схеме, причем без дообучения модели.
Вместо генерации текста задается шаблон ответа, а после одного шага denoising из логитов сразу достаются ответы и их вероятности. Поддерживаются yes/no, multiple-choice и scoring вопросы.
Теперь этот режим добавили в vLLM. По первым тестам качество близко к оригинальному Jev, а в NVFP4 модель можно поднять на одной GPU с 24 ГБ памяти.
https://github.com/taeold/djev-run
Чёрный Треугольник · 23.09 17:18 · открыть в Telegram (читать целиком в Telegram)
Китайская коммерческая ракета Kinetica-1 компании CAS Space вывела на орбиту девять спутников. Среди них первый в Китае спутник для ИИ-вычислений.🚀
«Суперкомпьютер-1» — его сделала компания S-AIDC, которая строит ИИ-инфраструктуру.
На борту две главные вещи:
🔻 оптическая камера высокого разрешения
🔻 ИИ-компьютер для обработки снимков
☝🏻Снимки обрабатываются прямо в космосе, и сырые данные больше не нужно гнать в наземные дата-центры. Это должно сократить обработку с часов до минут.⚡️
Такие спутники могут сами находить на снимках пожары, наводнения, штормы или корабли и отправлять на Землю только результат.🛰
Запуск входит в большую госпрограмму. В июне Пекин одобрил центр космических …
Чёрный Треугольник · 23.09 15:15 · открыть в Telegram (читать целиком в Telegram)
Токийский стартап MW показал MW Living Home — жильё, где архитектура, ИИ и робот-домработница проектируются как единое целое.🤖
Устройство дома авторы сравнивают с человеком:
🔻 «органы чувств» — встроенные в здание датчики
🔻 «мозг» — ИИ MW Intelligence, который анализирует обстановку и постоянно учится
🔻 «тело» — робот MW bot, который берёт на себя уборку и стирку
☝🏻Ставка не на гуманоида: в тесном японском жилье ему сложно работать безопасно, поэтому дом подгоняют под робота, а не наоборот.🤔
Прототип раньше видели только на фото, а на презентации в Токио его привезли вместе с экспериментальным домом-трейлером и показали за работой вживую.
Целевая аудитория — семьи, где работают оба …
Data Secrets · 23.09 15:04 · открыть в Telegram (читать целиком в Telegram)
В интервью CEO Yandex Cloud хорошо подсветили несколько трендов, которые сейчас определяют развитие российского ML-рынка. Один из самых интересных здесь про экономику инференса.
Стоимость токена за последние годы упала примерно в 6 раз, но вместо падения рынка это приводит к росту потребления. Чем дешевле инференс, тем больше данных становится экономически выгодно прогонять через модели и тем больше процессов можно автоматизировать. Получается цикл: дешевле токены → больше потребление → больше оптимизаций → еще дешевле токены.
При этом само железо дешевле не становится. Стоимость инфраструктуры растет в 2–5 раз, поэтому вокруг AI постепенно формируется отдельный инфраструктурный слой со …
Data Secrets · 23.09 10:22 · открыть в Telegram (читать целиком в Telegram)
Поиск кратчайшего пути – классическая проблема теории графов, на решении которой основываются навигаторы, роутинг в интернете, логистика и куча других задач современного мира. В 1959 году нидерландский информатик Эдсгер Дейкстра предложил для поиска кратчайшего пути алгоритм O(m + n log n), который следующие 65 лет оставался золотым стандартом и использовался буквально везде.
В 2025-м команда из Цинхуа, Стэнфорда и Института Макса Планка впервые обошла его с оценкой O(m log^{2/3} n). Однако выигрыш их решения раскрывается только на достаточно плотных графах (число ребер m ≥ числа вершин n). На разреженных графах Дейкстра все еще был лучше.
Vals AI решили потестировать новый Opus 5.5 …