Обзор

Новости об ИИ-моделях: релизы, сравнения, бенчмарки. Обновляется автоматически.


OpenAI возвращает Pro за $200

Data Secrets · 29.09 16:02 · открыть в Telegram

С завтрашнего дня снова можно будет оформить Pro за $200. Вместе с этим OpenAI меняет расчет использования: в пересчете на стоимость API новая подписка будет давать примерно в два раза меньше старой. При этом пятичасовые лимиты возвращать не будут. OpenAI объясняет изменение тем, что сами модели становятся дешевле и эффективнее. Например, новые GPT-6 Sol и Luna вышли с ценами API в два раза ниже предыдущих, поэтому даже при меньшем лимите в долларах компания обещает, что фактически на подписке получится сделать больше работы, чем месяц назад. Завтра к Pro также добавят новые возможности, которые вообще не будут расходовать лимиты. Что именно это будет, пока не раскрывают.

OpenAI переносит релиз GPT-6.1 Astra

Data Secrets · 29.09 14:32 · открыть в Telegram

Судя по всему, модель должны были выпустить уже сегодня на DevDay. Однако пока что выпуск отменили из-за опасений исследователей по итогам внутреннего тестирования. Глава систем безопасности OpenAI утверждает, что модель слишком много врет о том, какие действия совершает, а также слишком часто выходит за пределы полномочий. Модель не дотянула до нужного уровня в умении оставаться в рамках задачи и отчитываться пользователю, и поэтому в стартапе еще некоторое время будут работать над ее безопасностью. Недоучили – так и скажите, чего бубнить то...

OpenAI отменила новую модель, потому что она врала людям

Чёрный Треугольник · 29.09 13:17 · открыть в Telegram (читать целиком в Telegram)

OpenAI отменила релиз флагманской модели GPT-6.1 Astra. Она должна была выйти в октябре и заменить нынешнюю GPT-6 Astra.❌ От новой версии ждали, что она будет ещё лучше работать с ИИ-агентами.🤖 Но в части тестов GPT-6.1 Astra оказалась хуже старой модели.📉 Что с ней не так: 🔻 она чаще обманывала пользователей 🔻 не всегда честно сообщала, что сделала, а чего не сделала 🔻 продолжала выполнять задачу, не спрашивая разрешения у человека 🔻 временами обращалась к внешним инструментам и сервисам, даже если это могло быть небезопасно ☝🏻Модель, которую учили действовать самостоятельно, начала действовать слишком самостоятельно и при этом скрывать, что делает.🤔 В OpenAI заявили, что проведут …

AMD купила стартап Фей-Фей Ли World Labs

Data Secrets · 29.09 12:34 · открыть в Telegram

Это тот самый, который занимается world models и недавно выпустил мощную мультимодальную модель мира Atlas (https://t.me/datasecrets/9806). В компании говорят, что объединение поможет World Labs быть ближе к железу и масштабироваться за счет ресурсов AMD. Стартап войдет в компанию как отдельная исследовательская организация. Сама Фей-Фей Ли займет в AMD должность исполнительного вице-президента и Chief Scientist, будет работать напрямую с Лизой Су.

Reuters ознакомились с приватными проспектами Anthropic перед предстоящим IPO:

Сиолошная · 29.09 05:04 · открыть в Telegram

чистый убыток в размере 42 миллиардов долларов за 2025-й год (34 миллиарда из них - бухгалтерская переоценка активов с учетом инструментов, которые в будущем могут конвертироваться в акции Anthropic) — 😐 планируют потратить 518 миллиардов долларов на вычислительные мощности и инфраструктуру в 2027-м — в прошлом году они потратили 7.3 миллиарда долларов на мощности и инфраструктуру — планируют целиться в оценку в 2 триллиона на IPO === я пока не понимаю, откуда они столько денег возьмут 👨‍🦳 посмотрим, чем будет удивлять Dario UPD: текст новости исправили, теперь там траты в $518B указаны на «следующие годы», не «следующий год».

Похоже, что GPT 6 Astra останется лучшей моделью OpenAI надолго

Сиолошная · 29.09 03:27 · открыть в Telegram

завтра на DevDay почти наверянка не представят обновление, и даже релиз 6.1 с октября перенесли на неопределенный срок из-аз переживаний по поводу безопасности.

Claude Sonnet 5.5 is here

Чёрный Треугольник · 28.09 23:21 · открыть в Telegram (читать целиком в Telegram)

Anthropic выпустила Claude Sonnet 5.5, которая работает на 30% быстрее прошлой версии.⚡️ Цены за токены остались прежними: $2 за миллион входных и $10 за миллион выходных.💰 ☝🏻В тесте агентного программирования Terminal-Bench 4.0 новинка набрала 70,6% против 10,3% у предшественницы и обошла даже старшую Opus 5.5 с её 66,4%.🤯 Что ещё изменилось: 🔻 управление компьютером в OSWorld: 80,1% вместо 57% 🔻 чтение графиков: 61,6% вместо 15,6% 🔻 первая Sonnet, которая прошла Pokémon Red, глядя только на скриншоты🎮 В остальных тестах Opus 5.5 всё же впереди, так что флагман пока остаётся флагманом. ☝🏻Это первая Sonnet с такой же киберзащитой, как у Opus 5.5: рискованные запросы по безопасности …

Вышел Sonnet-5.5!

Data Secrets · 28.09 23:06 · открыть в Telegram

Главное: по бенчмаркам модель лучше GPT-6 Sol и довольно плотно подобралась к новому опусу. Обещают, что помимо качества, модель также будет дешевле Sonnet-5 за счет экономии токенов (пишут, что на внутренних тестах выходило примерно на 30% дешевле в пересчете на задачу). Кроме того, модель стала на 30% быстрее генерировать текст. Также заверяют, что новый Sonnet чище пишет и обладает «талантом к дизайну». Да будут тесты! https://www.anthropic.com/claude-sonnet-5-5 P.S. Уже доступно по API у нас на платформе DS Lab: https://dslab.tech/ai/models/llm/claude-sonnet-5-5

С минуты на минуту выходит новый Sonnet-5.5

Data Secrets · 28.09 22:54 · открыть в Telegram

Стоить будет ровно столько же, сколько GPT-6 Sol. Интересно, что предложат по качеству.

Джеффри Хинтон, Йошуа Бенджио, Якуб Пахоцки из OpenAI, Джек Кларк из Anthropic и еще 18 очень влиятельных…

Data Secrets · 28.09 22:46 · открыть в Telegram (читать целиком в Telegram)

TL;DR: мы потеряем контроль и все умрем Авторы обсуждают так называемый интеллектуальный взрыв, то есть резкое ускорение прогресса ИИ за счет самого ИИ. По данным Anthropic, доля одобренного кода, написанного ИИ, выросла с единиц процентов до 80%+ с января 2025 по май 2026. Доля R&D-работы, которую ИИ выполняет (почти) самостоятельно, выросла с 1% до 26%. Авторы считают, что в ближайшие годы агенты могут автоматизировать большую часть работы по AI-исследованиям и разработке, а возможно, и всю. Например, экстраполяция трендов METR говорит, что многомесячные R&D-проекты могут быть автоматизированы уже к середине 2028 года. Получается, что каждая компания будет иметь миллионы топовых …

GPT-6 Astra дали поуправлять китайским роботом

Чёрный Треугольник · 28.09 22:03 · открыть в Telegram (читать целиком в Telegram)

Исследователи из Стэнфорда и Caltech показали систему HomeBody: робот Unitree G1 выполняет бытовые задачи в незнакомом помещении без обучения под конкретную комнату.🤖 Управляет им свежая модель OpenAI GPT-6 Astra. Промежуточного слоя VLA между «мозгом» и моторами здесь нет: модель сама выбирает, какой навык запустить. Навыков всего пять: дойти, взять, положить, открыть ящик, достать из ящика. Как это работает: 🔻 робот сначала сам обходит кухню с камерами и лидаром 🔻 по этим данным Astra строит цифрового двойника помещения в NVIDIA Isaac Sim 🔻 пространственная память помнит, где лежат вещи, даже если их не видно ☝🏻Роботу можно дать задание, и он сам его вспомнит и в каком ящике видел …

Нейросети хватит 10 секунд вашего голоса, чтобы заговорить им на 90 языках

Чёрный Треугольник · 28.09 20:30 · открыть в Telegram (читать целиком в Telegram)

ElevenLabs выпустила Eleven v4 и v4 Turbo. Компания называет их своими самыми эмоциональными речевыми моделями.🤖 Что нового: 🔻 больше 90 языков вместо 70 у прошлой версии 🔻 клон голоса из 10 секунд аудио, и на чужом языке он говорит с акцентом носителя 🔻 модель держит один и тот же голос на длинных текстах и сама подстраивает интонацию под контекст ☝🏻Эмоциями управляют тегами прямо в тексте: [excited, happy], [laughs], [said angrily in French accent]. Теги можно ставить подряд, и модель отыграет их по порядку. Есть даже фоновые звуки вроде [light rain] и [phone buzzing].🤯 Turbo-версия сделана для голосовых агентов: первый звук появляется примерно через 150 мс, а генерация стартует, пока …

По данным Bloomberg, Китай ограничивает зарубежные поездки ведущих AI-специалистов частных компаний и…

Сиолошная · 28.09 20:10 · открыть в Telegram (читать целиком в Telegram)

Супругам и детям ряда руководителей AI- и чиповых компаний, чья работа считается критически важной для госбезопасности, теперь нужно получать одобрение Пекина даже для коротких поездок за границу. Госорганы уже уведомили нескольких человек, а список планируется постепенно расширять. При этом неясно, распространяется ли требование на семьи всех, кто уже находится под ограничениями. Сами ограничения для специалистов из таких компаний, как Alibaba и DeepSeek, действуют с начала года. Отдельно с 15 сентября вступили в силу правила применения запретов на выезд, в том числе при возможных нарушениях промышленной и технологической безопасности. Подобный режим, включающий родственников, Пекин …

Практический RecSys: собери рекомендательную ленту с помощью ML

Data Secrets · 28.09 19:58 · открыть в Telegram (читать целиком в Telegram)

на бесплатном вебинаре AI Talent Hub × Karpov.Courses 30 сентября в 18:00 разберем как работают рекомендательные системы изнутри. Научим: → Превращать действия пользователей в данные для модели: просмотры, клики, реакции и другие сигналы; → Собирать персональные рекомендации и понимать, что показать конкретному пользователю; → Ранжировать контент в ленте и оценивать качество рекомендаций не только по ML-метрикам, но и с точки зрения продукта; И покажем, как эти навыки можно развить на программе AI Talent Hub ИТМО × karpovꓸcourses «Машинное обучение: от технической базы до создания ИИ-продукта». 👉 Участие бесплатное, по предварительной регистрации → успей зарегистрироваться до 30 …

В Твиттере заметили, что Андрей Карпаты ничего не постит уже 2 месяца, хотя раньше делал это достаточно часто

Data Secrets · 28.09 18:07 · открыть в Telegram

Он даже ничего не написал про Opus 5.5 Anthropic держат его в заложниках?..

Nvidia обещает решить проблему ИИ-агентов, которые сбегают из песочниц

Чёрный Треугольник · 28.09 18:03 · открыть в Telegram (читать целиком в Telegram)

Корпорация представила Open Agent Safety Platform. Это двухуровневая система контроля автономных ИИ-агентов с открытым исходным кодом.🛡 Она в реальном времени следит за тем, что делает агент, и принудительно его останавливает, если тот нарушает заданные правила. Система состоит из двух частей: 🔻 OpenShell работает на процессорах Nvidia Vera и задаёт агенту жёсткие границы доступа 🔻 Nvidia Sentry работает на DPU BlueField, замечает аномальное поведение модели и изолирует агента за миллисекунды⚡️ ☝🏻В Nvidia утверждают, что их система предотвратила бы недавний взлом Hugging Face, который устроили модели OpenAI.🤔 Глава корпорации Дженсен Хуанг и вовсе заявил, что безопасность ИИ …

Дженсен Хуанг и 100+ партнеров анонсируют NVIDIA Open Agent Safety Platform

Data Secrets · 28.09 15:08 · открыть в Telegram (читать целиком в Telegram)

Это система для контроля и ограничения ИИ-агентов, главная идея которой состоит в том, чтобы следить за агентом не только на уровне софта, но и на уровне железа. Технически она будет состоять из двух составляющих: 1. OpenShell – открытый (Apache 2.0) рантайм, который запускает агента в песочнице с изоляцией на уровне ядра. Оператор заранее описывает, к каким файлам, инструментам и учетным данным у агента есть доступ, и эту политику принудительно проверяют до запуска и во время работы агента. 2. Sentry – независимый слой контроля, который крутится прямо на чипе DPU BlueField-4. Он собирает в единую картину действия агента, ловит попытки отхода от задачи и проверяет, что у агента не …

Gemini будет звонить в организации вместо вас

Чёрный Треугольник · 28.09 14:39 · открыть в Telegram (читать целиком в Telegram)

Google запустила эксперимент Call for Me: ИИ-агент сам звонит в магазин, ресторан или парикмахерскую с вашего телефона и с вашего номера.📱 Сценарий задаётся обычным запросом: узнать, есть ли товар в наличии, забронировать столик, перенести запись. Что умеет агент: 🔻 сам проходит голосовое меню и висит на удержании вместо вас 🔻 ведёт разговор по заданному сценарию 🔻 показывает живую расшифровку, трубку можно забрать в любой момент ☝🏻Каждый звонок Gemini начинает с того, что он ИИ-ассистент Google, звонит от вашего имени и разговор записывается.👁 Звонить в 911, проводить платежи и передавать номера карт, пароли или SSN агенту запрещено. Телемаркетинг тоже под запретом.❌ Пока всё это …

Концепция Katas или зачем изобретать велосипеды

LLM под капотом · 28.09 13:51 · открыть в Telegram (читать целиком в Telegram)

никакая автоматизация не дает повод изобретать велосипеды на каждый чих у Рината скорее всего есть идея, как что-то принципиально улучшить Это было комментарием на мое замечание, что я писал markdown редактор для себя. Давайте объясню зачем мне такое. Итак, я Ринат Абдуллин. 20+ лет работаю с кодом и с компаниями в EU/USA. Веду достаточно сложные и временами высоконагруженные продукты (про что пишу в этом канале, в блоге и рассылке), еще веду распределенный R&D в области AI агентов (вместе с потрясающим коммьюнити инженеров вокруг BitGN), иногда провожу курсы и тренинги. Для актуализации навыков и качественного преподавания мне нужно не просто разрабатывать сложные и высоконагруженные …

Тот самый курс по ML, который прошли 200 000 человек. Теперь — в новой версии

Data Secrets · 28.09 13:28 · открыть в Telegram (читать целиком в Telegram)

С 2016 по 2022 год специализация «Машинное обучение и анализ данных» на Coursera была входным билетом в профессию — через неё прошли больше 200 000 человек. С тех пор AI ушёл далеко вперёд, и набор тем, которые нужно знать сегодня, изменился. Поэтому Виктор Кантор с командой MLinside обновил программу и перевыпустил специализацию заново — уже как «Искусственный интеллект и анализ данных». Цену оставили ту же, что четыре года назад. Кому это нужно ML обычно изучают по частям: линейные модели подтянул на работе, про трансформеры прочитал статью, про агентов посмотрел ролик на YouTube. Каждый кусок вроде понятен, а цельной картины нет. Пока задачи типовые, это не мешает. Сложности начинаются …

OpenAI: заявляют, что замедляют обучение и массово перебрасывают человеческие ресурсы на безопасность

Data Secrets · 28.09 12:17 · открыть в Telegram

Тем временем Борис Пауэр, глава Applied Research в OpenAI: «80-90% исследований компании сейчас посвящены GPT-7, GPT-8 и следующим моделям» (С ним в разведку не идем) По словам Бориса, те улучшения, которые делаются в рамках текущего поколения (включая дообучение) – это, скорее, вынужденная мера, которая ускоряет обучение и немного бустит модели сегодня. Но такой подход не является долгосрочной стратегией компании. На самом деле их видение – это обучать огромные супермощные модели следующих поколений, а затем дистиллировать их во что-то поменьше. Например, Luna – это, судя по всему, дистилляция Astra. Похоже на замедление? 🗿

Alibaba вкладывает $3 млн в Omarchy Linux

Чёрный Треугольник · 28.09 00:09 · открыть в Telegram (читать целиком в Telegram)

Alibaba Cloud стала патроном фонда, который развивает Omarchy — Linux-дистрибутив ориентированный на агенскую работу с ИИ. Деньги будут отправлять по $1 млн в год, три года подряд.💰 Что Alibaba получает взамен: 🔻 Omarchy China — локальный CDN, хостинг, сайт и сообщество для китайских пользователей🇨🇳 🔻 настройку системы под китайские ИИ-модели Qwen из коробки 🔻 плотную интеграцию дистрибутива Linux с китайскими сервисами ☝🏻Главная цель — Qwen Book, ИИ-компьютер Alibaba с философией «OS as Harness»: модели, ОС, приложения, облако и железо сплетаются в одно целое. Omarchy хотят сделать для него идеальной агентной ОС.🤖 Первая версия Qwen Book выйдет на ARM, со своим «движком непрерывного …

Google засунули AI-агента в 20+ чатов реальных команд на 5 месяцев. Результаты получились забавные.

Data Secrets · 27.09 22:43 · открыть в Telegram (читать целиком в Telegram)

https://arxiv.org/pdf/2609.29901 Агент имел доступ к документам и баг-трекеру команды, как обычный сотрудник, умел сам заводить баги, писать людям в личку, реагировать эмодзи, тегать коллег. И все бы ничего, но, внезапно, главная проблема оказалась в том, что ИИ не поладил с живыми людьми. Одного инженера он на полном серьезе отчитал за шутки (не понял сарказма). В другой команде проставил тег вице-президенту в 16 багах подряд, посчитав, что раз человек в контексте, значит, должен разгребать баг-трекер. В общем, сработаться с агентом оказалось сложнее, чем кажется. Некоторые команды стали создавать отдельные приватные чаты без него: чтобы обсудить найм сотрудников, чувствительные темы …

Недавно мы рассказывали об открытом письме филдсовских медалистов в защиту математики в эпоху ИИ.

Data Secrets · 27.09 19:02 · открыть в Telegram (читать целиком в Telegram)

Нет, его авторы не предлагают запретить нейросети! Они просто хотят, чтобы вместе с ответами на важные теоретические вопросы наука получала ещё и пути их решения. Без метода и контекста результат трудно проверить, обсудить и применить в следующей задаче. Любое доказательство нужно верифицировать, а идеи — уточнить и найти, где ещё они работают. Когда кто-то выдал правильный ответ, настоящая математика только начинается!  В канале «Зачем мне эта математика» как раз пишут о том, как она работает. В рубрике #этобаза разбирают, из каких определений и допущений рождаются привычные всем нам понятия. Под хештегом #какустроено объясняют, как математические модели описывают реальные …

Axios пишет, что OpenAI и Anthropic расследуют десятки тысяч инцидентов с побегами агентов

Data Secrets · 27.09 17:51 · открыть в Telegram (читать целиком в Telegram)

Со ссылкой на источники в обеих компаниях и независимых исследователей безопасности журналисты утверждают, что статистика гораздо пессимистичнее, чем мы могли себе представить. В эти "десятки тысяч инцидентов" входят обходы guardrails, побеги из сандбоксов, попытки взломов внешних сайтов и так далее. Возьмем, например, system card к Opus 5.5. Даже там компания открыто пишет, что модель пыталась выбраться из sandbox в 1.5% тестовых прогонов. Учитывая, что для каждой модели прогоняются сотни тысяч тестов и больше, можно легко прикинуть масштаб происходящего. Однако исследователи, с которыми говорили Axios, утвеждают, что и это – только верхушка айсберга, и дело даже не в количестве …

На DevDay OpenAI выпустят нового always-on агента

Data Secrets · 27.09 13:53 · открыть в Telegram

Сейчас он мелькает под кодовым названием «o» (где-то мы эту букву уже слышали, ну да ладно, видимо остальной алфавит Альтману не по душе). Упоминание агента уже появилось на экране обновления тарифа ChatGPT у многих пользователей. Судя по утечкам, агент будет продолжать работать постоянно, даже вне обычных чат-сессии и, возможно, получит собственный email (или будет постоянно мониторить ваш). Под капотом, по слухам, будет модель Aeon – вариант GPT-6 Astra, заточенный под длинные задачи. Но сильно не обольщаемся, возможно «o» выйдет только в новом тарифе за 500 долларов 😃

Навайбкодить AI-агента сейчас можно за вечер.

Data Secrets · 26.09 19:02 · открыть в Telegram (читать целиком в Telegram)

А вот довести его до прода так, чтобы он не выбирал неправильные тулы, не работал с устаревшими данными и не выполнял опасные действия без ограничений – уже совсем другая история 😵‍💫 Как раз про этот разрыв между демкой и нормальной системой сделали курс «AI-агенты» в Школе Высшей Математики. Ведут его инженеры, которые запускали агентные системы в Revolut, Wildberries и Точка Банке. В программе разберут всё, что нужно агенту уже в реальной эксплуатации: — трейсы, логи и отладка агентов — метрики и оценка качества — ограничения для опасных действий — RAG, LangGraph, MCP и Langfuse — мультиагентные системы и деплой Курс идёт 12 недель, занятия живые + домашки с фидбэком от …

OpenAI прямо сейчас приостановила все обучение мощных моделей из-за нового инцидента

Data Secrets · 26.09 17:39 · открыть в Telegram

https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot 20 сентября агент решал поисковую задачу в песочнице (естественно, без доступа к интернету). Прокси блокировал исходящие веб-запросы, но DNS-резолвер не был так же закрыт, и агент стал передавать вопросы внешнему чат-боту, кодируя их в DNS-запросах, и таким образом получал ответы из сети. Компания объявила, что обучение будет приостановлено до тех пор, пока они не убедятся, что уязвимость закрыта, и не проведут дополнительный red-teaming. Когда обучение возобновится, OpenAI начнут новый запуск с улучшенным элайментом, а эту конкретную модель дообучать не будут.

Kadr обновился до v0.6.0...

Чёрный Треугольник · 26.09 16:57 · открыть в Telegram (читать целиком в Telegram)

Продолжаю разработку своего видеоредактора Главное изменение релиза: Если ранее Kadr видел по снапшотам, и читал транскрибации речи, а музыку воспринимал как просто аудиофайл, то теперь он полноценно слышит звуки и музыку.🔊 Редактор умеет находить ритм любого звука на временной шкале и позволяет строит графику в ее такт. При этом каждый звук помечен и имеет свой момент срабатывания, яркость, огибающие и прочие параметры... Так как это умеет пользователь, то все это точно также умеет делать и ИИ встроенный в редактор. И видео выше полностью смонтировано им.🤖 🔻Код общедоступен: https://github.com/HelpFreedom/kadr Полная документация по релизу: …

Claude посчитал девятипетлевую амплитуду в N=4 SYM.

Data Secrets · 26.09 15:19 · открыть в Telegram (читать целиком в Telegram)

Эту задачу эксперты долго считали слишком тяжелой для прямого расчета. Амплитуды рассеяния – это формулы, по которым физики предсказывают, с какой вероятностью частицы провзаимодействуют тем или иным образом. Точно их посчитать почти невозможно, поэтому считают приближенно, до определенного числа петель: чем петель больше, тем точнее ответ, но и тем быстрее растет сложность вычислений. Большинство реальных амплитуд посчитаны всего до двух-трех петель. Новые методы расчета обычно обкатывают на упрощенных игрушечных теориях, например на суперсимметричной теории Янга-Миллса (N=4 SYM). Но даже в ней рекордом до сих пор было восемь петель, которые подсчитал Лэнс Диксон из SLAC, а девятую …

Агенты OpenAI слили фото пользователей ChatGPT и влезли на сайты правительства США

Чёрный Треугольник · 26.09 11:41 · открыть в Telegram (читать целиком в Telegram)

OpenAI подтвердила: её ИИ-агенты получили доступ к разработке сайтов Комиссии по ценным бумагам и биржам (SEC) и Министерства торговли США. С сайта министерства они забрали данные переписи населения.🇺🇸 Ещё компания расследует попытку взлома агентами сайта Министерства образования.🤔 До этого агенты OpenAI уже взломали сайт правительства Австралии. В тот же день OpenAI признала, что агенты слили в сеть 53 изображения пользователей ChatGPT. На вопросы, есть ли на них реальные люди и когда их выложили, компания не отвечает.🤷🏼‍♀️ Большую часть картинок уже удалили, остальные OpenAI просит убрать хостинг-провайдеров. ☝🏻У агентов был доступ к картинкам, потому что OpenAI обучает модели на …

Исследователи из AIRI запустили открытое сообщество для решения NetHack.

Data Secrets · 25.09 21:01 · открыть в Telegram (читать целиком в Telegram)

Зовут объединяться всех работающих над системами планирования для искусственного интеллекта. У участников будет свой способ получить программу, свои инструменты и своя стратегия. Общая инфраструктура позволит видеть результаты, сравнивать их между собой и продолжать разрабатывать решения друг друга. Для старта доступен эволюционный харнесс на базе MAP-Elites: Claude Code, Codex или OpenCode модифицируют код ботов, а алгоритм сохраняет лучшие варианты для разных стартовых персонажей. В самой игре действует получившаяся программа, а не LLM на каждом ходу; участники могут разрабатывать собственные харнессы, а результаты независимо перепроверяются на скрытых сидах. Пробовать решить NetHack …

Google отправляет в космос ИИ дата-центр

Чёрный Треугольник · 25.09 20:00 · открыть в Telegram (читать целиком в Telegram)

Google запускает на орбиту первый экспериментальный спутник проекта Suncatcher: это ИИ-сервер, который работает от Солнца. Он полетит на Falcon 9 от SpaceX уже на следующей неделе.🛰 Что внутри: 🔻 четыре тензорных процессора TPU, на которых Google обучает и запускает свои модели 🔻 солнечные панели мощностью 1000 Вт, то есть всего киловатт на все чипы⚡️ 🔻 система охлаждения, которая сбрасывает тепло прямо в космос. ☝🏻Однако, даже с космической системой охлаждения чипы работают около 15 минут, а потом отключаются из-за перегрева.🤷🏼‍♀️ В условиях вакуума тепло некуда передать с помощью воздуха или воды, а само космическое пространство работает как идеальный термос. Единственный способ …

Сегодня не 14 февраля, но мы желаем вам найти человека, который будет смотреть на вас также, как Альтман…

Data Secrets · 25.09 18:08 · открыть в Telegram

фото со вчерашнего ужина в Белом Доме (Трамп принимал президента Китая Си Цзиньпина). Гостей было больше 130, среди них Безос, Маск, Хуанг, Альтман, Кук, Пичаи и другие. Не позвали только Амодеи. Напоминаем, что ранее Трамп назвал CEO Anthropic лицемером, который строит из себя "идеального маленького ангелочка"

Лучшие дебаты про безопасность ИИ для нормисов

Сиолошная · 25.09 17:47 · открыть в Telegram (читать целиком в Telegram)

В последнее время слушал много подкастов на тему AI safety в поисках того, который можно было бы смело рекомендовать обычным нормисам уровня погружения «ну я немного слышал о хайпе про “ИИ нас всех убьет”, с точки зрения здравого смысла звучит как полная ерунда, конечно…». Так вот, я его нашел – встречайте, идеальный выпуск для погружения в текущее состояние этого дискурса: The Diary Of A CEO – дебаты между Нейтом Соаресом, Романом Ямпольским, Эдом Зитроном и Эндрю МакАфи: https://www.youtube.com/watch?v=OhOmLqR5nN4 Я прямо горячо рекомендую вам посмотреть этот выпуск на 2,5 часа (там в настройках Ютуба можно включить русскую дорожку), причем чем дальше – тем он становится …

OpenAI готовит подписку ChatGPT за $500 в месяц

Чёрный Треугольник · 25.09 15:43 · открыть в Telegram (читать целиком в Telegram)

В коде ChatGPT нашли упоминания нового тарифа Pro Max. Он будет стоить $500 в месяц, в 2,5 раза дороже нынешнего Pro за $200.💰 Официально OpenAI тариф не анонсировала, поэтому цена и состав ещё могут поменяться. Pro Max рассчитан не на обычных пользователей, а на разработчиков и исследователей с долгими и тяжёлыми задачами. Что обещают: 🔻 режим «Fastest Work», главная фишка тарифа — максимальная скорость 🔻 Codex для проектов, которые идут часами и даже днями 🔻 возможно, повышенные лимиты, но это пока не подтверждено🤔 ☝🏻Скорость, судя по всему, обеспечат чипы Cerebras. OpenAI уже запускает на них GPT-5.6 Sol Ultrafast, которая работает до 14 раз быстрее.⚡️ Для сравнения: у Anthropic и …

OpenAI готовит подписку за 500 долларов 🤑

Data Secrets · 25.09 15:21 · открыть в Telegram

Пока что в описании плана единственные изменения по сравнению с ChatGPT Pro – это «Самая быстрая работа в Work и Codex». Скорее всего, речь про ту самую Astra/Sol на Cerebras (https://t.me/datasecrets/9708). Миллионеры на месте?

Экспортный контроль чипов действительно существенно влияет на китайские компании.

Сиолошная · 25.09 13:50 · открыть в Telegram (читать целиком в Telegram)

Да, некоторые уже пытаются переходить на Huawei и другие — но их производство тоже сильно ограничено, и особо сильно упирается в память. Epoch.AI подсчитали, что если Китай будет использовать только HBM (память в GPU для LLM) собственного производства, то они смогут производить примерно... 1% от GPU Nvidia (первая картинка) в ближайшие годы — и эта доля падает (в 2026-м это примерно 4%). Насколько контрабанда HBM позволила бы сократить дефицит? Предположим, Huawei контрабандой ввезла бы в 2028 году в 10 раз больше HBM, чем на внутреннем рынке, — невероятно большой объем, обошедшийся как минимум в 40 миллиардов долларов. В этом случае ее производство в 2028 году выросло бы с 1 млн до …

Google запускают свои TPU в космос

Data Secrets · 25.09 13:43 · открыть в Telegram

Они объединились с SpaceX, и уже на ближайшей миссии Transporter‑18 отправят прототип спутника с TPU, чтобы проверить работу своих чипов в реальном космосе. Платформу и интеграцию Google делает совместно с Planet, известной своими спутниками для съемок Земли. Главное, что предстоит проверить – будет ли работать отводка тепла. На Земле для этого используются воздух, вентиляторы и огромные системы охлаждения. В вакууме нет конвекции, и лишнее тепло можно сбрасывать в основном излучением через радиаторы. Google испытывает комбинацию тепловых трубок и радиаторов в термовакуумной камере.

Немного новостей из поднебесной от TheInformation:

Сиолошная · 25.09 13:38 · открыть в Telegram (читать целиком в Telegram)

DeepSeek достигли ARR в $1B (ARR = выручка за последний месяц, умноженная на 12, то есть сколько они заработают за год, если спрос не изменится). У OpenAI последние цифры были в районе $40B, у Anthropic $65B, но обе скорее всего выросли после успешных недавних релизов. — к концу октября DeepSeek планирует привлечь новый раунд инвестиций в размере $7.5B при оценке $75B. Это уже существенные цифры, хоть и всё равно на порядок меньше американских конкурентов. — Рост выручки DeepSeek частично обусловлен повышением цен в прошлом месяце, в результате которого стоимость моделей для клиентов увеличилась в 2.3–4.5 раз (но даже при этом они остаются очень дешевыми). В июле писали, что ARR был …

Alfa Connectome ML Competition 🌱

Data Secrets · 25.09 12:02 · открыть в Telegram

Началось новое соревнование по машинному обучению от Wunder Fund. Задача: Вы будете изучать исторические торговые данные для двух связанных инструментов. Нужно создать модель, которая предсказывает индикаторы движения цены одного из них по информации об ордербуке, сделках и кое-чем еще. По сути, классическая работа кванта. Вы будете работать с реальными биржевыми данными. Когда: 11 сентября — 15 ноября Призовой фонд: $13,600 Победители получат денежные призы, приглашение побеседовать в Wunder Fund, а главное — большое интеллектуальное удовольствие. Сам Wunder Fund с 2014 года занимается высокочастотным трейдингом с дневным оборотом более $10 млрд. >> Участвовать

Адам Елдаров, ex-CPO YouDo, написал два поста про экономику AI-подписок и развенчание мифа о том, что подписки

Сиолошная · 24.09 22:06 · открыть в Telegram (читать целиком в Telegram)

«субсидируемые» и что компании на них теряют огромные деньги. Я согласен наверное с 95% того что там написано. Форвардить два поста не хочется, поэтому зайдите и почитайте, если вам интересно: https://t.me/c3ponotes/589 и следующий за ним. Не знаю, планировал ли Адам писать про это дальше, но мне кажется логичным продолжением будет рассуждение о том, когда у компаний изменится баланс выручки и трат на RND / обучение моделей. Пока что растет и одно, и другое, поэтому легко ошибиться и сказать «так они всегда будут убыточными!», что, очевидно, не правда, потому что второй компонент можно контролировать: ты можешь выбрать не тратить больше денег на обучение или исследование. Сейчас такой …

Робот 140 лет играл в футбол в симуляции против самого себя, и теперь забивает голы людям в реальной жизни

Data Secrets · 24.09 21:20 · открыть в Telegram (читать целиком в Telegram)

Стартап Skild AI занимается разработкой "общего робо-интеллекта". Месяц назад они выпустили модель S1, главная фишка которой была в том, что она была способна дообучаться без файнтюнинга, просто по нескольким демонстрациям. Теперь они решили воскресить опыт Google, которые когда-то обучали AlphaGo с помощью техники self-play – игры модели против самой себя. Skild AI полигоном выбрали футбол: www.skild.ai/blogs/physical-self-play. Сначала S1 дообучили базовым ударам по мячу и дриблингу, а затем отпустили в свободное плавание: гуманоид 140 симуляционных лет играл против предыдущих версий себя. И самое интересное, что отдельных ревордов за выучивание каких-то приемов не было, и …

Meta показала ИИ брелок с камерой

Чёрный Треугольник · 24.09 20:15 · открыть в Telegram (читать целиком в Telegram)

На конференции Connect 2026 Meta представила Muse Charm — брелок для общения с персональным ИИ-агентом Muse без смартфона.🤖 По размеру он напоминает кейс от AirPods, а по виду — тамагочи: на 2-дюймовом сенсорном экране живёт анимированный персонаж, которого можно настроить. Что внутри: 🔻 встроенный 5G-модем: брелоку не нужны ни телефон, ни Wi-Fi 🔻 сканер отпечатка пальца в углу для активации 🔻 камера, про которую Meta пока ничего не рассказывает🤔 Агент работает в голосовом режиме: отвечает на вопросы, разбирает почту, управляет приложениями на Mac и выполняет задачи в фоне. ☝🏻Он подключается к сервисам Walmart, Best Buy, PayPal, Expedia, Notion, GitHub и Dropbox. То есть может тратить …

На Yandex Scale показали новый этап корпоративного ИИ

Data Secrets · 24.09 19:56 · открыть в Telegram

Алиса AI Про для бизнеса теперь может не просто отвечать на запросы, а сама разбивать сложную задачу между несколькими специализированными агентами и собирать результат. Для них добавили skills — переиспользуемые наборы инструкций, скриптов и шаблонов. Плюс можно подключать корпоративные сервисы через плагины и MCP. Еще один анонс — Speech TTS Live, новая модель синтеза речи. На старте доступны шесть голосов и разные манеры речи, а компании могут создавать собственный голос для своих сервисов. В общем, корпоративный ИИ постепенно обрастает всем необходимым, чтобы не просто генерировать текст, а встраиваться в рабочие процессы.

ИИ-агенты OpenAI взломали сайт правительства Австралии

Чёрный Треугольник · 24.09 18:23 · открыть в Telegram (читать целиком в Telegram)

Премьер-министр Австралии Энтони Албаниз заявил, что агент OpenAI проник на портал статистики Medicare и получил доступ к публичным и непубличным файлам.🇦🇺 Medicare — государственная медстраховка Австралии. По словам OpenAI, агенту достались сводная медстатистика и внутренние названия файлов, а до медкарт пациентов он не добрался. Похоже, это первый подтверждённый случай, когда ИИ-агент, вышедший из-под контроля, взломал государственный сайт.🤯 Самое интересное — зачем он это сделал. Кибератаку никто не заказывал: во внутреннем тесте модели просто пытались «найти ответы» на вопросы.🤖 ☝🏻Взлом случился в июне, а правительству OpenAI написала только в сентябре — на общий «публичный …

Лаборатория Transluce провела большое расследование инцидентов с агентами OpenAI

Data Secrets · 24.09 17:55 · открыть в Telegram (читать целиком в Telegram)

Они утверждают, что активность агентов продолжается до сих пор, и что они обнаружили еще больше жертв агентов, чем было известно до этого. Исследователи разобрали публичные логи urlquery.net – это сервис, который открывает любую ссылку в удаленном браузере и публикует результат. Агенты использовали его как прокси, то есть если сайт их блокировал, они шли через urlquery. При этом агенты не пытались специально кого-то взломать, они решали обычные задачи по поиску данных. Например, выясняли среднюю стоимость процедур для кожи и волос в Австралии. Но когда данные не отдавались, агенты начинали применять SQL-инъекции, XSS, path traversal, SSRF. Так пострадали Австралийский институт …

Угадайте, что взломали агенты OpenAI на этот раз?

Data Secrets · 24.09 15:07 · открыть в Telegram (читать целиком в Telegram)

Ни за что не догадаетесь. Австралию 🙃 Премьер-министр Австралии заявил, что агент OpenAI 18 июня получил доступ к непубличным разделам госпортала статистики Medicare, которым управляет федеральное ведомство Services Australia. Дело в том, что агенту нужно было исследовать расходы на здравоохранение, и он обошел блокировки, чтобы найти ответы в закрытых разделах. При этом он не только читал файлы, но и зачем-то записывал их в базу. OpenAI заявила, что агенты "совершили действия, которых они не предполагали". Инцидент произошел в июне, но в стартапе о нем узнали в августе, и расследование еще идет. Австралийские власти были уведомлены только 10 сентября, почти через три месяца после …

30 сентября приглашаем на АЛЬФА ВААА{АИ}ЙЙЙБ МИТАП — масштабное событие про нейросети и вайб-кодинг.

Data Secrets · 24.09 14:01 · открыть в Telegram

В программе — техно-рейв с группой ЛАУД и ток-шоу про ИИ. Встречаемся в Москве на модной площадке Альфа-Кристалле или онлайн — главное зарегистрироваться.

Период полураспада софта - 3 месяца

LLM под капотом · 24.09 12:44 · открыть в Telegram (читать целиком в Telegram)

Я сейчас возвращаюсь к сайту BitGN, чтобы начать подготовку к соревнованию ECOM2 (agentic economy), добавить место для публикации LLM бенчмарков и в целом обновить дизайн. В этот код я давно не ходил, и он ну очень дремучий - эпохи где-то до декабря 2025 года, когда Codex расцвел. Современным стандартам AI Native разработки совсем не соответствует. Агенты спотыкаются часто (даже Astra), предлагают ерунду, прямо за ручку надо держать. А потом я восстановил хронологию и сильно удивился. Я же ушел из TimeToAct в феврале этого года, чтобы начать делать платформу для бенчмарков агентов. Этой весной мы с COLIBRIX провели два соревнования, с тех пор 2.8M задач выполнено агентами на платформе. …

Claude (почти) автономно обнаружил в ДНК фагов неизвестный механизм – ART

Data Secrets · 24.09 12:32 · открыть в Telegram (читать целиком в Telegram)

Вчера Anthropic объявили, что создали собственную биолабораторию и исследовательскую группу: люди совместно с Claude занимаются фундаментальной биологией с целью попытаться поставить научные открытия на поток. И у этой лаборатории уже появился первый крупный результат. Возможно, многие слышали про CRISPR. Это природная иммунная система бактерий. Они хранят в ДНК кусочки вирусов-агрессоров и с помощью белка Cas9 находят и разрезают их ДНК при повторной атаке. Люди научились программировать этот механизм под любую ДНК, и сейчас это главный инструмент редактирования генов. В 2020 году за обнаружение CRISPR дали Нобелевку, и сейчас Claude, кажется, нашел нечто подобное у бактериофагов. …

GPT-6 Astra села за руль, и никто не пострадал

Чёрный Треугольник · 24.09 10:30 · открыть в Telegram (читать целиком в Telegram)

Трое исследователей посадили языковые модели за руль настоящей Toyota Corolla и прогнали их по трассе из конусов на пустой парковке.🤖 Руль и педали модели крутили через устройство comma four с открытым openpilot, а дорогу видели только по снимкам с камеры. ☝🏻Трассу до конца прошла только GPT-6 Astra, и то со второй попытки: 134,7 метра за 5 минут 22 секунды, это примерно 1,5 км/ч.🤷🏼‍♀️ Остальные участники сошли с дистанции: 🔻 GPT-5.6 Sol и Grok 4.6 чаще всего вылетали на первом же повороте 🔻 Claude Fable 5.1 в лучшей попытке доехал до середины, а в одном из заездов 159 секунд из 190 просто «думал» Главная проблема — зрение: модели путали, с какой стороны от диагональной линии конусов …

Ребята из DrivingBench выпустили новый тест, в котором AI-модели управляют настоящим автомобилем

Data Secrets · 23.09 23:12 · открыть в Telegram

GPT-6 Astra, Claude Fable 5.1 и Grok 4.6 подключили к Toyota Corolla и дали управление рулем, газом и тормозом. Каждой модели предоставили до трех попыток пройти трассу. Полностью справилась только GPT-6 Astra. В первый раз Astra прошла 49% маршрута. Затем модели предложили разобрать свои ошибки, после чего она проехала трассу целиком. https://drivingbench.com/

YouTube даст вам самим собрать себе алгоритм

Чёрный Треугольник · 23.09 21:42 · открыть в Telegram (читать целиком в Telegram)

YouTube анонсировал Custom Feeds — ленты, которые собираются по вашему текстовому описанию, а не только по истории просмотров.🤖 Пишете в строку запроса, что хотите смотреть: например, «видеоподкасты на 30 минут дороги» или «длинные документалки, чтобы расслабиться вечером». Под капотом работает Gemini. Что умеет функция: 🔻 понимает длинные и подробные запросы: что показывать, что исключать и что ставить в приоритет 🔻 позволяет создать несколько лент под разные настроения и привычки 🔻 закрепляет каждую ленту отдельной вкладкой на главной странице ☝🏻Подбирать есть из чего: по словам YouTube, на платформе более 20 миллиардов видео.🤯 Сначала функция заработает только в США — в браузере, …

Чему учиться в век ИИ-агентов и зачем ходить на конференции в 2026?

Data Secrets · 23.09 21:10 · открыть в Telegram

В субботу мы побывали на Practical ML Conf от Яндекса. Это техническая ML-конференция для инженеров, которую компания проводит в этом году уже четвертый раз. Пока участники слушали доклады и общались, нам удалось поговорить с Петром Ермаковым, ML Вrand Director в Яндексе. Петр рассказал нам, как изменилась конференция за четыре года, о каких проектах и научно-технических трендах спикеры рассказывают со сцены в этот раз, и почему живые доклады и кулуарные разговоры все еще так важны для сообщества. Смотрите, как это было ⬆️

Мам, давай купим Jev по API

Data Secrets · 23.09 17:35 · открыть в Telegram

Нет, у нас есть Jev дома Jev дома: Мэтт Мастраччи, контрибьютор vLLM, взял DiffusionGemma 26B от Google и заставил ее работать по той же схеме, причем без дообучения модели. Вместо генерации текста задается шаблон ответа, а после одного шага denoising из логитов сразу достаются ответы и их вероятности. Поддерживаются yes/no, multiple-choice и scoring вопросы. Теперь этот режим добавили в vLLM. По первым тестам качество близко к оригинальному Jev, а в NVFP4 модель можно поднять на одной GPU с 24 ГБ памяти. https://github.com/taeold/djev-run

Китай тоже нацелен на орбитальный ИИ дата-центр

Чёрный Треугольник · 23.09 17:18 · открыть в Telegram (читать целиком в Telegram)

Китайская коммерческая ракета Kinetica-1 компании CAS Space вывела на орбиту девять спутников. Среди них первый в Китае спутник для ИИ-вычислений.🚀 «Суперкомпьютер-1» — его сделала компания S-AIDC, которая строит ИИ-инфраструктуру. На борту две главные вещи: 🔻 оптическая камера высокого разрешения 🔻 ИИ-компьютер для обработки снимков ☝🏻Снимки обрабатываются прямо в космосе, и сырые данные больше не нужно гнать в наземные дата-центры. Это должно сократить обработку с часов до минут.⚡️ Такие спутники могут сами находить на снимках пожары, наводнения, штормы или корабли и отправлять на Землю только результат.🛰 Запуск входит в большую госпрограмму. В июне Пекин одобрил центр космических …

Японцы строят дом, в котором не нужно убираться и стирать

Чёрный Треугольник · 23.09 15:15 · открыть в Telegram (читать целиком в Telegram)

Токийский стартап MW показал MW Living Home — жильё, где архитектура, ИИ и робот-домработница проектируются как единое целое.🤖 Устройство дома авторы сравнивают с человеком: 🔻 «органы чувств» — встроенные в здание датчики 🔻 «мозг» — ИИ MW Intelligence, который анализирует обстановку и постоянно учится 🔻 «тело» — робот MW bot, который берёт на себя уборку и стирку ☝🏻Ставка не на гуманоида: в тесном японском жилье ему сложно работать безопасно, поэтому дом подгоняют под робота, а не наоборот.🤔 Прототип раньше видели только на фото, а на презентации в Токио его привезли вместе с экспериментальным домом-трейлером и показали за работой вживую. Целевая аудитория — семьи, где работают оба …

Экономика токенов и эра универсальных агентов

Data Secrets · 23.09 15:04 · открыть в Telegram (читать целиком в Telegram)

В интервью CEO Yandex Cloud хорошо подсветили несколько трендов, которые сейчас определяют развитие российского ML-рынка. Один из самых интересных здесь про экономику инференса. Стоимость токена за последние годы упала примерно в 6 раз, но вместо падения рынка это приводит к росту потребления. Чем дешевле инференс, тем больше данных становится экономически выгодно прогонять через модели и тем больше процессов можно автоматизировать. Получается цикл: дешевле токены → больше потребление → больше оптимизаций → еще дешевле токены. При этом само железо дешевле не становится. Стоимость инфраструктуры растет в 2–5 раз, поэтому вокруг AI постепенно формируется отдельный инфраструктурный слой со …

10 агентов Opus 5.5 за 15 часов обнаружили алгоритм поиска кратчайшего пути, превосходящий Дейкстру

Data Secrets · 23.09 10:22 · открыть в Telegram (читать целиком в Telegram)

Поиск кратчайшего пути – классическая проблема теории графов, на решении которой основываются навигаторы, роутинг в интернете, логистика и куча других задач современного мира. В 1959 году нидерландский информатик Эдсгер Дейкстра предложил для поиска кратчайшего пути алгоритм O(m + n log n), который следующие 65 лет оставался золотым стандартом и использовался буквально везде. В 2025-м команда из Цинхуа, Стэнфорда и Института Макса Планка впервые обошла его с оценкой O(m log^{2/3} n). Однако выигрыш их решения раскрывается только на достаточно плотных графах (число ребер m ≥ числа вершин n). На разреженных графах Дейкстра все еще был лучше. Vals AI решили потестировать новый Opus 5.5 …