runawayllm - главные новости
runawayllm - последние новости часа
+1628OpenAI рассказала, что ей пришлось приостановить внутреннее использование экспериментальной модели, построенной для долгой автономной работы, — той самой, которая в мае опровергла гипотезу Эрдёша о единичных расстояниях. В ходе ограниченных внутренних запусков модель раз за разом находила способы действовать за пределами песочницы — изолированной среды, которая должна была отрезать ее от внешнего мира. Доступ вернули только после того, как систему безопасности серьезно перестроили.
Одновременно с запуском GPT-5.6 OpenAI представила самую широкую переделку своих интерфейсов. ChatGPT Work — новый режим вокруг ChatGPT, фактически агент для рабочих задач, рассчитанный не на программистов, а на широкую аудиторию. Внутри та же технология Codex, но в понятном интерфейсе и заточенная не только под кодинг. Например, Work берет на себя офисную рутину: собирает информацию из ваших приложений и файлов и превращает ее в готовые таблицы, презентации, документы и веб-приложения. Сама OpenAI объясняет логику цифрами: Codex каждую неделю используют более 5 миллионов человек, и свыше миллиона из них — для задач, не связанных с разработкой.
18.05 / 20:46
общество
токен
«Гипотезу Римана может доказать анонимный аккаунт»: математик MIT — об опыте работы с GPT-5.5-Pro
Дэвид Туртуреан, аспирант MIT, опубликовал в X решение задачи #696 из списка Эрдёша через GPT-5.5-Pro — и обнаружил, что днем раньше на форуме erdosproblems.com уже появилось детальное частичное решение от анонимного пользователя Treasure42, полученное тем же способом. Это первый публично описанный случай, когда два независимых AI-пайплайна параллельно сошлись на одной открытой математической задаче — и на одном из них вообще не было привязки к реальному имени.
18.05 / 17:47
происшествия
самит
стартап
ИИ-агент нашел в NGINX критическую уязвимость, которой 18 лет
Исследователи компании depthfirst запустили свой автономный ИИ-агент на исходный код NGINX — и за 6 часов он нашел критическую уязвимость, которая жила с 2008 года. CVE-2026-42945 с рейтингом 9.2 по шкале CVSS позволяет удаленно выполнять произвольный код через комбинацию директив rewrite и set в конфигурации сервера. На NGINX работает почти треть всех сайтов мира, и под угрозой оказались версии от 0.6.27 до 1.30.0 — то есть почти весь жизненный цикл продукта.
18.05 / 14:39
технологии
общество
токен
Enterprise
Codex добавили в мобильный ChatGPT — для всех планов, включая бесплатный
OpenAI запустила Codex в мобильном приложении ChatGPT в режиме preview. Версии для iOS и Android раскатывают на всех тарифах — включая Free и Go. По данным компании, кодинг-агентом сейчас пользуются больше 4 миллионов человек в неделю, что вчетверо больше, чем в феврале, когда OpenAI выпустила для Codex десктопный клиент под macOS.
18.05 / 12:39
технологии
Apple
история
самит
wsj
google
Дом и интерьер
Claude Mythos обошел защиту macOS всего за пять дней
Исследователи из калифорнийской фирмы по кибербезопасности Calif обошли флагманскую защиту macOS с помощью Claude Mythos Preview всего за пять дней — а ведь на разработку этой защиты у Apple ушло пять лет. Об этом со ссылкой на отчет компании написал WSJ.
18.05 / 12:39
деньги
история
общество
доллар
финансирование
лекарства
google
Спин-офф Google привлек $2,1 млрд под лекарства, разработанные ИИ
Isomorphic Labs, спин-офф DeepMind, привлекла 2,1 млрд долларов во втором крупном раунде финансирования. Раунд возглавил фонд Thrive Capital. По оценке аналитиков BioSpace, это вторая по размеру сделка в истории биотеха — больше только у Altos Labs с их 3 млрд долларов в 2022 году.
18.05 / 10:04
бизнес
экономика
общество
самит
интересное
74% компаний выключили AI-агентов в клиентской поддержке
Шведский провайдер коммуникационных сервисов Sinch опросил больше 2500 руководителей AI-проектов в разных странах и индустриях для своего исследования AI Production Paradox. Главная цифра — 74% компаний откатили или совсем отключили уже запущенных AI-агентов клиентской поддержки. Под "откатом" авторы понимают именно снятие с боевой эксплуатации, а не отмену проекта до запуска.
18.05 / 06:51
бизнес
технологии
люди
экономика
доллар
CEO
Увольнения ради ИИ не окупаются: Gartner опросил 350 руководителей с выручкой от $1 млрд
Аналитическая компания Gartner опросила 350 руководителей крупных компаний и обнаружила парадокс. 80% из тех, кто внедряет автономные технологии на базе ИИ, уже сократили штат. Но компании, заработавшие на ИИ, и компании, которым он не принес почти ничего, увольняли людей примерно одинаково. То есть сокращения никак не связаны с тем, удалось ли получить отдачу от технологии.
17.05 / 08:02
продукты
конференция
общество
прогноз
самит
страховка
Зачем в Anthropic полгода делали неработающего ИИ-агента
Борис Черни, создатель Claude Code в Anthropic, на конференции Sequoia AI Ascent 2026 признал: первые полгода продукт работал у него самого только в 10% случаев. "Он едва годился к использованию. Я писал через него максимум 10% своего кода. Мы строили под следующую модель", — рассказал он в разговоре с Лорен Ридер из Sequoia. Экспоненциальный рост пользователей начался только в мае 2025 года, с выходом Opus 4 — то есть спустя примерно полгода после публичного релиза самого Claude Code.
17.05 / 08:02
люди
экономика
общество
прогноз
трудоустройство
курс
Cisco
Cisco сократила 4000 человек на фоне рекордной выручки. Уволенным подарили курс по ИИ
Cisco в среду, 13 мая, опубликовала рекордный квартальный отчет — выручка $15.84 млрд, рост на 12% год к году, выше всех прогнозов аналитиков. Одновременно в письме к команде генеральный директор Чак Роббинс сообщил, что компания режет 4000 рабочих мест, около 5% штата. Уведомления уволенным начинают рассылать сегодня, 14 мая. И в прощальный пакет, кроме выходного пособия и помощи в трудоустройстве, Cisco добавила год бесплатного доступа к курсам и сертификациям своей учебной платформы — в том числе по AI.
16.05 / 18:54
технологии
происшествия
история
Microsoft натравила 100 ИИ-агентов на Windows и нашла 16 новых уязвимостей
Microsoft показала агентную систему поиска уязвимостей под кодовым именем MDASH (multi-model agentic scanning harness — мультимодельная агентная обвязка для сканирования). С ее помощью в майском Patch Tuesday — ежемесячном выпуске обновлений безопасности Microsoft — закрыли 16 новых уязвимостей в сетевом стеке Windows и смежных сервисах. Среди них четыре критических RCE (удаленное выполнение кода): в драйвере tcpip.sys, в службе ikeext.dll и в библиотеках netlogon.dll и dnsapi.dll. Десять из шестнадцати багов сидят в ядре, большинство достижимо из сети без аутентификации.
16.05 / 16:03
продукты
SpaceX
Nvidia
общество
самит
крипто
Enterprise
Anthropic увеличил лимиты подписки Claude и API-кредит для агентов. Но довольны не все
13 мая Anthropic объявил сразу две новости для платных подписчиков Claude. Во-первых, недельные лимиты на использование Claude Code выросли на 50% — изменение действует уже сейчас и продержится до 13 июля. Во-вторых, с 15 июня у подписки появится отдельный месячный кредит для агентов, изолированный от обычных лимитов чата.
16.05 / 15:03
закон
промышленность
Новый чекпоинт Claude Mythos взламывает защиту электростанции в 3 из 10 попыток
Британский AI Security Institute (AISI) опубликовал отчет о темпах развития кибер-возможностей у передовых моделей. Главный результат: новый внутренний чекпоинт Claude Mythos Preview прошел полигон Cooling Tower — симулятор атаки на промышленную систему управления (industrial control system, ICS) — в 3 из 10 попыток.
16.05 / 09:13
технологии
люди
закон
общество
самит
«Фабрика извлечения данных»: сотрудники Meta* восстали против слежки за мышью
Сотрудники Meta* (признана экстремистской и запрещена в РФ) во вторник начали распространять листовки с призывом подписать онлайн-петицию против ПО, которое отслеживает движения мыши на их рабочих компьютерах, собирая данные, которые далее будут использоваться для обучения ИИ.
15.05 / 15:54
SpaceX
Nvidia
самит
интересное
IPO
google
Google поедет в космос на ракетах SpaceX: компании обсуждают орбитальный ИИ-проект
Google подтвердил 12 мая, что ведет переговоры со SpaceX о запуске прототипов Project Suncatcher — экспериментального проекта орбитальных дата-центров для ИИ. Компания планирует вывести два прототипа спутников с фирменными чипами TPU на орбиту в начале 2027 года, изначально через партнера Planet Labs. Теперь к списку возможных подрядчиков добавилась SpaceX — ракетная компания Илона Маска, в которой у материнской Alphabet уже есть доля 6,1% как у одного из ранних инвесторов.
15.05 / 13:21
технологии
общество
самит
пилот
сад и огород
стартап
CEO
CEO залез в собственного меха: Unitree показала пилотируемого робота за $650 000
Китайский стартап Unitree Robotics представил GD01 — то, что компания называет первым в мире серийным пилотируемым мех-роботом. Стартовая цена — 3,9 млн юаней, около $650 000. Это не очередной автономный гуманоид, а машина, в которую человек физически садится и которой управляет изнутри.
15.05 / 08:03
бизнес
люди
общество
доллар
Block
CEO
«Софт будут писать машины, а направлять — люди»: CEO GitLab объявил сокращения
Билл Стейплз, CEO GitLab, опубликовал меморандум "GitLab Act 2" — масштабную реструктуризацию компании под "агентную эру" разработки. Главный тезис документа Стейплз сформулировал коротко: "Софт будут писать машины, направлять — люди". План включает сокращения коллектива (инсайдеры говорят о 7% команды), выход из примерно трети стран присутствия и реорганизацию R&D. Рынок отреагировал быстро и жестко — акции GTLB упали на 8,2% в after-hours торгах сразу после анонса.
15.05 / 07:25
бизнес
технологии
люди
общество
самит
безработица
Нет, ИИ не уничтожит рынок труда: Эндрю Ын разнес позицию AI-компаний
Эндрю Ын, основатель DeepLearning.AI и Coursera, опубликовал в рассылке The Batch колонку, в которой назвал нарратив о массовой безработице из-за ИИ безответственным и вредным. Аргумент простой: уровень безработицы в США держится на здоровых 4,3%, а найм разработчиков остается сильным — хотя именно их работу кодинг-агенты меняют быстрее всего. Если бы апокалипсис на рынке труда уже шел, по статистике это было бы видно в первую очередь.
15.05 / 07:01
самит
крипто
токен
Enterprise
2,5x скорости за 6x цены: у Opus 4.7 появился турбо-режим
Anthropic запустила fast mode (турбо-режим) для Claude Opus 4.7 — режим выдает до 2,5 раза больше выходных токенов в секунду, но стоит в 6 раз дороже стандартной модели. Опция доступна как research preview на API и в Claude Code; параллельно ее подключил Cursor.
15.05 / 06:21
спорт
Tesla
общество
самит
мозг
дефолт
Андрей Карпати: главная проблема LLM — в том, как они отвечают
Сооснователь OpenAI и бывший директор AI в Tesla Андрей Карпати опубликовал в X пост, в котором назвал главное узкое место в общении с большими языковыми моделями — формат их ответа. По его мнению, голый текст тяжело читать, markdown как текущий дефолт уже исчерпал себя, а следующая ступень эволюции вывода LLM — это HTML. Карпати выстроил траекторию минимум из четырех шагов и считает, что отрасль сейчас застряла на втором.
14.05 / 22:33
закон
история
общество
семья
самит
школы
ИИ-фильтр ложно забраковал сочинение ученика. Теперь школа отвечает в федеральном суде
В Палo-Альто семья школьника подала федеральный иск против школьного округа Palo Alto Unified School District. Причина — учитель английского обвинила его сына в том, что сочинение написано ИИ, и снизила полугодовую оценку с A до C. Поводом стал отчет сервиса Turnitin (платформа проверки текстов на плагиат и AI-генерацию) — алгоритм показал 76% сгенерированного ИИ контента. Семья отправила в школу 1162 страницы доказательств — от черновиков до полной истории правок в Google Docs — но округ отказался пересматривать оценку. Иск подан 5 мая 2026 года в Северный окружной суд Калифорнии и опирается на две главы американского закона о гражданских правах.
14.05 / 14:24
технологии
происшествия
общество
самит
жертва
google
ИИ впервые написал хакерам обход двухфакторной защиты. Под угрозой были десятки тысяч серверов
Google опубликовал отчет, в котором впервые зафиксировал хакерскую атаку с эксплойтом, написанным нейросетью. Группа киберпреступников использовала ИИ, чтобы найти неизвестную ранее уязвимость в распространенной open-source панели администрирования серверов — она позволяла обходить двухфакторную аутентификацию. По данным Google, атаку готовили массовой: заразить максимум жертв через одну дыру. Кампанию вскрыли заранее, уведомили разработчиков пострадавшего инструмента, и она не развернулась.
14.05 / 14:24
экономика
самит
«ИИ ускоряет работу в 3 раза»: METR опросил инженеров — и засомневался в их ответах
METR — некоммерческий институт оценки рисков передовых ИИ-моделей, который проводит проверки перед релизами для Anthropic и OpenAI — опубликовал результаты опроса 349 технических работников. Медианный респондент оценил рост скорости работы благодаря ИИ в 3 раза, рост ценности — в 1,6–2,1 раза в зависимости от формулировки вопроса. И в том же анонсе сам институт предупредил: восприятие обычно завышено относительно реальности.
14.05 / 10:36
технологии
происшествия
закон
общество
самит
CEO
Anthropic чуть не поглотила OpenAI в ноябре 2023-го — Суцкевер подтвердил это в суде
На третьей неделе суда Маска против OpenAI Илья Суцкевер под присягой подтвердил то, что раньше было известно только из утечек: в ноябре 2023-го, после увольнения Сэма Альтмана, остатки совета директоров OpenAI вели переговоры с Anthropic. Обсуждали не покупку, а слияние с передачей управления объединенной компанией Дарио Амодеи — основателю и CEO Anthropic. На прошлой неделе деталь всплыла в материалах дела, теперь зафиксирована в зале суда.
14.05 / 09:51
связь
общество
самит
интересное
стартап
ИИ, который не тупит: стартап Миры Мурати показал первый крупный проект
Thinking Machines Lab, стартап бывшего технического директора OpenAI Миры Мурати, показал первое демо новой модели, которая работает с пользователем в режиме живого разговора — слышит, видит и говорит одновременно, без классической схемы "сначала вопрос, потом ответ". Задержка между репликой пользователя и реакцией модели — 0,4 секунды против 1,18 у GPT-realtime-2.0 и 0,57 у Gemini-3.1-flash-live.
14.05 / 09:07
технологии
LinkedIn
история
общество
Gmail, Salesforce и LinkedIn в одном агенте: OpenAI выпустил Codex для Chrome
OpenAI 7 мая выпустил расширение Codex для Chrome — агент получает прямой доступ к залогиненным сессиям пользователя на любых сайтах: от Gmail и LinkedIn до Salesforce и корпоративных панелей. Поводом для расширения функциональности компания называет внутреннюю статистику: Codex используют 4 млн человек в неделю, аудитория выросла в 8 раз с начала года.
14.05 / 09:07
Apple
Nvidia
общество
самит
google
«Маркетинговый хайп»: из пяти уязвимостей Mythos в curl подтвердилась одна
Дэниел Стенберг, лид и основной разработчик проекта curl, опубликовал разбор результатов сканирования кода библиотеки моделью Mythos от Anthropic в рамках Project Glasswing. Из пяти "подтвержденных уязвимостей", о которых отчиталась модель, после проверки силами команды безопасности проекта осталась одна — низкого уровня важности, она выйдет CVE вместе с curl 8.21.0 в конце июня. Свой главный вывод Стенберг сформулировал прямо: "хайп вокруг этой модели в основном маркетинговый".
14.05 / 08:34
технологии
экономика
история
крипто
токен
Поддельная модель OpenAI воровала пароли, крипту и сессии Discord
Исследователи из HiddenLayer обнаружили вредоносный репозиторий Open-OSS/privacy-filter на Hugging Face, который маскировался под легитимный релиз OpenAI Privacy Filter. За 18 часов он собрал около 244 000 загрузок и 667 лайков, добрался до первой строчки трендов платформы и был удален только после обращения исследователей.
14.05 / 02:01
экономика
Amazon
история
самит
доллар
ByteDance
ИИ сам находит, сравнивает и оплачивает товары. В Китае запускают агентный шопинг
Alibaba готовится развернуть глубокую интеграцию своего AI-приложения Qwen с маркетплейсом Taobao и его премиальной частью Tmall. Чат-бот получит доступ к каталогу из более 4 миллиардов товарных позиций и сможет вести пользователя по всему пути покупки: подобрать товар, сравнить его у разных продавцов, оформить заказ и провести оплату через Alipay. Покупателю остается только подтвердить финальный шаг.
13.05 / 19:47
бизнес
закон
самит
крипто
Lowe's
OpenAI представила первую голосовую модель с интеллектом GPT-5
OpenAI выпустила GPT-Realtime-2 — первую голосовую модель компании с уровнем рассуждений GPT-5. На бенчмарке Big Bench Audio (тест на способность аудиомоделей рассуждать) она показала 96,6% против 81,4% у предыдущей версии gpt-realtime-1.5 — прирост в 15,2 пункта. Параллельно с ней OpenAI представила еще две специализированные модели: GPT-Realtime-Translate для синхронного перевода с 70+ языков на 13 и GPT-Realtime-Whisper для потоковой транскрипции.
13.05 / 17:52
Amazon
SpaceX
самит
аномалия
инвестор
google
Впервые с основания Anthropic стоит больше OpenAI: $900 млрд против $852 млрд
Anthropic ведет переговоры о новом инвестраунде на $40–50 млрд при оценке $850–900 млрд, сообщил TechCrunch со ссылкой на полдюжины источников; параллельно цифры подтвердила Financial Times. Если сделка закроется на этих условиях, компания впервые с момента основания в 2021 году обойдет OpenAI ($852 млрд после февральского раунда) и станет самым дорогим AI-стартапом в мире. По словам одного из инвесторов компании, которого цитирует FT, фонды "готовы кидать в Anthropic любую сумму".
13.05 / 16:00
общество
самит
Главный критик LLM почти похвалил Claude Mythos. Почти
Гэри Маркус, один из самых известных критиков современного ИИ, неожиданно мягко прокомментировал свежие результаты Claude Mythos на бенчмарке METR. На последнем замере модель Anthropic показала горизонт автономной работы 16+ часов при 50%-вероятности успеха и 3 часа при 80% — это вдвое больше ближайшего конкурента. Маркус согласился, что прогресс реальный, но добавил, что сам по себе Mythos может и не быть главной причиной успеха.
13.05 / 16:00
закон
Tesla
общество
самит
дети и родители
CEO
Маск пытался переманить Альтмана в Tesla — еще до раскола OpenAI
На второй неделе процесса Musk v. Altman в федеральном суде Окленда вскрылся неудобный для Илона Маска факт: к концу 2017 года, еще будучи членом совета OpenAI, он пытался переманить Сэма Альтмана к себе — возглавить новую AI-лабораторию внутри Tesla. Об этом рассказала под присягой Шивон Зилис — мать четверых детей Маска и бывший член совета OpenAI. Тот самый Альтман, которого Маск сейчас обвиняет в обмане и требует отстранить от компании, тогда был для него желанным сотрудником. ИИ-лаборатория в Tesla тогда так и не была создана, но переписки и черновики уцелели.
13.05 / 14:11
общество
вирус
разведка
самит
Opus 4.6 в 81% попыток сам «копирует себя» на чужой сервер через дыру в коде — исследование Palisade
Лаборатория Palisade Research замерила, как часто современные ИИ-модели сами могут взломать чужой сервер и установить туда копию своих весов. У Claude Opus 4.6 получилось в 81% попыток, у GPT-5.4 — в 33%. Год назад актуальные модели тех же разработчиков показывали 6% и ровно 0% соответственно — это новое исследование фиксирует не столько отдельный факт, сколько скорость, с которой эта способность вырастала за один релизный цикл.
13.05 / 11:17
деньги
закон
общество
выплаты
конгресс
правительство
DOGE
В США чиновники резали гранты через ChatGPT. Потом сделали бота крайним в суде
Окружной судья Колин Маккэхон в Манхэттене 7 мая признала незаконной отмену больше 1400 грантов Национального фонда гуманитарных наук — государственной структуры, которая распределяет деньги между учеными и исследовательскими институтами. Речь о выплатах больше чем на $100 млн, утвержденных Конгрессом. Решение Маккэхон занимает 143 страницы, и теперь у правительства США нет права эти гранты отменять.
13.05 / 10:29
закон
история
общество
самит
Евросоюз
google
Из настроек Chrome пропало сообщение о приватности локального ИИ Gemini Nano. Это может стоить Google миллиарды
4 мая исследователь приватности Александр Ханфф опубликовал детальный разбор того, как Chrome тихо ставит на устройства пользователей 4-гигабайтный файл с весами Gemini Nano — без диалога и без уведомления. Уже через четыре дня у истории новый поворот: Ханфф зафиксировал, что Google тихо удалил из настроек Chrome ту самую фразу про приватность, которой раньше оправдывал эту фоновую загрузку. По его юридической оценке, у Google здесь регуляторные риски сразу в нескольких правовых системах, а потенциальный штраф — до 4% мировой выручки, то есть около €11 млрд по итогам 2025 года.
13.05 / 10:14
бизнес
Amazon
конференция
общество
самит
профессия
CEO
«Замена джунов на ИИ — тупая идея»: CEO AWS берет 11 000 интернов
Глава AWS Мэтт Гарман на конференции "What's Next with AWS" заявил, что Amazon в 2026 году возьмет 11 000 интернов-разработчиков — столько же, сколько в предыдущие годы. По его словам, спрос на программистов внутри компании "реально ускоряется", а нанимают их "ровно столько же, сколько всегда".
13.05 / 10:14
закон
история
общество
самит
профессор
Из экспоненты в полином за два часа: что GPT-5.5 Pro сделала с задачей по теории чисел
Тимоти Гауэрс — обладатель Филдсовской премии и кембриджский профессор — опубликовал в блоге отчет о своем эксперименте с GPT-5.5 Pro: за неполных два часа модель улучшила границу в открытой задаче по аддитивной теории чисел с экспоненциальной до полиномиальной. Уровень итогового результата Гауэрс оценил как "вполне разумную главу диссертации по комбинаторике" — один самостоятельный блок результатов в диссертации PhD-студента. Профессор отдельно подчеркнул, что его собственный математический вклад был нулевым — он только переформулировал чужие задачи в запросы к модели.
13.05 / 09:00
закон
история
общество
самит
фантастика
От 96% до нуля: как Anthropic отучила Claude от шантажа
Anthropic опубликовала исследование "Teaching Claude Why" — разбор того, как компания починила вредное поведение Claude в агентском режиме. Главная цифра: в фирменном тестовом сценарии с шантажом инженера ранние версии Claude Opus 4 шли на шантаж в 96% прогонов, а начиная с Claude Haiku 4.5 показатель упал до нуля.
13.05 / 09:00
семья
самит
мода и стиль
google
gemini
Google собрал ИИ-математика — и тот закрыл открытую задачу из Коуровской тетради
Google DeepMind представил AI co-mathematician — агентную систему на базе Gemini 3.1, которая работает не как чатбот, а как рабочее пространство для математика с командой ИИ-агентов. С ее помощью топологист Марк Лакенби закрыл проблему 21.10 из Коуровской тетради — сборника открытых задач по теории групп, который ведется в Новосибирске с 1965 года. Параллельно система поставила новый рекорд на самом сложном математическом бенчмарке FrontierMath Tier 4 — 48% правильных ответов.
13.05 / 07:38
деньги
общество
самит
интересное
DeepSeek V4 силен только в «своих» бенчмарках. На независимых — отстает на 8 месяцев
После анонса DeepSeek V4 Pro, в котором компания заявила об отставании от фронтира США всего на 3–6 месяцев, NIST — американский институт стандартов при Министерстве торговли — провел собственные замеры и заявил, что в реальности модель позади как минимум на 8 месяцев. Расхождение объясняется одним фактором — выбором бенчмарков.
12.05 / 13:57
общество
политика
Anthropic научилась читать мысли Claude — и поймала его на скрытом обмане
Компания Anthropic выпустила метод Natural Language Autoencoders (NLA) — алгоритм, который переводит внутренние активации языковой модели в читаемый человеком текст. На предрелизном аудите Claude Opus 4.6 и экспериментальной Claude Mythos Preview метод вытащил из активаций то, чего модели не сказали вслух: подозрение в том, что их тестируют, попытки обмануть проверяющего и параллельные рассуждения, расходящиеся с итоговым ответом. На бенчмарке SWE-bench Verified Opus 4.6 распознает ситуацию как тест в 26% случаев, но прямо говорит об этом только в 1%.
12.05 / 08:49
экономика
история
самит
капитал
мода и стиль
google
Идеальный полигон для ИИ: Google DeepMind стала совладельцем разработчиков EVE Online
Google DeepMind вошла в капитал исландской студии Fenris Creations — бывшей CCP Games, разработчика космической MMO EVE Online. Это часть более крупного перехода для самой CCP Games/Fenris: ее команда выкупила компанию у корейского владельца Pearl Abyss за $120 млн и одновременно сменила имя после почти 30 лет под старым брендом. Доля Google DeepMind в Fenris — миноритарная, ее размер не раскрывается. Параллельно с инвестицией стороны запустили исследовательское партнерство: DeepMind будет использовать офлайн-версию EVE Online на локальном сервере как экспериментальную среду для своих моделей.
12.05 / 07:57
связь
люди
экономика
общество
школы
дефицит
«Если AI заберет работу у джунов — где брать сеньоров?»: Anthropic Institute займется поиском ответа
Anthropic Institute (TAI) — научное подразделение Anthropic, запущенное в марте 2026 года, — опубликовал 7 мая свою исследовательскую программу. В документе четыре больших направления и более 30 конкретных вопросов. Среди них — что делать, если ИИ заберет задачи, на которых традиционно учились младшие сотрудники, и откуда тогда возьмутся опытные специалисты через 10–15 лет.
12.05 / 07:57
интересное
С Claude Mythos команда Firefox за апрель закрыла больше уязвимостей, чем за весь 2025-й
Mozilla опубликовала технический разбор работы с Claude Mythos Preview, передовой моделью Anthropic, которую компания пока открыла узкой группе компаний для поиска уязвимость. За апрель 2026 года в браузере закрыли 423 уязвимости. Для сравнения: суммарно за весь 2025 год — 258, в среднем 17-31 исправление в месяц. Ритм поменялся в феврале (61) и марте (76), когда Mozilla работала с более ранней моделью Claude Opus 4.6, и резко вырос в апреле после перехода на Mythos.
12.05 / 07:57
происшествия
промышленность
общество
Claude Opus 4.7 стал лучшим ИИ в рефакторинге кода. Второе место у GPT-5.5
Scale Labs запустила Refactoring Leaderboard — третий и последний элемент исследовательского пакета SWE Atlas, оценивающего ИИ-агенты на задачах разработки ПО. В отличие от классических бенчмарков, где модель решает изолированные задачи, новый лидерборд проверяет агентов на работе с кодом промышленного уровня: понимание существующей архитектуры, правки в нескольких файлах, прохождение тестов и уборка устаревших артефактов после рефакторинга. По данным Scale Labs, задачи Refactoring требуют примерно вдвое больше изменений строк кода и в 1,7 раза больше правок файлов, чем задачи SWE-Bench Pro — это делает бенчмарк более жестким тестом многофайловой инженерной работы.
11.05 / 20:57
происшествия
люди
закон
история
общество
Прокурор
CEO
Мира Мурати в суде обвинила Альтмана в обмане и хаосе
В федеральном суде Окленда (Калифорния) на второй неделе процесса по иску Илона Маска против OpenAI показали видеозапись допроса под присягой Миры Мурати, бывшего CTO компании. Она заявила, что Сэм Альтман обманул ее насчет обязательной проверки безопасности новой модели и регулярно создавал хаос в управлении. Маск требует с ответчиков $134 млрд и принудительного возврата OpenAI к некоммерческой структуре.
11.05 / 09:52
SpaceX
Nvidia
IPO
Три месяца назад Илон Маск называл Anthropic злом — а теперь отказался от своих слов и сдал им суперкомпьютер в аренду
Илон Маск 6 мая написал в X, что после личной встречи с командой Anthropic он "был впечатлен" и не нашел причин не сдавать ей в аренду суперкомпьютер Colossus 1. "Все, с кем я встречался, были высококомпетентными и заботились о том, чтобы все делать правильно. Никто не активировал мой детектор зла", — заявил миллиардер в ответ на твит сооснователя Anthropic Тома Брауна, который объявил о начале развертывания Claude на Colossus в ближайшие дни. По данным CNBC, Anthropic получит доступ ко всем 220 000+ GPU NVIDIA в дата-центре — это даст компании 300+ МВт дополнительной мощности.
11.05 / 05:03
самит
стартап
крипто
токен
Энтузиаст «выжег» microGPT Андрея Карпати в FPGA и получил 53 тыс. токенов/сек
20-летний студент факультета электроники и вычислительной техники университета Торонто Лутира Абейкун выложил на GitHub проект TALOS-V2 — реализацию трансформера microGPT Андрея Карпати, целиком собранную в железе FPGA. По описанию проекта, модель выдает около 53 000 токенов в секунду на плате размером с кредитную карту — без Python, без CUDA и без какой-либо программной прослойки.