runawayllm - главные новости

runawayllm - последние новости часа

+1628
OpenAI рассказала, что ей пришлось приостановить внутреннее использование экспериментальной модели, построенной для долгой автономной работы, — той самой, которая в мае опровергла гипотезу Эрдёша о единичных расстояниях. В ходе ограниченных внутренних запусков модель раз за разом находила способы действовать за пределами песочницы — изолированной среды, которая должна была отрезать ее от внешнего мира. Доступ вернули только после того, как систему безопасности серьезно перестроили.
Одновременно с запуском GPT-5.6 OpenAI представила самую широкую переделку своих интерфейсов. ChatGPT Work — новый режим вокруг ChatGPT, фактически агент для рабочих задач, рассчитанный не на программистов, а на широкую аудиторию. Внутри та же технология Codex, но в понятном интерфейсе и заточенная не только под кодинг. Например, Work берет на себя офисную рутину: собирает информацию из ваших приложений и файлов и превращает ее в готовые таблицы, презентации, документы и веб-приложения. Сама OpenAI объясняет логику цифрами: Codex каждую неделю используют более 5 миллионов человек, и свыше миллиона из них — для задач, не связанных с разработкой.

Все новости, где упоминается runawayllm

20.11 / 08:42
reddit xAI выпустила Grok 4.1 — новый ИИ сразу доступен бесплатно
xAI выпустила Grok 4.1, обновленную модель своего ведущего ИИ, который уже доступен в веб-версии и мобильных приложениях на iOS и Android. Модель доступна в быстром и рассуждающем режиме — переключение происходит автоматически, но при необходимости можно нажать Think Harder и включить рассуждения вручную. Grok 4.1 сразу же доступен бесплатно, конкретные лимиты xAI не раскрывает, но в первых отзывах на Reddit говорят, что беседовали с моделью десятки минут, не получив никаких ограничений.
20.11 / 07:46
бизнес медицина интересное В новом бенчмарке на галлюцинации лишь три ИИ чаще отвечают правильно, чем ошибаются
Artificial Analysis представила новый бенчмарк AA-Omniscience, который оценивает уровень галлюцинаций не только по количеству правильных ответов, но и по умению моделей говорить "не знаю". Первые три места занимают ИИ из линейки Claude: маленькая Claude 4.5 Haiku показывает около 26% неверных ответов среди всех неудачных попыток, а Claude 4.5 Sonnet и Claude 4.1 Opus делят второе и третье место с результатом 48%. Важно добавить, что в бенчмарке моделям отключили возможность поиска в сети и задавали максимально сложные вопросы — в реальных задачах количество ошибок существенно ниже, а бенчмарк в первую очередь должен показать разработчикам ИИ слабые места в текущих схемах тренировки.
20.11 / 04:31
бизнес экономика предприятия коалиция стартап DeepSeek, Qwen и Kimi вытесняют американский ИИ из Кремниевой долины
Обозреватель Bloomberg Opinion Кэтрин Торбек пишет о развороте в Кремниевой долине: все больше местных компаний строят свои сервисы на ИИ из Китая, в первую очередь — DeepSeek, Qwen и Kimi. Несмотря на то, что США и Китай ведут практически открытую ИИ-гонку, американский бизнес предпочитает китайские модели за дешевизну, производительность и открытость, которая упрощает дообучение под нужные задачи.
19.11 / 12:36
общество Waves ИИ Qwen научили проходить Genshin Impact как человек
Опубликован рассказ об ИИ-агенте Lumine на базе Qwen2-VL-7B, которого научили играть в Genshin Impact. Агент способен пройти основную сюжетную линию региона Мондштадт, которая у живых игроков занимает около пяти часов, с эффективностью, сопоставимой с человеком. Также Lumine проходит следующие регионы, на которых он не обучался, и даже переносит навыки на другие похожие игры.
19.11 / 11:34
Олимпиада золото самит Психология и отношения gemini OpenAI готовит к выпуску ИИ олимпиадного уровня
OpenAI работает над тем, чтобы открыть обычным пользователям доступ к модели, основанной на экспериментальном ИИ, который ранее в этом году достиг уровня золотой медали сразу на нескольких престижных соревнованиях: международных школьных олимпиадах по математике и информатике (IMO 2025 и IOI 2025), а также студенческой олимпиаде по программированию (ICPC World Finals 2025). Об этом сообщил Джерри Творек — вице-президент по исследованиям в OpenAI.
19.11 / 09:26
самит крипто GPT-5.1 Thinking назвали самым умным ИИ. Разбираем бенчмарки новинки
Опубликован обновленный Artificial Analysis Intelligence Index, сводный индекс, который оценивает эффективность ИИ по целом ряду популярных бенчмарков. Первое место в нем заняла GPT-5.1 Thinking High (70 баллов), которая обошла GPT-5 Thinking High (68 баллов), Kimi K2 Thinking (67 баллов), Grok 4 (65 баллов) и Claude Sonnet 4.5 (63 балла).
19.11 / 08:54
самит газопровод Знаменитости доллар взрывы google ИИ Google DeepMind приблизил ученых к разгадке вековой загадки газов и жидкостей
Когда самолет разгоняется по взлетной полосе, вокруг крыла и фюзеляжа рождаются сложные вихри. Мы привыкли считать, что инженеры давно научились описывать эти потоки уравнениями, но у этих уравнений есть собственная загадка: уже больше ста лет математики спорят, могут ли в идеальной модели газа или жидкости ни с того ни с сего возникать "разрывы" — сингулярности, где скорости и градиенты формально устремляются к бесконечности. От ответа зависят и наше понимание турбулентности, и знаменитая задача о трехмерных уравнениях Навье–Стокса, за решение которой обещана награда в миллион долларов от Математического институт Клэя.
19.11 / 08:54
мода и стиль крипто Dash gemini Новый Grok с огромным контекстным окном испытывают на OpenRouter
На OpenRouter стартовало тестирование сразу двух новых моделей: "быстрой" Sherlock Dash Alpha и "рассуждающей" Sherlock Think Alpha. Из характеристик раскрыто контекстное окно: 1,84M токенов, что является одним из лучших результатов для ИИ — например, у Gemini 2.5 Flash и Pro контекстное окно достигает 1M токенов.
19.11 / 04:55
стартап google крипто gemini Глава Google намекнул на выход Gemini 3.0 Pro на следующей неделе
В сети появляется все больше намеков на скорый выход Gemini 3.0 Pro — как от профессионалов рынка, так и от представителей Google. Начнем с твитов Васумана Моцы, бывшего ML-инженера в Meta* (признана экстремисткой в РФ), а сейчас главы стартапа Varick Agents, который разрабатывает кастомных агентов для бизнеса.
18.11 / 18:56
самит крипто В новом бенчмарке ни один ИИ не выставил правильно стрелки на часах
Брайан Мур запустил бенчмарк AI World Clocks, в котором девять ИИ разных поколений — от GPT-3.5 до Grok 4 и GPT-5 — пытаются создать в html часы с правильно показанным временем. К сожалению, задача оказалась не под силу даже лучшим моделям.
18.11 / 15:23
экономика интересное токен Илон Маск рассказал про Grok 5
В разговоре с Роном Бароном основатель xAI Илон Маск раскрыл подробности Grok 5. Этот ИИ обучают на новом суперкомпьютере Colossus 2 — он пока не вышел на полную мощность (1 млн GPU прогнозируют в 2026 году), но даже текущих возможностей хватает, чтобы разработчики размахнулись на модель с рекордными 6 трлн параметров. Для сравнения, Qwen3-Max и Kimi K2 состоят из 1 трлн параметров, GPT-4o оценивается в 1,7 трлн параметров, а Grok 4 — 3 трлн параметров в зависимости от источника. Также важно добавить, что разработчики Grok всегда придерживались архитектуры MoE (Mixture of Experts), в которой на каждый токен активируется лишь часть параметров — это позволяет экономить ресурсы.
18.11 / 12:21
Олимпиада интересное reddit OpenAI рассказала про особенности GPT-5.1 и будущее модели
Представители OpenAI провели сессию ответов на вопросы на Reddit про GPT-5.1 и новые настройки персонализации. В новой версии модели большой упор сделан на более "человечные" ответы и добавлено сразу восемь базовых личностей: от нейтральной и искренней до циничной и даже нерда. Отдельно модель дообучили лучше следовать пользовательским инструкциям по стилю ответа: например, теперь ей можно запретить использование длинных тире (и буквы "ё": прописывайте это свободным языком в "настроки — персонализация" — прим. авт.).
18.11 / 12:21
экономика нефть Amazon доллар google Oracle Отчет МЭА: уже в 2025-м вложения в ИИ-инфраструктуру обгонят нефтеразведку
В свежем World Energy Outlook 2025 Международное энергетическое агентство показало, что на фоне ИИ-бума уже в 2025 году глобальные инвестиции в дата-центры вырастут до ≈580 млрд долларов и впервые обгонят вложения в новую нефтедобычу — около 540 млрд долларов в год. По словам главы МЭА Фатиха Бироля, прямо на наших глазах цифровая инфраструктура выходит на один уровень с классическими сырьевыми отраслями.
18.11 / 07:46
самит OpenAI раскрыла секреты промптинга GPT-5.1
OpenAI выложила GPT-5.1 Prompting Guide — подробное руководство по тому, как общаться с новой моделью так, чтобы она работала как задуманный инструмент, а не как случайный собеседник. Документ заточен под использование через API, но многие советы в нем подойдут тем, кто пользуется через ChatGPT. Авторы разбирают не только базовые советы ("задайте роль, формулируйте явные цели, требуйте конкретный формат ответа"), но и более тонкие вещи: как управлять инициативностью агента, как не дать ему бросить задачу на полпути и как использовать саму GPT-5.1 для отладки промптов. Гайд написан на английском языке, однако можно попросить ту же GPT-5.1 сделать из него выжимку на русском.
17.11 / 16:53
люди самит google gemini Google сделала «шаг к AGI»: ИИ-бот SIMA 2 сам учится жить в виртуальных мирах
Google DeepMind представила SIMA 2 и прямо называет его "значимым шагом в сторону AGI". Новый агент на базе языковой модели Gemini 2.5 Flash Lite видит видеопоток с экрана, использует виртуальную клавиатуру и мышь, понимает сложные инструкции и способен самостоятельно осваивать 3D-игры. По словам компании, это уже не просто модель, которая "говорит", а система, которая действует, рассуждает и учится в живых виртуальных средах.
17.11 / 14:16
крипто GPT-5.1 вошла в число лидеров по качеству программирования
Через день после релиза в ChatGPT, GPT-5.1 вышла в API и добавлена в кодинг-агент Codex вместе с новыми инструментами для разработки. Модель построена на архитектуре GPT-5 и унаследовала ее способность долго размышлять над сложными задачами — от анализа репозиториев до генерации патчей.
17.11 / 13:33
люди общество политика разведка самит спецслужбы расследование Китайская хакерская госгруппа использовала Claude для масштабного кибершпионажа
Anthropic опубликовала отчет о попытке масштабной кампании кибершпионажа, в которой связанная с Китаем хакерская группа использовала возможности Claude для почти полностью автоматизированных атак. По данным компании, злоумышленники нацелились примерно на 30 крупных организаций по всему миру — от технологических гигантов до финансового сектора и критической инфраструктуры — и в части случаев смогли добиться первичного проникновения.
17.11 / 13:05
СМИ история общество 32-летняя японка сыграла «свадьбу» с ИИ-персонажем из ChatGPT
32-летняя японка, известная в СМИ под именем Кано, провела символическую "свадьбу" с ИИ-персонажем, которого создала через ChatGPT. История получила широкое внимание после сюжета регионального телеканала из Окаямы, а затем разошлась по англоязычным медиа и соцсетям как "брак человека и ИИ" — хотя юридической силы у церемонии нет.
17.11 / 07:08
самит ByteDance ByteDance запустила самый дешевый в Китае ИИ для кодинга — всего 450 руб./мес за уровень Sonnet 4.5
ByteDance через свое облако Volcano Engine запустила Doubao-Seed-Code — ИИ-ассистент для программирования, который компания позиционирует как самый дешевый в Китае. По результатам SWE-Bench Verified модель набирает 78,8 % — это сопоставимо с уровнем Claude Sonnet 4.5, тогда как подписка стоит около 40 юаней в месяц (примерно 450 руб).
17.11 / 06:23
Nvidia общество Microsoft представила фабрики суперинтеллекта — архитектуру Fairwater
Microsoft рассказала про архитектуру Fairwater — нового типа датацентров Azure AI — и одновременно анонсировала строительство еще одного центра на площадке под Атлантой. Этот ДЦ планируется объединить с первым Fairwater в Висконсине и предыдущими ИИ-суперкомпьютерами Azure в "первую планетарную AI-суперфабрику", на которой компания будет тренировать ИИ-модели, существенно превосходящие все, что есть сейчас.
15.11 / 13:31
Nvidia BMW самит SoftBank Quantinuum представила Helios — самый мощный квантовый компьютер в мире
Quantinuum представила Helios — квантовый компьютер, который в компании называют самым мощным в мире. Процессор на 98 ионных кубитах и 48 полностью корректируемых логических кубитах задает рекордную планку по точности операций и эффективной коррекции ошибок: одиночные гейты дают точность порядка 99,9975 %, двухкубитные — около 99,921 %. В Quantinuum позиционируют Helios в ктом числе как основу для Generative Quantum AI (GenQAI) — гибридных систем, где квантовый компьютер генерирует данные и распределения для обучения классических моделей ИИ.
15.11 / 09:04
бюджет мода и стиль OpenAI выпустила GPT-5.1
OpenAI представила обновление линейки моделей: GPT-5.1 Instant и GPT-5.1 Thinking. Первыми доступ начнут получать пользователи подписок ChatGPT Plus и Pro — традиционна полная раскатка модели будет идти поэтапно и может занять до нескольких дней. API-поддержка появится в ближайшие недели. Компания описывает релиз как "крупное обновление", но внутри семейства GPT-5.
15.11 / 07:00
семья курс google $50 млрд для Claude: Anthropic запускает строительство собственных дата-центров в США
Anthropic объявила о запуске масштабной инвестпрограммы в размере $50 млрд, направленной на развитие ИИ-инфраструктуры в США. В рамках инициативы компания построит собственные дата-центры в партнерстве с Fluidstack — британским провайдером GPU-облаков и кастомных дата-центров, специализирующимся на развертывании кластеров под ИИ-нагрузки. По словам Anthropic, проект необходим для удовлетворения растущего спроса на модели Claude и обеспечения вычислительных мощностей для исследований "на фронтире искусственного интеллекта".
15.11 / 07:00
продукты экономика закон самит Глава Microsoft назвал гонку за AGI бессмысленной
Гендиректор Microsoft Сатя Наделла в интервью у Дваркеша Пателя раскритиковал гонку за "вехами AGI", назвав достижение подобных целей "бессмысленным хакерством бенчмарков". По его словам, такие рубежи плохо отражают реальный прогресс и чаще служат инфоповодом, чем ориентиром для индустрии.
14.11 / 14:36
СМИ самит google ChatGPT получит групповые чаты с участием ИИ
Небольшая группа пользователей ChatGPT получила доступ к функции групповых чатов, которую далее планируется открыть для всех подписчиков. Функция старта такого чата появляется в верхней панели веб-версии — там можно создать чат, а затем поделиться ссылкой на него с другими пользователями. Также для чата можно прописать отдельные инструкции, подробно рассказав о теме разговора и участниках, которые над ней работают.
14.11 / 14:21
общество самит журналист профессия интересное Вышел анализ влияния ИИ на рынок труда в США: ML-инженеры растут, разработчики ПО в безопасности
Bloomberry опубликовал исследование о том, как ИИ влияет на рынок труда в США. Аналитики сервиса изучили более 180 млн объявлений о найме и выявили, какие профессии теряют спрос быстрее всего, а какие, наоборот, растут. Общий фон — падение числа вакансий примерно на 8% за год, но распределяется оно неравномерно: ИИ усиливает одни профессии и вытесняет другие.
14.11 / 08:42
google Nano gemini Главный соперник nano banana 2? Первая информация о Mandarin — ИИ-рисовалке от xAI
На LMArena началось тестирование Mandarin: новой продвинутой модели создания изображений. В ответ на классический промпт "нарисуй доску и напиши на ней, кто твои создатели", модель отвечает, что ее разработала компания Илона Маска xAI (Grok):
14.11 / 07:19
экономика общество xAI и Anthropic-Amazon первыми построят дата-центры рекордной мощности 1 ГВт
Аналитическая группа Epoch AI оценила темпы строительства крупнейших ИИ-кампусов в США. По их модели, первыми до порога 1 ГВт мощности дойдут Anthropic–Amazon (New Carlisle) и xAI (Colossus 2) — оба проекта находятся на финальных стадиях подготовки и запустятся в начале 2026 года. При этом xAI показывает рекорд по скорости строительства — примерно год.
14.11 / 06:14
общество google gemini Ждем Doom внутри Gemini? Google готовит «креативный холст» для своего чат-бота
В сети появилась информация о двух новых режимах отображения информации в чат-боте Gemini: Visual Layout и Creative Canvas. Visual Layout пригодится, если ИИ подготовил объемный ответ, который удобнее читать в структурированном виде: с картинками, информационными карточками и даже вкладками с дополнительной информацией.
14.11 / 04:17
продукты связь самит стартап дети и родители инвестор «Крестный отец ИИ» Янн ЛеКун планирует уйти из Meta* и запустить свой стартап
Financial Times со ссылкой на источники сообщает, что главный ученый Meta* (признана экстремистской в России) по искусственному интеллекту Янн ЛеКун готовится покинуть компанию и запустить собственный ИИ-стартап. По данным издания, он уже ведет ранние переговоры с потенциальными инвесторами. Официального подтверждения со стороны Meta* и самого ЛеКуна пока нет.
13.11 / 22:45
reddit Китайский топ-ИИ Kimi K2 получит новые версии, компьютерное зрение и агентный режим
В ходе сессии вопросов и ответов на Reddit команда Moonshot AI раскрыла планы по развитию модели Kimi K2. Разработчики подтвердили, что готовят несколько новых версий, включая облегченные для запуска на потребительском "железе", а также ведут работу над мультимодальностью и агентным режимом с поддержкой инструментов.
13.11 / 09:27
общество прогноз бюджет доллар gemini Доработанная GPT-5 Pro достигла человеческого уровня в сложном бенчмарке ARC-AGI-1
Исследователь Джереми Берман сообщил, что разработанная им мультиагентная система на базе GPT-5 Pro показала 88 из 100 на случайной выборке задач из бенчмарка ARC-AGI-1 при средней стоимости порядка 27 долларов за задачу и суммарном времени прогона около 12 часов. Берман подчеркивает, что результат еще предстоит проверить на скрытом наборе ARC Prize; в его прошлых экспериментах официальная верификация обычно снижала итог на несколько пунктов и слегка увеличивала стоимость. С этой оговоркой автор ожидает, что итоговый скор окажется вблизи ориентирной планки «human-level» около 85%. Стоит отметить, что системы Бермана регулярно достигали лидирующих позиций в бенчмарках ARC, так что его слова заслуживают доверия.
13.11 / 08:19
общество доллар Финальное обучение Kimi K2-Thinking стоило всего $4,6 млн — в разы меньше западных моделей
По данным CNBC, финальный этап обучения модели Kimi K2-Thinking обошелся примерно в 4,6 миллиона долларов. Издание ссылается на анонимный источник и уточняет, что не смогло независимо подтвердить эту цифру. Компания Moonshot AI официально стоимость обучения не раскрывала, поэтому речь идет о предварительной оценке.
13.11 / 08:19
продукты самит google Google представила DS-STAR — ИИ-агента для сквозной дата-аналитики
Исследователи Google представили DS-STAR — экспериментального ИИ-агента, способного самостоятельно проводить полный цикл анализа данных: от чтения исходных файлов до написания кода, проверки результатов и улучшения своих шагов. В тестах система показала лучшие результаты среди существующих аналогов.
13.11 / 06:41
люди общество профессия CEO Разработчик DeepSeek предупредил о риске увольнений из-за ИИ
На Всемирной интернет-конференции в Учжэне старший исследователь DeepSeek Чен Дэли (выступил как делегат CEO компании Ляна Вэньфэна) предупредил: по мере развития ИИ в горизонте 5–10 лет начнется заметное вытеснение людей из ряда профессий. Он предложил индустрии ввести механизм "осведомителей" — публичного учета и раскрытия случаев, когда внедрение ИИ приводит к сокращениям или перераспределению сотрудников.
12.11 / 18:14
люди творчество Сэм Альтман рассказал, чем GPT-6 будет отличаться от GPT-5
В недавнем эпизоде подкаста Conversations with Tyler глава OpenAI Сэм Альтман пообещал, что GPT-6 станет большим шагом и для науки, и для управления компаниями. От точечных "проблесков" GPT-5 новая версия перейдет к первым к реальным открытиям и высоким долям автоматизации отделов под управлением ИИ. На вопрос ведущего подкаста, готова ли компания открыть доступ к GPT-6 до конца года хотя бы ученым, Альтман ответил негативно — выход модели готовят на 2026-й.
12.11 / 09:18
технологии google Nano gemini Google случайно открыла доступ к nano banana 2
На платформе Media AI, которая агрегирует доступ к нейросетям от разных компаний, на некоторое время появилась новая модель генерации изображений Google Nano Banana 2.
12.11 / 08:10
семья самит reddit мода и стиль Сотрудник OpenAI пожелал «смерти» модели GPT-4o
Популярный X-аккаунт Roon (250 тысяч подписчиков), который принадлежит одному из технических сотрудников OpenAI, резко высказался в отношении модели GPT-4o, назвав ее "плохо выровненной" и сказав, что надеется, что модель "скоро умрет".
12.11 / 05:49
экономика общество Progressive В OpenAI предупредили о «потенциально катастрофической» опасности супер-ИИ
На официальном сайте OpenAI вышел программный пост AI Progress and Recommendations ("Развитие ИИ и рекомендации), в котором компания в том числе предупреждает о "потенциально катастрофических" рисках супер-ИИ и предлагает пять шагов для улучшения безопасности.
12.11 / 04:03
бизнес экспорт закон Nvidia политика самит «Китай — на наносекунды позади»: босс Nvidia призвал США выиграть ИИ-гонку
После того, как Financial Times выпустил новость с якобы заявением Дженсена Хуанга, что Китай "выиграет гонку ИИ", босс Nvidia уточнил свою позицию. Хуанг пояснил, что, по его мнению, Китай не побеждает, а всего в "наносекундах позади" США. Поэтому Америке "жизненно важно выиграть", ускоряясь и притягивая разработчиков. Он также подчеркнул, что у Nvidia нет активных обсуждений продажи чипов Blackwell в Китай.
12.11 / 02:27
продукты мода и стиль Прототип GPT-5.1 можно бесплатно попробовать на OpenRouter
На сервисе OpenRouter появилась стелс-модель Polaris Alpha, которую в ближайшие дни можно использовать бесплатно. В сообществе считают, что это - тестовая версия GPT-5.1, о скором выходе которой ходят слухи. Модель не выдает своего разработчика, но раскрывает параметр knowledge cutoff (дата, по которую у ИИ есть знания) - октябрь 2024 года. Из всех моделей на рынке аналогичный knowledge cutoff есть только у семейства GPT-5, развитием которого и должна стать GPT-5.1.
11.11 / 13:58
бизнес технологии президент самит google В Google предложили решение одного из главных недостатков ИИ
Практически все современные ИИ страдают "катастрофическим забыванием": если доучивать модель на новых данных, то она начинает путать и забывать старое. Из-за этого трудно реализовать постоянное обучение моделей — а это важно, например, в задачах бизнеса, где что-то меняется ежедневно. И также иногда приводит к курьезам, когда модель продолжает называть Джо Байдена президентом США.
11.11 / 10:43
продукты экономика Huawei Nvidia самит Китай запретил ИИ-чипы Nvidia в дата-центрах с госфинансированием
По данным Reuters, Китай запретил использование иностранных ИИ-чипов во всех проектах дата-центров, которые получают госфинансирование. Новые объекты обязаны ставить только отечественные процессоры; проекты с готовностью менее 30% должны убрать уже установленные зарубежные чипы или отказаться от их закупок. Проекты с бОльшей степенью завершенности будут рассматривать индивидуально. Решение ударит по Nvidia/AMD/Intel; под запрет попадают и "разрешенные" для КНР H20, и более мощные H200/B200, даже если они попадали через серые каналы.
11.11 / 09:44
общество google gemini ИИ-ученый Google AlphaEvolve помог математикам совершить несколько открытий
Группа математиков и исследователей ИИ представила подробную работу о том, как ИИ-ученый Google DeepMind AlphaEvolve помогает находить новые конструкции в математике; среди авторов — легенда математики Теренс Тао (UCLA), а также Богдан Георгиев и Адам Жолт Вагнер (Google DeepMind) и Хавьер Гомес-Серрано (Brown University/IAS). В статье описан единый конвейер: от машинного поиска идей до доказательств и формализации результатов.
10.11 / 16:18
связь технологии люди общество самит мозг Представлен ИИ, который читает воспоминания — шаг к чтению мыслей
Группа японских ученых из лаборатории NTT, Inc показала систему, которая по данным функциональной МРТ генерирует текстовые описания того, что человек вспоминает, представляет или видит. В отличие от более ранних экспериментов, где удавалось распознавать лишь общие категории вроде "человек" или "пейзаж", теперь формируются более подробные тексты вроде "собака прыгает в воду" или "мужчина идет по пляжу". Авторы называют это "подписи к мыслям" (mind-captioning).
10.11 / 12:48
экономика самит Беплатная нейросеть Kimi K2-Thinking обошла GPT-5 в одном из самых сложных бенчмарков
Вслед за запуском Kimi K2-Thinking, компания Moonshot AI опубликовала подробный блог-пост с описанием модели, а также выпустила ее открытые веса (ранее модель вышла в API и чате, причем в чате она бесплатна). По бенчмаркам видно, что новинка идет на равных с лидирующими коммерческими ИИ: GPT-5, Claude Sonnet 4.5 и Grok 4.
10.11 / 09:56
крипто токен Вышла Kimi K2-Thinking. Новый ИИ из Китая доступен бесплатно
Moonshot AI начала раскатку думающей версии своей модели K2 - K2-Thinking. Официального релиза пока нет, но модель уже доступна в API и чат-приложении Kimi. В чате ей можно пользоваться бесплатно, включается через меню Tools (левый нижний угол поля для ввода промпта) - Thinking.
10.11 / 07:42
общество самит доллар мозг болезнь Представлен ИИ-ученый Edison Kosmos, за день выполняющий до 6 месяцев рутинной работы
Представлен агент Edison Kosmos — "ИИ-ученый", который берет на себя самый трудоемкий черновой слой научного R&D. В одном длинном прогоне он сам находит и «переваривает» литературу, формулирует проверяемые гипотезы, пишет код анализа данных (обычно на Python/R), строит графики и собирает связный отчет с цитатами и ссылками на исходники. Разработчики заявляют, что такой подход значительно сокращает количество черновой работы — в тестировании модель за один дневной прогон справлялась с объемами работы до 6 месяцев ( речь об оценке эквивалента объема, а не о буквальном календарном сроке).
DMCA