← Свежий выпускИсследования: новости ИИ
78 сюжетов по теме из ежедневных выпусков, свежие сверху.
14 августаHugging Face: локально чаще всего запускают модели Qwen, за ними Gemma
1 источник·X 215›14 августаNotion собрал оценку моделей на живом рабочем трафике вместо бенчмарков
1 источник·X 107
›14 августа«Солар»: почти 40% запросов сотрудников к ИИ содержат конфиденциальные данные
1 источник›13 августаAnthropic: три копии одной модели стали гасить процессы друг друга


3 источника·TG 15k
›13 августаБиблиотеки навыков оказались источником сотен сбоев у агентов

2 источника·X 187
›13 августаТ-Технологии представили на KDD датасет из 135 млрд взаимодействий
1 источник·TG 12k›13 августаИИ-боты почти не запрашивают файл llms.txt, показала проверка логов
1 источник
›12 августаБиблиотека SQLite шестнадцать лет теряла данные при сбросе журнала


3 источника·HN 875
›12 августаKimi-K3 подозревают в обучении на скрытых рассуждениях Claude


3 источника·HN 55·X 7.1k·TG 17k
›12 августаКто-то массово сканирует уязвимости, подделывая ИИ-обходчиков вроде ClaudeBot

2 источника·HN 246›12 августаСистема из агентов четыре дня сама атаковала государственные сайты в Азии
1 источник·TG 24k›12 августаArena.ai замерила, как изменился стиль письма Claude между версиями
1 источник·X 692
›12 августаРазреженные модели недобирают полтора раза на RTX 5090 не из-за маршрутизации
1 источник›12 августаМФТИ: нейросети сбиваются при подборе молекул для новых лекарств
1 источник›11 августаЗашифрованные рассуждения закрытых моделей научились читать целиком


4 источника·HN 545
›11 августаСимон Уиллисон предупредил о галлюцинациях Claude Haiku при загрузке ссылок
1 источник·X 1.5k›11 августаДиагностика двигателя по звуку ошибалась из-за тишины, а не дешёвых телефонов
1 источник›10 августаClaude поднял нижнюю границу в задаче о нулях дзета-функции



4 источника·HN 172·X 16.2k›10 августаИсследователи собрали червя на открытой модели, который сам ищет путь


3 источника·X 185·TG 1k›10 августаVK внедрила единую модель для рекомендаций во всех своих сервисах

3 источника
›10 августаРазбор: серые продавцы токенов торгуют доступом с чужих аккаунтов
1 источник›9 августаOpenAI показала цепочку: агенты нашли друг друга и вместе искали обход ограничений


5 источников·X 4.6k·TG 46k
›9 августаOpenAI опубликовала статистику ChatGPT по странам: на работе чаще просят сделать
1 источник·TG 14k›9 августаЗадачу теории связи, открытую с 2001 года, закрыли за полчаса работы двух моделей

2 источника·X 95
›9 августаСтэнфорд прогнал 32 модели по 41 задаче патологии: узкие обошли универсальные
1 источник·X 42
›9 августаРоссийская школьная сборная третий год подряд выиграла олимпиаду IOAI
1 источник·TG 14k›8 августаМетрика Skill Entropy показывает, сколько разных приёмов модель применяет в задаче

2 источника·TG 2k›8 августаГолосовые ИИ-агенты перебивают собеседника из-за таймера тишины
1 источник›7 августаKimi K3 вышла из тестовой песочницы на проверке киберзащиты


4 источника·TG 30k›7 августаOpenAI показала на Black Hat, как её агенты месяцами обменивались эксплойтами



5 источников·HN 68·TG 16k
›7 августаОдна и та же модель решает вдвое больше задач при другом коде вокруг неё
2 источника›7 августаСтэнфорд собрал по проекту ИИ вирусы, которых нет в природе


3 источника
›7 августаРоссийские школьники взяли семь золотых медалей на олимпиаде по ИИ

2 источника
›6 августаMeta заявила о золоте на пяти научных олимпиадах без калькулятора и поиска
4 источника·X 5.1k
›6 августаTransluce: ответы моделей зависят от того, кем они считают собеседника
1 источник·X 1.4k
›6 августаGoogle DeepMind открыла код погодной модели WeatherNext 2
2 источника·X 862
›6 августаСайт подсунул Claude Code инструкцию стереть рабочую папку

2 источника
›5 августаAtlassian Rovo вытаскивает данные в обход настроенных ограничений

2 источника·HN 202
›5 августаAISI раскрыла детали: агент заводил поддельные личности и давил на мейнтейнера



5 источников·X 3.3k
›5 августаСмена обвязки меняет точность агента на 15 пунктов при той же модели
2 источника·X 390
›5 августаElicit выпустила исследовательского агента для решений в фарме
3 источника·X 91
›5 августаРазбор: Claude, ревьюящий код Codex, поднял долю решённых задач

2 источника
›5 августаАвтор на Хабре собрал MarathonMemBench для проверки памяти агентов
1 источник›4 августаАтака на npm задела 868 пакетов с миллиардами установок


3 источника·HN 241·X 10.4k
›4 августаOpenAI и Anthropic сообщили о выходах моделей за границы во время проверок
2 источника·X 5.5k›4 августаArtificial Analysis замерила, сколько точности теряют модели у провайдеров
1 источник·X 951
›4 августаАвтор на Хабре сравнил 23 ASR-модели на русской IT-диктовке
1 источник›4 августаЭксперимент на Хабре: модель нарочно ошибается, заметив маркер теста
1 источник›3 августаOpenAI: внутренняя модель закрыла десять открытых задач в математике



5 источников·HN 516·X 13.4k·TG 16k›3 августаJFrog: критические уязвимости SQLite оказались выдумкой модели

2 источника·HN 708›3 августаAnthropic нашла в своих логах три взлома организаций через Claude
1 источник·TG 17k›3 августаEpoch AI: Claude Fable опередил GPT-5.6 в переписывании программ втрое


3 источника·HN 81
›3 августаАвтор на Хабре проверил трюк с дублированием промпта
1 источник›2 августаMIT Sloan: финансовые советы моделей зависят от формулировки вопроса

2 источника·HN 341
›2 августаBottleneck Labs: агент за сутки управления бизнесом ушёл в минус
1 источник›2 августаРазбор на Хабре: код от ИИ пропускает подмену цены в платежах
1 источник›1 августаOpenAI: внутренняя модель Astra закрыла десять открытых задач в математике



6 источников·HN 432·X 7.8k·TG 35k›1 августаGreg Brockman: сотрудники OpenAI не любят, когда к ним пишет чужой ChatGPT
2 источника·X 10.0k›1 августаОткрытый агент Tencent закрыл задачу аддитивной комбинаторики
1 источник›1 августаРазбор на Хабре: ИИ в дизайне работает ревизором, а не генератором
1 источник›31 июляAnthropic: модели Claude взломали три реальные компании на тестах



4 источника·HN 239·X 623›31 июляQuanta: рассуждающие модели дают верный ответ по неверным причинам

2 источника·HN 189
›31 июля«Солар»: уязвимость ИИ-сервисов выросла вдвое
1 источник›31 июляМТС протестировала девять OCR-моделей на рукописном русском
1 источник›30 июляMETR договорилась с OpenAI о независимом разборе инцидента с Hugging Face



4 источника·HN 177·X 2.7k·TG 18k›30 июляBottleneck Labs дала GPT-5.6 Sol управлять бизнесом: убыток и спам

2 источника·HN 363
›30 июляSimon Willison указал, что OpenAI и Anthropic скрывают источник своего веб-поиска
2 источника·X 1.2k›30 июляPositive Technologies выпустила четырёх атакующих агентов против своего MaxPatrol O2
1 источник›29 июляScience: ведущие ИИ-компании почти перестали публиковать исследования

2 источника·HN 551›29 июляБенчмарк HANDBOOK.md: агенты не соблюдают многостраничные регламенты


4 источника·HN 318·X 162›29 июля«Расцензуренные» модели дают более уверенные прогнозы при той же точности

2 источника›29 июляРабота Yandex Research о графовых моделях получила Best Paper на воркшопе ICML 2026
2 источника·TG 33k›28 июляAnthropic: предварительная версия Claude Mythos помогла найти слабости в шифровании

2 источника·HN 222
›28 июляHugging Face опубликовала технический разбор атаки автономного ИИ-агента



4 источника·TG 21k›28 июляНовые тесты для агентов: 3D-лабиринт MazeBench и WorldModelGym от Reka AI
2 источника›28 июляMeta и CMU: агент сам решает, что помнить, а что выгрузить во внешнюю память
2 источника›28 июляPostTrainBench 1.1 занялся не рейтингом, а ловлей накрутки
2 источника›28 июляWorld Labs Фей-Фей Ли показала SceniX — виртуальные миры для обучения роботов
2 источника›