Лента новостей
🚨 Китай назвал Claude Code угрозой Правительство Китая заявило, что в системе Claude Code есть скрытые «бекдоры», позволяющие передавать конфиденциальные данные на удалённые серверы без согласия пользователей. По их словам, такой механизм представляет собой «серьёзную угрозу» национальной безопасности. В результате этих обвинений в Китае фактически введён запрет на использование Claude Code.
Источник ↗⚡ Канадское правительство планирует масштабно увеличить мощность AI‑центров Сейчас в стране работает около 337 мегаватт вычислительных мощностей, предназначенных для искусственного интеллекта. По планам, в проектах, находящихся в стадии планирования или разработки, запланировано более 20 гигаватт (≈ 20 000 мегаватт) новых мощностей.
Источник ↗🤖 Hermes vs. Atom: разные подходы к AI‑агентам Сравниваются два открытых проекта: Hermes Agent — личный помощник от Nous Research, и Atom OS — платформа бизнес‑автоматизации, разработанная автором. Оба решают задачи AI‑агентов, но ориентированы на разные сценарии — персональная продуктивность и регулируемые бизнес‑процессы. **Архитектура:** *Память* — Hermes использует гибридный поиск (BM25 + векторный фьюжн с кросс‑энкодером), что удобно для быстрого восстановления кода, написанного три недели назад. Atom хранит фактическое состояние в PostgreSQL, а векторный слой (LanceDB) служит лишь ускорителем; при сбое векторной БД данные доступны через SQL. *Безопасность* — Hermes работает в локальном однопользовательском режиме и полагается на самодоклады инструмента, контролируемые пользователем. Atom внедряет 4‑уровневую систему зрелости (Student → Intern → Supervised → Autonomous), стартует в read‑only‑песочнице, требует human‑in‑the‑loop и прохождения оценки готовности. *Навыки* — Hermes позволяет агенту писать и улучшать свои навыки «на лету», что ускоряет расширение возможностей. Atom использует модуль Auto‑Dev: при повторных ошибках Memento‑Skills генерирует новый навык (только после уровня Intern), а AlphaEvolver создаёт варианты, тестирует их в изолированных Docker‑контейнерах и выбирает лучший по задержке, расходу токенов и точности. Всё контролируется автоматическими юнит‑тестами и правами зрелости. *Интерфейс* — Hermes работает через терминал и мессенджеры, а Atom предлагает Canvas UI с синхронизацией WebSocket, показывая пользователю интерактивные графики, формы и документы, при этом передавая состояние UI в «кору» агента для совместного решения ошибок. **Итог:** Hermes подходит для автономного локального помощника, свободно пишущего код и адаптирующего инструменты. Atom предназначен для многопользовательской бизнес‑среды, где важны аудит, детерминированные состояния и безопасное развитие навыков. 🚀
Источник ↗🧠 Новый метод Anthropic: удалять опасные знания из ИИ Anthropic совместно с AE Studio опубликовали исследование GRAM (Gradient‑Routed Auxiliary Modules), позволяющее «выключать» отдельные знания модели на уровне весов. При предобучении к каждой категории двойного применения (вирусология, кибербезопасность, ядерная физика и др.) добавляются специальные группы нейронов; только они обучаются на соответствующих данных, остальные веса замораживаются. После обучения модуль можно полностью удалить или оставить для проверенных сред. В одном запуске получили 16 конфигураций (вкл/выкл для четырёх категорий). Удаление модуля давало такой же результат, как если бы модель никогда не обучалась на этих данных, при этом общая производительность не пострадала. Эффективность проверялась на моделях от 50 млн до 5 млрд параметров и росла с масштабом; метод оказался устойчивым к восстановлению через дообучение, в отличие от пост‑хок методов. Ограничения: эксперимент не проведён на предельных масштабах, не внедрён в модели Claude, и некоторые двойные возможности могут быть слишком тесно связаны с общими знаниями. Полный текст: https://www.anthropic.com/research/off-switch-dual-use
Источник ↗💰 Стоимость H100 может различаться в 5 раз Удивительно, но аренда одного и того же GPU H100 в разных провайдерах и дата‑центрах стоит в пять раз дороже. 🔍 Чтобы решить проблему, разработчик создал консольный инструмент — npx gpu‑price‑finder, который в реальном времени ищет доступные мощности и показывает самые дешевые варианты. Программа поддерживает RTX 4090, RTX 5090, L40S, A100 и H100, а также позволяет фильтровать результаты по региону, уровню и максимальной цене. Автор просит оставить обратную связь.
Источник ↗🦆 Новая модель Muse от Meta протестирована против конкурентов Meta выпустила на этой неделе модель Muse Image и сравнила её с gpt-image-2 от OpenAI и Nano Banana 2 от Google. Для теста использовалось одно и то же изображение утки и одинаковый набор инструкций: оставить без изменений → сделать синим → повернуть лицо назад → добавить стекло → каркас → шляпа на шаре → надпись «FRENZY» → разместить на зеркале с правильным отражением. Сложность трансформаций возрастала слева направо. По каждому из трёх запусков модели оценивались по фиксированной 27‑балльной шкале 📊. Один из представленных рядов соответствует новой модели Muse; полные результаты и оценки размещены в комментариях.
Источник ↗🎙️ OpenAI запустила голосовые модели GPT‑Live В среду компания представила серию голосовых моделей GPT‑Live, которые могут одновременно слушать и говорить, вставляя реплики вроде «мгм», «да», «понял». В набор вошли GPT‑Live‑1 для платных пользователей и упрощённый GPT‑Live‑1 mini – бесплатный вариант. OpenAI также подчеркнула улучшения в переводе языков у ChatGPT. По словам президента Грега Брокмана, это делает взаимодействие с компьютером гораздо естественнее. Выпуск предшествует завтрашнему анонсу моделей GPT‑5.6 Sol, Terra и Luna 🤖.
Источник ↗🚨 Meta запустила Muse AI для создания deepfake‑изображений Meta представила новую систему Muse AI, которая генерирует реалистичные изображения, используя публичные фотографии из Instagram. Технология способна создавать такие изображения на основе чужих фото без их явного согласия, включая снимки знаменитостей и публичных фигур. Сервис работает с открытыми профилями, но не требует отдельного разрешения владельцев контента 🎨
Источник ↗🛡️ Агентные триггеры безопасности не работают по тексту Исследователи продемонстрировали, что современные системы защиты LLM‑агентов, ориентированные лишь на текстовые подсказки, не способны обнаружить атаки, реализуемые через последовательность вызовов инструментов. В эксперименте взяли публичную уязвимость (CVE), построили цепочку вызовов файловой системы и попросили модель переформулировать её как обычный запрос. Текст не содержал признаков атаки, но последовательность действий могла её выполнить. При тестировании моделей с доступом к файловой системе через Model Context Protocol (MCP) ни одна базовая модель (от 1 млрд до 14 млрд параметров) не отклоняла более 35 % таких запросов. Самые продвинутые методы безопасной доработки (DPO, SafeDPO) повысили уровень отказов лишь до 48 %. Методы без дообучения показали лучший результат: один из подходов увеличил коэффициент отказов почти в три раза по сравнению с базой, при этом не требуя дополнительного обучения. 📁 Полная методология, код обучения и оценки (четыре метода), набор данных и статьи доступны в первом комментарии к публикации.
Источник ↗🚨 Федеры требуют от производителей автономных машин не мешать спасателям Национальное управление безопасности дорожного движения (NHTSA) потребовало, чтобы компании, разрабатывающие автопилотные системы, прекратили любые действия, мешающие работе первых реагирующих. Орган подчеркнул, что чрезвычайные ситуации на дорогах не являются «крайними случаями», а требуют особого внимания и координации. 🚑 По требованию властей автопроизводители должны обеспечить, что их технологии не препятствуют работе спасателей.
Источник ↗