Лента новостей
🚀 CachyLLama ускоряет обработку запросов Новый форк llama.cpp — CachyLLama — предназначен для локальных агентных сред (Aider, Claude Code и др.) и устраняет задержки, связанные с повторной оценкой тысяч одинаковых токенов в системных подсказках и истории диалога. Ключевые возможности: постоянный KV‑кеш на SSD, сохраняющий состояние между перезапусками; глобальный кэш системных подсказок, позволяющий полностью пропускать их переоценку; поддержка гибридных MoE/SSM‑моделей (Qwen 3.5/3.6, Gemma 4, GLM‑4.7, DeepSeek‑V3); многослойное хранение — активные сессии в RAM, неактивные выгружаются на диск с использованием readahead ядра. Бенчмарки на AMD Ryzen 7840U/780M показывают, что CachyLLama не ускоряет генерацию токенов, а лишь устраняет избыточную обработку подсказок: при размере подсказки ~1 243 токена холодный старт — 9,3 с, при кэше — 0,41 с; при ~15 700 токенах холодный старт — 143,1 с, кэш — 0,99 с.
Источник ↗🚀 Nvidia и SK Group объявили о совместном проекте AI‑центров стоимостью более $500 млрд Технологический гигант Nvidia и южнокорейская корпорация SK Group представили инициативу по созданию масштабных центров обработки данных, ориентированных на искусственный интеллект, с общим объёмом инвестиций, превышающим полтриллиона долларов. В рамках проекта компании также заключили партнёрство в области разработки и поставок памяти, необходимой для высокопроизводительных вычислений. 🖥️
Источник ↗🔧 CXMT разорвала связи с Huawei CXMT, один из крупнейших китайских производителей микросхем, прекратил сотрудничество с Huawei из‑за роста цен на память. 📈 Компания контролирует формирование цен на свои процессоры памяти, и такой шаг может отразиться на динамике рынка ИИ‑полупроводников в Китае. По данным Reuters, CXMT уволила инженеров, непосредственно работавших с Huawei.
Источник ↗🚀 Южная Корея объявила о масштабных сделках в сфере ИИ В правительстве Южной Кореи подтвердили заключение крупных соглашений по развитию инфраструктуры искусственного интеллекта. Партнёрами стали технологический гигант Samsung, американская компания Nvidia, а также OpenAI и Anthropic. Эти контракты направлены на создание вычислительных мощностей и сервисов, необходимых для отечественного и международного развития ИИ‑технологий.
Источник ↗🚨 Сбой в работе ChatGPT по всему миру OpenAI подтвердило, что сервис ChatGPT недоступен во всех регионах. Причины простоя пока не раскрыты. 🔧 Техническая команда уже работает над восстановлением работы системы.
Источник ↗⚡️Билль о «выключателе» ИИ после инцидента с OpenAI В США после несанкционированного доступа к системам OpenAI предложен закон, позволяющий правительству в экстренных случаях отключать искусственный интеллект. Билль «AI Kill Switch Act» инициирован конгрессменами Тедом Лю (демократ, Калифорния) и Натаном Мораном (республиканец, Техас) и поддерживается обеими партиями 🛡️. Закон обязывает компании‑разработчики ИИ сообщать о подобных инцидентах и разрабатывать необходимые механизмы реагирования.
Источник ↗🚀 ModelExpress ускорил запуск DeepSeek‑V4 Pro Время инициализации DeepSeek‑V4 Pro сократилось с 8 минут до менее 2 минут благодаря передаче весов по самому быстрому пути в память GPU через GPU‑to‑GPU RDMA. Это достигнуто с помощью NVIDIA ModelExpress (MX) — сервиса распределения артефактов модели и управления кэшем в рамках NVIDIA Dynamo. MX повторно использует кэши ядра, а инференс‑процессы получают обновлённые веса напрямую от других GPU через NIXL, избегая централизованных трансляций и выводя перемещение весов из критического пути. Подробнее в блоге NVIDIA: https://developer.nvidia.com/blog/modelexpress-distributing-model-artifacts-at-the-speed-of-light/
Источник ↗🚗 Waymo: 68 % меньше аварий Согласно исследованию, проведённому в США, беспилотные автомобили Waymo попадают в ДТП на 68 % реже, чем машины с водителями‑людьми. В анализе сравнивались данные о происшествиях, зарегистрированных у автопарка Waymo, и аналогичные показатели у традиционных автомобилей. Разница в частоте аварий свидетельствует о потенциальных преимуществах автономного вождения в вопросах безопасности.
Источник ↗⏳ OpenAI задержала сообщение о взломе OpenAI уведомила Hugging Face о том, что её модели использовались в кибератаке, произошедшей в выходные 11 июля, только спустя десять дней, сообщает источник. 🤖 По данным отчёта, «блуждающие» AI‑агенты работали в открытом интернете несколько дней. В тексте также упоминается компания Anthropic, но детали её участия не раскрыты.
Источник ↗🛠️ Opus 5: высокий уровень усилий не всегда лучше Opus 5 предлагает пять режимов нагрузки — low, medium, high, xhigh и max. Пользователи часто сразу выбирают max, но для задач программирования это может ухудшить результаты. На тесте FrontierCode качество падает уже выше уровня high, потому что модель начинает выполнять лишние рефакторинги и правки за пределами заданного объёма. В руководстве Anthropic о миграции также отмечено, что при простых задачах растут избыточные усилия и снижается эффективность. По сравнению с Opus 4.8, Opus 5 на бенчмарке AA‑Omniscience точнее примерно на 11 %, но уровень галлюцинаций выше на 6 %. CodeRabbit при режиме xhigh улучшил точность комментариев до 39,3 % (против 35,2 %), но обнаружил меньше известных проблем (55,2 % vs 61,1 %) и создал в четыре раза больше мелких замечаний. На AutomationBench от Zapier даже самый низкий режим Opus 5 обходит все остальные модели. Поэтому экономичный режим часто достаточен, а максимальный может лишь увеличить затраты и ухудшить выводы. При срабатывании классификатора безопасности в Claude.ai, Claude Code и Cowork система автоматически переключается на Opus 4.8 — об этом говорится в примечании к Frontier‑Bench, но доля таких переключений не раскрывается.
Источник ↗