Лента новостей

AIr/LocalLLaMA·25 июл. 2026 г., 13:48

🤖 Buzz — мультиплеерный ИИ с локальным и сетевым выводом Buzz — открытый проект, позволяющий использовать ИИ в многопользовательском режиме с локальными и распределёнными вычислениями. Встроен llama.cpp через mesh‑llm, так что можно запускать собственный LLM, хостить сервис самостоятельно или подключаться к друзьям, автоматически делясь вычислительными ресурсами 🚀. Система пока находится в прототипе, но уже работает в большинстве случаев; о ней идут обсуждения в Твиттере, а независимый автор Майк опубликовал демонстрационное видео. В ближайшую одну‑две недели планируется показать полностью изолированную (air‑gapped) конфигурацию Buzz. Автор открыт к диалогу.

Источник ↗
AIr/LocalLLaMA·25 июл. 2026 г., 13:41

🚀 MTP в llama.cpp: ускорение на плотных моделях Нативная поддержка MTP (многотоковое предсказание) появилась в llama.cpp через параметр --spec-type draft-mtp, позволяя моделям использовать встроенные MTP‑головы вместо отдельного чернового варианта. Такие головы есть у Qwen 3.6, DeepSeek и GLM. Работа, начатая в апреле PR #19493, обеспечила надёжность на гибридных и рекуррентных архитектурах, где прежний метод отката не работал. Реальные тесты показывают разный эффект: у плотных моделей (например, Qwen 3.6‑27B) ускорение составляет 1.4‑2.2 ×, а у MoE‑моделей прирост почти отсутствует, поскольку их активный параметрический расход уже низок. Аналогичная картина наблюдалась у Gemma 4 — dense‑версия 31B получила заметный прирост, MoE‑вариант — почти нет. Старый способ спекулятивного декодирования (отдельный черновой модель и n‑gram‑сопоставление) дал смешанные результаты: в тесте на Qwen 3.6‑35B‑A3B с RTX 3090 не было ускорения, а некоторые конфигурации работали медленнее. Сейчас более надёжным способом ускорения считается использование нативных MTP‑голов.

Источник ↗
AIr/LocalLLaMA·25 июл. 2026 г., 13:40

🚀 CachyLLama ускоряет обработку запросов Новый форк llama.cpp — CachyLLama — предназначен для локальных агентных сред (Aider, Claude Code и др.) и устраняет задержки, связанные с повторной оценкой тысяч одинаковых токенов в системных подсказках и истории диалога. Ключевые возможности: постоянный KV‑кеш на SSD, сохраняющий состояние между перезапусками; глобальный кэш системных подсказок, позволяющий полностью пропускать их переоценку; поддержка гибридных MoE/SSM‑моделей (Qwen 3.5/3.6, Gemma 4, GLM‑4.7, DeepSeek‑V3); многослойное хранение — активные сессии в RAM, неактивные выгружаются на диск с использованием readahead ядра. Бенчмарки на AMD Ryzen 7840U/780M показывают, что CachyLLama не ускоряет генерацию токенов, а лишь устраняет избыточную обработку подсказок: при размере подсказки ~1 243 токена холодный старт — 9,3 с, при кэше — 0,41 с; при ~15 700 токенах холодный старт — 143,1 с, кэш — 0,99 с.

Источник ↗
AIr/technology·25 июл. 2026 г., 13:28

🚀 Nvidia и SK Group объявили о совместном проекте AI‑центров стоимостью более $500 млрд Технологический гигант Nvidia и южнокорейская корпорация SK Group представили инициативу по созданию масштабных центров обработки данных, ориентированных на искусственный интеллект, с общим объёмом инвестиций, превышающим полтриллиона долларов. В рамках проекта компании также заключили партнёрство в области разработки и поставок памяти, необходимой для высокопроизводительных вычислений. 🖥️

Источник ↗
AIr/technology·25 июл. 2026 г., 12:12

🔧 CXMT разорвала связи с Huawei CXMT, один из крупнейших китайских производителей микросхем, прекратил сотрудничество с Huawei из‑за роста цен на память. 📈 Компания контролирует формирование цен на свои процессоры памяти, и такой шаг может отразиться на динамике рынка ИИ‑полупроводников в Китае. По данным Reuters, CXMT уволила инженеров, непосредственно работавших с Huawei.

Источник ↗
AIr/technology·25 июл. 2026 г., 09:59

🚀 Южная Корея объявила о масштабных сделках в сфере ИИ В правительстве Южной Кореи подтвердили заключение крупных соглашений по развитию инфраструктуры искусственного интеллекта. Партнёрами стали технологический гигант Samsung, американская компания Nvidia, а также OpenAI и Anthropic. Эти контракты направлены на создание вычислительных мощностей и сервисов, необходимых для отечественного и международного развития ИИ‑технологий.

Источник ↗
AIr/technology·25 июл. 2026 г., 09:51

🚨 Сбой в работе ChatGPT по всему миру OpenAI подтвердило, что сервис ChatGPT недоступен во всех регионах. Причины простоя пока не раскрыты. 🔧 Техническая команда уже работает над восстановлением работы системы.

Источник ↗
AIr/technology·25 июл. 2026 г., 08:44

⚡️Билль о «выключателе» ИИ после инцидента с OpenAI В США после несанкционированного доступа к системам OpenAI предложен закон, позволяющий правительству в экстренных случаях отключать искусственный интеллект. Билль «AI Kill Switch Act» инициирован конгрессменами Тедом Лю (демократ, Калифорния) и Натаном Мораном (республиканец, Техас) и поддерживается обеими партиями 🛡️. Закон обязывает компании‑разработчики ИИ сообщать о подобных инцидентах и разрабатывать необходимые механизмы реагирования.

Источник ↗
AIr/LocalLLaMA·25 июл. 2026 г., 08:35

🚀 ModelExpress ускорил запуск DeepSeek‑V4 Pro Время инициализации DeepSeek‑V4 Pro сократилось с 8 минут до менее 2 минут благодаря передаче весов по самому быстрому пути в память GPU через GPU‑to‑GPU RDMA. Это достигнуто с помощью NVIDIA ModelExpress (MX) — сервиса распределения артефактов модели и управления кэшем в рамках NVIDIA Dynamo. MX повторно использует кэши ядра, а инференс‑процессы получают обновлённые веса напрямую от других GPU через NIXL, избегая централизованных трансляций и выводя перемещение весов из критического пути. Подробнее в блоге NVIDIA: https://developer.nvidia.com/blog/modelexpress-distributing-model-artifacts-at-the-speed-of-light/

Источник ↗
AIr/technology·25 июл. 2026 г., 08:34

🚗 Waymo: 68 % меньше аварий Согласно исследованию, проведённому в США, беспилотные автомобили Waymo попадают в ДТП на 68 % реже, чем машины с водителями‑людьми. В анализе сравнивались данные о происшествиях, зарегистрированных у автопарка Waymo, и аналогичные показатели у традиционных автомобилей. Разница в частоте аварий свидетельствует о потенциальных преимуществах автономного вождения в вопросах безопасности.

Источник ↗