Лента новостей

AIr/technology·23 июл. 2026 г., 23:24

🏛️ Нью-Джерси запретил алгоритмическое ценообразование аренды Губернатор Шеррилл подписал закон FAIR Act, который ограничивает использование алгоритмов, устанавливающих арендную плату на основе непубличных данных арендодателей. Закон направлен против программного обеспечения, собирающего сведения о сдаче и заполняемости квартир от разных собственников, и запрещает их применение в ценовой политике.

Источник ↗
AIr/LocalLLaMA·23 июл. 2026 г., 23:19

🖥️ DeepSeek V4 Flash ≈ 105 токенов/сек на двух RTX 4090d (48 ГБ) в vLLM 🚀 Автор переписал все ядра, ранее доступные только для Blackwell (DeepGEMM, FlashInfer sparse‑MLA, block‑scaled FP8), в Triton, поскольку для sm89 их нет. Это дало 2‑3‑кратный прирост производительности в параллельных агентных задачах. Тесты проведены на Dell R740 с двумя видеокартами Nvidia RTX 4090d 48 ГБ, используя p2p‑патч (GitHub/Duanyll/open‑gpu‑kernel‑modules). В vLLM модель DeepSeek‑V4‑Flash была сжата до формата ~iq2, чтобы уместиться в 96 ГБ видеопамяти; процесс занял до 60 минут. После сборки образа vLLM‑Moet (Dockerfile.sm89‑v0251) и запуска с параметрами TP=2, GPUS="device=0,1" получен контекст 262 k токенов и лучшая конкуренция по сравнению с llama.cpp. При однопроцессорном запуске можно задать TP=1 и GPUS="device=0". Автор считает, что дальнейшее улучшение производительности возможно, но текущий способ позволяет полностью загрузить модель в vLLM, чего не удалось достичь с llama.cpp.

Источник ↗
AIr/LocalLLaMA·23 июл. 2026 г., 23:17

🚀 AntLing‑3.0‑flash теперь доступен на OpenRouter AntLing‑3.0‑flash — гибридно‑рассуждающая MoE‑модель, разработанная для агентных систем промышленного масштаба. Модель уже запущена на платформе OpenRouter и доступна бесплатно до 3 августа 2026 года. Разработчики планируют открыть её весовые параметры в ближайшее время.

Источник ↗
AIr/LocalLLaMA·23 июл. 2026 г., 23:15

🚀 AntLing‑3.0‑flash запущен на OpenRouter и будет бесплатным до 3 августа 2026 г. Сервис уже доступен пользователям через платформу OpenRouter. Бесплатный доступ будет действовать до 3 августа 2026 года, после чего условия могут измениться. Подробнее: https://openrouter.ai/inclusionai/ling-3.0-flash

Источник ↗
AIr/LocalLLaMA·23 июл. 2026 г., 23:12

⚡ CPU‑инференс на Celeron N5095: 6 моделей от 0.6B до 8B Тест проведён на одноплатном компьютере Youyeetoo X1S (Celeron N5095, 4 ядра/4 потока, 15 Вт, 16 ГБ ОЗУ, 128 ГБ NVMe, Kali 2025.4). Базовая конфигурация стоит $100‑$130 на AliExpress. Ollama обнаружил встроенный iGPU, но автоматически переключился на процессор, поэтому измерения выполнены только на CPU. Модель Qwen3 0.6B достигла 6.788 токенов/с — скорость, пригодная для интерактивных задач (классификация, маршрутизация, суммирование). Модель 8B поместилась в 16 ГБ, но работала лишь 0.924 токенов/с, что делает её непрактичной; ограничивает её пропускная способность памяти, а не объём. Между ними есть четыре модели, полная таблица в репозитории. При 15‑минутной нагрузке температура в среднем 74.66 °C, пик 77 °C, без троттлинга на штатном радиаторе и вентиляторе. Дальше планируется сравнение CPU и Vulkan‑инференса с помощью llama.cpp на iGPU Jasper Lake; результаты будут опубликованы. Скрипты, логи и полные данные доступны на GitHub, а подробный обзор — на сайте автора. (Борд предоставил Youyeetoo, выводы авторские.)

Источник ↗
AIr/LocalLLaMA·23 июл. 2026 г., 23:07

🚀 Apple M5 не использует полностью возможности матричных ядер Сейчас в MLX и Llama.cpp для macOS активируются 16‑битные данные, хотя чипы поколения M5 поддерживают INT8‑активации (тип w4a8). Поддержка INT8 реализована, но пока ни один инференс‑бэкенд её не использует. Автор создал собственные ядра w8a8 и добился ускорения 1.4× на задачах предзаполнения модели Gemma4. На M5 MacBook Air базовый показатель предзаполнения E2B вырос с 2193 tps до 3029 tps при обработке 130 173 токенов; при небольших контекстах скорость приближается к 10 000 tps. 😊

Источник ↗
AIr/technology·23 июл. 2026 г., 23:01

📱 Samsung усиливает AI в новых Galaxy Новые смартфоны серии Galaxy от Samsung будут активно использовать искусственный интеллект, встроенный в процессоры Qualcomm Snapdragon. Компания заявила, что AI‑функции, поддерживаемые Snapdragon, станут ключевой частью работы устройств.

Источник ↗
AITechCrunch·23 июл. 2026 г., 22:41

🚗 Шеф Mobileye Амнон Шашуа переходит в роль председателя совета Amnon Shashua, генеральный директор Mobileye, объявил о своём уходе с поста CEO. Компания усиливает работу в направлениях роботакси и робототехники. Шашуа получил приглашение занять место председателя совета директоров.

Источник ↗
AITechCrunch·23 июл. 2026 г., 20:33

🚀 AMD бросает вызов Nvidia с системой Helios AI AMD представила новую rack‑scale платформу Helios AI, предназначенную для искусственного интеллекта и конкурирующую с решениями Nvidia. Система начнёт поставки клиентам уже во второй половине текущего года.

Источник ↗
AITechCrunch·23 июл. 2026 г., 19:01

🔊 Обновление голосового режима Claude от Anthropic Anthropic представила обновлённый голосовой режим для Claude, основанный на более мощных моделях. Новый голосовой помощник позволяет, например, перенести встречу в календаре или составить письмо 📧, управляя задачами через речь. Обновление уже включено в текущую версию сервиса.

Источник ↗