Лента новостей

AITechCrunch·16 июл. 2026 г., 14:27

🚀 Kimi 3 приближается к Opus 4.8 Moonshot готовит новую модель Kimi 3, которая, по прогнозам, сократит отставание от Anthropic Opus 4.8. По данным FT, Kimi 3 станет крупнейшей открытой ИИ‑моделью из Китая: количество её параметров будет находиться в диапазоне от 2 трлн до 3 трлн 🤖.

Источник ↗
AIr/LocalLLaMA·16 июл. 2026 г., 14:18

🚀 Kimi K3 доступен в веб‑версии и приложении Модель Kimi K3 запущена для использования онлайн и в мобильном приложении. Она оснащена 2,8 трлн параметров и поддерживает контекст до 1 млн токенов. Разработчики отмечают, что Kimi K3 лидирует в кодировании, выполнении агентных задач, длительном рассуждении, визуальном восприятии и работе в роще агентов 📊

Источник ↗
AIr/LocalLLaMA·16 июл. 2026 г., 14:16

📊 Отчет Mozilla о состоянии открытого ИИ Mozilla опубликовала новый доклад «State of Open Source AI». В нём заявлено, что открытый ИИ преодолел важный рубеж, и многолетняя дискуссия о том, смогут ли открытые модели конкурировать с закрытыми, теперь считается завершённой. Ссылка на полный отчёт размещена внизу страницы. 🚀

Источник ↗
AIr/LocalLLaMA·16 июл. 2026 г., 14:11

🚀 hftools: загрузка моделей Hugging Face с возобновлением и проверкой Создатель инструмента hftools представил единый статический бинарник на Go (macOS, Windows, Linux; arm64 + x86‑64), который работает без Python и распространяется по лицензии MIT. Он возник из необходимости справляться с частыми сбоями при загрузке больших файлов GGUF и safetensors — многие загрузки прерывались из‑за 5xx‑ошибок Hub, а huggingface‑cli приходилось начинать заново. 🔧 hftools по умолчанию возобновляет загрузку: multipart‑Range‑запросы продолжаются с точного байтового смещения, а параметр --retries -1 позволяет выдержать многочасовые простои Hub. Для офлайн‑передачи файлов реализована проверка контрольных сумм — каждый файл сравнивается с SHA‑1 Git‑blob или SHA‑256 LFS, а файлы .sha256 /.sha1sum позволяют повторно проверять целостность без сети. Инструмент конвертирует между «плоской» загрузкой и кешем ~/.cache/huggingface в обе стороны, что упрощает работу трансформеров и диффузеров в изолированных средах. Дополнительно команда peek чтёт заголовок safetensors/GGUF одним Range‑запросом (тензоры, типы, параметры, несколько мегабайт) и сканирует на наличие небезопасных pickle‑импортов перед загрузкой чекпоинта. Установить можно командой `go install github.com/ziozzang/hftools/cmd/hftools@latest`, задав переменную HF_TOKEN, а готовые бинарники доступны на https://github.com/ziozzang/hftools. Проект ещё в ранней стадии, обратная связь и вопросы о альтернативных решениях приветствуются. Как вы проверяете большие модели при переносе их на офлайн‑машины?

Источник ↗
AIr/LocalLLaMA·16 июл. 2026 г., 14:10

🤖 Модели застревают в повторении JSON Изначально модель Qwen3‑VL‑30B была отклонена как слишком медленная для извлечения данных из документов. При запуске на видеокарте RTX 5090 выяснилось, что она застревает, постоянно генерируя один и тот же корректный JSON‑объект. Автор подробно описал свои эксперименты и сравнил поведение моделей Qwen и Gemma при обработке 37 страниц. Подробнее в статье: https://coles.codes/posts/grammar-constrained-repetition-trap/

Источник ↗
AIr/LocalLLaMA·16 июл. 2026 г., 14:09

📊 Запущен Cortex — открытый граф знаний для локальных моделей Cortex — это слой институциональной памяти для команд и сообществ, который автоматически упорядочивает загруженные данные, позволяя LLM‑агентам быстро их запрашивать даже на потребительском железе. Проект опубликован под лицензией Apache 2.0, исходный код доступен на GitHub — https://github.com/mocaOS/cortex-app. Для работы рекомендуется использовать небольшие модели: Gemma4‑26B‑A4B (MoE) для агентного поиска, Qwen3.6‑27B — для визуального ввода, а в качестве эмбеддингов — Qwen3‑0.6B или Qwen3‑VL‑2B. Один DGX Spark справляется со всем стеком, а при необходимости можно масштабировать с помощью двух видеокарт 3090/4090. Также поддерживается подключение облачных API через стандартизированные /v1‑эндпоинты (см. https://docs.cortex.eco). Интерфейс разделён на «Manage» (загрузка документов, поддержка множества форматов, интеграция crawl4ai для сканирования URL, Git‑интеграция) и «Explore» (визуализация графа, 3‑D‑просмотр через отдельный Cortex Explorer). Пользовательская версия — приложение Cortex Chat, где каждый сотрудник получает личный аккаунт и может выбирать режим «Chat» или «Deep Research». Команда собирает отзывы, планирует новые инструменты, например автоматическую транскрипцию YouTube‑каналов и их интеграцию в граф знаний.

Источник ↗
AIr/LocalLLaMA·16 июл. 2026 г., 14:05

📊 Обзор новых открытых моделей (июль 2026) На 16 июля 2026 г. опубликованы крупные модели с открытым весом, классифицированные по типу лицензии и результатам бенчмарков. Apache 2.0 — Thinking Machines Lab: Inkling (15 июля 2026); MIT — DeepSeek V4 Pro (24 апреля 2026); Xiaomi MiMo‑V2.5‑Pro (22 апреля 2026); GLM‑5.2 (13 июня 2026); Custom/restricted — MiniMax M3 (1 июня 2026); Kimi K2.7 Code (12 июня 2026); Modified MIT — NVIDIA: Nemotron 3 Ultra.

Источник ↗
AITechCrunch·16 июл. 2026 г., 13:18

🟢 Apple Intelligence получит запуск в Китае совместно с Alibaba и Baidu Apple официально одобрила запуск сервиса Apple Intelligence в Китае, сотрудничая с местными технологическими гигантами Alibaba и Baidu. 🤝 По сообщениям, о возможных переговорах шёл слух ещё в прошлом году, но теперь партнёрство подтверждено. Это событие рассматривается как важный шаг в реализации AI‑стратегии Apple на одном из крупнейших мировых рынков.

Источник ↗
AITechCrunch·16 июл. 2026 г., 11:30

🚀 Привлечено 5,5 млн долларов для новых AI‑устройств Бывший вице‑президент по аппаратному обеспечению компании Ultrahuman собрал инвестицию в размере 5,5 млн долларов. Средства направлены на разработку устройств, способных управлять AI‑агентами, а не только фиксировать пользовательские данные. Компания Aina объявила, что в ближайшие недели начнёт пилотный запуск собственного устройства, созданного в рамках этого проекта. 🤖

Источник ↗
AITechCrunch·16 июл. 2026 г., 11:00

🚨 Meta будет предупреждать родителей о суицидальных разговорах подростков с чат‑ботом Meta объявила, что теперь будет отправлять уведомления родителям, если их ребёнок‑подросток обсуждал с её ИИ‑чатботом темы самоубийства или самоповреждения. 🔍 Эти изменения появились на фоне усиливающегося контроля со стороны регуляторов и родителей, которые следят за тем, как чат‑боты реагируют на пользователей в кризисных ситуациях, особенно среди подростков, и проверяют действия Meta и других технологических компаний.

Источник ↗