Лента новостей

AIr/LocalLLaMA·1 июл. 2026 г., 15:28

📅 Open Models — июнь 2026 В июне 2026 года компания Open Models выпустила свой ежемесячный отчёт. Документ содержит актуальные данные о проектах компании за указанный период.

Источник ↗
AIr/LocalLLaMA·1 июл. 2026 г., 15:18

🤖 Gemma‑4‑31B превзошла голосовой режим ChatGPT На платформе Cerebras запущена модель gemma‑4‑31B, которая показала лучшие результаты, чем голосовой режим ChatGPT. 🎙️ Тесты подтвердили более точные и естественные ответы новой модели в голосовом взаимодействии.

Источник ↗
AIr/LocalLLaMA·1 июл. 2026 г., 14:58

📊 Обновление лидерборда SWE‑rebench Сегодня обновлен список лидеров SWE‑rebench: добавлены новые модели и улучшен интерфейс. В таблицу вошли GLM‑5.2, Qwen3.6‑27B, Qwen3.6‑35B‑A3B, Gemma 4 31B и несколько других моделей. Кроме новых записей, пользовательский интерфейс стал более удобным и информативным. 🛠️

Источник ↗
AIr/LocalLLaMA·1 июл. 2026 г., 14:28

🗂️ Подбор локальных LLM по объёму ОЗУ Автор составил карту, показывающую, какие локальные большие языковые модели работают при разных объёмах оперативной памяти. В таблице указаны модели, совместимые с уровнями от 8 ГБ до 128 ГБ ОЗУ. Все результаты опубликованы в открытом наборе данных, доступном для скачивания.

Источник ↗
AITechCrunch·1 июл. 2026 г., 14:20

🚀 Gemini Spark теперь доступен на Mac Google объявила, что её круглосуточный агентный помощник Gemini Spark теперь можно установить на компьютеры с macOS. В рамках обновления добавлены новые возможности: отслеживание в реальном времени и расширенная поддержка приложений.

Источник ↗
AIr/LocalLLaMA·1 июл. 2026 г., 14:07

🛠️ Лучшие практики разработки в эпоху кода от LLM В статье рассматриваются подходы к программированию, когда значительную часть кода генерируют большие языковые модели. Автор обсуждает, какие методики сохраняют эффективность и безопасность проекта при таком взаимодействии.

Источник ↗
AIr/LocalLLaMA·1 июл. 2026 г., 13:48

🔍 Визуализатор выполнения агентов Agent execution visualizer Agent execution visualizer

Источник ↗
AIr/LocalLLaMA·1 июл. 2026 г., 13:46

🤖 Deepseek выпустил модели V4 Flash в 2‑, 3‑ и 4‑битных форматах GGUF Компания представила новые версии модели V4 Flash, доступные в трех разрядных вариантах: 2‑бит, 3‑бит и 4‑бит GGUF. Файлы GGUF подготовлены для быстрой загрузки и интеграции в существующие системы. Эти версии позволяют выбирать оптимальный компромисс между размером модели и точностью работы.

Источник ↗
AITechCrunch·1 июл. 2026 г., 13:43

🚀 Meta планирует монетизировать избыточные AI‑ресурсы Meta, как и SpaceX, ищет способы превратить лишние вычислительные мощности ИИ в доход. 💡 Компания разрабатывает облачную инфраструктуру, где будет продавать доступ к вычислительным ресурсам и готовым моделям ИИ. Это поставит Meta в прямую конкуренцию с крупнейшими облачными провайдерами — Amazon Web Services, Google Cloud и Microsoft Azure.

Источник ↗
AIr/LocalLLaMA·1 июл. 2026 г., 13:42

🖥️ Вопрос о TPS модели Qwen3.5 122B Пользователь интересуется, какой максимальный показатель TPS (transactions per second) можно достичь, используя модель Qwen3.5 122B. Указаны параметры системы: видеопамять — 32 ГБ VRAM, оперативная память — 64 ГБ RAM.

Источник ↗