Лента новостей

AIr/LocalLLaMA·29 июн. 2026 г., 04:30

🔧 Первые ручные результаты тестирования переноса процедурных навыков в небольших моделях Исследователи опубликовали обновление, в котором представлены первые результаты экспериментов по переносу процедурных навыков между небольшими языковыми моделями. Тестирование проводилось вручную, что позволило детально оценить эффективность переноса и выявить ключевые ограничения текущих подходов. Полученные данные помогут в дальнейшем улучшать методы обучения небольших моделей, делая их более гибкими при выполнении сложных задач.

Источник ↗
AIr/LocalLLaMA·29 июн. 2026 г., 04:29

❓ Почему нет системы «pay‑to‑own» для локальных моделей? Вопрос был задан в рамках обсуждения доступа к локальным ИИ‑моделям.

Источник ↗
AIr/LocalLLaMA·29 июн. 2026 г., 04:28

🏆 GLM 5.2 опередил Claude в кибер‑тестах В последних кибер‑бенчмарках, проведённых в рамках проекта Mythos at Home, модель GLM 5.2 показала более высокие показатели, чем Claude от Anthropic. Тесты оценивали способность моделей решать задачи в сфере кибербезопасности, и результаты подтвердили конкурентоспособность GLM 5.2. Подробные метрики и методика сравнения будут опубликованы в ближайшее время.

Источник ↗
AIr/LocalLLaMA·29 июн. 2026 г., 04:27

🔍 Возможен ли запуск 405B на 8‑GPU узле? Технические специалисты рассматривают сценарий работы модели 405B на одном узле с восемью видеокартами A100. Планируется загрузка до 30 специализированных моделей‑специалистов в «горячем» режиме. Ожидаемое время переключения между специалистами должно составлять менее 200 мс, что позволяет быстро менять контекст обработки запросов. Вопрос остаётся открытым: есть ли практические применения для такой конфигурации.

Источник ↗
AIr/LocalLLaMA·29 июн. 2026 г., 04:26

🔧 Обновления в Ubuntu, CUDA, llama.cpp и nvcc Ubuntu CUDA, llama.cpp, nvcc versioning

Источник ↗
AIr/LocalLLaMA·29 июн. 2026 г., 04:24

🔎 Minimax M3 vs M2.7 Сравнительный материал посвящён моделям Minimax M3 и M2.7. В заголовке указано, что рассматривается противостояние этих двух вариантов.

Источник ↗
AIr/LocalLLaMA·29 июн. 2026 г., 04:23

🔄 Возможный прорыв для локальных LLM Новое решение может стать переломным моментом. Для локальных больших языковых моделей.

Источник ↗
AIr/MachineLearning·29 июн. 2026 г., 04:19

🤖 AI‑платформа для кредитных документов запустила новые функции На этой неделе команда завершила работу над системой, предназначенной для анализа кредитных документов с помощью искусственного интеллекта. В релиз вошли три ключевых компонента: модуль обнаружения мошенничества, гибридный поиск 🔍 и система резервного отправления писем с трёхуровневой схемой отказа. Все функции уже доступны пользователям платформы.

Источник ↗
AIr/LocalLLaMA·29 июн. 2026 г., 00:51

🧠 Высококачественная квантизация GLM‑5.2 на 4‑х DGX Spark Опубликован подробный гайд по квантизации модели GLM‑5.2 с использованием четырёх серверов DGX Spark. В руководстве описаны методики, настройки и последовательность шагов для получения качественного результата. В документе представлены полученные метрики производительности и точности, а также сравнение с другими подходами к квантизации. Все материалы доступны для изучения специалистами, работающими с крупными языковыми моделями и вычислительными кластерами.

Источник ↗
AIr/LocalLLaMA·29 июн. 2026 г., 00:50

📘 Руководство по Fine‑Tune в MLX Опубликовано примерное руководство по настройке (fine‑tune) моделей в системе MLX. Оно содержит пошаговые инструкции и кодовые примеры для практического применения.

Источник ↗