Лента новостей

AIr/technology·15 июл. 2026 г., 09:08

🚀 ASML повышает прогноз до 2026 года и расширяет мощности ASML объявила о повышении финансового прогноза на 2026 год. Компания также планирует увеличить производственные мощности в ответ на растущий спрос на чипы для искусственного интеллекта. Рост спроса на AI‑чипы стал причиной расширения производства, чтобы обеспечить необходимую пропускную способность литографических установок.

Источник ↗
AIr/artificial·15 июл. 2026 г., 08:58

🚀 Цены на AI‑модели поднимаются За последний год‑два доступ к мощным моделям был чрезвычайно дешёвым, но компании Meta, Tesla и Uber уже ограничивают внутреннее использование ИИ из‑за роста расходов на вычисления. DeepSeek, известный своими недорогими моделями, объявил о вводе «пикового» ценообразования для предстоящего релиза V4: при высокой нагрузке стоимость API будет повышаться, аналогично «суровому» ценообразованию на GPU. Это меняет подход к созданию AI‑продуктов: вместо повторного построения одинаковой инфраструктуры появляются специализированные решения. Примером служат Firecrawl (автоматический веб‑скрейпинг и загрузка данных) и Chatbase (превращение внутренних документов в AI‑ассистентов) — они позволяют инженерам сосредоточиться на самом продукте, а не на поддержке инфраструктуры. По мере того как стоимость токенов становится менее предсказуемой, такие узкоспециализированные сервисы становятся всё более ценными, а команды, предлагающие лучшие системы вокруг моделей, получат преимущество.

Источник ↗
AIr/technology·15 июл. 2026 г., 08:13

⚖️ Сотрудники подали иск против Meta за дискриминацию при увольнениях с помощью ИИ Группа нынешних и бывших работников обратилась в суд, заявив, что компания Meta использовала искусственный интеллект для проведения сокращений, что привело к дискриминационным решениям. 🤖 В иске подчёркивается растущее беспокойство по поводу влияния ИИ на рабочие места, особенно на людей с ограниченными возможностями.

Источник ↗
AIr/technology·15 июл. 2026 г., 08:11

🚀 Nvidia поставляет чипы H200 в Китай По словам официального представителя США, компания Nvidia начала отгружать в Китай свои мощные AI‑чипы H200. H200 — это высокопроизводительный процессор для искусственного интеллекта, первая партия которого, согласно заявлению, уже находится в пути к китайским клиентам.

Источник ↗
AIr/technology·15 июл. 2026 г., 08:09

🤖 Южная Корея запускает базовый AI‑чатбот Правительство объявило о планах создать бесплатный универсальный чат‑бот с искусственным интеллектом, открытый для всех пользователей. В рамках открытого тендера приглашены компании‑поставщики, которые будут обеспечивать работу сервиса на базе локальных больших языковых моделей (LLM). Государство также выделит часть графических процессоров для поддержки проекта 🖥️. Точная дата запуска пока не уточнена.

Источник ↗
AIr/LocalLLaMA·15 июл. 2026 г., 08:05

🚀 ExLlamaV3 v1.0.0: первый стабильный релиз после года разработки После более чем года работы над проектом команда ExLlama представила первую производственную версию ExLlamaV3 v1.0.0. Разработчик Turboderp совместно с Fable трудился по 10‑часовым сменам, чтобы собрать масштабный набор улучшений. В новой версии удалены зависимости flash‑attention‑2 и xformers, расширена поддержка tensor‑parallel для большинства моделей, в том числе Gemma4. Внедрён новый attention‑kernel с онлайн‑кеш‑квантованием, двойным вводом для SWA‑слоёв и attention‑sinks, что устраняет замедление при KV‑квантовании и даже ускоряет инференс. Добавлены новые графовые пути для всех attn/GDN‑модулей, conv1d‑kernel без необходимости causal_conv1d, а также значительные ускорения GEMM/GEMV на архитектуре Ampere, новый INT8 GEMV‑kernel и MoE‑kernel ticket scheduler. Также в релиз вошли модели GptOssForCausalLM и NemotronHForCausalLM, множество мелких оптимизаций, исправлений ошибок и улучшений удобства использования, а сборка расширения стала быстрее благодаря увеличенному числу компиляционных единиц. Если есть вопросы или хотите поздравить команду, присоединяйтесь к Discord‑сообществу ExLlama.

Источник ↗
AIr/LocalLLaMA·15 июл. 2026 г., 08:02

🚀 Как запустить Prism Bonsai 27B Для работы нужен файл - Q2_0.gguf из репозитория Prism ML. Его можно скачать через huggingface‑cli: `hf download prism-ml/Ternary-Bonsai-27B-gguf --include "*-Q2_0.gguf*"` или вручную с https://huggingface.co/prism-ml/Ternary-Bonsai-27B-gguf/tree/main, сохранив в удобное место. 💻 Затем компилируем свою версию llama.cpp: ```bash git clone https://github.com/PrismML-Eng/llama.cpp prism-llama.cpp cd prism-llama.cpp ``` Для macOS: `cmake -B build -DGGML_METAL=ON && cmake --build build --config Release -j$(sysctl -n hw.logicalcpu)` Для других платформ с CUDA: `cmake -B build -DGGML_CUDA=ON && cmake --build build --config Release -j$(nproc)` Опция `-j` задаёт количество используемых ядер. Запускаем сервер: ```bash build/bin/llama-server -hf prism-ml/Ternary-Bonsai-27B-gguf:Ternary-Bonsai-27B-Q2_0 --port 8080 --host 0.0.0.0 --temp 0.7 --top-p 0.95 --top-k 20 ``` Если файл скачан вручную, замените `-hf` на `-m` с путём к gguf. По умолчанию используются параметры `--temp 0.7`, `--top-p 0.95`, `--top-k 20`. Откройте в браузере http://localhost:8080 — сервер будет доступен как локально, так и извне (при `--host 0.0.0.0`).

Источник ↗
AIr/artificial·15 июл. 2026 г., 07:56

💡 Muse Spark 1.1: самая дешевая модель Meta для API Meta представила новую модель Muse Spark 1.1, первая, за использование которой взимается плата через API. Стоимость — $1.25 за входящие и $4.25 за исходящие токены на миллион, что в 4‑5 раз дешевле Opus 4.8 ($5/$25) и в 6‑7 раз дешевле GPT‑5.5 ($5/$30). Такой ценовой уровень может быть интересен разработчикам, которым не требуется самая мощная модель для каждого запроса. Для обычных пользователей, использующих подписки Claude Pro или ChatGPT Plus, аналогичного платного тарифа у Meta нет – доступен только бесплатный чат в приложении Meta AI с ограничениями. Два дня до релиза Muse Spark Meta выпустила модель Muse Image, позволяющую автоматически подтягивать фотографии из публичных Instagram‑аккаунтов; после критики со стороны SAG‑AFTRA функция была удалена. Итог: модель действительно стоит дешевле и обладает хорошей производительностью, но выгода от цены доступна лишь небольшому кругу разработчиков, а общая упаковка продукта вызывает вопросы. 🚀

Источник ↗
AIr/technology·15 июл. 2026 г., 04:55

🚨 Meta использовала ИИ для пометки сотрудников, взявших отпуск, перед увольнением В иске, поданном группой из нескольких десятков работников, говорится, что компания применяла алгоритм, который отмечал людей, находившихся в декретном или больничном отпуске, и затем отбирала их для сокращения. По заявлению истцов, такие сотрудники увольнялись в непропорционально большем числе, чем коллеги, не берущие отпуск. Иск подан в федеральный суд США; конкретные даты и цифры не раскрыты. 📄

Источник ↗
AIr/technology·15 июл. 2026 г., 04:48

🚀 Хассабис призывает США возглавить создание стандарта ИИ Глава Google DeepMind Дэмис Хассабис обратился с предложением, чтобы Соединённые Штаты стали инициатором международного органа по разработке стандартов в сфере искусственного интеллекта. Он отметил, что из‑за стремительного роста возможностей ИИ требуется «неотложные меры» и согласованная регуляторная база. 🛡️

Источник ↗