Лента новостей
🚀 Rime привлекла $24 млн в раунде Series A Компания Rime объявила о получении 24 млн долларов в рамках раунда Series A, цель которого — улучшить работу предприятий с входящими звонками клиентов. На текущий момент сервис обрабатывает более 100 млн звонков в месяц для разных компаний. Инвестиции планируется направить на расширение возможностей платформы и поддержку роста клиентской базы.
Источник ↗🦄 Индийский AI‑стартап Emergent стал единорогом после раунда Series C на $130 млн Индийская компания, специализирующаяся на AI‑инструментах для программирования, объявила о привлечении $130 млн в рамках серии C, что официально переводит её в категорию «единорогов». В текущем отчёте стартап сообщает о годовом доходе в $120 млн и более 200 000 платящих клиентов. 📈
Источник ↗🚀 Oak вышла из тени с $60 млн инвестиций Израильский стартап по управлению цифровой идентификацией Oak объявил о выходе из режима скрытности, получив посевное финансирование в размере 60 млн долларов. Компания основана опытным предпринимателем Шаем Морагом, который возглавил проект с целью решить проблемы идентификации, усиливающиеся из‑за работы AI‑агентов. 🛡️ Oak планирует создать инструменты, упрощающие проверку и защиту личных данных в условиях растущего использования искусственного интеллекта.
Источник ↗📱 StepFun анонсировала первый в мире AI‑смартфон Китайская компания StepFun, поддерживаемая Tencent, представила новый AI‑нативный телефон StepX Neo. Устройство позиционируется как первый смартфон с полностью интегрированным искусственным интеллектом. Запуск StepX Neo происходит в период обострения правовых конфликтов между Apple и OpenAI, что усиливает конкуренцию китайского продукта с американскими технологическими гигантами. 🚀
Источник ↗🚀 ASML повышает прогноз до 2026 года и расширяет мощности ASML объявила о повышении финансового прогноза на 2026 год. Компания также планирует увеличить производственные мощности в ответ на растущий спрос на чипы для искусственного интеллекта. Рост спроса на AI‑чипы стал причиной расширения производства, чтобы обеспечить необходимую пропускную способность литографических установок.
Источник ↗🚀 Цены на AI‑модели поднимаются За последний год‑два доступ к мощным моделям был чрезвычайно дешёвым, но компании Meta, Tesla и Uber уже ограничивают внутреннее использование ИИ из‑за роста расходов на вычисления. DeepSeek, известный своими недорогими моделями, объявил о вводе «пикового» ценообразования для предстоящего релиза V4: при высокой нагрузке стоимость API будет повышаться, аналогично «суровому» ценообразованию на GPU. Это меняет подход к созданию AI‑продуктов: вместо повторного построения одинаковой инфраструктуры появляются специализированные решения. Примером служат Firecrawl (автоматический веб‑скрейпинг и загрузка данных) и Chatbase (превращение внутренних документов в AI‑ассистентов) — они позволяют инженерам сосредоточиться на самом продукте, а не на поддержке инфраструктуры. По мере того как стоимость токенов становится менее предсказуемой, такие узкоспециализированные сервисы становятся всё более ценными, а команды, предлагающие лучшие системы вокруг моделей, получат преимущество.
Источник ↗⚖️ Сотрудники подали иск против Meta за дискриминацию при увольнениях с помощью ИИ Группа нынешних и бывших работников обратилась в суд, заявив, что компания Meta использовала искусственный интеллект для проведения сокращений, что привело к дискриминационным решениям. 🤖 В иске подчёркивается растущее беспокойство по поводу влияния ИИ на рабочие места, особенно на людей с ограниченными возможностями.
Источник ↗🚀 Nvidia поставляет чипы H200 в Китай По словам официального представителя США, компания Nvidia начала отгружать в Китай свои мощные AI‑чипы H200. H200 — это высокопроизводительный процессор для искусственного интеллекта, первая партия которого, согласно заявлению, уже находится в пути к китайским клиентам.
Источник ↗🤖 Южная Корея запускает базовый AI‑чатбот Правительство объявило о планах создать бесплатный универсальный чат‑бот с искусственным интеллектом, открытый для всех пользователей. В рамках открытого тендера приглашены компании‑поставщики, которые будут обеспечивать работу сервиса на базе локальных больших языковых моделей (LLM). Государство также выделит часть графических процессоров для поддержки проекта 🖥️. Точная дата запуска пока не уточнена.
Источник ↗🚀 ExLlamaV3 v1.0.0: первый стабильный релиз после года разработки После более чем года работы над проектом команда ExLlama представила первую производственную версию ExLlamaV3 v1.0.0. Разработчик Turboderp совместно с Fable трудился по 10‑часовым сменам, чтобы собрать масштабный набор улучшений. В новой версии удалены зависимости flash‑attention‑2 и xformers, расширена поддержка tensor‑parallel для большинства моделей, в том числе Gemma4. Внедрён новый attention‑kernel с онлайн‑кеш‑квантованием, двойным вводом для SWA‑слоёв и attention‑sinks, что устраняет замедление при KV‑квантовании и даже ускоряет инференс. Добавлены новые графовые пути для всех attn/GDN‑модулей, conv1d‑kernel без необходимости causal_conv1d, а также значительные ускорения GEMM/GEMV на архитектуре Ampere, новый INT8 GEMV‑kernel и MoE‑kernel ticket scheduler. Также в релиз вошли модели GptOssForCausalLM и NemotronHForCausalLM, множество мелких оптимизаций, исправлений ошибок и улучшений удобства использования, а сборка расширения стала быстрее благодаря увеличенному числу компиляционных единиц. Если есть вопросы или хотите поздравить команду, присоединяйтесь к Discord‑сообществу ExLlama.
Источник ↗