Лента новостей
⚖️ Судьи и юристы обсуждают баланс ИИ в работе суда Судьи и юристы активно обсуждают, как правильно интегрировать искусственный интеллект в судебный процесс, учитывая как его возможности, так и потенциальные риски. В центре дискуссии — применение ИИ для анализа документов, соблюдение этических норм и защита конфиденциальности данных.
Источник ↗🛠️ Инструмент cache‑hunter для выявления проблем кэша в LLM‑хранилах Разработчик создал простую утилиту cache‑hunter, позволяющую отследить случаи инвалидизации кэша при вызовах к большим языковым моделям. 🔍 Как пользоваться: запускаете cache‑hunter, указываете ему реальный endpoint LLM, в своей обёртке (harness) перенаправляете запросы на локальный порт cache‑hunter, нажимаете «Start capture» и проводите обычную сессию. Инструмент отображает её в реальном времени, а красные ячейки указывают на элементы, которые оказались нестабильными. Инвалидизация кэша происходит, если меняется порядок сообщений, системный промпт, набор инструментов или параметр reasoning_effort. Тестирование с OpenCode, Claude Code, Cline, Pi, Hermes и Vibe выявило проблемы с нестабильным системным промптом, инструментами, порядком или содержимым. Автор отмечает, что такой контроль редко включён в стандартные тесты хранилей, и рекомендует использовать cache‑hunter при разработке собственных решений.
Источник ↗🚀 Qwen3.5 122b на одном Mac Studio: 3 чата, 16‑кратное снижение нагрузки Автор сообщил о результатах эксперимента с Mac Studio (96 ГБ) и моделью Qwen3.5‑122b, где удалось обслуживать три одновременных сессии без потери стабильности. За 20‑минутный тест система обработала 789 351 токен‑запросов, из них только 48 996 (6,2 %) были пересчитаны на GPU, остальные 93,8 % взяты из KV‑кеша на SSD. Это сократило вычисления при предзаполнении примерно в 16 раз, а нагрузка на GPU соответствовала одной карте. Для этого реализованы частичное хранение Gated DeltaNet KV‑кеша и более эффективная стратегия вытеснения. Автор полностью отказался от «горячего» кэша, превратив qMLX в движок, восстанавливающий данные с SSD и обрабатывающий запросы последовательно, что обеспечивает конкурентность без параллелизма. Подробнее в статье https://mrzk.io/posts/qmlx-optimising-multiplexing-and-dogfood/ и репозитории https://github.com/marzukia/qMLX.
Источник ↗🚀 AMD Instinct MI350P — новый AI‑ускоритель в центре внимания За последние несколько недель в новостных лентах и профессиональных обсуждениях всё чаще упоминается ускоритель AMD Instinct MI350P. Это PCIe‑карта с 144 ГБ памяти HBM3E 💾, разработанная для вычислений в сфере искусственного интеллекта. Устройство уже считается популярным среди специалистов, о чём свидетельствуют частые упоминания в отраслевых источниках.
Источник ↗🏛️ Белый дом ограничивает доступ к передовым ИИ‑моделям Администрация Трампа начинает регулировать, кто может пользоваться новейшими ИИ‑моделями, что меняет баланс сил в пользу государства, а не крупных технологических компаний. По словам источников, уже предпринимаются конкретные шаги по контролю доступа к этим передовым системам. Эти сведения передали людям, знакомым с процессом, в интервью CNBC 🤖
Источник ↗⚙️ Время ответа RAG‑pipeline сократилось с 90 до 4 секунд В прошлом году я сотрудничал с AI‑стартапом‑спин‑оутом из Оксфорда, который предлагал сервис ответов на исследовательские вопросы через RAG‑pipeline. Каждый запрос занимал около 90 секунд, из‑за чего пользователи часто прекращали работу до получения ответа. ⚡ Оказалось, что узким местом был слой извлечения: избыточные эмбеддинги, отсутствие кэша и повторяющиеся вызовы при росте набора документов. После оптимизации этот слой был упрощён, время отклика упало до ≈ 4 секунд, а затраты сократились примерно на 95 %. Кроме того, я перестроил механизм извлечения в Weaviate, что улучшило точность выдаваемых результатов. Вывод: проблемы производительности в большинстве случаев связаны не с моделью, а с малоизученными компонентами системы.
Источник ↗🚀 Spotify удалил 75 млн треков, созданных ИИ Платформа удалила 75 млн записей, сгенерированных искусственным интеллектом, чтобы защитить выплаты авторам. Основная цель – блокировать спам‑боты, распространяющие нелегальный контент, при этом легальная музыка, созданная ИИ, остаётся доступной. Компания заявила, что работа над очисткой каталога продолжается.
Источник ↗⚽ ИИ от Google воссоздал самый красивый гол Пеле С помощью искусственного интеллекта компания Google восстановила видеокадр, показывающий легендарный гол Пеле, считающийся самым красивым в его карьере. Воссозданный ролик демонстрирует детали удара и реакцию зрителей, позволяя увидеть момент в современном качестве.
Источник ↗🛰️ Китай анонсировал новый прорыв в ИИ, который ставит под вопрос лидерство США. В официальных заявлениях китайских учёных говорится о достижении, способном изменить глобальный технологический баланс. Американские эксперты уже отмечают, что это может сократить отставание США в области искусственного интеллекта.
Источник ↗🚫 Сан‑Франциско требует удалить AI‑приложения «Nudify» Офис городского адвоката Сан‑Франциско на этой неделе отправил Apple и Google письма‑прекращения, требуя убрать из магазинов 13 приложений‑переключателей лиц, которые в подавляющем числе используются против женщин и девочек. В документах указано, что технологические гиганты продолжают получать прибыль от этих сервисов, и их необходимо полностью удалить из App Store и Google Play 📱.
Источник ↗