Cognition оценили в $40 млрд: почему ИИ-агент Devin так дорого стоит
Cognition ведёт переговоры о новом раунде с оценкой $40 млрд. Разбираем, почему ИИ-агент Devin так дорого стоит, какие компании его используют и что это значит для рынка.
Одна лента, одна логика
Все материалы по времени публикации. Новые всегда сверху.
Cognition ведёт переговоры о новом раунде с оценкой $40 млрд. Разбираем, почему ИИ-агент Devin так дорого стоит, какие компании его используют и что это значит для рынка.
AMD и Hugging Face сделали все модели Transformers совместимыми с GPU Instinct без изменения кода. Бенчмарки: MI250 быстрее NVIDIA A100 в 2,3 раза при генерации токенов. Разбираем технологии и production-решения.
NVIDIA и Hugging Face представили библиотеку Optimum-NVIDIA, которая ускоряет большие языковые модели до 28 раз без потери качества. Узнайте, как одна строка кода может снизить затраты на ИИ для вашего бизнеса.
Grok 4.6 от xAI сравнялся с лидерами рынка по производительности, но стоит в 4-5 раз дешевле. Разбираем цифры, сильные стороны в агентных задачах и влияние на рынок ИИ.
Chrome скачивает ИИ-модели в фоне и занимает гигабайты на диске. Разбираем, как отключить настройку «ИИ на устройстве», какие требования к системе и почему не стоит удалять файлы вручную.
В конце 2023 года модели набрали меньше 10 баллов из 100 в бенчмарке DROP. Разбираем, как ошибки нормализации чисел и стоп-токена исказили результаты и почему проблема была в оценке, а не в ИИ.
LCM LoRA ускоряет генерацию изображений Stable Diffusion в 4–10 раз: картинка на Mac создаётся за 6 секунд вместо минуты. Метод работает с любыми моделями без переобучения и запускается на обычных компьютерах. Узнайте, как это пр…
Hugging Face сократила время первого ответа для LoRA-моделей с 35 до 13 секунд. Узнайте, как динамическая загрузка адаптеров позволила обслуживать 2500 публичных LoRA на нескольких GPU A10G и что это значит для ваших проектов.
Минцифры готовит систему проверки ИИ на соответствие закону и духовным ценностям. Разбираем, кто и как будет тестировать нейросети, что такое бенчмарки и промпт-инъекции, и какие выгоды получат разработчики.
Google DeepMind встроила перевод жестового языка в Gboard и Live Transcribe на Pixel 11. Разбираем, как работает SL2T, насколько она точна и какие ограничения есть у технологии.
Перегрев чипов съедает до 40% энергии дата-центров. Разбираем, как стартап Discovered Materials использует ИИ-агентов и физическое моделирование, чтобы найти материалы, которые решат эту проблему и снизят стоимость ИИ.
Twitch разрешил Amazon обучать ИИ на контенте стримеров по умолчанию. Узнайте, почему платформа выбрала opt-out, как отключить использование своих записей и чем грозит коллективный иск Pandiscia.