Top.Mail.Ru

DeepSeek V4.1-Flash уменьшает память для AI-агентов и целится в стоимость запуска

DeepSeek выпустила V4.1-Flash и делает ставку на экономику AI-агентов: меньше памяти под KV cache, меньше - изображение

DeepSeek выпустила V4.1-Flash и делает ставку на экономику AI-агентов: меньше памяти под KV cache, меньше нагрузки на GPU, SSD и пропускную способность при длинных сценариях. Для команд, которые считают стоимость агентных задач, это может быть важнее очередного громкого места в бенчмарке.

Компания заявляет, что быстрый буфер в GPU-памяти теперь занимает около четверти прежнего объёма, а выгружаемая часть сокращена примерно до одной восьмой. Практический эффект простой: больше длинных агентных запусков на той же инфраструктуре, если качество и стабильность подтвердятся в рабочих задачах.

Разбираем, что именно изменила DeepSeek и где у V4.1-Flash остаются ограничения:

Подробнее: https://ai-digest.ru/go/finbazar/3236/


#ИИ #DeepSeek #инфраструктура

317
0 / 2000
Ваш комментарий
Тебя ждёт миллион инвесторов
Регистрируйся бесплатно, чтобы учиться у лучших, следить за инсайтами и повторять успешные стратегии
Мы используем файлы cookie, чтобы улучшить ваш опыт на нашем сайте
Нажимая «Принять», вы соглашаетесь на использование файлов cookie в соответствии с Политикой конфиденциальности. Можно самостоятельно управлять cookie через настройки браузера: их можно удалить или настроить их использование в будущем.
DeepSeek V41Flash уменьшает память для AIагентов и целится в стоимость запуска | БАЗАР