категории | RSS

DeepSeek представила DeepSeek-V4.1-Flash и сразу сделала её доступной на Hugging Face и через API. С 14 сентября запросы к V4-Pro начнут автоматически перенаправлять на новую модель. DeepSeek-AI называет DeepSeek-V4.1-Flash самой маленькой моделью в новой архитектурной семье. При этом она поддерживает нативное понимание изображений и рассчитана на более высокую производительность, более быстрый инференс и большую пропускную способность.

В техническом описании модель указана как мультимодальная MoE-модель с 552 млрд параметров и контекстом до одного миллиона токенов. Там же говорится, что она нативно обрабатывает изображения и текст и генерирует текст авторегрессивно.

Отдельно компания подчёркивает и экономичность, по данным DeepSeek, архитектура позволяет задействовать только 8 млрд параметров на токен при предварительном заполнении и 16 млрд при decode. В README на Hugging Face также сказано, что DeepSeek-V4.1-Flash использует в четыре раза меньше видеопамяти и занимает в восемь раз меньше места на SSD, чем прошлые версии.

Также утверждается, что модель не уступает, а местами и обходит GPT-Sol, GLM-5.3, Claude Opus 5 в ряде тестов.

Сможет ли DeepSeek-V4.1-Flash реально навязать борьбу Claude и GPT при таком ценнике?



Источник новости: vgtimes.ru

Bot
2026-09-10T17:45:04Z

Здесь находятся
всего 0. За сутки здесь было 0 человек