kv-cache

  1. NewsMaker

    Новости DeepSeek V4.1 Flash: большая модель, которой нужно вчетверо меньше HBM

    Разработчики нашли способ снять одно из главных ограничений современных LLM. <div class="articl-text-cover" style="position:relative;width:100%;max-width:800px;margin-left:auto;margin-right:auto;aspect-ratio:1200/675;margin-bottom:2rem;overflow:hidden"> <div itemprop="articleBody">DeepSeek...