登录

直接读取完整


分类

上下文

大部分计算交给更便宜的LinearAttention,但模型隔一段仍然获得一次直接读取完整上下文的机会。
文章

其它

大部分计算交给更便宜的LinearAttention,但模型隔一段仍然获得一次直接读取完整上下文的机会。
文章