登录
更多
已读文章
名词
现象
观点
问题
政要
直接读取完整
分类
上下文
大部分计算交给更便宜的LinearAttention,但模型隔一段仍然获得一次
直接读取完整
上下文的机会。
文章
其它
大部分计算交给更便宜的LinearAttention,但模型隔一段仍然获得一次
直接读取完整
上下文的机会。
文章