作者丨李娜
编辑丨岑峰
01
MiniMax最后还是留下了Full Attention
02
Scale之后,混合注意力又暴露了新问题
03
Agent重新放大了Full Attention的成本
04
Linear和Sparse被放进同一个模型
过去被当作不同路线讨论的Linear、Sparse和Full,正在变成同一个架构设计空间里的不同选项。
05
技术开始越过公司的边界
06
尾声:路线没有消失
上车,带你看遍全球 AI 顶会精华
可独家畅览:
专家演讲PPT
大会报告全文
热门论文解读
学术新星访谈
扫描上方二维码
或点击「阅读原文」关注专区。