深度专题 FEATURES — 2
世界寄存器:多智能体共享记忆
WorldWeaver 给多智能体装上共享账本,让不同视角记住同一个持续变化的世界。
FineServe:看清全球LLM负载
FineServe记录14.8亿次真实LLM请求,让调度研究第一次看见不同模型各自的流量潮汐。
速览 BRIEFS — 8
PAPER
长推理注意力不必全算
LISA只精看关键位置、其余压成长期记忆,试图让长推理更快而不降质。
PAPER
Actor忘了,世界模型还记得
旧技能未必丢在“记忆”里,而可能卡在负责出手的策略上。
PAPER
Solar Open 2瞄准长程Agent
250B参数的开放MoE模型,用混合注意力把完整Agent轨迹装进百万词元窗口。
PAPER
万亿MoE全参后训练登上昇腾
SLAI T-Rex让万亿参数MoE在昇腾SuperPOD上高效完成全参数后训练。
PAPER
长视频训练摆脱教师历史
SGF让未来帧的错误反过来修正早期记忆,缓解长视频越生成越跑偏。
PAPER
世界模型迎来运动学考场
KineBench把生成视频放回模拟器执行,检查世界模型是否真懂运动
PAPER
可复用KV缓存也能被劫持
共享“草稿”提速,也可能让攻击者隔空操纵别人的 AI 回答。
PAPER
机器人摔了以后学会自救
EgoRecovery让机器人不只练成功,还从人类示范中学习出错后如何纠正重试。