深度专题 FEATURES — 2
MiniCPM-Robot:2B小模型走进现实
OpenBMB 开源两款轻量具身模型,让机器人用小模型处理操控与目标追踪。
一张5090,Qwen长解码跑到543 tok/s
NInfer 把固定模型和显卡优化到极致:单张 RTX 5090 连续生成 65K Token,实测约 543 tok/s。
速览 BRIEFS — 8
REPO
transcribe.cpp扩到16类语音模型
一个本地转写引擎承接16个语音模型家族,换模型不必再换整套工具。
REPO
Moonshine打包低延迟语音Agent栈
Moonshine把听懂、判断和开口回应装进同一套端侧工具,让实时语音应用更易落地。
NEWS
13M语音模型跑进十美元芯片
13.1M 参数 Conformer 塞进不足 10 美元的 ESP32-S3,低成本设备也能离线听写。
REPO
FastMCP继续领跑MCP开发层
FastMCP把MCP接入压缩成几行Python,开发框架正向头部集中
REPO
Open-SWE押注异步编码Agent
Open-SWE让编码任务在云端后台运行,并把结果送进团队评审流程。
REPO
Deepsec让编码Agent反过来挖漏洞
Vercel Labs 开源 Deepsec,让编码 Agent 在大型代码库里持续追查隐蔽漏洞。
NEWS
Claude Code长会话修掉平方级变慢
Claude Code 修复长对话越聊越卡,并让网络管控与文件隔离可分开设置。
REPO
Qwen Code守住开源终端入口
Qwen Code把模型、工具调用和多种运行形态装进同一客户端,争夺开源编程入口。