深度专题 FEATURES — 1
本地语音Agent开始抢话了
Speakrail 把能听、会抢话的全双工语音 Agent 塞进单张 RTX 4090,展示本地实时对话的新可能。
速览 BRIEFS — 8
NEWS
一台Strix Halo跑出59 token/s
125B 稀疏模型在一台 128GB 迷你主机上跑到每秒 44至59 token
NEWS
17MB语音模型挑战Whisper
Whistle把七语种语音转写压进16.9MB,作者称体积、速度和识别效果均优于Whisper base。
NEWS
5美元芯片也能自然说话
ItoTTS让5美元芯片离线开口说话,两种英语音色各不到5MB。
REPO
34家免费模型服务合成一个端点
freellmapi把34家免费模型服务并成一个接口,还能管额度、自动换备用服务。
NEWS
一次前向传播,把LLM变成决策器
AnyJev直接读取LLM的内部状态,一次计算就给出选择与概率,为低延迟Agent决策提供新路径。
REPO
多模态决策模型热度陡升
JEV-27B-VL升至模型榜第5,下载超127万,多模态决策模型开始走红。
REPO
426个Token给Agent装长期记忆
用426个Token和一份Python脚本,让AI助手跨会话记住约定与经验。
NEWS
1.5B小模型专门替你敲命令
用40万组合成样本微调小模型,专门把人话翻成Bash命令