Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.021 — 2026-07-25
NEWS 约 1 分钟

图像模型公司开始争夺机器人入口

FLUX图像模型开始学习机器人动作,生成视觉厂商正把能力伸向物理世界。

让机器人把零件拿起、放准,看似只是“看见以后动手”,实际还要判断空间位置、预测动作后果,并连续控制机械臂。Black Forest Labs如今把图像生成模型沿这条路径推向现实世界:据公司7月23日发布的信息,其多模态模型FLUX 3会在统一架构中学习图像、视频和音频,还可扩展到动作预测。

公司同时与mimic robotics公布FLUX-mimic——一种视频—动作模型,也就是把画面变化与下一步控制动作联系起来的模型,面向抓取、放置、装配等通用机器人操作。Black Forest Labs称,它已在包括Audi在内的制造企业测试和部署;针对特定操作微调时,视难度而定,最少只需30分钟机器人数据,而以往方法需要30小时或更多。

值得注意的不是一家图像公司突然“做机器人”,而是生成视觉厂商的扩张路线变清楚了:从合成画面,走向理解现实场景,再预测机器该怎么动。不过上述数据均来自公司材料;FLUX 3 Action目前仅开放early access,完整方法和基准结果要等更广泛开放时公布。


供稿材料 SOURCES — 1

← 返回 2026-07-25 · 科技板块