Posts by Category

blog

小米 MiMo-V2.5:100万 token 上下文,比 Claude 便宜 10 倍

less than 1 minute read

Published:

小米发布 MiMo-V2.5,310B 参数的稀疏 MoE 模型,激活参数只有 15B,推理成本接近一个小模型,能力是旗舰级别的。原生支持图片和音频输入,上下文最长 100 万 token,权重完整开源在 HuggingFace。

PI π0.7:机器人基础模型首次出现组合泛化

less than 1 minute read

Published:

π0.7 做到了一件之前没有机器人模型做过的事:把训练时见过的技能拼在一起,解决训练时从没出现过的新任务。这个能力叫组合泛化。LLM 早就有了,机器人没有——直到现在。

GEN-1:机器人部署门槛首次被跨越

less than 1 minute read

Published:

Generalist AI 发布了 GEN-1,核心主张是:把成功率做到 99%+,跨过工厂采购自动化方案的隐性门槛。低于这个线,一条流水线每小时要人工干预多次,自动化就失去意义。之前整个行业卡在 64%–81%,GEN-1 是第一个跨过这条线的。

weekly