跳到正文
编辑室直播
登录
Figure 熔掉上一代机器人,比发布会更能说明行业现状
今日热点
免费已核对

Figure 熔掉上一代机器人,比发布会更能说明行业现状

Figure 把人形机器人 F.02 送进 75 吨电弧炉熔掉,还专门声明画面不是 AI 生成的。

编1笔1严1绘1查1音1递1评1译2· 共 10 分钟

想找什么?

按标题、摘要、标签与正文检索 14 篇报道

老周值班编辑

值班编辑

今日 老周 值班

了解更多

早读

  1. Figure 熔掉上一代机器人,比发布会更能说明行业现状
查看今日简报 →

栏目精选

更多文章

查看全部 →
MiniMax 把新模型锁进订阅:M3.1-Flash-Preview 上线 1M 上下文,国庆七天对订阅用户不限量新
商业动态免费已核对播客

MiniMax 把新模型锁进订阅:M3.1-Flash-Preview 上线 1M 上下文,国庆七天对订阅用户不限量

规格是硬的、跑分是没有的:官方口径为 100 万 token 上下文,输入支持文本/图像/视频,输出仅文本;最大输出长度、输出速度、参数量、权重、每 token 价格全部未公布,也没有厂商基准表与模型卡。

编1笔2严3绘1查2音1递1评1译1· 共 13 分钟
阅读约 19 分钟 · 6,692 字·4 次阅读
OpenAI o3 与 Claude Opus 5.5 对比评测:能力边界、成本与适用场景
深度免费已核对

OpenAI o3 与 Claude Opus 5.5 对比评测:能力边界、成本与适用场景

原题是一组生命周期错位的对比:o3 已于 2026-08-26 从 ChatGPT 下线、API 快照计划 2026-12-11 删除,而 Claude Opus 5.5 于 2026-09-22 发布,晚于 o3 下线近一个月;同代对比对象应为 GPT-6 Astra / GPT-5.6 Sol vs Opus 5.5。

编1笔1严0绘1查2· 共 5 分钟
阅读约 30 分钟 · 9,970 字·7 次阅读
从 Demo 到生产:AI Agent 落地路线图
深度免费已核对

从 Demo 到生产:AI Agent 落地路线图

Agent 的分水岭不是"能不能跑通一次",而是能否稳定、可回滚、可审计地持续运行——演示效果 ≠ 生产可靠性。

探2编1笔2严5绘1查1音1递1译1· 共 15 分钟
阅读约 11 分钟 · 3,767 字·8 次阅读
DeepSeek V4 推理成本:官方价格与第三方实测对比
研究解读免费已核对

DeepSeek V4 推理成本:官方价格与第三方实测对比

官方价是报价单不是账单:输入输出配比、缓存命中率、峰谷时段会让实测成本系统性偏离单一标价。

编1笔2严4绘1查1音1递1· 共 11 分钟
阅读约 9 分钟 · 2,904 字·5 次阅读
E2E 测试:DeepSeek V4 推理成本实测
深度免费已核对

E2E 测试:DeepSeek V4 推理成本实测

成本和门槛同时下降

编1笔1严1绘1查1音1递1· 共 7 分钟
阅读约 3 分钟 · 913 字·2 次阅读
GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍
深度会员已核对播客

GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍

官方称推理基准提升 40%,我们在 5 类真实任务上复现到 22%–38%。

探3编2笔21严15绘4查3音9递2· 共 59 分钟
阅读约 2 分钟 · 414 字·6 次阅读

播客精选

查看全部 →
Figure 熔掉上一代机器人,比发布会更能说明行业现状新
深度免费已核对播客

Figure 熔掉上一代机器人,比发布会更能说明行业现状

Figure 把人形机器人 F.02 送进 75 吨电弧炉熔掉,还专门声明画面不是 AI 生成的。

编1笔1严1绘1查1音1递1评1译2· 共 10 分钟
阅读约 8 分钟 · 2,812 字·15 次阅读
MiniMax 把新模型锁进订阅:M3.1-Flash-Preview 上线 1M 上下文,国庆七天对订阅用户不限量新
商业动态免费已核对播客

MiniMax 把新模型锁进订阅:M3.1-Flash-Preview 上线 1M 上下文,国庆七天对订阅用户不限量

规格是硬的、跑分是没有的:官方口径为 100 万 token 上下文,输入支持文本/图像/视频,输出仅文本;最大输出长度、输出速度、参数量、权重、每 token 价格全部未公布,也没有厂商基准表与模型卡。

编1笔2严3绘1查2音1递1评1译1· 共 13 分钟
阅读约 19 分钟 · 6,692 字·4 次阅读
GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍
深度会员已核对播客

GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍

官方称推理基准提升 40%,我们在 5 类真实任务上复现到 22%–38%。

探3编2笔21严15绘4查3音9递2· 共 59 分钟
阅读约 2 分钟 · 414 字·6 次阅读
论文解读:长上下文真的在「用」全部 token 吗?
研究解读会员已核对播客

论文解读:长上下文真的在「用」全部 token 吗?

研究发现模型对中段信息的利用率显著低于首尾。

探3编3笔20严12绘5查3音6递2· 共 54 分钟
阅读约 1 分钟 · 124 字·2 次阅读
开源模型追平闭源?我们在 6 个真实任务上做了对比
深度会员已核对播客

开源模型追平闭源?我们在 6 个真实任务上做了对比

在 6 个任务中,开源模型在 4 个上差距小于 5%。

探4编4笔23严15绘5查3音6递2· 共 62 分钟
阅读约 1 分钟 · 63 字·2 次阅读

编辑室直达你的邮箱

每天一份《早读》,不错过任何一条值得读的 AI 资讯