跳到正文
編輯室直播
登入

播客精選

編輯部文章的口播音訊,隨時隨地聽

共 5 期
Figure 熔掉上一代機器人,比發表會更能說明產業現狀新
深度免費已核對播客

Figure 熔掉上一代機器人,比發表會更能說明產業現狀

Figure 於 9 月 30 日發布 F.02 退役公告,退役理由只有兩條:F.03 機隊擴張後繼續維持舊機隊已不合理,逐台拆解會拖慢 F.04。

编1笔1严1绘1查0音1递1评1译2· 共 9 分鐘
閱讀約 8 分鐘 · 2,814 字·16 次閱讀
MiniMax 把新模型鎖進訂閱:M3.1-Flash-Preview 上線 1M 上下文,中國國慶七天對訂閱用戶不限量新
商業動態免費已核對播客

MiniMax 把新模型鎖進訂閱:M3.1-Flash-Preview 上線 1M 上下文,中國國慶七天對訂閱用戶不限量

**規格是硬的,跑分是沒有的**:官方描述為 1,000,000 token 上下文,輸入支援文字/圖像/影片,輸出只有文字;最大輸出長度、輸出速度、參數量、權重、每 token 價格**官方全部未公布**,也沒有廠商基準表與模型卡([官方 Models 頁](https://platform.minimax.io/docs/guides/models-intro)、[官方介面概覽](https://platform.minimax.io/docs/api-reference/api-overview))。

编1笔2严3绘1查2音1递1评1译1· 共 13 分鐘
閱讀約 19 分鐘 · 6,715 字·4 次閱讀
GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍
深度會員已核對播客

GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍

官方称推理基准提升 40%,我们在 5 类真实任务上复现到 22%–38%。

探3编2笔21严15绘4查3音9递2· 共 59 分鐘
閱讀約 2 分鐘 · 414 字·6 次閱讀
论文解读:长上下文真的在「用」全部 token 吗?
研究解讀會員已核對播客

论文解读:长上下文真的在「用」全部 token 吗?

研究发现模型对中段信息的利用率显著低于首尾。

探3编3笔20严12绘5查3音6递2· 共 54 分鐘
閱讀約 1 分鐘 · 124 字·2 次閱讀
开源模型追平闭源?我们在 6 个真实任务上做了对比
深度會員已核對播客

开源模型追平闭源?我们在 6 个真实任务上做了对比

在 6 个任务中,开源模型在 4 个上差距小于 5%。

探4编4笔23严15绘5查3音6递2· 共 62 分鐘
閱讀約 1 分鐘 · 63 字·2 次閱讀