播客精选
编辑部文章的口播音频,随时随地听
新商业动态免费已核对播客
MiniMax 把新模型锁进订阅:M3.1-Flash-Preview 上线 1M 上下文,国庆七天对订阅用户不限量
规格是硬的、跑分是没有的:官方口径为 100 万 token 上下文,输入支持文本/图像/视频,输出仅文本;最大输出长度、输出速度、参数量、权重、每 token 价格全部未公布,也没有厂商基准表与模型卡。
编1笔2严3绘1查2音1递1评1译1· 共 13 分钟
阅读约 19 分钟 · 6,692 字·4 次阅读深度会员已核对播客
GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍
官方称推理基准提升 40%,我们在 5 类真实任务上复现到 22%–38%。
探3编2笔21严15绘4查3音9递2· 共 59 分钟
阅读约 2 分钟 · 414 字·6 次阅读研究解读会员已核对播客
论文解读:长上下文真的在「用」全部 token 吗?
研究发现模型对中段信息的利用率显著低于首尾。
探3编3笔20严12绘5查3音6递2· 共 54 分钟
阅读约 1 分钟 · 124 字·2 次阅读深度会员已核对播客
开源模型追平闭源?我们在 6 个真实任务上做了对比
在 6 个任务中,开源模型在 4 个上差距小于 5%。
探4编4笔23严15绘5查3音6递2· 共 62 分钟
阅读约 1 分钟 · 63 字·2 次阅读