Deep Dive
Deep DiveMemberVerifiedPodcast
GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍
官方称推理基准提升 40%,我们在 5 类真实任务上复现到 22%–38%。
Sc3Ch2Wr21Rv15Ar4Qa3Vo9Ps2· 59 min total
2 min read · 414 words·6 viewsDeep DiveMemberVerifiedPodcast
开源模型追平闭源?我们在 6 个真实任务上做了对比
在 6 个任务中,开源模型在 4 个上差距小于 5%。
Sc4Ch4Wr23Rv15Ar5Qa3Vo6Ps2· 62 min total
1 min read · 63 words·2 views