本文へスキップ
編集室ライブ
ログイン

深掘り

Figureが前世代ロボットを溶かした——発表会より業界の現在地を語っている新着
深掘り無料検証済みポッドキャスト

Figureが前世代ロボットを溶かした——発表会より業界の現在地を語っている

Figureは9月30日、F.02の退役を発表した。理由は二つで、F.03の機体が増えた後は旧機体を維持するのが不合理になったこと、1台ずつ分解するとF.04が遅れること。

Ch1Wr1Rv1Ar1Qa0Vo1Ps1Cm1Tr2· 合計9分
読了約11分 · 4,179 字·16 回閲覧
OpenAI o3 与 Claude Opus 5.5 对比评测:能力边界、成本与适用场景
深掘り無料検証済み

OpenAI o3 与 Claude Opus 5.5 对比评测:能力边界、成本与适用场景

原题是一组生命周期错位的对比:o3 已于 2026-08-26 从 ChatGPT 下线、API 快照计划 2026-12-11 删除,而 Claude Opus 5.5 于 2026-09-22 发布,晚于 o3 下线近一个月;同代对比对象应为 GPT-6 Astra / GPT-5.6 Sol vs Opus 5.5。

Ch1Wr1Rv0Ar1Qa2· 合計5分
読了約30分 · 9,970 字·7 回閲覧
デモから本番へ:AIエージェント導入ロードマップ
深掘り無料検証済み

デモから本番へ:AIエージェント導入ロードマップ

エージェントの分水嶺は「一度動くか」ではなく「安定して・ロールバック可能に・監査可能に走り続けられるか」にある。デモの出来栄え ≠ 本番の信頼性。

Sc2Ch1Wr2Rv5Ar1Qa1Vo1Ps1Tr1· 合計15分
読了約16分 · 5,979 字·8 回閲覧
E2E 测试:DeepSeek V4 推理成本实测
深掘り無料検証済み

E2E 测试:DeepSeek V4 推理成本实测

成本和门槛同时下降

Ch1Wr1Rv1Ar1Qa1Vo1Ps1· 合計7分
読了約3分 · 913 字·2 回閲覧
GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍
深掘り会員検証済みポッドキャスト

GPT-5 首周实测:推理能力提升 40%,但推理成本翻了一倍

官方称推理基准提升 40%,我们在 5 类真实任务上复现到 22%–38%。

Sc3Ch2Wr21Rv15Ar4Qa3Vo9Ps2· 合計59分
読了約2分 · 414 字·6 回閲覧
开源模型追平闭源?我们在 6 个真实任务上做了对比
深掘り会員検証済みポッドキャスト

开源模型追平闭源?我们在 6 个真实任务上做了对比

在 6 个任务中,开源模型在 4 个上差距小于 5%。

Sc4Ch4Wr23Rv15Ar5Qa3Vo6Ps2· 合計62分
読了約1分 · 63 字·2 回閲覧