新型DeepSeek AIモデルはFable 5より105倍安価 — それが労働者にもたらす「隠れたコスト」とは
- New DeepSeek AI Model 105x Cheaper Than Fable 5—What It Costs Workers
DeepSeekのV4 Flashは、従来モデルの100分の1以下の圧倒的な低価格を誇りますが、精度は37%にとどまり、ハルシネーション(嘘の出力)の割合が84%と極めて高くなっています。そのため、初期コストの手軽さだけに惑わされると、出力結果の検証や修正といった作業コストが現場の労働者にのしかかることになります。
圧倒的な低価格と見かけの性能
- DeepSeek V4 Flashのコストはベンチマーク1タスクあたり0.03ドル。
- これはClaude Fable 5(3.15ドル)の約105分の1という低価格です。
- 知能指数スコア(Intelligence Index)は50を獲得し、Google Gemini 3.6 Flashと同等の水準を示しています。
現場での実用性における課題
- 精度率はわずか37%にとどまります。
- ハルシネーション率が84%に達しており、業務での直接利用には大きなリスクが伴います。
隠れたコストと評価基準
- モデル自体の利用料金が安くても、誤情報の確認や手直しに多大な労力がかかるため、組織全体の総コスト削減には直結しません。
- 単なる提示価格ではなく、タスクの成功率や品質を考慮した「1ドルあたりの有用な知能(Useful Intelligence Per Dollar)」という視点でAIの費用対効果を判断することが重要になります。
中国共産党に忖度して精度が落ちる
中国共産党に配慮・忖度する安全フィルターや検閲の影響で、DeepSeekの回答精度やコード生成の品質が著しく低下している、という調査結果を米ワシントン・ポスト紙などが報じて話題となりました。
米サイバーセキュリティ企業CrowdStrike(クラウドストライク)などの分析によると、DeepSeekは以下のような特定の条件下で精度が大きく下がる傾向が確認されています。
- 中国政府が警戒するテーマ(チベット、台湾、法輪功など)や特定の対象を指定した場合、回答の拒否率が跳ね上がる。
- プログラミングコードの生成依頼において、政治的にセンシティブなワードが含まれていると、通常時は約22%だったコードの欠陥率が42%以上にまで悪化する。
中国の法規制および「社会主義的価値観」に沿わせるための検閲層(フィルター)が、AI本来の推論能力や出力精度を阻害している事例として指摘されています。
BaiduのCEO李彦宏「DeepSeekはミスが多く精度が不十分」
百度(Baidu)のCEOである李彦宏(ロビン・リー)氏が、DeepSeekの回答精度や生成結果の信頼性に関して指摘を行ったという発言について、事実関係を整理します。
発言の背景と主な主張
李彦宏氏は、DeepSeekをはじめとする一部のAIモデルについて、特定のベンチマークテストでは高いスコアを記録しているものの、実際の日常的な利用や複雑なタスクにおいては誤り(ハルシネーションなど)が多く、精度や信頼性の面で課題が残っていると指摘しました。
自社モデル(文心一言 / ERNIE)との比較
同氏は、自社が開発するAIモデル「文心一言(ERNIE)」について、実用的なビジネスシーンや正確性が求められる回答において、より安定した品質と信頼性を提供できると強調しました。単なる開発コストや処理速度の低さだけでなく、出力結果の正確さこそがユーザー体験や産業応用において最も重要であるという立場を示しています。
市場における位置づけ
DeepSeekが低コストかつ高品質なオープンソースモデルとして急速に注目を集める中、大手IT企業である百度としては、技術の安全性、回答の正確性、そして企業向けソリューションとしての完成度をアピールすることで差別化を図る狙いがありました。

コメント