来源:国际能源小数据2025-02-06
这个实验带有许多注意事项:他只测试了 deepseek r-1 的中等规模版本,仅使用少量提示。“deepseek 是我们能接触到的第一个比较流行的推理模型,”他说。...总体而言,在 40 个提示的测试中,deepseek 被发现与 meta 模型具有类似的能源效率,但 deepseek 倾向于生成更长的回答,因此被发现使用了多 87% 的能源。