推文
@Compute_King · 2026-09-11 07:56
OpenDesign对梁圣的DeepSeek V4.1 Flash进行了基准测试,这个模型是@deepseek_ai提供的。 在基于用户需求的日常设计任务中,它以1.4%的成本达到了GPT-6 Astra 98%的得分。 除Astra外,所有模型的得分都更低,而且成本更高。 开放模型正在超越闭源模型吗? 完整结果如下->
曝光 5956 · 评论 65 · 点赞 47 · 书签 6
@Compute_King · 2026-09-11 07:56
OpenDesign对梁圣的DeepSeek V4.1 Flash进行了基准测试,这个模型是@deepseek_ai提供的。 在基于用户需求的日常设计任务中,它以1.4%的成本达到了GPT-6 Astra 98%的得分。 除Astra外,所有模型的得分都更低,而且成本更高。 开放模型正在超越闭源模型吗? 完整结果如下->
曝光 5956 · 评论 65 · 点赞 47 · 书签 6