DeepSeek 还在“瞎干”?

DeepSeek V4 发布后,作者用真实项目测试它能否替代 Claude Code 和 Codex。结果并非跑分宣传里的全能:它在推理、价格和开源上仍有优势,却在实际编码、稳定性和任务完成度上暴露短板。文章给出适用场景和选型判断。 最近 AI 圈很热,Kimi K3、阿里 Qwen 3.8、智谱 GLM 5.3、DeepSeek V4 等国产旗舰模型陆续发布,跑分和促销价格都很吸引人。...