Deepseek R1-0528 开源模型评测:编程实力强劲,超越 OpenAI o3 和 o4-mini

Deepseek R1-0528 模型在编程、审美设计、代码补全等方面表现出色,尤其在复杂指令处理和前端页面生成上展现出高效能,超越 OpenAI 的 o3 和 o4-mini 模型。

9效率工具AI编程代码生成模型评测效率工具

Deepseek R1-0528 模型评测

深度求索(Deepseek)最新开源模型 R1-0528 在编程能力、审美设计和代码补全等方面表现出色,尤其在复杂指令处理和前端页面生成上展现了高精度和高效能。

该模型能根据用户输入的简单提示词,快速生成高质量代码,其在 Extended NYT Connections 跑分中取得了 49.8 分的优异成绩,超越了初代 Deepseek R1 模型的 38.6 分。

初探 Deepseek R1-0528 开源模型:AI 编程能力跃升,媲美 OpenAI o3 和 o4-mini插图

Extended NYT Connections 是一个评估大型语言模型(LLM)性能的基准测试,基于《纽约时报》的 Connections 谜题游戏。

初探 Deepseek R1-0528 开源模型:AI 编程能力跃升,媲美 OpenAI o3 和 o4-mini插图1

R1-0528 模型具有 o3-2.5 专业风格的响应,箭头 / 星号的使用与 o3 风格非常一致,结尾处“why it works”的表述更具说服力。

在审美设计和代码补全方面,R1-0528 同样表现出色,能轻松应对多样化任务,输出结果精准且实用。

初探 Deepseek R1-0528 开源模型:AI 编程能力跃升,媲美 OpenAI o3 和 o4-mini插图2

在生成复杂前端页面和动态动画方面,R1-0528 也展现了强大的能力,能准确理解复杂指令。相比 OpenAI 的 o3 和 o4-mini 模型,R1-0528 大幅缩短了推理时长,提供了更加流畅和高效的使用体验。