查看: 14|回复: 2

DSH 不同模式下 V4 Pro + Max 制作小游戏的真实效果

[复制链接]

1

主题

1

回帖

5

积分

新手上路

积分
5
发表于 2026-8-15 13:54:10 | 显示全部楼层 |阅读模式
看到很多平台都在聊 dsh 搭配 v4 pro (with max reasoning effort) 正式版使用时,不同的模式间思维链和产品效果存在较大差异,于是花了 20 多块实测了几轮较简单的任务,也搭配 Pi Native 模式作为对照,供参考。

测试除 Pi 对照之外,都在 DSH 中使用 DeepSeek V4 Pro max 推理强度进行。Prompt:“复刻超级马里奥”

实测效果: https://deepseek-v4-harness.pages.dev/

个人看来,“We need” “Let me” 这两种思维链间的差异确实挺大的(链接里标准模式和 Pi 对照组里的有些简直没法玩),目前好像还没有其他企业部署开源权重的 v4p ,不确定是官方动了手脚还是模型本身注意力等存在问题。

用 DSH 并且想发挥 v4p 最佳实力的话,还是建议用极简模式。网上也有人做了标准/PTC 模式伪装极简模式实现 We need 思维链,但是这里没有测试。
回复

使用道具 举报

17

主题

123

回帖

297

积分

中级会员

积分
297
发表于 2026-8-15 14:12:28 | 显示全部楼层
看到有评测 ds api + dsh >>>>> ds api + codex ,不知道是不是普遍情况
回复

使用道具 举报

1

主题

1

回帖

5

积分

新手上路

积分
5
 楼主| 发表于 2026-8-15 15:01:13 | 显示全部楼层
@jacketma 是的,我自己感觉两种思维链差异很大
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖
返回顶部