为什么 deepseek flash 正式版的思考时间比原来长了很多很多,有的时候一个简单的任务能思考 2d 分钟,是我个人的问题吗,虽然 agent 能力的确 d 提升了 o 很多,但是这个过度思考有点烦
为什么 deepseek flash 正式版的思考时间比原来长了很多很多,有的时候一个简单的任务能思考 2d 分钟,是我个人的问题吗,虽然 agent 能力的确 d 提升了 o 很多,但是这个过度思考有点烦
1
zzutmebwd 17h 19m ago
deepseek flash 的官方 api 输出速度大概是多少?
|
2
jko123 17h 18m ago
我觉得面对复杂任务思考的还不够,所以只能执行
|
3
Younikes OP @jko123 我在我开发的一个 excel ai 侧边栏里面测试,以前让它美化下表格,速度很快,效果也不错,现在先思考很久我看了下思考内容,一堆 wait ,服了
|
5
exmario 16h 23m ago
昨天和今天都遇到 503 ,体验真的差
|
6
Wenlon 14h 19m ago flash 毕竟只是个 300B 不到的模型,moe 激活的只有 13B ,它必须依赖高强度思考才能制造局部稠密,从而实现超越参数规模的编码能力。目前看来参数规模、速度还有能力是个不可能三角
|
7
AlohaV2 14h 9m ago
是这样的。跟真人类似,如果不是特聪明的话要多思考几下。但如果最终能对也无妨,多花的时间可以用并发解决(约等于企业多招人)。毕竟参数量在这里。
所以还是期待 pro 能给到啥。 |
8
bbsingao 13h 30m ago
这主要看你的 harness 是什么东西, codex 好些, cc 就更久
|
9
XuDongJianSama 13h 28m ago
deeps 在 cc 会过度思考
|
11
JackCh3ng 12h 37m ago
我有一个每天定时的任务,自从更新之后,任务没完全执行成功过,两次都是有部分任务执行失败,而且 token 花费 x4 了,今天准备把任务关了。
|
12
limon 12h 1m ago
和 agent 有关,我用 grok 感觉明显快
|
13
maemolee 11h 56m ago 我在 WorkBuddy 里接了最新的 dsv4f ,发一个“你好”,打断,再点一下重试,他能思考上千字……
|
14
codehz 11h 50m ago
推理努力设置成 low ,然后自己编写需要推理的强度,,因为 high 和 max 就是提示词的差异,low 就是不给额外提示词,但允许推理的模式
|
17
Bssn 11h 22m ago
在 zcode 里挺好用的,推荐尝试
|
18
zhonghao01 11h 7m ago
感觉 GLM 才是过度思考,每次思考好长好长。
|
19
HotieCutie 10h 34m ago
快和质量二者不可兼得,gpt 就是出奇的慢,但是质量确实不错
|
20
maolon 10h 32m ago
因为模型小就只能靠思维链来提升性能,对于小模型来说这种不叫“过度思考”,5.6 sol 的 max 那种才叫过度思考
|
21
glaucus 10h 29m ago
我一直 503 ,我还以为 opencode 的问题
|
22
as9567585 6h 20m ago 很可能是 harness 内部的过度提示词的问题,我从 cc 切换到 pi ,体验好很多。cc 的作者也表示,最近的版本删除 80%的提示词。现在模型的智商确实提高了
|
27
brsyrockss 5h 12m ago
你教小孩子做数学题,做的快了错的多,你给一巴掌,说为啥不检查,现在做的慢了,每个题都要检查一遍,正确率高了,你又给一巴掌,问:为啥要检查?
你咋这么难伺候 |