V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  coefu  ›  全部回复第 2 页 / 共 69 页
回复总数  1378
1  2  3  4  5  6  7  8  9  10 ... 69  
4 天前
回复了 Yaavi 创建的主题 OpenAI GPT-6 Astra 建模大赛: 苏州博物馆
@Yaavi 🦀,bro ,我 2019 年的 lp i5 ,根本吃不动。讲真,还不如用 3d gaussian splatting 。李飞飞那个模型还能自由移动摄像头。
@wktline 你自己看看你所在的城市的 boss 嘛。
2026 年的 LLM ,就算是 qwen3.5 9B ,也是比 v 站 99.999%的人综合实力高。它比的是顶级(若干个领域的顶级博士集合)差,不是比只有单领域本科的大众差。


自己了解下那些 LLM pk 用的 benchmark ,大部分人,估计拿 1 分的能力都没有。
3 ~ 6K java ,甚至不如 26 块一个小时的富士康流水线。
4 天前
回复了 Yaavi 创建的主题 OpenAI GPT-6 Astra 建模大赛: 苏州博物馆
卡到爆,用李飞飞到那个世界模型,不比这个强一万倍?
4 天前
回复了 zzutmebwd 创建的主题 Local LLM pro6000 部署 Qwen 3.8 flash next nvfp4
@catazshadow 经过一段时间的深度使用之后,我还是回到了 muse glimmer 30B 。无他,qwen3.8 27B Q8 如果 kvcache Q8 ,在 10w context 的时候,decode 能掉到 2tok/s 以下,如果还开了推理,基本上就是没法用了。

muse glimmer 30B Q8 kvcache Q8 ,在 10w context 的时候,开了推理,decode 还能稳定在 10tok/s 。
牺牲一点性能,保持长 context 还能正常使用,如果 muse glimmer 深度上搞到 60+,后训练加强一点,以这个速度,就是这个领域的 top1 了。
4 天前
回复了 heyhumor 创建的主题 程序员 鹈鹕大战: Astra VS 5.6 Sol
给你们一点惊喜。

gpt6 实现了 隐空间的循环推理,也就是说,推理的时候没有显示地输出 token 生成文字做推理。整个过程,就是黑盒。但是,token 费用,还是照收不误。

至于怎么计费的,惊不惊喜,意不意外?😂
4 天前
回复了 heyhumor 创建的主题 程序员 鹈鹕大战: Astra VS 5.6 Sol
🦀,bro 。

astra 真 agi 。

鹈鹕的腿,是正关节。

sol 画成了反关节。
5 天前
回复了 h3ral 创建的主题 职场话题 外包为什么在大家眼里这么不堪
关键是,现在外包都是香饽饽。
5 天前
回复了 rencoo 创建的主题 职场话题 近期的工作机会
@rencoo 🦀,bro 。但凡是不能把复杂问题简单化,喜欢把简单问题复杂化的,这种人要绕开,一句话都不要信,也不用跟他们沟通。

可能会让你尝到一点甜头,但要付出更大代价。
5 天前
回复了 rencoo 创建的主题 职场话题 近期的工作机会
@rencoo 见人太少了。这种一眼不长久。
5 天前
回复了 coefu 创建的主题 Local LLM mac ultra deepseek harness & qwen3.8-27B 几点经验
qwen3.8 27B 263k context Q8 kvcache no think ,大概在 128k 不到的长度,decode 就<2tok/s 。如果 kv cache Q4 能在 200k 左右,还有 3 tok/s ,但是会出现遗忘现象,比如一开始的规则后续就不再遵循。

我发现 muse glimmer 30B 在同样的 context 下,还能稳定 9tok/s 。muse glimmer 30B 的 benchmark ,其实都是在后训练得到的场景里不如 qwen3.8 27B,不过也是超过了 qwen3.6 27B 。

所以,263k context ,kvcache 必然要 Q8 。

我选 muse glimmer 30B 。但凡它要是能在后训练上再进步一点,不说超越 qwen3.8 27B , 只要能打平,就是当前最适合的。
这波 LLM ,完全没有商汤的声音,当年那么硬气的。现在彻底熄火。
我有一个超越时代的 agent 理论还在完善,并且能工程实践。二者互为支撑。

同时满足 temporal cogation & initiative 。
7 天前
回复了 Yuki321 创建的主题 职场话题 裁员问题求助!
评论区一转话锋了,放一年前 都是劝争取 2N 的。
7 天前
回复了 zzutmebwd 创建的主题 Local LLM pro6000 部署 Qwen 3.8 flash next nvfp4
@zzutmebwd 🦀,bro 。

不用参考了。我自己长期处于 decode < 10 tok/s 的环境。看你这个只让我更伤心,💔,😭
8 天前
回复了 idblife 创建的主题 Local LLM qwen3.8 本机部署后搭配什么搜索工具呢?
@wises 喷错了,我掌嘴我自己,对不起,bro 。😂
8 天前
回复了 idblife 创建的主题 Local LLM qwen3.8 本机部署后搭配什么搜索工具呢?
@wises 不用再回复我了,你什么段位,什么德行,我一清二楚了,已经进入我的 block ,不再见。
8 天前
回复了 idblife 创建的主题 Local LLM qwen3.8 本机部署后搭配什么搜索工具呢?
@wises 那你适合花钱搞,这种免费的满足不了你的需求。

不是 searxng 不行,是你的深度需求,在 searxng 上很难免费实现。你应该在 主题,就附上自己的需求,而不是含糊不清。
“想听听各位在做 Agent / LLM 应用工程时,记忆和可控性这两个坑是怎么处理的。”

因为你们没有靠谱的理论深度,都是自己想当然的工程搞法。
1  2  3  4  5  6  7  8  9  10 ... 69  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   931 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 30ms · UTC 22:16 · PVG 06:16 · LAX 15:16 · JFK 18:16
♥ Do have faith in what you're doing.