V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  poxiaohy  ›  全部回复第 1 页 / 共 1 页
回复总数  19
@blackantt 不同子模型能力得综合各种排行榜来评价。至于实际工作,每个人遇到的项目复杂度不一样,对需求复杂度评判标准也不一样,具体用什么模型,只能靠自己的体感去体验。比如有的人任务复杂,需求量大,那就直接上 claude 和 GPT 最强的;有的人追求快,不想被封,也有一定性能,那 grok 挺好的;有的人偏爱国产,那就上 Kimi 和 GLM 。有的人需求简单,DeepSeek-flash 都够用了。
T0:Fable 5 、GPT 5.6 sol 、Kimi K3
T1:opus-4.8 、GPT 5.5 、Grok 4.5
T2:muse-spark-1.1 、Gemini-3.6-flash 、GLM-5.2
追求性能的,哪个最强用哪个
追求价格的,哪个性价比高用哪个
大小模型搭配几个一起用都很正常
@106npo 好吧,那玩意很少用,主要是用来编码,不过 K3 确实消耗太大了,今天出不同级别了,可以选标准了
199 档位之前用 k2.7 常规速度是够用的,用 highspeed 看需求有时候不够用。k3 今天试了半天用了周额度 30%额度,完全不够用了。。。
@106npo kimi plan 是按周限额的
价格比跑分更能看出模型强弱哈哈哈
12 天前
回复了 initialJJ 创建的主题 职场话题 10 年 Java 失业半年 还没找到工作
看年龄和家庭情况,跑杭州或者上海干多几年肯定中小厂还是有机会的。要么用 AI 自己捣鼓下。外卖滴滴这种除非短期有生存压力不然不建议做。
12 天前
回复了 x177plus 创建的主题 程序员 现在哪个 ai agent 性价比比较高
现在用 Zcode/OpenCode/VSCode + kimi-k2.7 ,各有优劣在对比着用。GPT 前两天到期已经不续费了,等 K3 和 dsv4 正式版
18 天前
回复了 flowzeta 创建的主题 职场话题 还会推荐学生报考计算机吗
其实只是当前阶段对计算机就业冲击比较大,加上现在大模型厂商都在发力 code 和 agent ,过几年就开始替代坐在电脑前的白领了,再考虑到未来世界模型和具身智能的发展,蓝领也会逐步给替代,只有跟人打交道为主的短期内可替代性不高。与其说这是一个专业问题,不如说是一个社会问题。
@fqyd Kimi 的 code plan 还在用的,搭配了 codex 的 GPT plus 套餐。你说的 cli 不适合交互确实是,不过 Kimi 的 cli 还有个 web 模式( kimi web 命令),也不知道 GLM 都出 ZCode 了为何 Kimi 还在搞 cli 。另外可以试试 OpenCode + Kimi-v2.7-code ,看代码用 Zed 。特别推荐 Zed 很轻量非常省内存(几十 MB 级别),还可以复用 VSCode 的快捷键。
个人想法是未来 agent 大部分能力也会移植到模型上。只要模型足够强,提示词工程就是最直观的。现在的各种 harness 约束和引导都是阶段性的。
@fqyd 可能是工作方式不一样,之前我一开始用习惯 Superpowers ,都喜欢讨论需求再执行,现在觉得 Superpowers 太重,所以都用/plan 。然后如果想看模型推理过程,用 OpenCode 可以直接设置模型思考过程可视化,不需要写到本地。
Kimi-2.7 我觉得最大改善就是思考循环问题,之前 2.6 经常出现各种等等...,啊!什么的,然后自己陷进去半天最后还吐出来一个错误的结论。2.7 虽然也有这方面问题,但是明显改善很多。另外官方宣称的 30% token 减少没有明显感觉。我去 Reddit 论坛也看过,很多评价 2.7-code 还不如 2.6 ,但我觉得不至于,只是确实提升不大。可以参考下盲测平台: https://arena.ai/leaderboard/code/webdev
@fqyd 2.6 不开/yolo 基本不会讨论就去执行吧,我是没试过/plan 的情况下出现执行的。2.7-code 对比 2.6 肯定是有提升的,但是真的不明显。Kimi-2.6/2.7 搞不定的,我切 GPT 5.5-high/xhigh 同样提示词一两轮就解决了,体感区别就太明显了。。。
@junwind 是的,Gemini 除了多模态,编码不行。习惯喊御三家了,希望后面 Google 能跟上吧
@aicong2021 体感 Kimi-2.7-code 对比 Kimi-2.6 提升不大,只能说稍微比 DeepSeek-v4-pro 强一丢丢
御三家贵的贵,封的封,反正公司不报销是用不起。
GLM 能买到优先 GLM ,我反正闲鱼帮抢都抢不到,github 也有脚本试过也没啥用。
Kimi 用官方 cli 或者 OpenCode ,199 套餐勉强能干点日常活,重构啥的效果还是太差,还是需要上 codex + GPT5.5 。但是目前申请了 6 倍速 3x 消耗额度不够烧了。
DeepSeek 用 OpenCode 免费或 go ,亦或者 api 用 flash 也足够便宜,简单问题用 flash 就是了。
MiMo 赠送额度用完就没用了,MiMo code 刚出也有免费的可以去试试。
MiniMax 不考虑,Qwen 3.7 Max 也是贵。

综上就是复杂问题还是优先御三家和 GLM ,简单问题或者前端问题 Kimi 你就当能识图的 DeepSeek 用着就行,上下文只有 256k ,注意多/compact 或者新开会话用。
上限肯定是提高了,AI 编码实现速度、效率都比绝大部分开发强。
下限不好说,可高可低。AI 可能不按需求设计,可能过度设计,可维护性和稳定性得看开发人员的使用水平。
5 月 22 日
回复了 Tilie 创建的主题 程序员 如何消除 vibe code 产生的技术债?
你这样想,如果你是技术 Leader 管着 N 个开发,你也不可能每个开发的逐行代码去 review 。
就像 Karpathy 说的,都 2026 了,Vibe Coding 思路要转变为 Agentic Engineering 。制定好开发规范,做好架构师和技术管理工作。
至于类似制动系统、转向控制、车门解锁等人命相关代码,还是需要人工 review ,甚至要单独拉出来开技术讨论会的。
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1206 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 19ms · UTC 17:40 · PVG 01:40 · LAX 10:40 · JFK 13:40
♥ Do have faith in what you're doing.