V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  maolon  ›  全部回复第 7 页 / 共 20 页
回复总数  394
1 ... 3  4  5  6  7  8  9  10  11  12 ... 20  
2 月 28 日
回复了 slmaaw 创建的主题 随想 我觉得古法编程是一种乐趣
古法之所以叫古法就跟传统文化传人一样, 不是说他没有意义而是没有效率。
以及按我的理解公司做项目 成果和效率 > 意义和成就感,
当然自己的项目想怎么玩就怎么玩
@hrzlvn #46 趁现在讨论还有意义?😂,至少你现在对话的还是人类哈哈哈
2 月 24 日
回复了 stinkytofux 创建的主题 全球工单系统 智谱 GLM-5 是不是来搞笑的?
我倒是比较好奇, 智谱这几周在 v2 上都给骂成什么样了
是什么让你决定继续去买的
一些评论:
2022 ai 最多完成个补全
2023 ai 最多改几个文件,还要复制黏贴麻烦的很
2024 ai 写一个 demo 差不多了,玩具而已
2025 ai 根本搞不定复杂的设计和屎山代码的生产老项目, 还有出问题了谁来背锅?
2026 ?

人要向前看的, 这玩意儿 4 年前还是个补全代码都能出错的东西,你可以说 boris 自卖自夸在那里暴论,但是趋势就是 agent 开始趋向于自动化,自我完善化,agent 组织架构化( kimi 的 swarm, cc 的 agent team, codex 的 spawned agent ),这里同样有另一个 openai 实践完全自主化 codex 完成大型项目的例子: https://openai.com/index/harness-engineering/,

还局限于讨论屁股坐哪里我觉得意义不大,讨论讨论人类位置应该摆在哪里,HITL 应该做到什么程度,agent autonomy 应该给多少权限才是今年的话题
2 月 23 日
回复了 hlwjia 创建的主题 Codex 感觉 Codex 没有 Claude Code 那么耗 token 啊
codex 现在送 2x 的用量这是其一, 然后 codex 最出色的是他的 auto compact 系统,他自己知道什么时候该 compact 而不是非得等到一个窗口用完才 compact ,最后 codex 本身比较少 verbose ,也是省 token 的一环
那确实,之前在红迪上看到有人拿 seed dance 2 把妹非妹的崩坏集给重置了,这套东西再可控一点恐怕很多厕纸的外包就会大量使用这种方法来生产内容了
2 月 21 日
回复了 Winner4good 创建的主题 问与答 求文档 ai 率查验工具
没有 这些都不准,因为 ai 检测相对准确只有两种方法 1. token 级别的水印(需要提供商主动加入) 2. 开源模型知道本身 token 的分布

而这些网站/工具本质上就是拿大量的 ai 生成文章训练分类器,或者辅助通过检查文本困惑度和突发性来提供更强的 ai 文章信号,问题在于 llm 模型更新速度太快,每一代的新模型又是重新训练和微调的,基本上这些网站工具是很难跟得上进度的,准确度基本和扔硬币差不多

这个问题不应该使用工程手段而是应该通过管理手段来解决
当年打字员还是个职业呢,现在呢?
编程自然语言化和基础技能化那是必然趋势

但是会编程不代表你是程序员,更不代表你是软件工程师(虽然软工这个职业还存不存在可以另外讨论)
我觉得之前的 openai 的 5.3 codex spark 已经很有想象力了, 没想到这个更夸张
> 而是纯粹概率学上的堆砌
不对,至少有论文讨论 predict next token 是贝叶斯的

> 几乎全部 AI 回答都是走过去,所以短期内 AI 编程无法全自动化
不对,corner case 不能代表什么东西,以及这两个之间也不构成直接逻辑关系

每天看这种重复的讨论真的有点累了
是 powershell 的问题 现在大模型默认训练的是 posix 那套命令,powershell 的训的太少了经常出错,windows 下想正常用要不 wsl 要不 git bash
这个都不用问的,
全自主 agent 和超长程任务(> 15hr 持续执行)用 gpt 系列( 5.2 high/xhigh and/or 5.3 codex high/xhigh ),
copilot 模式(你和 agent 合作写)用 claude 的 sonnet 4.6 + opus 4.6,
另外建议搭配各家自己的套餐使用(也就是 codex 用 gpt 订阅,cc 用 claude 订阅),以及 opus 价格非常高,注意使用限制
2 月 19 日
回复了 383394544 创建的主题 OpenAI 各位现在还在用 GPT 还是转向别的 LLM
难道 gpt 没给你 personality 选项么, 你自己不去调去怪他和稀泥?
是总体降了(我不存在 ip 不干净的问题),然后 ip 不干净降的更厉害
@closedevice #47 对 都订阅了
2 月 16 日
回复了 typing 创建的主题 Claude 长期 Claude 用户试用了一下 ChatGPT/Codex
网页的这些任务你得用 pro 来搞,或者至少用 codex cli 提供的 5.2 high/xhigh(或者等他出 5.3), 网页的 thinking 感觉最近砍了不少能力。
5.3 codex 是纯粹的 working horse ,也就是说他最适合的是定义清晰的任务然后执行。另外 gpt 现在和 claude 走向不同的路数了,claude 是 pair coding 和 copilot, gpt 是自主工作 agent ,正确用法我觉得应该是给他设置一个目标,然后放着让他自己跑(目标设置得当他可以连续工作几天,以及是的,如果要用 gpt 系列就做好不看代码只看结果的准备,另外 gpt 比 claude 的优势在于在大代码库里他比较耐心会仔细查看所有的代码才开写而不像 claude 急冲冲的就开搞,在你这个应用场景下 claude 是优于 gpt 的)。
opus 是这样的 巨贵无比,连 max 20x 都撑不住一直这么用, 之前在 copilot 和 cursor 里用一天就能用完 pro 账号一个月的量。
但是怎么说呢,也确实物有所值,拿来做 plan 和 review 就挺好的,写交给 codex 就行了
2 月 15 日
回复了 SummerOrange 创建的主题 程序员 AI 编程后,我更累了
是的就是认知负荷超载了,比如管理里确实有提到“一个人只能管 7 个直属手下”,这就是因为虽然每个人能力不同,但是时间是有限的,5-7 个人差不多就把你一天的时间和精力都压榨完毕了(但是像皮衣黄他老哥就能管 100 多个人,所以每个人方法不同,结果就是不同的),
那么 AI 呢,你从一开始就没有觉得自己是在管理一个“人”,所以也就不会用合理的方法去管理他们,我觉得今年的主题应该就是如何把管理学里如何管人的经验挪进去变成如何管理一个 AI 的组织架构
@securityCoding 还真是留着过年 😂,过年前都要给用户添波堵你们智谱是有水平的
1 ... 3  4  5  6  7  8  9  10  11  12 ... 20  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2649 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 49ms · UTC 14:56 · PVG 22:56 · LAX 07:56 · JFK 10:56
♥ Do have faith in what you're doing.