V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  imdoge  ›  全部回复第 1 页 / 共 14 页
回复总数  279
1  2  3  4  5  6  7  8  9  10 ... 14  
@zhensjoke 你开机了吗,听说连上基站会被检测?
我好像是 22 年底还是 23 年初的,没被封,但是最近也没开机……
我 3 年前的还在……几个月发条短信保活一下
7 月 20 日
回复了 YanSeven 创建的主题 程序员 你觉得 A 厂封号的最大因素是
ip 和用量吧
我没上指纹浏览器,没改时区没改语言,各种特征都没改,就家宽落地正常用,一直没封
连续跑这么久几万行一般是屎山……除非你最初架构和产品文档开发文档写的很好很好,或者任务很简单都是重复任务
7 月 15 日
回复了 mr123villain 创建的主题 问与答 gpt 科学上网相关
直接机场就行,gpt 平时风控一般
前段时间提高了下风控,5.5pro 降智了,就加一层住宅 ip 落地
不用 skill 还是不行,字体字号和间距明显有问题,视觉效果上
7 月 4 日
回复了 twk93 创建的主题 推广 Claude 账号被封风险检测工具
76 分这么高,但是家宽落地,没被封
7 月 3 日
回复了 yaocy 创建的主题 程序员 真的没人觉得 codex 比 claude 笨很多吗?
复杂的 codex 做的更细(虽然也有冗余设计风险)
不降智来说,大概就是 opus4.8 是高考 660 分但做事不够全如果你的代码很屎山各种耦合很多,他可能不看够全,gpt5.5 是高考 650 分但肯给你花半小时认真全面做一件事
ID: 1284
thx~
6 月 9 日
回复了 SunShare 创建的主题 游戏 被这个 Web 游戏惊艳后,我忍不住复刻了一遍
速度有点慢,方向调整有点迟钝,另外对我有点晕……
但是 web 能做成这样真的惊艳
6 月 9 日
回复了 SunShare 创建的主题 游戏 被这个 Web 游戏惊艳后,我忍不住复刻了一遍
很惊艳,另外怎么玩的
风扇猛转…
这点感觉 gpt 说的很正啊
中国有取保候审
关了一年多,如果最后无罪,国家赔偿、舆论、追责都会很尴尬。于是长期羁押会制造一种“沉没成本”:系统更倾向于用一个有罪结果来解释之前的羁押
美国保释制度当然也有严重阶层不平等,但至少“审前释放”更像一个可以持续争取的程序战场。中国取保候审更多依赖办案机关内部判断和检察监督

假如这个测评确实存在:
明知测试条件不公正;
故意剪辑误导;
收了竞争方的钱;
造成实际严重商誉损失;
证据显示有组织黑公关;

那可能进入刑事风险区,但即便如此,刑事调查 ≠ 必须长期羁押。
否则容易让人感觉:不是为了保障诉讼,而是在提前惩罚。
5 月 25 日
回复了 DiKaErJi 创建的主题 职场话题 技术不值钱 想法和流量才值钱
技术值钱,能 ai 快速抄或者堆人力人力抄的技术不值钱,那种不是有护城河的高端的技术
figma 插件转 html ,figma 插件转 tailwindcss ,选一个,然后拿 html/tailwind 来丢给 codex 让它参考着样式和 tailwind 类来写前端
我觉得是更喜欢了,能更快更多时间实现自己想法的东西
5 月 16 日
回复了 PeterYang1996 创建的主题 Codex codex 执行是真的慢啊,大家也是这样的吗
已经算加快了,5.2 时是最慢的,一个任务半小时
5 月 10 日
回复了 imdoge 创建的主题 程序员 如果有这样一个 agent 框架,大家怎么选择?
@rogerer
这恰恰是和 workflow 不同的思想的设计,可能我前面没表达的清楚
workflow:比较固定的路径
agent loop + ReAct 太自由,全靠 llm 智商,目前在开放任务表现一般,而且有些私域或者内部流程是有固定限制和流程的,模型再聪明也需要门控
我这种设想的思想就是在 langgraph 上再高一层的抽象,不仅是语法糖写法的不同(边代表的更多,协议优先等)
和 gpt-5.5 pro/5.5 heavy 讨论中,有几句总结我觉得很适合表现这种预想的设计:
“Runtime 内核做薄,任务协议做厚,Graph 模板做稀疏,节点内部 agent 保持自由”

它不是 agent loop 那种纯自由的,也不是 workflow 那种固定的,是在一定的图/状态机/门控/harness 等工程限制下的自由,大概就是“限制在一定的流动范围和门控限制下,但是某些节点内它是自由的,可以随便 agent loop 的工具调用的自由的”

举个例子:一个 research 任务,你用普通的 agent sdk 比如就拿 cc/codex 去做它可能调 web search 工具查几轮网站,有时发现点什么还会进一步 web fetch 仔细看,然后开始总结
实际的高级 research 智能体:拆分任务、定证据标准、维护 evidence/gap 、来源校验、补证据、判断能不能 final 等等,这样才能达到更强的效果

@mwVYYA6
以后模型会不会智能到我上面举例的 research 任务不编排也能自己这样做不清楚,毕竟有的 harness 工程就是应该模型越智能越少的,目前测试下来就是很开放的专业的工作,让它自由 agent loop 效果一般。
但是有的不是模型变聪明就消失的:私域知识/行业组织规范/权限边界/安全策略/质量门槛/恢复策略,我觉得不能指望你贴一串 prompt 告诉它就能遵守,有的还是代码硬门控的(除非真的 AGI 了)?
1  2  3  4  5  6  7  8  9  10 ... 14  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2453 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 30ms · UTC 16:04 · PVG 00:04 · LAX 09:04 · JFK 12:04
♥ Do have faith in what you're doing.