V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  WhatIf  ›  全部回复第 1 页 / 共 22 页
回复总数  423
1  2  3  4  5  6  7  8  9  10 ... 22  
❮ ❯
4 天前
回复了 lhc70000 创建的主题 › 分享创造 › IINA 1.5.0 发布了
看到帖子,就通过菜单操作了检查更新, 但是没有开全局的梯子,更新失败.
当初因为 mac 上 vlc 性能太差转向了 iina , 用到了现在
生成失败,已退回本次消耗的积分(或免费次数),请重试。
第一次操作, 无法执行
今年高价位入手了一台 160w 的 ai max+ 395 机器 128G 版本 , 早先就是玩具,qwen3.6 35BA3B Q4KM 加上 mtp 可以到 70token/s 的 decode 速度, prefill 差不多 300-600 之间。
后面 qwen3.8 27b 出来, 默认 17token/s 加上 mtp 24token/s 如果选择 UD Q8 量化 差不多 15-17 的样子,xhigh 思考模式下 ,跑一个鹈鹕 1 小时起步。 但是效果方面还是 Q8 能真干活。
最近发现一个 halogen 的框架, 运行 qwen3.8 flash next 125B 4 位量化 ,能有 50-70token/s 的速度,prefill 1500 左右, 接入 opencode 或者 deepseek harness 完全够用。
今天也折腾了一下 minimax h3 , 生成差不多 640*480 这一档的视频,5s 长度 要 4 分钟左右,8s 时长的 8 分钟起步。

感觉现在已经是脱离了玩具的范畴,真能用了, 但是缺点也有, 风扇呼呼得很吵。

我另外一个方案是垃圾佬模式, 2080ti 22G*2 跑 qwen3.8 27B fp8 prefill 初始状态下 1300 左右后面会跌落到 700-900 吧 ,decode 60-160 之间, 当然得用合适的推理框架,配合 dflashv2 的结果。
strata 跑 qwen3.8 flash next , 我用 Swift-1.5-Qwen3.8-Flash-Next-GSQ-RCO-GGUF IQ3_XXS 的情况下,decode 速度比 ai max 的机器略高 50-90 之间吧,harness 里面统计的一般是 75-80.
这个方案我都是限制显卡在 180w 的场景, 这样温度最高 72 左右, 风扇声音不会起飞(当然我把侧盖打开也有关系)

价格方面 ai max 395 无固态的版本 当时是 17949 现在看好像还是没变, 2080ti 22g 当前 3000 出头一张卡
5 月 10 日
回复了 davidyin 创建的主题 › Local LLM › 想折腾一个 AI 主机,请行家出手
24G 的 3090 ,4090 之类 可以跑 30B 上下规模的模型,但是上下文很小, 项目大了估计就不行。
但是感觉 32G 48G 的也好不了太多。
那么只有 pro 6000 96G 显存 能全量跑 32B ,这两天狗东刚看了下价格, 有提供整机的,84000 左右
爬过一次径山, 寺庙里还喝过一小口
3 月 22 日
回复了 hzdt 创建的主题 › 生活 › gemini 给我推荐的补剂方案合理吗?
作息时间是否正常? 血压是否正常?
3 月 17 日
回复了 MrTlyer 创建的主题 › 分享发现 › 说说曾经买过的软件
steam, playstation store, wps, wiznote
扫码进群,抢红包,抽小龙虾 AI 主机!实现 OpenClaw 龙虾自由!
3 月 11 日
回复了 yxisenx 创建的主题 › 职场话题 › 公司开始裁员了, 因为 AI 太好用了
@cheese 话说我昨天让 AI 写了一个安卓 app 的前端+接口后端,用来实现支付宝支付的完整流程。包括下单,回调,支付取消,回调未收到的轮询复查等功能。代码的确是一遍就能用的,当然功能一开始不能正常工作,扔给 AI 信息以后,指出商户后台没配置,配置完全功能都正常可用。唯一的问题是取消订单接口实现时,并未判断订单是否归属当前用户,但是我相信这种问题大量的人都会犯,所以指出一下立马补全了。
当然如果啥都不懂的人是不是可以搞定就不好说了。
好像还没开始抽? 那么无耻地+1
2 月 15 日
回复了 gigishy 创建的主题 › 旅行 › 关于普陀拜佛求健康
普陀山香火很好, 都是去求子的
2 月 12 日
回复了 abenx 创建的主题 › 职场话题 › 部门混进一个混子,我该如何避免被牵连
可以看大戏
ID: 421
2025 年 12 月 22 日
回复了 sevenyangcc 创建的主题 › 生活 › 为什么有的人按电梯总喜欢上下都按啊?
有时候和买火车票多买几站一样的道理, 虽然要下去,但是等下行电梯过来,可能完全挤不进去, 几次之后,就还是先上后下
2025 年 11 月 11 日
回复了 xuxiake 创建的主题 › 程序员 › 个人开发者发验证码有救了
用着阿里云的短信服务, 大概去年开始运营商整顿后,各种发送失败,而阿里云方面也无法解决, 全看运营商心情
qwen code 免费,简单用用不报太大期望的话还不错
gemini cli 我用免费额度, 一天只有 300 万 token 一般就是卡在这个上面,1000 次的请求这个完全到不了,总是 token 数先到
最近常用的时 minimax m2 , 在 claude code 里面配置, 限时免费中,不过快收费了。
质量方面 minimax m2 还是很不错的,gemini cli 也不差, 有时候一个犯傻了, 换另外一个,避免进入死胡同。qwen code 如前所说,能干活,别指望定位处理难度高的问题,但是人家免费啊, 如果和人比, 比起实习生来好的可不是一星半点
VMRACK 上新 cn2 三网精品线路
2025 年 10 月 1 日
回复了 albin504 创建的主题 › 职场话题 › 我记性很差,程序员是不是都这样?
程序员不背锅
记性都不好的话, 咋记住那么多程序规则?
恕我直言, 再坐的全是***
都认为写的是面向对象吧?
那么 属性呢?行为呢? 按照现行习惯, 路上跑的狗, 只有参数肉体, 以及一个狗服务。
1  2  3  4  5  6  7  8  9  10 ... 22  
❮ ❯
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2953 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 42ms · UTC 02:12 · PVG 10:12 · LAX 19:12 · JFK 22:12
♥ Do have faith in what you're doing.