[讨论] 请问大家沦陷CHAT GPT pro了吗?

楼主: arsl400 (dark hatter)   2026-08-30 02:47:38
最近OPENAI突然在几天前宣布plus要限制字数,不然就卡几小时
Pro的token数量比较多
可是要3000抠抠
请问大家有沦陷吗?
还是写程式公司会补助pro?
作者: pponywong (pony)   2026-08-30 08:09:00
pro方案很值 没事还会reset用量 还会给你reset ticket因为太值了 我都直接开2~3个repo同时用codex 要不然根本用不完
作者: USD5566 (美金五千五百六十六)   2026-08-30 10:42:00
这个 id直接嘘就好 平常电影版洗不够来这洗
作者: abc0922001 (中士abc)   2026-08-30 11:20:00
我都用gemini
作者: ke265379ke (山王泽北)   2026-08-30 22:22:00
上周我才碰到 chatgpt 算错一个变量的代数问题…..
作者: awenracious (Racious)   2026-08-30 22:49:00
公司有提供claude MAX 不过我自己也是订阅了GPT pro
作者: Obama19 (^_^)   2026-08-31 01:34:00
AI顶多拿来查资料吧 生产环境最好别用
作者: jobintan (Robin Artemstein)   2026-08-31 07:05:00
算力紧张(×)开割韭菜(○)
作者: pponywong (pony)   2026-08-31 09:33:00
你要AI直接算代数 错误的机率很高 因为他是文本产生器但是你可以较AI用python lapack解 或是用julia写出script 跑答案比较快
作者: CoNsTaR ((const *))   2026-08-31 11:23:00
自己跑 glm-5.3-flash, deepseek-v4-flash-0731 和 qwen3.8-flash-next,永远不会被限制qwen3.8-flash-next 只要 80GB RAM 就可以跑 Q4 full context
作者: shortoneal (不告诉你咧)   2026-08-31 19:05:00
很有意思,以前网络时代大家把黏度高的客户当高价值客户,AI时代反而是要赶走那些用的多的叫他们滚去自架
作者: samuel0330 (samuel)   2026-08-31 22:43:00
因为网络时代重度用户为企业带来价值,现在重度用户反而是让算力成本爆增
作者: jobintan (Robin Artemstein)   2026-09-03 07:03:00
CoNsTaR所说的80GB,所指的是RAM还是VRAM?两者差很大。
作者: CoNsTaR ((const *))   2026-09-03 15:01:00
RAM+VRAM 总合大于 80GB 就可以,qwen3.8-flash-next 只有 6b active parameters 所以就算大部分 parameters 都spill over 到 RAM 速度也不会太慢,你的 VRAM 只要能放得下 kv cache 就可以,而且它有 51b 是 per layer embedding,所以大概有 102GB 是可以直接从 SSD 串流,不需要常驻在 RAM 的,所以才只需要 80GB RAM265k context 的话 kv cache 只有 6.2 GB,所以就算你只有 8GB VRAM 也行*256k算错,256k context Q8 kv cache 需要 14GB RAM,所以至少要 16GB VRAM 才塞得下 256k kv cache,但如果你只用 128k context 虽然有点小,但 8GB 就够了然后有一个 AtomicChat 的 quant 他的 Q4 因为把 per layer embedding 也算进 bpw,然后又用 bpw 来命名,所以只要 56GB RAM 就可以跑 "Q4",虽然没有统一的 KLD 跑分,但是其他人的 Q4 KLD 大概都是 0.04,AtomicChat 的 Q4是 0.08,比其他人的 divergence 高了一倍,但如果 RAM吃紧,用 AtomicChat 的 quant 只要 16GB VRAM + 56GB RAM 也能号称跑 Q4(但实际上更像 IQ2 或 IQ3)

Links booklink

Contact Us: admin [ a t ] ucptt.com