Re: [新闻] DeepSeek V4新模型曝光!舍弃辉达转用“华为芯片”

楼主: d8888 (Don)   2026-04-24 20:36:45
小弟倒是看好中国模型。
不是因为中国模型够强,而是中国模型可以用便宜的价格卖 token
任何技术的正确率再怎么叠都只能到 100%
如果中国模型和顶尖模型差距是 60 分 和 85 分的差距
那中国模型就是表现极差不可接受的
但如果过几个迭代,差距是 80 分 和 92 分,甚至 89 分和 95 分,或 92 分和 97 分
呢?
Opus 和 GPT5 Codex 很好
但算力贵啊,小弟玩龙虾,稍微解复杂一点的任务,
AI 实验一段时间就把我帐户余额喷光
现在换 QWEN 3.6 Plus 体感有变笨,但一些简单但繁杂的资料整理任务还是够用了
token 价格只要 GPT5 几分之一
而这阵子似乎大厂都开始更严格管理算力,Github Copilot 不给新人注册,Claude 偷
降 thinking 降智...
一流大模型的算力也许以后越来越贵
而中国大模型则足够便宜
就算不便宜但只要它有 open weight 那总是有供应商会愿意用血流成河的价格 hosting
至于性能差距的问题,中国模型跟顶尖还是有差
但这几年还是进步明显
Minimax 或 Qwen 之流也许赢不了 GPT5 Codex 和 Opus
但跟 Deepseek R1 比起来已经进步极为明显
Minimax 这类玩意在写脚本这种任务也够用了。
等再过几个迭代,一流大模型逐渐接近理论极限
中国便宜模型就会有优势
也许他们知识都是蒸馏来的
一流表现 99.98 分,中国模型技术代差和用二手知识只有 93 分
但中国模型 token 价格只有 1/N
小弟认为是能够劣币驱逐良币的

Links booklink

Contact Us: admin [ a t ] ucptt.com