Re: [爆卦] 中国开源AI模型月の暗面K3站上榜首

楼主: doig (dd)   2026-07-20 09:42:29
Anthropic这招玩不下去了
时常有新闻风向故弄玄虚
说什么Mythos太强会自己思考
只能用一再出一个更安全的Fable 5
然后后来Fable 5又强到不能上架
或是Anthropic又出新闻说
自己发现在Claude系列模型有内部工作区
类似人脑意识思维
Anthropic把Fable吹上天
网络上也有不少Fable粉
后来没多久《GPT-5.6 Sol》上市
Fable就GG了,
随后的《Kimi K3》
又让Fable神话再度破灭
Fable贵,而且有时会偷降智到Opus 4.8
美国人自己都做辛普森动画酸Fable
不少人改用Kimi、GPT
https://i.meee.com.tw/SxTvprg.gif
阿里的千问3.8最近也出预览板了
当初一堆人说阿里不可能开源(开放权重)
他们也有计划要开放权重了
▼阿里千问Qwen。17小时前的发文
https://i.meee.com.tw/dCcKYth.jpg
https://i.meee.com.tw/UZFMrQo.jpg
(但Qwen3.8 Preview我还没玩过
先不评论,最近都在玩Kimi K3)
Deepseek V4正式板(GA)(General Availability)
这几天会出,有可能是今天
(多方消息说最快7月20日)
我最近也已经在OpenCode上
玩过Deepseek V4 API的灰度测试
(灰度测试Graysacle Testing
也叫金丝雀测试Canary Testing
是软件在正式向全民发布前
筛选一些用户,对他们先发放新功能
灰度测试的核心概念是
"由灰到黑",从一小部分用户开始,
逐步扩大范围到大众)
最快今天Deepseek V4会出正式版
我自己的看法
之后中美4巨头就是
Kimi、Deepseek、Qwen千问、GPT
(Fable不列入讨论,就如我开头说的
Anthropic爱故弄玄虚
而且Fable还会用户玩到一半下架
这家我看可能玩不了几年了,
在美国会被GPT(OpenAI)取代
)
这里面的Deepseek,我也相当看好
因为Deepseek每次都能改变生态
(别忘了它是美国政府认证的强
因为美国政府禁用Deepseek
可说是白宫挂保证的)
2年后
可能我们看到的全球4巨头,会是这样:
3个大陆的(Qwen、Kimi、Deepseek)
加上一个美国OpenAI的GPT
(因为全球市场不只美国
其他国家不太会因为中美竞争,或政治因素
就不去使用大陆的模型)
所以全球范围来看
几年后的4巨头
还真的可能是3大陆、1美国
※ 引述《purplvampire (阿修雷)》之铭言
: 来自权威机构ArenaAI的测试,中国最新开放权重模型K3,
: 在前端开发表现上超越Fable5站上榜首位置
: 震撼全球AI开发者
: https://x.com/arena/status/2077824029126504525
: 来自西班牙的测试结果
: https://x.com/nicos_ai/status/2077841576760381455
: → Fable 5:45,800 个token,$0.42
: → Kimi K3:38,200 个token,$0.05
: K3的结果更好、更快,而且花了我8倍更少的费用
: 来自美国的测试
: https://x.com/bhavani_00007/status/2077798166729208223
: 差距大到令人难以置信。
: Kimi K3 建构了一个完整的场景,包含纹理、适当的灯光、弹药箱、武器架,到处都有精

: 的细节。Opus 4.8 给了我一个几乎空荡荡的房间,只有几张漂浮的桌子。
: 毫无疑问,它完胜 Opus 4.8。Kimi K3 达到 Fable 5 等级,而且在 3D 和游戏方面明显

: 于 GPT-5.6 Sol。
: 一个开放权重模型竟然匹敌市面上最好的封闭模型。好好消化一下这点。
: prompt
: A realistic military armory with rifles, pistols, sniper rifles, grenades, bul
le
: tproof vests, ammo crates, weapon racks, animated monitors, and dynamic lighti
ng
: . build this in 3.js

Links booklink

Contact Us: admin [ a t ] ucptt.com