Wyatt Pan
1.5K posts

Wyatt Pan
@wyatt_pan
EasyAcc® 合伙人, 非常想编码却无足够时间编码的一个打杂人员
中国, 湖南, 长沙 Katılım Mart 2010
575 Takip Edilen200 Takipçiler

@hepin1989 @AstroHanRay 我 codex 用的 $20 用来对比的,没用 $200 的套餐,用的都是保持有 ZDR 特性的提供商😂,按我的 Token 用法,预估 Ollama Cloud 的 $100 大约在 5B/月的 token 量,他家按 GPU 时间算钱,token 个人差距大…
中文

Ollama Max 已经被顶爆了,3 天后还有 Kimi K3,手中的 Ollama Max 太香了!
ollama@ollama
The demand for GLM-5.2 and other frontier-level open models has been surging on Ollama's cloud. We're adding capacity in anticipation for some very large models next week! To make sure Ollama's infrastructure stays fast we're temporarily pausing new subscriptions on Ollama's Max plan. Existing Max subscribers are not affected and Ollama's Pro plan is still available to subscribe to.
中文

@wyatt_pan 是的,只看额度其实不算很香,Pro 很好了。但是并发更高!TPS 我没注意 Pro 和 Max 的差距,GLM-5.2 但是都比 Z.ai 官方快,是官方速度的 2 倍左右
中文

@wyatt_pan 不光是资源吧。Token是一方面,另一方面是像这种我们这种更2C的公司和他们coding agent解决的事完全不同的问题。
中文



今天晚上各个群都在传一份《国内大模型蒸馏风波的来龙去脉》。
我大概看了一下,很可惜,这更像是一份由外行根据各种流言拼凑出来的 AI slop。
里面的内容有真有假,但几个核心判断基本都经不起推敲。
比如里面声称,智谱 @Zai_org 在今年 4 月份就已经破解并开始蒸馏 Fable。
这个时间线真的很离谱。
因为 4 月份的时候,Fable (那个时候还是Mythos)甚至还没有正式发布,能够使用的基本都是 Anthropic 的内部测试用户,通过Project Glasswing进行访问。
那智谱是怎么拿到的访问权限呢?
难道是 @AnthropicAI 的邀请或者是五角大楼反代吗🤣
还有一个比较典型的问题,是作者对于传闻中DeepSeek 将部分请求路由到 Fable 表示不理解,认为这样算不过来经济账。
实际上,但凡是个从业者或者稍微了解模型公司的研发流程,就知道这件事情不能简单按照 API 成本计算。
如果一个 frontier model 可以帮助你生成高质量训练数据、评测数据,或者提升模型迭代速度,那么获取这些能力本身就是一种研发投入。
用单次调用价格去判断整个策略是否划算,本身就是把模型公司的研发逻辑想简单了。
但最离谱的部分,是 PDF 里面声称 @Kimi_Moonshot 在 K3 发布前,把整个 RL 团队全部解雇了❓❓
这个说法目前没有任何可靠依据。
实际上情况恰恰相反,根据我的确认Kimi RL 相关团队目前仍然存在,并没有所谓“整个 RL 组被裁撤”的情况。
甚至 PDF 里面还进一步延伸出一套完整叙事:
K3 = 蒸馏 + 刷榜 + 裁撤 RL。
我一开始还在认真的区分哪些是事实,哪些是推测,哪些只是作者脑补出来的故事。
直到我看到 PDF 后半部分开始大量加入意识形态化表达,把技术讨论上升到所谓“国模黑暗时代”“技术偷取”等叙事,我反而释然了。
因为这已经不是在分析 AI 行业,而是在借 AI 叙事讲另一个故事。
PS:我感觉这个PDF是黑KIMI来的,因为KIMI的篇幅最大,但里面的大部分内容都是假的,其他家就有真有假了。

中文










