Mochiao Chen
178 posts

Mochiao Chen
@MochiaoChen
A finance bro, an AI native, a literatus, a nerd, a gambler, and in tech & humanity I believe Co-founder of UIBEAIA,ex-CITIC, intern@MiraclePlus(former YC cn)








扇子は日本発祥やで父さん…



中国开源模型Kimi开始证明,云大厂的资本开支没有必要。美国 AI 资本溢价到顶了? 这是我今天见到最可笑的外行解读和小作文(如同meta和市场算力过剩)。我认为这个消息继续发酵得越厉害,我抄底抄得越安心,谢谢小作文和燃料 从硅谷业内一线 AI 从业人员角度,给大家解释一下我看到的逻辑荒谬点。去年 DeepSeek 事件之后,nvda当天跌了 17%,之后发生什么,一直持续到今年的 Infra 上涨,我就不多赘述了 很多人没有分清推理和训练就开始下结论,或者看大家都在发,通过情绪渲染,洗个稿就立刻发出来,证明自己紧跟 AI 潮流,其实都不知道自己在说什么 推理不是凭空产生的,不是有了模型就能用。模型参数需要托管在 GPU 上,需要用存储kv cache,需要用互联来搬运数据。 模型越便宜、越好用,甚至开源,就越能推动整个行业的进步。这会让更多的人用上好的模型,把蛋糕越做越大,而非在有限的盘子里你多一块、我少一块的零和博弈 当模型更便宜,能让更多的人用得起、更智能,总的推理量会越来越多,还是越来越少呢?社会上是不是有更多的人会用上呢 Kimi 能够训练出来好模型,跟推理 token 的消耗有什么关系? 当然,每个人可能有不同的意见。最关键的是,你作为投资者,你相信它会更多吗? 其次,有一个方法叫“蒸馏”。我对 Kimi 是否蒸馏了sota模型不做评论。我也不觉得训练就到此止步了,模型每三个月就会变得更聪明。 什么时候 Kimi 说,我们不用这么多的算力,能做到赶超拥有强算力的模型而非逼近,我会立刻改变我的想法 但目前 Kimi 自己也承认,跟 GPT 5.6 和 Fable 还是有比较大的差距。 现在吹得最猛的就是这个前端做网页的榜单评分 我看到的更多是情绪渲染和通稿,期待更多的生产力实测 此外现在主流媒体拿着一个大语言模型LLM就认为这是 AGI(通用智能)的终局了,我不这么认为。正如我所说的:端侧 AI、物理 AI 甚至世界模型。 同时,我也再次感谢写小作文的人,希望这个消息继续发酵,能让我们有更好的价格买入




I'm very curious: how close to the code do you still prompt? Do you still ask for specific architecture? Do you still ask for the code to be written in a specific way? For me, it mostly depends on the project, but I can't hide I've been further and further from the actual code.




















