raymond l

8 posts

raymond l

raymond l

@raymondwatcher

Katılım Aralık 2024
18 Takip Edilen1 Takipçiler
raymond l
raymond l@raymondwatcher·
@MAGAA_BIGLY @notnijiatall @hasanthehun Oh! you thinking a guy just dressing like Mao is worse then; A guy who stole public tax funds, defrauded patient groups, and make lot of staff to lose their jobs
English
2
1
14
137
MAGAA BIGLY
MAGAA BIGLY@MAGAA_BIGLY·
@notnijiatall @hasanthehun Reminder that Mao was a ruthless dictator that murdered millions of people. WTF is he doing dressing up like him?
English
3
0
3
553
raymond l
raymond l@raymondwatcher·
@realQPomelo 管理层在没有ai的时代早就用上 “能工智人” 的vibe coding 啦😄 不都是一样的吗?模糊不清的需求,然后让下面的程序员自己写。
中文
0
0
2
3.6K
QPomelo
QPomelo@realQPomelo·
苹果是怎么在没有 vibe coding 的年代里,写出 xcode 这坨屎的......
中文
81
3
508
157.2K
屠屠老湿
屠屠老湿@ttls2024·
中国商飞向中国南航新交付的两架C919出现严重质量问题,影响了飞行安全,修了半天南航不干了,直接发了一封质量投诉信到商飞,要求商飞整改。商飞内部出具要求员工积极报名整改,有电子有能力的先上。
屠屠老湿 tweet media屠屠老湿 tweet media
中文
472
440
3.4K
1.3M
たこ焼き
たこ焼き@kimihyonte·
@Ofuton410482 そうだね、どうせ君たちは陥没した道路の中に埋められるだけだしね アスファルトの下にいたんじゃ地上のことはわからないんだから それともダムの底?
日本語
7
0
2
1.4K
Ofuton
Ofuton@Ofuton410482·
日本人是怎么觉得刷六四就可以让中国人破防的?还是说日文里的六四天安门=我不听我不听🤡 我又不支持老共,你爱说就多说说
ヤマエナガ@自認アルねこ@y0ama

@Ofuton410482 @3nzyx1VIJYrmssV @47news_official 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 六四天安門 去死吧小熊维尼

中文
35
4
269
25.6K
raymond l
raymond l@raymondwatcher·
@paperpaper886 傻逼鉴定指南,能信这个的学历自动和作者画等号。 (人家是年纪小是哪个学历,能信这个的我不好说属于什么)
中文
0
0
6
865
paperpaper
paperpaper@paperpaper886·
《大模型蒸馏技术报告》
paperpaper tweet mediapaperpaper tweet mediapaperpaper tweet mediapaperpaper tweet media
中文
10
5
70
43.6K
raymond l
raymond l@raymondwatcher·
@MaxForAI @Zai_org 哎呦woc,牢中怎么这么神通广大,先是蒸馏测试模型,再是能搞到被五角大楼禁止的模型,然后是能搞到给大银行的访问权限。这些能做到,该怀疑的是不是美国内部被老中渗透成筛子了吧😅
中文
0
0
13
2.1K
Max For AI
Max For AI@MaxForAI·
今天晚上各个群都在传一份《国内大模型蒸馏风波的来龙去脉》。 我大概看了一下,很可惜,这更像是一份由外行根据各种流言拼凑出来的 AI slop。 里面的内容有真有假,但几个核心判断基本都经不起推敲。 比如里面声称,智谱 @Zai_org 在今年 4 月份就已经破解并开始蒸馏 Fable。 这个时间线真的很离谱。 因为 4 月份的时候,Fable (那个时候还是Mythos)甚至还没有正式发布,能够使用的基本都是 Anthropic 的内部测试用户,通过Project Glasswing进行访问。 那智谱是怎么拿到的访问权限呢? 难道是 @AnthropicAI 的邀请或者是五角大楼反代吗🤣 还有一个比较典型的问题,是作者对于传闻中DeepSeek 将部分请求路由到 Fable 表示不理解,认为这样算不过来经济账。 实际上,但凡是个从业者或者稍微了解模型公司的研发流程,就知道这件事情不能简单按照 API 成本计算。 如果一个 frontier model 可以帮助你生成高质量训练数据、评测数据,或者提升模型迭代速度,那么获取这些能力本身就是一种研发投入。 用单次调用价格去判断整个策略是否划算,本身就是把模型公司的研发逻辑想简单了。 但最离谱的部分,是 PDF 里面声称 @Kimi_Moonshot 在 K3 发布前,把整个 RL 团队全部解雇了❓❓ 这个说法目前没有任何可靠依据。 实际上情况恰恰相反,根据我的确认Kimi RL 相关团队目前仍然存在,并没有所谓“整个 RL 组被裁撤”的情况。 甚至 PDF 里面还进一步延伸出一套完整叙事: K3 = 蒸馏 + 刷榜 + 裁撤 RL。 我一开始还在认真的区分哪些是事实,哪些是推测,哪些只是作者脑补出来的故事。 直到我看到 PDF 后半部分开始大量加入意识形态化表达,把技术讨论上升到所谓“国模黑暗时代”“技术偷取”等叙事,我反而释然了。 因为这已经不是在分析 AI 行业,而是在借 AI 叙事讲另一个故事。 PS:我感觉这个PDF是黑KIMI来的,因为KIMI的篇幅最大,但里面的大部分内容都是假的,其他家就有真有假了。
Max For AI tweet media
中文
62
24
243
223.2K
数字生命卡兹克
数字生命卡兹克@Khazix0918·
可能很多人不知道,其实现在做代码Review最牛逼的,是ChatGPT网页版上的GPT-5.6 Sol Pro模式。 其Review水平和深度,让Fable 5都甘拜下风。。。
数字生命卡兹克 tweet media
中文
210
83
972
286.5K
raymond l
raymond l@raymondwatcher·
@2022meimei3 Typeical dumbass jap, lack of awareness of new technologies like a child who has learned the new term from adult, and using it indiscriminately The best proof is: couldn't found a single model from japan on artifical analysis What we can expect is: lost decades are far form over
English
0
0
2
150
mei
mei@2022meimei3·
ウォール街が騒いでいる🇨🇳KIMIですが、これはCloudeをコピペしたようなモノですから、メディアなどは過剰反応し過ぎではないでしょうかね。 まるで🇨🇳独自開発みたいに見せられていますが、ユーザーがKIMIに『君は誰?』と聞くと、『私はClaudeだ』と名乗ってしまっていますw DeepSeekの時と同じ違和感を覚えますが... これが昨日AI半導体銘柄急落の一因になったと言われてますからウンザリ😇 ☆中国のMoonshot AI(月之暗面)は7月中旬に「Kimi K3」を発表。 2.8兆パラメータで、コーディング・エージェント系ベンチマークではClaude Opus 4.8やGPT-5.5を上回る結果を出したとされ、市場を驚かせました。 ☆Anthropicは今年2月、この中国企業Moonshotが340万件のClaudeとの会話ログを使って蒸留(distillation)していると指摘していました。 今回、実際にKimi K3が「私はClaude、Anthropicが作ったAIアシスタントです」と自己紹介する場面がスクリーンショットで拡散し、この蒸留疑惑の「動かぬ証拠」として受け止められています。 ☆「Claudeと名乗ってしまう」現象自体は、Kimi K3がClaudeの出力データ(他社モデルの応答ログなど)を学習データに大量に含んでいる場合に起きやすい典型的な症状です。 モデルは学習データの表面的なパターンを学ぶ為、Claudeの応答スタイルを大量に模倣学習していれば、自己同一性の質問にClaudeの定型文で答えてしまう事があります。 ☆Kimi K3は学習に使った計算資源が少ないと主張する一方で、推論時の計算コストはGPT-5.5やClaude Opus 4.8 Highと同水準とされている点がおかしいとClaudeが指摘。 本当に効率的な独自トレーニング手法なら推論コストにも効率性が反映される筈で、この矛盾が「蒸留疑惑」を補強する材料として議論されています。 ☆過剰反応しているメディアは、ベンチマーク上位というだけで「Claudeに匹敵/凌駕」と騒いでいますが早計だとClaude。 ベンチマークは実運用の質を完全には反映しない。オープンウェイトモデルが登場する度に同様の「黒船」報道パターンが繰り返されて来てますよね💀 パクる事が出来なければリリース時点が最高地点で、アプデなどがなされ時間が経過するにつれClaudeに遠く及ばない事が知れ渡り、DeepSeekと同じように廃れそう。
Francois Chaubard@FrancoisChauba1

@MarioNawfal kimi thinks its claude. ??

日本語
80
336
919
97.7K