Wei WANG

1.7K posts

Wei WANG

Wei WANG

@nahuty

Turn it on.

Sydney, New South Wales Katılım Mart 2009
286 Takip Edilen150 Takipçiler
Wei WANG
Wei WANG@nahuty·
@raycat2021 “时间线上看到彼得林奇的视频就可以考虑抄底了” 😅
中文
0
0
1
111
徐老猫
徐老猫@raycat2021·
这个时候可以听一下彼得-林奇谈股市下跌: “历史会告诉你市场会下跌,而且会跌得很厉害。 过去一百年,大约每两年市场会有10%的下跌,每六年会有一次25%以上的暴跌。 市场总有一天会下跌,如果你还没做好准备,就不应该持有股票。 而且,下跌是好事,因为你了解这家公司, 知道他们经营良好。所以你可以抄底,可以利用波动性。 但没有人知道下跌何时发生,人们都是事后才说自己预测到了。 另一个关键是, 你总有足够的时间买入。 举沃尔玛的例子,它于1970年10月上市,它的经营业绩良好,但你如果是保守型投资者,也可以等10年再说。 因为10年后你再买入沃尔玛,仍能获得35倍的投资回报。 当然如果你在上市时买入,你将获得500倍的回报。
中文
30
5
72
10.9K
Wei WANG
Wei WANG@nahuty·
@RobinSeun 那是他们语文不好,阅读理解能力有限。我可以很肯定的说 😄 (水军另论)
中文
0
0
1
70
RobinSeun_维京黑船
RobinSeun_维京黑船@RobinSeun·
认真发推9个月了,被骂那是稀松平常了。 最好玩的是:一直被左的骂我太右,被右的骂我太左😂😂😂
中文
24
0
51
5.5K
Wei WANG retweetledi
naiive
naiive@naiivememe·
2026 Bull Market Expectation vs 2026 Bull Market Reality
naiive tweet media
English
169
466
10.2K
453.2K
Wei WANG
Wei WANG@nahuty·
@williamlong 莫名其妙想到 “起个丑名好养活” 😅
中文
0
0
1
259
William Long
William Long@williamlong·
#知乎问答 问:为什么有人把新加坡称呼为「坡县」? 答:日本,叫鬼子 韩国,叫棒子 台湾,叫台蛙 香港,叫港灿 印度,叫阿三 越南,叫猴子 澳洲,叫土澳 美国,叫丑国 新加坡,叫坡县 俄罗斯,叫毛子 在中国大陆的舆论环境里,有哪个国家,是被正常称呼或赞美的?
William Long tweet media
中文
133
9
103
31.8K
Wei WANG
Wei WANG@nahuty·
@python_xxt 试了一下ChatGPT,回答得比较果断。 我想骗它加重新闻的权重,结果还被它反过来教育了一下
Wei WANG tweet mediaWei WANG tweet media
中文
0
0
3
403
Wei WANG
Wei WANG@nahuty·
@imwsl90 网友们可以证明,你的格局还是👍的 😄
中文
0
0
0
71
卫斯理
卫斯理@imwsl90·
我的生活质量太低了 ​ ​和家人一起回家 ​ ​聊着聊着就开始批评我了 ​ ​要顾家 要顾小孩子学习 ​ ​不要每天呆在电脑面前 ​ ​你的格局太低了 还没起来……🌚🌚🌚
中文
40
0
34
8.1K
Wei WANG retweetledi
Brett Adcock
Brett Adcock@adcock_brett·
Few interesting details around the F.03 livestream: > We previously showed this task running for 1 hour. Today we're pushing for 8 hours straight. High odds something breaks > The use case is small package sorting. F.03 must detect the barcode, pick up the package, and reorient it barcode face-down onto the conveyor. The robots have to reason purely from camera pixels > Humans average ~3 seconds per package. F.03 is now around human parity > The robots are fully autonomous running Helix-02, our in-house neural network running entirely onboard F.03 (e.g. AI inference is done on device) > Multiple humanoids are networked together and communicating with each other to maximize conveyor uptime. The system is designed to run 24/7 > A robot will work until battery is low (~3-4 hours), then autonomously request another robot to swap in to minimize conveyor downtime > It's a multi-robot coordination with autonomous failover strategy. If a robot detects an issue - it will self diagnose itself and if there's an issue it autonomously walks to maintenance and requests a replacement from the fleet - no humans in the loop
English
112
104
1.7K
369.3K
Wei WANG retweetledi
Brett Adcock
Brett Adcock@adcock_brett·
Watch a team of humanoid robots running a full 8-hr shift at human performance levels. This is fully autonomous running Helix-02 x.com/i/broadcasts/1…
English
1.9K
3K
17K
13.6M
Wei WANG
Wei WANG@nahuty·
@yuyy614893671 没事。就想想大家是会因为飞碟来关注你,还是因为你其它手敲的内容,心里就舒坦了 😄
中文
0
0
1
37
金融汪
金融汪@yuyy614893671·
我算是无意中,解码了X上的流量密码 认认真真码字,做记录,查资料写的有营养的文字看的不多;估计X的算法也不会推荐 躺在床上,无意中看见五角大楼文件,顺手转发还加了几个夸张的词汇的那条UFO的推文无数人看 而且那条推文中还有歧义存在,或者大家都认为是错误存在 尼玛这是怎样的一个世界啊?
中文
78
3
169
19.2K
William Long
William Long@williamlong·
#历史上的今天 1961年5月4日,苏联颁布《反寄生生活法》,根据法令,连续一年中无正当理由失业超过4个月即犯罪,将被强制执行劳动改造2–5年。诺贝尔文学奖得主约瑟夫·布罗茨基曾在20世纪60年代被苏联法庭以“社会寄生虫”的罪名判监5年。这个法令持续了30年之久,直到1991年4月才被废除。
中文
23
40
298
46.5K
小盖
小盖@xiaogaifun·
强烈推荐大家看看DeepMind CEO Demis的最新判断。 真的,Google DeepMind 的 CEO Demis Hassabis 每一期访谈我觉得值得都花时间看看。这哥们讲东西很实在,而且通俗易懂。 早上边跑步边听完了他和 YC CEO Garry Tan 的最新一期播客。 刚刚把笔记写完,也给大家分享下。 多说一句,好多人问我这种笔记是不是 AI 写的。我说下自己的流程。 我会先完整听完播客,然后用语音输入法把感触尽量充分地讲出来,再让 AI 帮着整理初稿,最后自己逐字修改优化。 如果全部交给 AI 做总结,那等于把思考和理解的能力让渡给了 AI,对自己理解这件事其实没有任何价值。 OK,咱们进正题。 1 Demis 的态度非常明确,现在的大模型范式(大规模预训练 + RLHF + CoT)一定会是 AGI 最终架构的一部分,他不认为这会是条死路。 但要实现 AGI,还有几个关键问题要解决。这几个问题包括:持续学习、长程推理和记忆系统。 先从最容易看到的现象讲起,Context Window。 现在大模型处理长信息,最常用的招就是把 Context Window 一直撑大。一开始 8k,后来 32k,再后来 100 万 Token。听起来很厉害,但本质上是暴力堆砌。 Context Window 其实就相当于人脑里的 Working Memory,工作记忆。人的工作记忆能同时装多少东西?心理学里有个经典数字,7 个左右。背电话号码能记住 7 位上下,再多就溢出了。 大模型呢?已经做到 100 万 Token。 按理说,模型的工作记忆比人大几十万倍,应该比人聪明几十万倍才对。但显然不是。 问题也恰恰就出现在这。把所有东西都塞进 Context Window 里,里面包含了不重要的东西、错的东西、过时的东西。看起来信息很多,其实是一团乱麻。 那人为什么 7 个数字的工作记忆就够用? 因为人脑背后还有另一套机制在工作。我们记得几年前的事,记得童年的事,记得几小时前发生的事。这些都不塞在工作记忆里,而是另一套系统。 具体来说这套系统是海马体,大脑里负责把新知识整合进已有知识库的那个部分。 研究发现,人睡觉的时候,特别是 REM 睡眠阶段,大脑会重放白天重要的片段,让大脑从中学习。新东西在睡觉的过程里,温柔地融进了旧的知识体系。 这个把新东西融进旧知识库的过程,就是持续学习。 模型现在没有这套机制。每一次对话结束,刚学到的东西就会忘记。下次重新打开,还是上次那个模型,没长进。 2 再聊聊长程推理的问题。英文表达是 Long-term Reasoning。我翻译为了长程。 长程推理这个词太抽象了。Demis 讲了一个特别具体的故事,听完会立刻明白他说的是什么。 他说自己喜欢跟 Gemini 下国际象棋。下棋的过程里能看到模型的 thinking trace,也就是它在那里到底想了什么。 然后他发现一件怪事。 模型考虑一步棋的时候,思考链里清清楚楚写着,这步是个昏招。但接下来,它没找到更好的走法,于是又走回这步昏招。 明明知道是错的,还是把错的那一步走出去了。 这个细节比任何 benchmark 数据都说明问题。因为它暴露的是模型缺少对自己思考过程的某种内省能力。 正常人下棋,意识到一步是昏招之后,脑子里会有一个反应,停一下,再想想。停一下、再想想这个能力,模型现在没有。它能在每一步局部判断对错,但没法基于整盘棋的局势去调整整体策略。 这就是长程推理还没搞定的样子。模型可以一步一步往前走,每一步看起来都合理,但走到后面整盘棋的方向其实是错的。它没有那种退回到当前思考的上一层、重新审视一下的能力。 说到底,模型缺的是一种内省。 3 学习、长程推理、记忆,这是 Demis 在播客里点出来的三个 AGI 鸿沟。 除此之外,他还反复提到了创造力。 2016 年 AlphaGo 跟李世石下棋,第二局走出了著名的 Move 37。那一步棋走出来的瞬间,全世界的围棋高手都看呆了。 所有人类几千年下围棋积累的经验都告诉它不该下那里,但 AlphaGo 下了。下完之后大家发现,是一步神来之笔。 很多人觉得,这就是 AI 的创造力来了。 但 Demis 说,对他自己来说,Move 37 只是起点。他真正想看到的是另一件事。AI 能不能发明围棋这件事本身。 这两件事的区别非常关键。 Move 37 是在围棋这个现成的规则里,找到了一步人类没想到的招。但围棋的规则、棋盘的形状、黑白子的对弈方式,是人类发明出来的。AI 在已有的框架里非常厉害,但能不能自己造一个框架,是另外一回事。 Demis 给了一个具体的设想。 如果给 AI 一个高层次的描述。造一个游戏,五分钟能学会规则,要好几辈子才能精通,棋局有审美,一下午能下完一局。AI 能不能根据这个描述,自己倒推出围棋? 目前做不到。 为了把这件事讲得更清楚,Demis 还提了一个测试,他自己叫爱因斯坦测试。 用 1901 年人类已有的全部知识训练一个模型,看它能不能在 1905 年那个时间点,自己推出狭义相对论。 爱因斯坦在 1905 年那一年里,连写了几篇改变物理学的论文,后来叫爱因斯坦奇迹年。那些工作不是从已有的物理学论文里通过拼接得到的,是基于已有材料做了一次全新的概念跳跃。 爱因斯坦测试想问的就是这件事。AI 能不能做这种跳跃。 目前的大模型主要在做两件事,pattern matching 和 extrapolation。一个是从大量数据里找规律,一个是把规律往外延伸一点。但发现新东西需要的是类比推理的能力。从一个领域里抽出深层结构,搬到另一个全新的领域去用。 这个能力,模型现在还没有。也可能是有,但用法不对所以激发不出来。 4 除此之外,Demis 还分享了一个让我特别出乎意料的判断,他说未来 6 到 12 个月,真正的价值不在更大的模型,在更小的模型。 这一部分内容我反复听了好几次,确实突破我的已有认知。 不知道大家的想法,反正我自己,这一年来并没有怎么关注小模型的进展。毕竟行业的焦点就是把模型做大嘛。 那小模型的价值到底在哪? 最直接的是成本。同样一个任务,小模型的推理价格可能只是前沿模型的十分之一甚至更少。 但 Demis 说,比成本更重要的其实是速度。 这里有一个前提得先说清楚。Demis 不是在说速度可以替代智能。 他的原话是,当小模型的能力已经达到前沿模型的 90% 到 95%,也就是已经相当不错的时候,剩下那 5% 到 10% 的能力差距,比不上速度带来的好处。 比如现在工程师用 AI 写代码,已经形成了一种新的工作节奏。一个想法冒出来,几秒之内就能看到结果,不行就改,再不行再改。 这个一改再改的循环跑得越快,做出来的东西就越好。如果每次调用都要等十秒,整个工作流就被打断了。 更关键的是,快到一定程度,工程师在这种节奏里能进入心流。一个想法、一次尝试、一个反馈、再来一个想法,思维不被打断。 这件事写过代码的人都懂,进入心流和频繁掉出心流,产出的差距是数量级的。 Agent 也是同样的逻辑。一个 Agent 跑完一个任务可能要调几十次模型,每次慢一秒,整个任务就慢一分钟。慢到一定程度,Agent 就从一个能用的东西变成鸡肋。 小模型不是大模型的廉价替代品。有些事只有小模型能做。 比如手机、眼镜、家用机器人,需要的就是一个能在本地跑起来的模型。本地跑除了反应快,还有一个特别重要的好处,隐私。 家里机器人看到的视频、听到的对话,全部在设备本地处理,根本不上云。这件事对很多用户来说不是加分项,是底线。 成本、速度、边缘部署,这是小模型的价值。 5 讲完小模型的价值,接下来一个更关键的问题是,能力被压到这么小的参数里,会不会有上限? Demis 的判断是,目前没看到信息密度有任何理论上限。小模型的智能天花板还远没看到。 支撑这个判断的,是 DeepMind 在蒸馏这件事上的积累。蒸馏简单说就是先训练一个超大的模型,然后用这个超大模型去教一个小模型。教完之后,小模型用极少的参数,能复现原来 95% 以上的能力。 为什么 DeepMind 这么重视蒸馏?因为要把 AI 能力放进谷歌的头部产品中,前提是低延迟、低成本。前沿模型再强,每次推理花几秒钟、花几毛钱...这条路,恐怕很难走得通。 一个前沿模型发布之后,6 到 12 个月内,他们就能把这个模型的能力蒸馏到边缘设备能跑的小模型上去。这个时间表比很多人想的要快。 在很多场景中,小模型和大模型会相互配合。 举个例子,一个端到端的智能助手,绝大部分日常任务在本地的小模型上跑。智能眼镜看到的画面、家里机器人听到的对话、手机里的私人助理,模型直接在设备里读懂,不需要往云端传一遍。 只有遇到特别复杂、本地搞不定的问题,才向云端的前沿模型发起请求。 也就是说小模型在边缘做主力,前沿模型在云端做后援。 不过,这个构想对小模型的要求也比较高,它不能只会处理文字,还得能理解物理世界。 这就是为什么 Gemini 从一开始就坚持多模态,不光处理文字,也处理图像、视频、声音。 一开始这么做比只做文本要难得多,但眼镜也好,机器人也好,需要的是一个能看懂周围世界的模型,不是一个只会聊天的模型。 讲到这里,小模型这条路的轮廓就完全清楚了。它独立成立,不是前沿模型的廉价替代品,而是另一条同样重要的路。 嗯,很有启发。
中文
49
239
1.2K
187.3K
RobinSeun_维京黑船
RobinSeun_维京黑船@RobinSeun·
这件事跟30-300这俩凑在一起,在内网引起了轩然大波。 律师鸣不平、民企吓破胆、群众拍段子,尤其在后半夜的抖音,那简直闹得没边儿了。 我们看看财新怎么解读,简单来说是这样: 中国正在把“民企内部腐败”纳入和公职腐败接近的重刑治理框架,表面逻辑是保护民企产权,实际上会严重影响民企经营,导致更激烈的股权斗争。 其实看到这里就够了,还想看细节可以往下看: 一、最重要变化 从2026年5月1日起,《解释(二)》施行。 官方文件明确说,非国家工作人员受贿罪、对非国家工作人员行贿罪、职务侵占罪、挪用资金罪,定罪量刑标准分别参照受贿罪、行贿罪、贪污罪、挪用公款罪执行。 二、财新这篇文章真正说了什么 表面看很有爱,说这是保护民企产权。 稍微深一点儿:这是国家把民企内部治理也纳入刑事治理框架。 以后采购吃回扣、高管拿返点、任何员工侵占公司钱,风险都会变大。 中国大量民企本来就账目不清、股权不清、公私不清。 过去叫家族企业管理粗糙,以后就得叫挪用资金、职务侵占、非国家工作人员受贿。 再多思考一点儿:民企内部的权力关系和权力斗争都会变化。 肯定会震慑住很多大厂员工的贪污行为,但是也一定会变成一把利刃。 员工之间、股东之前,都多了一个刑事按钮。 以前搞你是把你项目搞黄,让你在老板面前吃瘪,以后搞你就是让你进去三年,这差距可太大了。 ——— 文章最后,对一个律师采访时,律师说出了“友善的建议”: 公安机关要对刑事立案的标准进行严格审查和判断,防止搞趋利性司法和“远洋捕捞”,避免沦为民企股东之间互相打压的工具。 呵呵,真的太友善了,是互相打压么?还是降维打击?
RobinSeun_维京黑船 tweet media
中文
8
14
79
21.5K
Wei WANG
Wei WANG@nahuty·
今天偶然看到“奥密克戎”这个词。其实我也不记得了。
中文
0
0
0
22
Wei WANG
Wei WANG@nahuty·
@8964kevin_t 不是错觉,每次回国都有这种体验。 我一般用国内的实体sim卡,带一个海外的 eSIM 。前者不到一天就把免费的1G数据跑光了;后者大概10天才用了不到5G。
中文
0
0
1
185
KT666
KT666@8964kevin_t·
不知道是不是错觉,在中国的时候用流量特别的快,回到美国感觉就没有这样。
中文
34
2
47
14.9K
Wei WANG
Wei WANG@nahuty·
@Nohomework0 正在东京体验,外国餐厅可选项确实不到…
中文
0
0
1
34
双层牛肉汉堡
双层牛肉汉堡@Nohomework0·
你要真是对比东京和悉尼的各国餐馆质量,说个很违反常识的结论。东京作为全世界米其林餐厅最多的城市,各国餐厅好吃程度被悉尼吊打。 你去你就知道,你在东京想要找到好的粤菜馆,新马泰餐厅,墨西哥餐厅,不好找。再说一个违反常识的事情:悉尼的日料店都是日本人开的。原汁原味很重要
中文
46
3
134
38.1K
RobinSeun_维京黑船
RobinSeun_维京黑船@RobinSeun·
@bketck 我也就是飞机、高铁、失眠时间看,其他时间也得伺候甲方和领导
中文
1
0
4
545
RobinSeun_维京黑船
RobinSeun_维京黑船@RobinSeun·
我不会消失的,首先收益的那三瓜俩枣对我来说约等于无。 其次在墙内被阉割了十几二十年的我上了推特,就如同千年的太监突然长出了jj。 根本无法遏制每天都拿出来给所有人分享和炫耀的冲动。 到现在,起码已经持续7个多月了,还没有衰退的迹象。
中文
28
1
105
19.8K