Gabriel M

20 posts

Gabriel M

Gabriel M

@InwinterM

Katılım January 2023
37 Takip Edilen7 Takipçiler

2026 Yıllık Özeti

@InwinterM hesabının Twitter yılını gör

Yufan Sheng
Yufan Sheng@syhily·
讲个暴论: 现在的很多大模型测评,都停留在一句话生成一个游戏,一个网站等 demo 阶段。实际上,这些本质上是测试世界知识。 而具体到日常开发本身,很多时候,很多人可能自己都没有良好的编码习惯和品味,自然用不好大模型。
seekinganythingbutalpha@ivanalog_com

那些说dsv4f不行的,我也不知道什么活这么难需要金锄头才能干。 我dsv4f hands off跑完一个阶段,gpt5.6,K3,opus 5,分别review一遍,都得夸意图对其的好,就一两个小毛病。 这三个模型互相之间review最多也就这个水平了。gpt和opus还经常互相骂。 只要不用瞎子写前端,dsv4f已经是版本答案了。

中文
7
1
86
14K
Gabriel M
Gabriel M@InwinterM·
@alz_zyd_ 免费用户剔除掉再看,图景可能很不一样。
中文
0
0
1
40
alz
alz@alz_zyd_·
The AI ecosystem in China seems to have gone a strangely different route from the US. Doubao is extremely dumb, but has highest market share. Deepseek is smarter but has 1/3 the users. Kimi k3, famously an exceptionally strong model, has nearly 0 users
English
130
17
436
62K
实践哥MinLi
实践哥MinLi@MinLiBuilds·
@coder_left 他们这个版本号命名也有个好处:之前那个直接就下线了,不会像 Opus, 4.5、4.6、4.7、4.8、5.0 都得在线。
中文
1
0
1
120
程序员Left
程序员Left@coder_left·
DeepSeek-V4-Flash 正式发布,Agent 能力大幅加强,官方 API 现已正式上线公测! 1、本次更新大幅升级了 Agent 能力——基准测试分数现在远远超过 V4-Pro-Preview 2、官方 V4-Flash 现在原生支持 Responses API 格式,并完全适配 Codex! 尼玛,这都能叫 4.5了,这原来才正式版吗
程序员Left tweet media
DeepSeek@deepseek_ai

🚀 DeepSeek-V4-Flash Official API is now LIVE in public beta! 🔷 We’ve massively upgraded its Agent capabilities—benchmark scores are now far surpassing the V4-Pro-Preview. Check out the massive performance leap below! 👇 🔷 The official V4-Flash now natively supports the Responses API format and is fully adapted for Codex! Check out the configuration details in our official API docs: api-docs.deepseek.com/quick_start/ag…

中文
4
0
4
605
码良
码良@cxjwin·
带过一个应届生,底子不错,但前两个月几乎零产出,不是做不了,是他不敢 代码不敢提交,怕被review打脸;问题不敢问,怕别人觉得他蠢;方案不敢提,怕在会上被公开否定。每次1v1问他有什么事吗,他永远说没事,我能搞定 结果第三周直接搞出个线上告警,他把一个缓存逻辑搞错了,生产环境差点出问题。事后复盘他才说实话,那个逻辑他第二天就觉得不对,但不确定,又不敢找人确认 职场的生长痛,大部分来自心理内耗,不是能力不足。新人害怕暴露自己的脆弱,一个好的团队,应该让新人觉得犯错是安全的
中文
41
30
558
100.8K
Gabriel M
Gabriel M@InwinterM·
@ethan3lee @dotey 你可拉倒吧。Trae只是用户量大,但能力是国产这几家里最差的
中文
0
0
9
616
Ethan
Ethan@ethan3lee·
@dotey 不认可,字节的 Trae,阿里的 Qoder,体验明显好于 kimi 和智谱的 zcode
中文
8
0
13
8.2K
宝玉
宝玉@dotey·
只要去山寨 Codex,体验就不会差;底层只要用 PI 或者 Claude Code 的 SDK,那功能就不会差;只要接聪明一点的模型,能力就不会差。大厂如果舍不得落下脸山寨、什么都要从头搭、还只能用有限的自家模型,那效果当然不会好,人也不会少。
宝玉 tweet media
中文
175
54
633
198.9K
xscan x
xscan x@xscanzm·
@Pluvio9yte 是要发布新模型? 5.2 都是牛夫人了啊
中文
1
0
1
3.9K
雪踏乌云
雪踏乌云@Pluvio9yte·
GLM的套餐也太离谱了,终于放开套餐了,用量没变的情况下,价格直接从149翻3倍多到了538 同一天OpenAI还进行了大降价: • OpenAI:Luna 砍 80%、Terra 砍 20% • 智谱 GLM Coding Plan:开放订阅但涨价,Lite 大约 49 → 118 元 😅
雪踏乌云 tweet media
中文
118
1
49
147.7K
Gabriel M
Gabriel M@InwinterM·
@hqmank 6也许,5.5意味着还是几千亿的参数量,完全不可能干过K3
中文
0
0
0
68
Kai
Kai@hqmank·
Rumor: Zai is about to drop GLM-5.5. Can it beat Kimi K3?👀
Kai tweet media
English
49
24
872
56K
Gabriel M
Gabriel M@InwinterM·
@dzvoz58421711 不支持。中日的深刻矛盾源于日本强烈的侵略性,这个结构已经存在至少一千多年了,跟中共没多大关系
中文
1
0
7
277
善喜
善喜@dzvoz58421711·
你支持吗?
善喜 tweet media
中文
326
72
1.2K
42.6K
Gabriel M
Gabriel M@InwinterM·
@biantaishabi5 是的,否则理论上讲模型原创公司肯定干不过搭车的,因为有巨大的研发投入。完全免费的开源方式长久来看必然消失。
中文
0
0
0
171
Gabriel M
Gabriel M@InwinterM·
@RealHanyaHu 这一次,我认为市场的反应是理性的。因为这在很大程度上确认了中国在光刻机赛道上能够实现自主。即使还需要很长时间兑现,但股市归根到底就是建立在长线信心上的。举个极端的例子,如果确定 ASML 会在 10年后消失,那他今天的股价就会跌到地板上,因为没前途了,即使他还能赚10年前钱。
中文
1
0
1
175
Gabriel M
Gabriel M@InwinterM·
@falali2015 骗点击的垃圾文章,标题跟内容TM屁关系没有
中文
0
0
0
692
Gabriel M
Gabriel M@InwinterM·
@Wanyouyouounp @_FORAB 必然的。这不是帽子的问题,以信息量来看,这属于相当高等级的泄密事件了。不过干出这种事的也不可能是什么有水平的投资人,多半是个跟着老板开会的傻逼马仔。
中文
1
0
11
659
kar大头叔叔
kar大头叔叔@Wanyouyouounp·
@_FORAB 芯片定价使用全曝光 国安帽子一扣 泄密的人摊上大事了
中文
1
0
33
10.8K
AB Kuai.Dong
AB Kuai.Dong@_FORAB·
不少分析师认为,此次 DeepSeek 因投资者会议,官方录音流出而紧急叫停融资,主要是关于国产最新芯片进展、定价、实际使用部分,被流出到海外。 在梁文锋的内部讲话全文,被中文媒体们发布不到 2 小时后,就有英文翻译件迅速流传到海外,可能已涉及国安,在场参会的潜在投资代表也要被调查。
AB Kuai.Dong tweet mediaAB Kuai.Dong tweet media
AB Kuai.Dong@_FORAB

DeepSeek 突然暂停第二轮融资,并口头告知投资者不会签署任何投资协议,原因是 DeepSeek 老板梁文锋,对此前投资者会议上,相关言论遭录音泄露,感到非常不满。 看来近期相关讲话实录文章,被迅速下架,是 DeepSeek 介入公关了。

中文
224
62
585
393.6K
Gabriel M
Gabriel M@InwinterM·
@6LXn9knb3RhSAcN @wquguru “怀疑”跟“确认”在政策制定上产生的效果是完全不同的。那个讲话的信息量实在是太大了。
中文
0
0
0
40
卡角76
卡角76@6LXn9knb3RhSAcN·
@wquguru 没什么意义,你无法核实会议记录的真伪,美国想制裁就制裁,没有其它理由。
中文
1
0
4
2.2K
Gabriel M
Gabriel M@InwinterM·
@wquguru 我看到发言马上就想,泄露信息的那个傻逼投资人要吃牢饭了。
中文
1
0
3
5.8K
jimmy
jimmy@jimmy_vibecodes·
以前还不觉得, 到了AI时代,感觉地球上只有中美两个国家了 美国:ChatGPT、Claude、Gemini、Grok、 Perplexity 中国:豆包、DeepSeek、文心、千问、智谱、Kimi、 MiniMax, MiMo 其他的欧洲、日本、韩国等190多个国家都不知道在干什么?
中文
408
26
890
674.9K
Gabriel M
Gabriel M@InwinterM·
@python_xxt 这个回答很牛逼,直接挑战了对方的思维层次
中文
0
0
3
4.2K
Robinson · 鲁棒逊
Robinson · 鲁棒逊@python_xxt·
“那你又是如何想到下一个词的呢?” 以后 我就这么回怼: 生成式人工智能的发明者之一杰弗里·辛顿在一次采访中给出了一个精彩的回答。 当时有人问他关于语言机器(LLM)的问题: “它们其实并没有思考,只是预测下一个词而已。” 他反问道:“那你又是如何想到下一个词的呢?”
中文
53
20
442
105.7K
Max For AI
Max For AI@MaxForAI·
‼️突发:DeepSeek @deepseek_ai 创始人梁文锋在一场据称长达四小时的投资者会议上的发言内容曝光。 过去一个月里,这场对话的片段一直在中国 AI 圈和投资人圈内流传。 最引人注目的是梁文锋反复强调的“不”字。 不搞“天才”神话。 不追求利润最大化。 不搞闭源。 不盲目争夺用户。 不做视频生成、3D、世界模型,也不做下一个“超级应用”。 他的解释很简单: “克制是一种策略。放弃一些东西,是为了提高实现 AGI(通用人工智能)的概率。” 以下是会议中的核心观点: - DeepSeek只有一条主线:AGI 梁文锋认为,现在不是追求产品收益最大化的时候。 核心是追逐人工智能最高峰,即AGI。 他的AGI路线图非常清晰。 去年的台阶是思维链,今年的台阶是Agent。 Agent之后,是持续学习。 持续学习之后,是AI自我迭代。 然后,AI开始帮助人类研发更加先进的AI系统。 最后才是具身智能。 梁文锋将这个过程称为“渐进的奇点”。 根据这个思考,DeepSeek目前正在主动放弃许多热门方向。 “很多东西不在我们的主线上,包括3D和视频生成。” 他也质疑了世界模型的重要性: “世界模型跟智能的上限没有太大关系。” 多模态对产品和C端用户很重要,但它仍然只是一个组件。 “它不是主线,也不是智能本身。” - 下一代模型必须拥有持续学习能力 人类可以在工作中不断学习。 但AI每次开始一个新任务,都需要人类重新提供所有相关上下文。 “这几乎是不可能的。” 这也是梁文锋认为,当前AI还无法真正替代员工的原因。 “下一代模型必须具备持续学习能力,否则就不能叫下一代模型。” 同时他表示智能的终点可能是具身。 他的逻辑很简单: 人类真正需要的,并不是另一个计算机界面。 人类需要的是劳动力。 - DeepSeek不追求利润最大化 梁文锋表示,DeepSeek不会以收入最大化为目标进行定价。 “我们只赚一个合理的利润。” DeepSeek V4最初担心需求过多,所以价格定得比较高。 后来,DeepSeek把价格降到了四分之一。 “公司群里很多人都在欢呼。” 因为做出这个模型的目的,就是让更多人能够充分使用它。 备受关注的低成本不仅是一种商业策略。 “低成本是架构带来的结果。” 更低的成本可以让AI变得更加普惠。 但还有一个更深层的原因: 单位计算成本越低,DeepSeek就越能够在有限算力下训练更大的模型。 “大公司可以通过增加资源解决问题,我们优先考虑成本效率。” 有意思的是梁文锋并不觉得API生意有多么好。 “我不觉得卖API这个事情有那么大的吸引力。” DeepSeek只需要一个很小的团队维护服务。 几乎没有客服,也不需要销售,用户自己就会来。 “我们一直在商业化,只是不以商业化为目标。” 他认为,DeepSeek彻底转向商业化的时间点仍然非常遥远。 - 开源是DeepSeek的战略甜蜜点 对于员工来说,开源能够带来成就感和组织凝聚力。 对于社会来说,它能够帮助研究者、企业和普通用户。 “开源是一种让利。” 梁文锋认为,AI最终会成为一个规模极其庞大的产业,任何试图垄断它的人,最终都会失败。 “如果AI最终占到人类社会GDP的10%,任何想要独占这部分利益的人,都会被历史抛弃。” 梁文锋表示,DeepSeek不会开源一个较弱的版本,同时在内部保留更强的模型。 他不担心竞争对手部署DeepSeek模型。 小型创业公司可能缺乏资源和意愿,去进行前沿模型研究。 大型公司可能拥有资源,却存在组织上的困难。 梁文锋认为,DeepSeek刚好处于一个罕见的中间位置。 “这是属于我们这个规模公司的sweet point。” - 中美AI的差距主要在资源 梁文锋认为,中国并不真正缺乏人才。 DeepSeek希望改写中美AI竞争的叙事: 用几分之一的算力,把差距缩短到6个月,甚至3个月。 他作出这个判断的原因是他依然相信Scaling “我们相信Scaling,规模越大,效果肯定越好。” DeepSeek训练当前规模的模型,并不是因为这个规模已经足够。 而是因为现有算力只允许它做到这个规模。 梁文锋认为,前沿模型的竞争,最终会由三个因素决定: 成本、时间、用户体验。 “成本排在第一位。” 如果两家公司提供的模型质量相同,胜负将取决于谁能以更低的成本提供服务。 时间排在第二位。 早几个月和晚几个月,结果可能完全不同。 用户体验可以形成一定的黏性和壁垒,但梁文锋并不认为它是最本质的护城河。 - 团队稳定是梁文锋唯一不能让步的事情 他将其视为DeepSeek面临的最大风险之一。 原话是:“只有一个是没法退让的:必须保持团队的稳定性。” 而最近的一轮融资,已经大幅降低了这个风险。 “只要能够保持团队的稳定性,我一定能做成AGI。就这么简单。” 有趣的是DeepSeek的组织既是自上而下,也是自下而上 自上而下的部分,被梁文锋称为“做正事”。 但他不希望被安排的工作占用员工一半以上的时间。 另外一半时间应该保持自下而上。 研究人员可以自由探索他们认为重要的方向,不需要提前审批,也没有固定要求。 与很多AI团队不同,DeepSeek不鼓励过度加班。 “做研究需要一个相对松弛的环境。” 另一个原因是聚焦。 DeepSeek的许多产品并不完善,但公司会主动选择不去补齐所有问题。 梁文锋认为,这同样是一种克制。 有趣的是DeepSeek靠愿景驱动,而不是KPI “要实现某个KPI,不是我们的方式。” 梁文锋表示,DeepSeek的愿景甚至不一定被正式写下来。 它存在于公司的做事方式里,也存在于公司对待世界的态度里。 “愿景不是挂在墙上的标语,不是怎么说,而是怎么做。” 梁文锋最后的警告,可能也是最重要的一句话 “如果你的愿景是拿得更多,你就已经输了。你可能会面临更大的困难。这个世界就是这样。” DeepSeek不想赢下每一个AI市场。 它想保留实现AGI所需要的专注、成本优势、团队稳定性和组织自由。 而梁文锋似乎愿意放弃几乎所有其他东西,只为增加实现AGI的概率。 他在做真正很Cool的事情。
Max For AI tweet media
中文
218
631
4K
650.3K
Foe Ally
Foe Ally@ally_foe·
又跟对象吵架了。 我最近不是搞 AI 这个板块认识了不少人嘛。 再加上我以前做销售积累了一堆客户资源,这几天陆陆续续有人找我聊项目,有合适的我也会参与一下。 结果我对象非常不屑。 他说: “你做这些项目有什么意思?一个项目你能赚几个钱?” 我当时沉默了。 哎,谈 A8 就是这样。 想进入有钱人的世界,就要接受有钱人的一些鄙视。 人家的视角跟普通人确实不一样。 可能在他眼里,几千几万的项目,真的就是小打小闹浪费时间。 但是没办法。 有钱人的格局我要学习,鄙视也要接受。 毕竟月底信用卡账单还得求他帮我还。 人在屋檐下,不得不低头。 先忍辱负重,等我把事业做起来,到时候狠狠打他的脸,突然理解宝妈创业了,家人们你们觉得 ALLY 能把事业做起来吗?
中文
61
1
54
17K
Gabriel M
Gabriel M@InwinterM·
@ruanyf 轻度尝试,很惊喜。写代码速度相当快,质量不差。
中文
0
0
0
37
ruanyf
ruanyf@ruanyf·
今天,腾讯发了混元 Hy3 模型。作为大公司自研的旗舰模型,它相当小,参数只有 295B,作为比较,GLM 5.2 的参数是 744B。 参数少,计算量就小,会影响表现,但好处是速度快,成本低。 根据我的测试,它的表现还可以,大概达到或超过了 GLM 5.1 的水平。由于 API 价格低,适合作为日常模型使用。mp.weixin.qq.com/s/ILdIo222TyBy…
ruanyf tweet media
中文
22
7
72
38.7K