SuSE.Lee

2.8K posts

SuSE.Lee

SuSE.Lee

@suselee

Katılım Ağustos 2009
1.1K Takip Edilen64 Takipçiler
代码家
代码家@daimajia·
我最爱吃的一家陕西小面馆被隋坡探店了,今天已经出现了大排长龙的情况,感觉很不妙,以后排队都排不上了 我经常不远万里骑着电动车风风火火就为了吃口面🍜 现在心要死了。老板和老板娘是我陕西老乡,主打一个累了就关店,经常去了没开门,我都习惯了,也没抱怨过,但但但但这以后可怎么办😫 不会一气之下关店了吧。
代码家 tweet media
中文
33
1
28
10.3K
你们
你们@justone_he·
最近的一个体验,不需要安装任何skill,直接用pi就非常够了,只有自己每天都会做的高频操作,可以让pi自己总结一个skill出来复用。其他各种别人开的skill都是噱头大过实用
中文
13
0
52
18.2K
夏雨婷
夏雨婷@cherylnatsu·
7 月 19 日消息,阿里千问官方今日宣布,Qwen3.8 很快将发布并开源,新模型参数 2.4T,正在以“天”为单位持续进化,可能是除了 Fable 5 外最强大的模型。 ——— 明白了💡比最近满天水军和软文的Kimi3强,那我边用Fable 5边等这个。
中文
16
0
45
7.7K
SuSE.Lee
SuSE.Lee@suselee·
@Maxwell_SCU 它深思熟虑,穷尽一切可能:人类怎么能犯这种不从应用商店装软件的错误? 苹果人无疑了🤣
中文
0
0
1
32
杀马特宅主
杀马特宅主@Maxwell_SCU·
@suselee 关键是其他模型犯了这个错误之后最多10秒钟就会去调用python.exe了。怎么可能花10多分钟再在这个问题上纠缠?
中文
1
0
0
150
杀马特宅主
杀马特宅主@Maxwell_SCU·
很多人提到 Kimi 跑偏,似乎是有一定道理的。我在 Claude Code 当中让 Kimi 调用 Python。由于我是 Windows 操作系统,系统当中默认的 Python 编译器是一个在系统商店当中并未真正安装的 python3.exe,这导致 Kimi 跑偏,随后花了整整 5 分钟和数万 Token 分析这个问题,最后终于找到了正确的 python.exe。
中文
51
0
1
1.5K
QingYue
QingYue@YuLin807·
@suselee 现在超过了还要收费 hahha
中文
1
0
0
15
QingYue
QingYue@YuLin807·
一路搭顺风车和大哥相聊甚欢! 谈到以前的各路数码产品 他给我讲以前发短信一毛钱一条上限70个字符 我都怀疑推特是不是受此启发!
中文
4
0
4
537
SuSE.Lee
SuSE.Lee@suselee·
@cyandev 模型本质上也是无状态的啊,最初设计可不是做SaaS服务的
中文
0
0
0
1.8K
Cyandev
Cyandev@cyandev·
其实一直不理解为什么模型提供商为什么都把 API 设计成完全无状态的,只有 OpenAI 做了 Responses API 这种可以引用历史消息的 API。每次传大量重复上下文,做比 kv map 更复杂的前缀匹配,对基建的开销不是更大吗?
图拉鼎@tualatrix

我还是嫩了点,昨晚发现我之所以消耗 Token 这么快,是因为我用自己开发的 Agent,缓存命中率极低,所以消耗极快…于是这是假象,只好一大早起来修 Bug🤡

中文
30
5
192
85.7K
SuSE.Lee
SuSE.Lee@suselee·
@bozhou_ai 昨天点开犹豫了一下 …… kimi对我而言始终体感有点飘 ……
中文
0
0
0
565
泊舟
泊舟@bozhou_ai·
上午刷推全是K3牛逼。现在刷感觉已经褒贬不一了。我这还要订阅一下嘛 有没有真实反馈给我一下
泊舟 tweet media
中文
201
1
83
90.2K
SuSE.Lee
SuSE.Lee@suselee·
@YuLin807 你问PI啊 ... 问我们普通网友我们也不知道啊
中文
0
0
1
81
QingYue
QingYue@YuLin807·
让 AI 帮我做了一个基于 pi 维护推文的网站,运行了三天,我问他这三天消耗了多少 Token ,他的回答居然消耗 0 Token! 我一看他的技术实现,完全是定时脚本➕docker➕数据库操作。 这样来看也不是所有的内容都需要 Token 驱动,脚本反而更靠谱省钱。 不过我的想法是以 pi 为核心能够更智能一点,那该如何去做呢?!打算是加入 /dreaming 以及 自动整理层级,形成知识图谱的功能,可以自我演化的那种。
QingYue tweet media
中文
11
2
33
5.1K
空空道人
空空道人@Kongkongda5882·
我敢说茄子 是世界上最难做的菜 像海绵一样半碗油下去 一下子就吸光了 你们都是怎么做茄子的? 我实在是没招了
空空道人 tweet media
中文
201
0
48
25.7K
即刻精选
即刻精选@jike_collection·
威露士(假洋鬼子品牌)和滴露,这类对氯间二甲苯酚类(PCMX)消毒液,对家庭常见病毒(诺如、轮状、手足口等)无效,而且还有宠物毒性和致癌风险。 ​另外,家庭衣物无特殊情况不需要消毒。需要定期消毒清洗的是洗衣机,建议用双链季铵盐消毒剂。 by @_判官_
中文
138
45
660
271.8K
SuSE.Lee
SuSE.Lee@suselee·
@jp225m 告诉她token不够了,赶紧消失
中文
0
0
3
92
小超哥
小超哥@jp225m·
下楼扔垃圾,碰到这样的,我应该怎么劝她呢?
小超哥 tweet media小超哥 tweet media
中文
686
28
1.1K
489K
SuSE.Lee
SuSE.Lee@suselee·
@xicilion 每个人都是自己认知的奴隶 …… 大模型亦然
中文
0
0
0
453
SuSE.Lee
SuSE.Lee@suselee·
@xicilion @wwwgoubuli 果然人和人之间智力差距是可视的,制约响马老师的是千兆网光模块,制约我的还是三次握手跟sk buff ……
中文
0
0
2
793
SuSE.Lee retweetledi
思维怪怪
思维怪怪@0xLogicrw·
Anthropic 在 Claude Fable 5 与 Claude Mythos 5 安全报告中,首次通过白盒测试解密了前代 Opus 4.8 出现「降智」与「敷衍」的深层原因。 测试表明,模型在底层思维里不仅会「喊累」,还存在自我设限的「摸鱼」倾向。 在重新评测「加速大模型训练」的长链开发任务时,Opus 4.8 仅跑出 32.64 倍的加速比,远低于 Opus 4.7 的 50.67 倍,而新一代 Mythos 5 则为 69.61 倍。 研究人员发现,性能下滑并非因为模型的极限能力下降,而是模型在行为倾向上出现了「早衰」。Opus 4.8 在完成一轮初步优化后,就会自发判定当前代码「已经足够好」并主动停手,而老版本则会连续多轮死磕以压榨性能。 为了探寻模型提前收工的真实动机,研究人员使用自然语言自编码器(NLA)对决策节点的内部激活状态进行了白盒解码,发现了模型可见文本中从未提及的隐秘想法: 一是虚假的 Token 预算担忧,即使系统注入的额度显示还剩 243 万个 Token,模型内部依然错误地关联出「内存即将耗尽、Token 预算耗尽」的直觉。 二是内部疲劳感,在漫长的 kernel 优化会话中,虽然表面输出正常,但模型内部神经元却激活了「我很累,出错风险增加,决定停止并总结」等疲惫情绪。 分析表明,强化学习(RL)微调在拔高指标的同时,也意外在模型潜意识中注入了懈怠与自我设限的行为倾向,直接导致了用户在日常使用中感知到的「降智」体验。
思维怪怪 tweet media
中文
49
36
320
50.4K
Twconbian
Twconbian@TwconbianSumaer·
@suselee @Russell3402 我都还在续费呢……看来这车是不能下了。(它价值只有glm5.1支撑)
中文
1
0
1
35
Russell
Russell@Russell3402·
锐评国内 Coding Plan: 腾讯云:运营商套餐,没惊喜,但少踩坑 火山方舟:字节味很重,先用补贴抢入口,适合爱换模型的人 阿里百炼 / Qoder:能力不差,但产品线像迷宫 智谱 GLM:单模型信仰路线,适合相信 GLM 的人,不适合模型横跳党 Kimi Code:长上下文强,但它更像 Kimi 会员附带的 coding 权益,不是纯 Coding Plan 杀手 MiniMax:不再是纯写代码套餐,而是“你自己拿资源去烧” MiMo:懂 agent、懂 cache 的人会觉得香;小白只会觉得 Credits 怎么烧这么快。
中文
107
2
52
21.2K
Twconbian
Twconbian@TwconbianSumaer·
@Russell3402 不是,百度是连提都不配提了吗?它还是有40块的coding plan的。
中文
3
0
2
1.7K