chen97

102 posts

chen97

chen97

@haochen9701

Katılım Eylül 2018
38 Takip Edilen9 Takipçiler
chen97
chen97@haochen9701·
@hqmank It seems like there was a massive outage just now. I'm not sure if there will be a compensation reset in a few hours.
English
0
0
0
11
Kai
Kai@hqmank·
@haochen9701 Looks like we might not get the reset this weekend. Maybe it is a good time to take a break.
English
1
0
0
392
chen97
chen97@haochen9701·
@xiaohu 现在能用,plus。凌晨估计要重置了
中文
0
0
1
1.4K
小互
小互@xiaohu·
ChatGPT 和Codex 宕机了 你们能用吗?
中文
335
5
247
112K
chen97
chen97@haochen9701·
@Gorden_Sun 我凌晨新号才开了,老号一直 19.9 美元切不过去
中文
0
0
0
847
chen97
chen97@haochen9701·
@dotey 明天凌晨再重置吧
日本語
0
0
0
602
宝玉
宝玉@dotey·
猜猜今天哪家会重置额度? 我估计 Codex 和 Claude Code 都会重置
宝玉@dotey

Anthropic 今天发布了 Claude Opus 5。API 价格为每百万输入 Token 5 美元、输出 Token 25 美元,与上一代 Opus 4.8 完全相同,但只有 Fable 5 的一半。官方给出的定位是:以一半的价格,提供接近 Fable 5 的前沿智能。 Fable 5 是 Anthropic 于 6 月 9 日发布的最强公开模型,输入、输出价格分别为每百万 Token 10 美元和 50 美元,是史上最昂贵的通用模型。同一底座的 Mythos 5 则只向 Project Glasswing 的少数合作伙伴开放。 【1】性能 在 Frontier-Bench v0.1 上,Opus 5 的成绩是 Opus 4.8 的两倍多,单任务成本反而更低。在 CursorBench 3.2 上,使用最高 Effort 档时,它与 Fable 5 峰值成绩的差距不到 0.5%,每项任务的成本却只有后者的一半。 【注:Effort 是可调节的思考强度档位。档位越高,模型思考得越多,价格也越高。】 ARC-AGI 3 测试的是模型解决未见过的新题的能力,Opus 5 的得分达到第二名模型的三倍。Zapier AutomationBench 测试的是模型能否将一项业务从头到尾完整执行;在成本相同的情况下,Opus 5 的任务通过率约为第二名的 1.5 倍。即使使用最低 Effort 档,它完成的任务也比其他所有模型更多。在电脑操作评测 OSWorld 2.0 上,它仅用 Fable 5 三分之一出头的成本,就超过了后者的最佳成绩。 在有机化学任务上,Opus 5 比 Opus 4.8 高出 10.2 个百分点;在蛋白质相关任务上,则高出 7.7 个百分点。 【2】几个比分数更能说明问题的例子 有一道题给了 Opus 5 一张机械零件图纸,要求它编写代码,在 FreeCAD 中重建三维模型,但故意不让模型直接“看”图。Opus 5 自己编写了一套计算机视觉流程,从原始像素中提取几何形状,再还原出整个零件,而且能够反复成功。同样配置下,其他模型尝试五次都没能完成。 在一个开源包管理器的真实 Bug 中,社区补丁遗漏了一个边界情况。Opus 5 找到了根因,并补上了这个缺口;对照模型则只修复了表面症状,随后便宣布 Bug 已解决。 一位交易公司的工程师使用 Opus 5,在一个会话中完成了新交易所的行情数据接入。由于找不到实时数据进行验证,Opus 5 便自行搭建了一套测试框架,用来检查解析结果是否正确。 【3】谁现在就能用 Claude Max 的默认模型已经切换为 Opus 5,Pro 用户目前能够使用的最强模型也是它。开发者可以通过 `claude-opus-5` 调用 API。Fast 模式的速度约为普通模式的 2.5 倍,价格则翻倍。 此次上线的两个 Beta 功能,对开发 Agent 的人很有实际价值。 一是对话进行到一半时,即使更换工具,也不会导致 Prompt 缓存失效。过去只要修改一次工具列表,整段缓存就会作废,成本随即上升。 二是 API 可以启用自动降级功能。被安全分类器拦截的请求会自动转交给其他模型处理,而不是直接失败。 【4】安全与拦截 Anthropic 表示,Opus 5 是其迄今为止对齐程度最高的模型。在自动化行为审计中,它的综合失准得分为 2.3,低于 Opus 4.8、Sonnet 5 和 Fable 5,欺骗行为所占比例也是最低的。 网络安全部分有一个值得注意的细节:Anthropic 刻意没有使用网络攻防任务训练 Opus 5,但随着通用能力提升,它发现漏洞的水平已经接近 Mythos 5。不过,在将漏洞转化为可用攻击代码方面,两者仍有很大差距。 安全分类器允许 Opus 5 在源代码中寻找漏洞,但会拦截二进制层面的漏洞扫描、渗透测试和 Exploit 生成。它的拦截频率比 Fable 5 低约 85%。在 Claude.ai、Claude Code 和 Cowork 中,被拦截的请求默认会回退至 Opus 4.8。 生物领域的限制则有所放宽:原本在 Fable 5 上被拦截的生物类请求,现在会转交给 Opus 5,而不是此前的 Opus 4.8。Anthropic 称,Opus 5 是目前面向科研场景能力最强的公开模型,但它在长时间自主研究任务上仍存在明显限制。

中文
56
1
97
66.6K
chen97
chen97@haochen9701·
@Vincent_AINotes 6.30 号 同样这个 bussiness 订阅。 20 刀 2 个席位,而且很幸运还是按月限额的。
中文
0
0
0
1.3K
Vincent
Vincent@Vincent_AINotes·
ChatGPT Business 的买一赠一居然还没停。 两个席位原价每月 50 美元,现在直接免掉一个席位,而且一免就是 48 个月,算下来四年都只用付 25 美元。 我一开始还以为是短期活动,结果优惠日期直接写到了 2030 年。 不过这不是整个 Business 免费,也不是所有账号都有,更像是定向发放。
Vincent tweet media
中文
7
4
19
15.7K
chen97
chen97@haochen9701·
@niaoshu 还有就是可以不管第一层的币种,主要看订阅弹窗出来的币种
chen97 tweet mediachen97 tweet media
中文
1
0
0
147
chen97
chen97@haochen9701·
@niaoshu 是真的,不过我是换了个新的谷歌账号才搞定,老号死活美元币种
中文
3
0
0
3.6K
鸟叔本鸟
鸟叔本鸟@niaoshu·
玻利维亚的chatgpt羊毛是真的还是假的? 折腾半天,还是搞不定, APP里显示的还是美元, 不是玻利维亚币, 怎么回事啊?
鸟叔本鸟 tweet media
中文
26
2
41
28.9K
chen97
chen97@haochen9701·
@Gorden_Sun @yuppiekjlb 我 mumuchatGPT 一直转圈进不去,谷歌 play 服务升级了,电脑 clash tun 和电脑不开代理模拟器单独代理都不行
中文
0
0
0
79
Gorden Sun
Gorden Sun@Gorden_Sun·
发玻利维亚国难财了,Codex 20x订阅,1380比索,折合人民币845元。 玻利维亚央行结束固定汇率制,转向由央行监控的灵活弹性汇率,导致官方汇率一次性重贬近30%。Google Play在付款时使用玻利维亚货币支付,导致价格实际低得多。 研究AI这几年,我不仅学会了AI,还学会了网络、自建节点、冒充尼哥、美国大兵教师学生、国际货币政策。
Gorden Sun tweet media
中文
210
85
975
670.3K
Julian I
Julian I@Julian_I1·
超划算299元入手M5 Pro24+1T,参加了国补家补
Julian I tweet media
中文
50
0
20
16.4K
蓝点网
蓝点网@landiantech·
今天Codex并没有重置,大家都被骗了😅😅😅(或者说习惯有大事就等着重置,但昨晚并没有),然后额度又蹬完了,只能用重置卡了
中文
61
0
73
23.1K
開心果
開心果@yusong0532·
@BlackMelooo 付成功了吗,我用的美国家宽也没付过去,提示未批准
中文
5
0
0
1.7K
chen97
chen97@haochen9701·
@xfengbro 失效了吗 我手机上看还是19.9美刀
中文
1
0
0
3.1K
chen97
chen97@haochen9701·
@RimusTW 没必要用 SOL,复杂任务用 Terra+max 就挺好用而且费用相对低。
中文
3
0
4
4.3K
莱姆菌 _ 🪁 🍂 ✨
感觉最近codex没有5h限制后,周限额显得格外不耐用,基本上一个pro的周限额一天就蹬完了,plus的撑不过4小时,整天在靠重置过日子🤪
中文
98
4
362
62.4K
chen97
chen97@haochen9701·
俺不中嘞
日本語
0
0
1
19
DogLIu
DogLIu@renoir1220·
@xiaohu 我已经/goal了,明天起来没重置就弹尽粮绝
中文
9
0
38
14.3K
小互
小互@xiaohu·
种种迹象表明 今晚Codex 还将会重置额度 同时他们还将发布一个炸裂的全新功能 让苹果跳脚的功能,Code 将直接接管 Siri和你的电脑...
中文
94
6
246
139.5K
chen97
chen97@haochen9701·
我没有使用 codex,额度还剩 96%,不会几个小时后 tibo 要重置吧
中文
0
0
0
119
CY.Cheung
CY.Cheung@chungyu_cheung·
@lengs4189 有的人说 business 额度多,有的说 PLUS 多
中文
3
0
0
2.4K
布丁
布丁@lengs4189·
ChatGPT Business 新促销来了 我这边测试:不是免费,而是买一送一优惠,2 个席位约 $25/月,持续 48 个月。 ⚠️ 需要美国节点,不保证所有账号可用,最终看结账页面。 我5月份订阅过法区11欧的两席位,Business 模型额度比 Plus 少,有需要可以看看。 chatgpt.com/?promoCode=ATG
布丁 tweet media布丁 tweet media
中文
15
13
125
40.7K
chen97
chen97@haochen9701·
@hqmank The reset date for subscriptions is also being postponed. If there are no more resets after August 1st, my account won't have any quota available in August
English
0
0
0
83