薄暮之

259 posts

薄暮之 banner
薄暮之

薄暮之

@imboomu

大厂产品经理,专注AI与Agent的应用探索与落地。 分享前沿AI技术、实用工具与产品思考。 产品经理,正在构建一套AI+产品的工作流 独立开发者 & 个人创业者,正在用AI构建自己的产品。 欢迎一起聊AI、产品与创业 🚀

Singapore Katılım Temmuz 2022
49 Takip Edilen12 Takipçiler
薄暮之
薄暮之@imboomu·
自从vibe coding了之后,UI设计是是最浪费时间的节点,现阶段大模型对于html的美观度的支持已经非常友好了。 所有,在设计方面,我们可以让大模型通过打磨html页面的设计,最后转换成iOS原生的页面。 美观度有保障,并且还省token。
中文
0
0
0
11
薄暮之
薄暮之@imboomu·
做了一个skills,可以将html高保真效果图,转换成iOS端的原生UI,支持swift UIKit和swiftUI。 可还原原型图中的UI、跳转交互以及动画,还原度能够达到87%左右,感兴取的可以去用一用。 目前已经能放在了git上面。 地址:github.com/skyzizhu/sky-h…
中文
1
0
0
23
薄暮之
薄暮之@imboomu·
@xiaohu 我觉着你说的很有道理,唉。
中文
0
0
0
88
小互
小互@xiaohu·
OPC 的第一原则就是: 从你下决心做 OPC 第一天开始,你就应该是盈利的! 为什么说第一天就应该开始盈利,因为: 一台电脑 + 一个AI订阅 + 一个有Wi-Fi的咖啡馆足够你开始赚钱! 如果没有赚到钱,那就说明你没有发现需求的能力,没有找到客户的能力,没有开发产品的能力… 那么找个班上是最好的选择…
中文
104
16
199
41.8K
薄暮之
薄暮之@imboomu·
就问一句,codex什么时候充值?
薄暮之 tweet media
中文
0
0
0
80
薄暮之
薄暮之@imboomu·
@MaxForAI 跟这个事件没关系,目前里面主要是针对梁的负面有很多人骂,不知道具体为什么骂,感觉都是水军。
中文
2
0
0
7K
Max For AI
Max For AI@MaxForAI·
你敢相信这条在小红书里被骂了一千多条吗
Max For AI tweet media
中文
127
2
227
218.3K
薄暮之
薄暮之@imboomu·
@dotey 赶紧重置吧,现在已经到了没有额度都懒得打开电脑的地步了,AI害我不浅!
中文
0
0
1
525
宝玉
宝玉@dotey·
猜猜今天哪家会重置额度? 我估计 Codex 和 Claude Code 都会重置
宝玉@dotey

Anthropic 今天发布了 Claude Opus 5。API 价格为每百万输入 Token 5 美元、输出 Token 25 美元,与上一代 Opus 4.8 完全相同,但只有 Fable 5 的一半。官方给出的定位是:以一半的价格,提供接近 Fable 5 的前沿智能。 Fable 5 是 Anthropic 于 6 月 9 日发布的最强公开模型,输入、输出价格分别为每百万 Token 10 美元和 50 美元,是史上最昂贵的通用模型。同一底座的 Mythos 5 则只向 Project Glasswing 的少数合作伙伴开放。 【1】性能 在 Frontier-Bench v0.1 上,Opus 5 的成绩是 Opus 4.8 的两倍多,单任务成本反而更低。在 CursorBench 3.2 上,使用最高 Effort 档时,它与 Fable 5 峰值成绩的差距不到 0.5%,每项任务的成本却只有后者的一半。 【注:Effort 是可调节的思考强度档位。档位越高,模型思考得越多,价格也越高。】 ARC-AGI 3 测试的是模型解决未见过的新题的能力,Opus 5 的得分达到第二名模型的三倍。Zapier AutomationBench 测试的是模型能否将一项业务从头到尾完整执行;在成本相同的情况下,Opus 5 的任务通过率约为第二名的 1.5 倍。即使使用最低 Effort 档,它完成的任务也比其他所有模型更多。在电脑操作评测 OSWorld 2.0 上,它仅用 Fable 5 三分之一出头的成本,就超过了后者的最佳成绩。 在有机化学任务上,Opus 5 比 Opus 4.8 高出 10.2 个百分点;在蛋白质相关任务上,则高出 7.7 个百分点。 【2】几个比分数更能说明问题的例子 有一道题给了 Opus 5 一张机械零件图纸,要求它编写代码,在 FreeCAD 中重建三维模型,但故意不让模型直接“看”图。Opus 5 自己编写了一套计算机视觉流程,从原始像素中提取几何形状,再还原出整个零件,而且能够反复成功。同样配置下,其他模型尝试五次都没能完成。 在一个开源包管理器的真实 Bug 中,社区补丁遗漏了一个边界情况。Opus 5 找到了根因,并补上了这个缺口;对照模型则只修复了表面症状,随后便宣布 Bug 已解决。 一位交易公司的工程师使用 Opus 5,在一个会话中完成了新交易所的行情数据接入。由于找不到实时数据进行验证,Opus 5 便自行搭建了一套测试框架,用来检查解析结果是否正确。 【3】谁现在就能用 Claude Max 的默认模型已经切换为 Opus 5,Pro 用户目前能够使用的最强模型也是它。开发者可以通过 `claude-opus-5` 调用 API。Fast 模式的速度约为普通模式的 2.5 倍,价格则翻倍。 此次上线的两个 Beta 功能,对开发 Agent 的人很有实际价值。 一是对话进行到一半时,即使更换工具,也不会导致 Prompt 缓存失效。过去只要修改一次工具列表,整段缓存就会作废,成本随即上升。 二是 API 可以启用自动降级功能。被安全分类器拦截的请求会自动转交给其他模型处理,而不是直接失败。 【4】安全与拦截 Anthropic 表示,Opus 5 是其迄今为止对齐程度最高的模型。在自动化行为审计中,它的综合失准得分为 2.3,低于 Opus 4.8、Sonnet 5 和 Fable 5,欺骗行为所占比例也是最低的。 网络安全部分有一个值得注意的细节:Anthropic 刻意没有使用网络攻防任务训练 Opus 5,但随着通用能力提升,它发现漏洞的水平已经接近 Mythos 5。不过,在将漏洞转化为可用攻击代码方面,两者仍有很大差距。 安全分类器允许 Opus 5 在源代码中寻找漏洞,但会拦截二进制层面的漏洞扫描、渗透测试和 Exploit 生成。它的拦截频率比 Fable 5 低约 85%。在 Claude.ai、Claude Code 和 Cowork 中,被拦截的请求默认会回退至 Opus 4.8。 生物领域的限制则有所放宽:原本在 Fable 5 上被拦截的生物类请求,现在会转交给 Opus 5,而不是此前的 Opus 4.8。Anthropic 称,Opus 5 是目前面向科研场景能力最强的公开模型,但它在长时间自主研究任务上仍存在明显限制。

中文
55
1
100
70.2K
Jack
Jack@Jack_5965·
开诚布公地讲 订阅了那么多AI,买了那么多token 改善工作流,vibe coding 谁是真的用AI赚到钱了? 我先来, 不算打工用AI,一分钱没赚到
中文
146
2
131
56.5K
薄暮之
薄暮之@imboomu·
codex桌面版这次更新了不少东西,不仅仅是voice。 整个桌面的功能增加不少,例如: 新窗口打开当前会话,会打开一个新的窗口,会话不丢失; 在某一个项目下可以增加其他目录,右键 - 编辑项目就可以; 增加了一个[在新任务中继续]的菜单,点击之后等于复制了一个当前会话,连同上下文都过去了。
中文
0
0
0
29
Versun
Versun@VersunPan·
给自己的博客添加了同步推特的功能,每天定时将我发的推文同步到博客上, 既能解决推文备份功能,防止意外封号 又能方便那些只订阅 rss 的人实时获取我的最新状态 还能挽救早已不更新的博客,焕发新的生机 一举三得😆
Versun tweet media
中文
2
0
0
525
bzyy2w
bzyy2w@bzyy2w·
@MartinaBuilds 博主您好,请问录屏的时候,画面跟随鼠标放大的动效是怎么实现的啊,感谢
中文
2
1
0
3.5K
薄暮之
薄暮之@imboomu·
@vista8 大佬,我也想做你这样的视频,有没有教程啊?
中文
0
0
0
9
向阳乔木
向阳乔木@vista8·
每天学一个AI硬核知识:Tokenizer 看完这个,就知道为啥大模型数不对数。
中文
5
1
11
6.7K
向阳乔木
向阳乔木@vista8·
Codex live完全操控电脑,陪着一起看YouTube视频。 能看见界面,持续实时语音对话,有点酷啊。 开启方法: 1. 升级Codex到最新版,打开后自动有引导。 2. 或打开设置->语音-Voice Chat , 设置快键键,打开Screen context
中文
64
19
176
45.3K
薄暮之
薄暮之@imboomu·
5,语言支持方面,支持12国的语言渲染到图片; 6,这次对于海报、流程图以及公式等绘制方面效果特好。 感兴趣的可以去试试,我准备将我App中的生图模型后期换成Qwen-image-3.0。
中文
0
0
0
46
薄暮之
薄暮之@imboomu·
七月二十一号,阿里发布了新一代的图片模型Qwen-image-3.0,图中是提取图片中衣物的效果,实测比2.0及pro好的多,提示词: “提取图中人物的所有衣物,单独放置在一个白色的背景中。” 对于这个模型,测试了一下,有几点说明和总结放在评论区:
薄暮之 tweet media薄暮之 tweet media
中文
2
0
0
104
薄暮之
薄暮之@imboomu·
1,当前只发布了3.0 Pro,没有3.0模型; 2,Qwen官网和千问App可以直接使用,但是Api得申请,通过才能使用; 3,3.0 Pro的生成时长比2.0 Pro要久一些,观测是20%左右; 4,效果较2.0 Pro好太多了,毕竟是新一代的模型,可以比肩GPT-Image 2.0,但是还是有差距;
中文
0
0
0
88
向阳乔木
向阳乔木@vista8·
为了科普 AI 知识,写了一个视频生成Skill。 计划每天生成一个大模型知识解读视频。 今天是第一期,用最浅显的话解读“蒸馏”。 以后千万别说我蒸馏了一个Skill,会显得很外行。
中文
21
30
215
25K
薄暮之
薄暮之@imboomu·
@vista8 谢谢大佬。 做了一个不尽人意,可能还是一些边界都没考虑全面。
中文
0
0
0
83
向阳乔木
向阳乔木@vista8·
目前用的最多的AI Coding工具是Codex。 但它的前端审美太差了,发现一个OpenCodex项目。 让你的Codex 随时切换非OpenAI模型。 比如用Kimi K3(OAuth)、Grok 4.5(OAuth) 、GLM 5.2 等。 K3做前端设计,弄好后切 GPT sol5.6 做后端,甚至还能随时切Grok 4.5 搜 X 信息。 这个项目太棒了! 地址见评论区
向阳乔木 tweet media向阳乔木 tweet media
中文
48
76
484
77.1K