sida

70 posts

sida banner
sida

sida

@s1dashu

ex-PM at bytedance building: 1. ousia: a minimalist desktop client for pi (https://t.co/zjmaObV1d7). 2. miki: a codex for creative minds (in progress).

Katılım Eylül 2023
383 Takip Edilen335 Takipçiler
Sabitlenmiş Tweet
sida
sida@s1dashu·
最近长时间用 codex,逐渐形成了这些自定义指令,挺好用的: 1. Fail Fast / Errors Never Pass Silently:不要在代码里藏兜底逻辑来吞掉错误、隐藏问题。出了问题就应该让它爆出来,否则你永远找不到真实问题。 2. Fix the Cause, Not the Symptom / Don't Paper Over Bugs:当一个问题出现时,不要用各种 small fix、针对性补丁来掩盖它。必须定位真实根因,彻底修复。在 bug 上糊纸只会让系统积累你不知道的危险暗病。 3. Make It Observable:即使问题很难定位,也绝不要偷懒做表面修复。应该给项目增加充分的日志和可观测性,保证下次问题再现时你有足够信息去定位。问题无法修复时,只需要诚实告诉我信息不足、需新增日志,不要假装修好了。 4. Design for Debugging / Traceability:始终注意在关键路径上给自己留足排查日志,确保每一个关键节点都是可追溯的。 5. Living Documentation / Single Source of Truth:当项目关键技术栈或产品方向发生变更时,同步更新 agents.md。文档必须随代码一起演进,不能让它变成过时的谎言。 6. Don't Break Mainline:大规模重构或实验性改动前,必须先切新分支。
sida tweet media
中文
9
51
321
29.8K
Tianyi Cui
Tianyi Cui@tianyi·
如果你是 Agent Harness 相关开源项目的开发者,希望参加 DeepSeek Harness 的内测,可以回复或私信联系我。请附上 GitHub id 以及开源代表作。
中文
301
68
817
103.7K
sida
sida@s1dashu·
最近在用 Codex + LibTV CLI 帮我制作动画科普视频(Animated Voiceover Video),并且经营一个小红书账号。目前小红书账号稳步起步中,数据看起来很健康。 现在将我的 Skill 开源出来: github.com/s1dashu/animat… 使用这个 Skill,配合 Codex/Claude Code,可以实现 90% 的自动化制作动画科普视频。 当然人的判断还是很重要的,你需要负责提供视频创意、确定视觉风格,输入自己的判断。人的判断仍然是创作的灵魂。 这个skill 也可以配合其他 CLI 使用,例如即梦 CLI、Higgsfield CLI 等等,但我还没有大范围测试效果。
sida tweet media
中文
35
65
323
31.9K
sida
sida@s1dashu·
动画配音视频 Skill 更新: github.com/s1dashu/animat… 配合 Codex 使用,一小时可以产出数条高质量的动画视频。 我已经用这个 Skill 在小红书和视频号稳定起号了,今天醒来一看两边都 99+ 了,很开心:) 本次更新内容: 新增 7 套内置视觉风格: 电影感 3D、多巴胺萌趣 3D、黏土定格、笨拙感手绘简笔画、忧郁蓝调简笔画、柔和彩铅萌趣、清爽线描蜡笔。 新增 4 款内置音色: 明亮高亢青年音、沉静青年男声、温柔治愈成年女声、灵动活泼年轻女声。 现在可以直接选择风格与音色,更快建立统一的画面和声音。当然,你还是可以让 Agent 按照你的要求生成新风格和音色。 下面是最新的忧郁蓝调简笔画风格生成的视频:
sida tweet mediasida tweet media
中文
0
0
0
232
sida
sida@s1dashu·
@TheStepC0009 libtv 年费会员成本 22 元/分钟,两分钟视频 44 块钱。如果不是年费会员的话,可能得 40+/分钟。
中文
1
0
0
201
sida
sida@s1dashu·
@afei_AI 是的,我现在就是在用这个 skill 不断产出新视频,中间有啥问题都记录下来补全到 skill 里面,最近还会更新。
中文
0
0
0
433
AFei Liang
AFei Liang@afei_AI·
@s1dashu 这类 Skill 真正的门槛,可能不是把生成步骤串起来,而是 把质量判断做成可复用的门禁:旁白完整性、角色和风格 一致性、单条成本、失败重试、最终人工验收。 如果再把每次失败和修改记录回 Skill,它就不只是“90% 自动化”,而是一个会越跑越稳的内容系统。
中文
1
0
0
538
sida
sida@s1dashu·
@DashHuang 模型这里选了 luna 但仍然停留在 Sol 上。
GIF
中文
1
0
0
438
AYi
AYi@AYi_AInotes·
这个Skill真的让我看到了一个人干翻一个动画工作室的可能性,我用它做了个DeepSeek V4-Flash的视频, 一个人,一条指令,40块钱,2分钟电影感动画科普视频。 不是那种一眼AI的垃圾。是角色不崩、声音一致、镜头有语言、旁白有节奏的正经片子。 这东西叫animated-voiceover,刚开源,MIT协议。作者是前字节产品经理@s1dashu,他自己已经用这套东西在小红书起号了。 它不是软件,不是App,是一套喂给Codex/Claude Code的完整制片流程。你就跟它说一句:"用animated-voiceover做一条两分钟关于确认偏误的动画科普",剩下的Agent按流程给你跑: 先研究,写完整旁白, 锁视觉风格参考图,锁角色参考图。 每15秒拆成5个镜头,每个镜头写清主体、变化、镜头运动。 先生成第1段,把人声提出来,48kHz立体声WAV锁死。 后面所有片段全部挂这同一个人声参考——声音飘的问题,工程化解决了。 逐段QC,旁白完整性、角色一致性、构图、运动,不合格重来。 最后拼成片,做封面。 最狠的是它解决问题的方式,全是工程思维,不是玄学。 AI视频最大的痛点是什么?声音每段都不一样,角色脸走着走着就变了,镜头之间没有逻辑。 他怎么干的?先做第一段,把人声锚定,后面全挂这个参考。 一张风格图贯穿全片,每个角色独立参考图+角色表管理。 旁白写完再切,中文卡到每15秒60个字,多一个少一个都不行,信息密度均匀,不机械。 这不是"帮我生成个视频",这是把一个专业动画导演脑子里的制片流程,变成了Agent可以执行的Skill。 一条2分钟的片子,LibTV跑下来大概40块钱。一个人,一个下午,从选题到成片。以前这活儿得一个团队干一周。 作者反复强调一句话:90%自动化,但那10%人的判断决定上限。你定选题、定风格、卡审批,剩下重复的、容易出错的、熬人的,全交给Agent。 这才是Agent Skill该有的样子, 不是跟你聊天,不是帮你写个Prompt,是把一整条专业生产管线——从研究到脚本到分镜到渲染到QC到成片——封装成一个你随时可以调用的能力。 知识博主、超级个体、想做深度内容但不会动画的人,这个东西的价值怎么强调都不过分。B站、小红书那些电影感科普号,以前得团队作战,现在一个人就能干。 GitHub搜s1dashu/animated-voiceover,SKILL.md和references目录里全是干货,旁白怎么写、分镜怎么拆、声音怎么锁、Seedance的提示词怎么用,全给你摊开了。 别再问AI能不能替代内容创作者了,会用这种工具的创作者,正在替代不会用的。
sida@s1dashu

最近在用 Codex + LibTV CLI 帮我制作动画科普视频(Animated Voiceover Video),并且经营一个小红书账号。目前小红书账号稳步起步中,数据看起来很健康。 现在将我的 Skill 开源出来: github.com/s1dashu/animat… 使用这个 Skill,配合 Codex/Claude Code,可以实现 90% 的自动化制作动画科普视频。 当然人的判断还是很重要的,你需要负责提供视频创意、确定视觉风格,输入自己的判断。人的判断仍然是创作的灵魂。 这个skill 也可以配合其他 CLI 使用,例如即梦 CLI、Higgsfield CLI 等等,但我还没有大范围测试效果。

中文
5
30
117
14.2K
sida
sida@s1dashu·
@cgnot996 用 libtv cli, 即梦 cli, 或者 higgsfield cli 都行,只要能调模型,直接填方舟 Key 都行。未来 h3 如果有更便宜的来源的话,是可以再降的
中文
0
0
1
172
铁柱AGI
铁柱AGI@cgnot996·
@s1dashu 这套skills 依赖 libTV吗?如果 H3 开源有更便宜的来源,成本应该还能降?
中文
1
0
0
168
AYi
AYi@AYi_AInotes·
@s1dashu 如此干货不给流量没有天理,必须四连助力一波!
中文
1
0
0
607
sida
sida@s1dashu·
@MinLiBuilds 是的,本质上和做短剧是一个流程,我就是蹲在抖音上做短剧的博主的直播间学的🤣
中文
1
0
1
861
实践哥MinLi
实践哥MinLi@MinLiBuilds·
@s1dashu 我天,学习了,这都能做工作流。 那些做短剧平台agent 的,也是这个原理
中文
1
0
0
897
sida
sida@s1dashu·
@ericoding99 然后这个 skill 目前完全是围绕着每个生成片段 15s 的 seedance 2.0 来做的,30s 的 seedance 2.5 提示词会有新的写法
中文
0
0
0
49
sida
sida@s1dashu·
@ericoding99 都可以,不过其他模型我暂时还没试,不知道效果咋样,这个 skill 如果反馈好的话我会在更多不同模型、不同agent 上测试下效果,尽量多覆盖
中文
0
0
0
1.1K
sida
sida@s1dashu·
@kaitoxhacker 嗯用 seedance 跑的,如果内容有流量、能起号的话还挺值的。后面我会研究用 minimax h3 降低成本,看看最低能到什么价格
中文
0
0
2
163
kaitox
kaitox@kaitoxhacker·
@s1dashu get,看来成本还是蛮贵的,是 seedance 跑的吗
中文
1
0
0
142
sida
sida@s1dashu·
@Astronaut_1216 哈哈我也可以是资本,我也可以批量化:) 但还是不希望未来大家都自动化生产视频,导致低质量内容把互联网给淹没了,那样的未来就很黑暗了。
中文
0
0
0
559
叫我阿杭
叫我阿杭@Astronaut_1216·
@s1dashu 我去,我感觉你这个内容质量好高啊,不管是画面还是啥,这种我感觉后面又会被资本去做批量化的复制,就类似于那种体验100种人生
中文
1
0
0
674
sida
sida@s1dashu·
@kaitoxhacker 我用的 libtv 尊享会员,折算下来一条两分钟视频成本 40 块钱左右
中文
1
0
1
774
kaitox
kaitox@kaitoxhacker·
@s1dashu 哇 这个效果是真不错👍👍👍,一个视频成本大概多少呀
中文
1
0
0
780
sida
sida@s1dashu·
@cgnot996 嗯我后面就准备用 H3 试试做 10-20 分钟的科普,可以做出来更深度的内容。 不过这个价格可能得在 lib 的年费会员下才做得到😂 还没仔细算。
中文
2
0
1
180
铁柱AGI
铁柱AGI@cgnot996·
@s1dashu 等大佬的 H3 实测,真这么便宜可太好了
中文
1
0
0
176
sida
sida@s1dashu·
@cgnot996 2 分钟视频 40 元~120 元左右,取决于你使用的是什么产品的模型服务,购买的是什么套餐。 如果使用 Minimax H3 的话,大概可以做到 10 块钱一条。
中文
1
0
1
884
铁柱AGI
铁柱AGI@cgnot996·
@s1dashu 这样一条视频的成本大概多少呢?
中文
1
0
0
878
sida
sida@s1dashu·
Ousia — a community-built desktop app for Pi. Over the past few days, I’ve completely rewritten Ousia in Tauri and cut the package size from 300 MB to just ~10 MB. It’s now a truly lightweight, minimalist desktop app for Pi. github.com/s1dashu/ousia
English
0
0
3
6.4K