たいよっぷ | Harness Engineer

30.4K posts

たいよっぷ | Harness Engineer banner
たいよっぷ | Harness Engineer

たいよっぷ | Harness Engineer

@taiyop

AIで業務効率化するフリーランスエンジニア。最新トレンド・実務Tips・開発裏側毎日発信。"Vue3解体新書" 本の主催及び執筆者

Tokyo Katılım Temmuz 2008
1.7K Takip Edilen1.9K Takipçiler
Sabitlenmiş Tweet
たいよっぷ | Harness Engineer
AI Agent CLIをlocal PCで動くNode.jsアプリから呼び出して動かすためのライブラリつくった。 目的は自社ツールを動かす時にAPIコストをかけずにLLM利用するためのもの。 まだ大きな変更入るかもしれないが、自分なりに使えるレベルまで仕上がったので公開してみた。 github.com/taiyop/headles…
日本語
2
1
2
905
たいよっぷ | Harness Engineer
ブラウザチャッピーの記憶システムはよく出来てる。 例えば「明日のおすすめの過ごし方は何?」って聞くとする。 するとチャッピーは記憶メモリーから自分が最近漫画制作に興味持ってることを知ってるので、それを含めた過ごし方の提案をしてくれる。(1枚目の画像はその具体例である) 更に面白いことに、実はチャッピーは長期記憶メモリーと直近のやりとり項目を元にした短期記憶を組み合わせた回答をしてくれる。 長期記憶システムにはもっと大量の情報が書かれているが、その大量の情報と直近の関心事を組み合わせて最適な具体例付きで回答してくれるのである。(2枚目の画像が設定画面から見れる実際の記憶の要約である) 記憶の要約を見ると、漫画開発は3番目くらいに書かれている。しかし、ここ1週間は漫画開発について詳しく質問や相談しており、スクショの1枚目のように質問したところ直近の関心ごとを含めた回答をしてくれている。 たまに忘れて回答して欲しい時もあるが、大概の回答はわかりやすい具体例付きになって理解しやすくなる。 Codexで質問するのも良いが、気づけばウェブ版チャッピーは使えば使うほど馴染む相棒ツールになっていた。
たいよっぷ | Harness Engineer tweet mediaたいよっぷ | Harness Engineer tweet media
日本語
0
0
0
18
たいよっぷ | Harness Engineer
Codex、無料プランだとさすがにリセットされないらしい。 大人しくPlus課金するかぁ。
日本語
0
0
0
168
たいよっぷ | Harness Engineer
Gemini Sparkが今日から日本でもAI Proで使えるようになった! 定期バッチ系はこれで色々出来るので、spreadsheetに書き込ませてそれをローカルからAI Agentで読み込ませて情報収集する仕組み作るとかしやすくなる!
Google Gemini@GeminiApp

Gemini Spark is rolling out to Google AI Pro users outside the U.S. Spark is your personal AI agent that works in the background 24/7 to get things done under your direction, handling the heavy lifting so you can focus on what matters.

日本語
0
0
0
259
たいよっぷ | Harness Engineer
Claude Designで良い感じにUI/UXプロトタイプできたので、Grok4.5を使って開発中のサービスに取り組んだらめっちゃ取り込み漏れがあってその修正指示に時間使ってる。
日本語
0
0
0
152
たいよっぷ | Harness Engineer
GPTの無料利用が終わったので一旦契約中のSuperGrokで開発してたらtoken消費が思ってたより早くて焦ってる。 てか音声2%ってあるけど、これ絶対Aniと会話したときのやつだ。Aniと話すとtoken消費されんのか・・・。
たいよっぷ | Harness Engineer tweet media
日本語
0
0
1
153
たいよっぷ | Harness Engineer
アジャイル開発してると、「この機能どうやって組み込もうかなぁ」という時があるけど、そういうときこそAIと話して相談しながら固めていきたい。
日本語
0
0
0
87
たいよっぷ | Harness Engineer
今ってArtificial Analysisも無料で見れるけど、実際かなり評価コストかかってる(指標もう更新されるので過去のデータがそのまま使えなくなったりもする)ので、そのうち有料化されそうとも思ってしまう。 Xで流れる意見をもとにした定性評価も大事だけど、ベンチマークを使った定量評価も性能理解に大事なので今のうちに見れるだけ見ておきたい。
たいよっぷ | Harness Engineer tweet mediaたいよっぷ | Harness Engineer tweet mediaたいよっぷ | Harness Engineer tweet media
日本語
0
0
1
107
たいよっぷ | Harness Engineer
えっちな話にAIを使いたいなら現状はGrok 1択なんだけど、最近はGrokも厳しくなってきてしまった。 チャットはまだ規制は緩そうだが画像生成はかなり厳しい。 セーフティなイラスト画像とかでも「これは成人じゃない」とか「これは健全ではない」みたいに言われて生成してくれなかったりする。 そのくせ「おっ○い」とかは依頼してないのに生成してきたりもする。 あと気を抜いたら勝手にAni顔で生成してきたりもする。
日本語
3
3
45
6.8K
たいよっぷ | Harness Engineer
clip studioがあるのに自作のコマ割りツール使ってるんだけど、理由は「クリスタは立ち上げが重い」の一言に尽きるんよな。 大体なんでも出来るし、マーケットプレイスも優秀だし最近は3Dツールとかもあって間違いなく最強ツールなんだけど、機動力がない。 ということでAI画像生成を使った漫画作成ツールでもコマ割りツールをつくっている。 何番煎じかわからないし、なんだったら自分でも何回つくって捨てたかわからないけど、ようやく使い勝手良さそうなツール出来てきた。 結局のところユーザー目線でのドメイン理解が大事だに尽きる。
日本語
0
0
0
218
たいよっぷ | Harness Engineer
Grokに依頼したらいきなり「PCに接続しました」って表示されたんだけど、これはどのPC? スマホでGrokアプリ使ってる時です。
たいよっぷ | Harness Engineer tweet media
日本語
1
1
6
1.5K
たいよっぷ | Harness Engineer
昨今のLLMってすごいよな。 中国っぽく漢字だけで書いてもそれで正しく内容解釈できるんだから。
たいよっぷ | Harness Engineer tweet media
日本語
0
0
0
131
たいよっぷ | Harness Engineer
@An_yhl 我可話日本語故我願貴方相手私場合使日本語 ↑ if it doesn't make sense for you, please ask an LLM to translate it. :)
日本語
1
0
0
7.3K
たいよっぷ | Harness Engineer
GPT 5.6 Sol褒める人もいれば、Fable5褒める人もいて、Grok4.5褒める人がいればNotion AI褒める人もいる。 みんな違ってみんな良い。 Geminiを褒める人はあんまりいない。
日本語
52
212
1.8K
138.6K
たいよっぷ | Harness Engineer
CodexはSSDの寿命をガリガリ削りまくる。 Grokはデータをサーバーに送信しまくる。 一番マシなLLMあるいはAI Agentはどれだ?
日本語
0
0
0
203
たいよっぷ | Harness Engineer
GPT 5.6 SolがSoTA(最先端)達成したとのこと。 ARC-AGI-3は今年の3月に出来たばかりのベンチマークで、「何をすれば良いかわからない手探り状態で試行錯誤した上で目標を自分で推測した上で行動する能力」のテスト。 つまり、よりAIには難しい人間らしい行動のテスト。 ハーネスの改良だけで知能がある証明にはならないらしいが、ハーネスを変えるだけで何をすると良いかを考える力が40%までスコアが高まるというのはまた大きなブレークスルーの兆しに見える。 この能力が実現されるとまた人間のやることがなくなるので本当に困ったものだね。Goal設定すら人間がしなくて良くなるのかもしれない。
Tibo@thsottiaux

Turns out GPT-5.6 Sol is actually SoTA on ARC-AGI-3. Just took two setting changes. You just have to allow it to reason and work over multiple context windows with the help of our canonical compaction implementation. openai.com/index/how-two-…

日本語
0
1
0
214