Pierre ✺

396 posts

Pierre ✺ banner
Pierre ✺

Pierre ✺

@pgllmt

Senior Software Engineer · AI workflows

France Katılım Eylül 2015
1.9K Takip Edilen6.9K Takipçiler
Sabitlenmiş Tweet
Pierre ✺
Pierre ✺@pgllmt·
Je suis senior software engineer. Pendant 30 jours, je vais documenter ici comment j’utilise l’IA sur de vrais problèmes de développement : architecture, debugging, tests, code review et agents. Pas de démo magique ni de promesse « 10x ». Je partagerai des méthodes reproductibles, des diffs commentés et surtout les erreurs rencontrées. Premier sujet : ma checklist avant de valider un diff généré par IA.
Français
80
168
4.8K
308.2K
Pierre ✺
Pierre ✺@pgllmt·
Excellent trick. Browser control shines for exploration. The real leverage comes from converting those interactions into generated clients, tests, and versioned artifacts. Replacing runtime behavior with deterministic code shrinks the error surface and lets you safely increase autonomy. This is the direction I’ve been refining.
English
0
0
1
96
dax
dax@thdxr·
used a trick @jlongster came up with agents can control browsers but you can also ask it to record network requests into a HAR file then it can derive a client for any website which is more efficient than browser controlling it every time made it build a quick uber eats cli
dax tweet media
English
165
202
4.5K
358.7K
Pierre ✺
Pierre ✺@pgllmt·
@AlmokhtarMo Merci ! 🙏 C’est une série quotidienne (Jour 4/30). Tu veux que je développe ça en thread ?
Français
0
0
0
41
محمد.
محمد.@AlmokhtarMo·
@pgllmt اعملها في ثريد شكرا لك
العربية
1
0
1
87
Pierre ✺
Pierre ✺@pgllmt·
Les coding agents actuels sont assez performants pour que trop de garde-fous deviennent eux-mêmes un coût. Hier, j’annonçais une phase d’exploration avant modification. La réponse honnête : pas systématiquement. Pour une modification locale, réversible et bien couverte par les tests, je laisse l’agent explorer la base de code et produire un premier diff. Je sépare exploration et modification lorsque la demande reste ambiguë, touche plusieurs modules ou contrats, repose sur peu de tests, ou serait difficile à annuler. Dans ce cas, je demande une carte courte et sourcée : • le point d’entrée ; • le chemin d’exécution concerné ; • les tests de référence ; • les fichiers probablement touchés ; • les incertitudes restantes. Un garde-fou n’est pas un jugement sur la qualité du modèle. Je calibre son autonomie sur le coût d’une erreur plausible. Jour 4/30. Demain : comment je vérifie qu’un test généré protège réellement le comportement.
Français
1
4
32
3.3K
Pierre ✺
Pierre ✺@pgllmt·
@arthur_gamby Merci pour l’info, je n’avais pas vu ! Du coup je suis bien bloqué à 256k, ça va le faire pour mes tests ! T’as pu tester de ton côté ? Un premier avis à chaud ?
Français
0
0
1
108
DevArt
DevArt@arthur_gamby·
Si vous utilisez kimi K3 avec l’abonnement « Moderato », la fenêtre de contexte est limitée à 256K. Il faut passer à l’abonnement supérieur pour bénéficier du contexte de 1M. (39$/mois) min.
DevArt tweet media
Français
1
0
6
286
Pierre ✺
Pierre ✺@pgllmt·
OpenShip : self-hosted complet + MCP agents. Prometteur 🔥 !
OpenShip@openshipio

Introducing OpenShip. An open-source application platform for building, deploying, operating, and scaling applications on infrastructure you own. Replace deployment tools, managed services, and infrastructure workflows with one open-source platform. Available today: - Mail Server (Built in. One click). • Runs on your own VPS • Unlimited domains • Unlimited mailboxes • Modern webmail included • Connect with Gmail, Outlook, Apple Mail, Thunderbird, or any IMAP/SMTP client • Send email directly from your applications using SMTP • No mailbox subscriptions or API fees • High email deliverability - Deployment: • Deploy any stack • Git-based deployments • Zero-downtime deployments • One-click rollbacks • Development, Staging, and Production environments • Multi-branch deployments with isolated environments • Deploy to VPSs, dedicated servers, cloud VMs, or your homelab - Services: Provision the services your applications need in one click. Replace multiple managed providers with services running on your own infrastructure. • Supabase • PostgreSQL • MySQL • MariaDB • MongoDB • Redis • MinIO • Meilisearch • Qdrant • RabbitMQ • Kafka • ClickHouse • Elasticsearch ...and deploy any other service alongside your applications. - Operate: • Live deployment logs • Live request logs • Real-time traffic analytics • Automated backups • Monitoring • Secrets management • Domains • Automatic SSL • Environment variables • Scheduled jobs • Health checks -Multi Environments: • Separate Development, Staging, and Production environments • Deploy every branch independently • Test changes before production • Isolated services, secrets, and configuration per environment - Security & Teams: • Team management • Role-based access control • IP allow/block rules • Rate limiting • Security rules - Developer Experience: • Web dashboard • Native desktop application • CLI • REST API • MCP support for AI agents, just add the mcp and your agent can do the work for you • Manage your infrastructure without living in SSH - Coming Soon: • Multi-server clustering for applications and databases • One-click load balancing • Horizontal scaling across multiple servers • Built-in high availability and failover • Scale from a single VPS to a cluster with the same workflow • Just add servers. OpenShip handles the rest. Open source.

English
0
1
17
1.9K
Alfouille
Alfouille@Alfouille·
@pgllmt Voila la liste ! j'espère que ça pourra aider certains 🫡
Alfouille tweet media
Français
1
0
5
50
Alfouille
Alfouille@Alfouille·
Cette semaine, j’ai audité le produit d’un client construit en grande partie avec l’IA. L’application fonctionnait. L’interface était propre. À première vue, elle semblait prête à être publiée. Pourtant, l’audit a révélé plusieurs erreurs de sécurité qui auraient pu être évitées avant la mise en production. Voici les 7 vérifications que je conseille à tous les builders : 1. Aucun secret ou token exposé dans le code client 2. Un utilisateur ne peut accéder qu’à ses propres données 3. Les actions sensibles sont contrôlées côté serveur 4. Les fichiers envoyés sont limités, renommés et analysés 5. Les dépendances sont à jour et exemptes de failles connues 6. Les logs ne contiennent ni token ni donnée personnelle 7. Les sauvegardes et la suppression des comptes fonctionnent réellement L’IA permet de construire beaucoup plus vite. Mais elle permet aussi de reproduire des erreurs de sécurité à la même vitesse — dans une application suffisamment propre pour inspirer confiance. Une belle interface n’est pas une preuve de sécurité. Et demander à l’IA d’auditer le code qu’elle vient de produire ne remplace pas un regard extérieur. Sauvegardez cette checklist avant votre prochaine mise en production.
Alfouille tweet media
Français
3
0
11
1.5K
Pierre ✺ retweetledi
Qwen
Qwen@Alibaba_Qwen·
Qwen3.8 is launching and going open-weight soon!🌐 With a massive 2.4T parameters, this model is continuously evolving. We believe it’s one of the most powerful model available today, compatible to leading frontier AI models , second only to Fable 5. You don't have to wait to test it. Just now, the Qwen3.8-Max-Preview made its debut on Alibaba’s Token Plan, Qoder, and QoderWork. Be among the very first to try it out. Can't wait to hear what you build. Stay tuned! 🚀  Token Plan international:qwencloud.com/pricing/token-… China:platform.qianwenai.com/pricing/token-…
Qwen tweet media
English
1.2K
3K
21.6K
6.4M
Pierre ✺
Pierre ✺@pgllmt·
@Alfouille Super sympa merci, rien ne presse, ton petit est plus important 😉 !
Français
1
0
1
54
Alfouille
Alfouille@Alfouille·
@pgllmt Je fini de m’occuper de mon petit et je te fais une liste des principaux outils que j’utilise 🫡
Français
1
0
1
75
Pierre ✺
Pierre ✺@pgllmt·
@KajanSiva Enchanté Kajan ! Hâte de poursuivre nos échanges sur X ou ailleurs. Je viens de t’ajouter sur Linkedin. Bonne courage pour la suite 👀
Français
1
0
2
117
Kajan Siva
Kajan Siva@KajanSiva·
Il est temps de me présenter 👋🏽 Moi c'est Kajan, dev freelance depuis 2014 (oui je sais, je suis vieux). Je bosse surtout en régie (1 client à la fois, à temps plein). La plupart des mes XPs sont en startup : frichti, libeo, payfit, toongether, ... Ma vision à long terme est de devenir entrepreneur. Mais pour les 2 / 3 prochaines années, je vais devoir rester sur ce format freelance. Mon focus du moment est de basculer à fond sur la partie IA. Pour décrocher des missions de type AI engineer. Pour ça, je suis rentré dans une phase "build & teach". Je bosse sur des projets persos et des POCs. Et je partage ce que j'apprends sur X, Linkedin et sur mon blog. Le dernier projet en date c'est un tuteur IA que je construis pour mes gamins. Côté perso, je suis marié et j'ai deux enfants. Je suis d'origine sri lankaise (tamil). Je suis fan de l'univers japonais de manière générale. En passant des ramens à One Piece. Et j'aime les films qui cassent la tête. Comme ceux de Nolan ou celui que j'ai vu récemment : Patéma. Fun fact : j'ai bossé 2 ans en tant que crêpier quand j'avais arreté les études. Je suis nouveau sur X. Donc hâte de voir ce que ça va donner. Et comment je peux aider.
Français
21
1
45
3.8K
Pierre ✺
Pierre ✺@pgllmt·
@thsottiaux Rebuilding an old PHP website with TypeScript this weekend! Full audit and pushing more features with GPT-5.6 Sol. Flying solo… well, not really solo with Codex by my side!
English
0
0
1
182
Tibo
Tibo@thsottiaux·
What are you building this weekend?
English
2.5K
60
3.2K
449.1K
Pierre ✺
Pierre ✺@pgllmt·
@KajanSiva Courage, tu n’es pas seul ! Si je peux t’aider, je suis là !
Français
1
0
1
167
Pierre ✺
Pierre ✺@pgllmt·
Hâte de te lire ! Je partage complètement cette vision. On parle beaucoup des modèles, mais beaucoup moins de l’écosystème. L’app ChatGPT sur macOS, avec le navigateur intégré, Computer Use et toutes les briques qui commencent à s’assembler, change vraiment la façon de travailler au quotidien pour moi aussi !
Français
0
0
3
219
Supersocks
Supersocks@iamsupersocks·
Demain ou lundi, je vous sors un article sur Codex × Cowork (app web) × Computer Use et, plus largement, sur l'écosystème OpenAI. On parle beaucoup des nouveaux modèles, mais je trouve qu'on ne mesure pas assez ce qui s'est passé ces derniers mois. OpenAI n'a pas seulement amélioré ses modèles : ils ont construit un véritable environnement de travail qui impacte désormais tous mes workflows, que ce soit pour mon métier, mes projets perso ou mes side business. Chaque brique mérite d'être analysée : > les capacités des modèles > l'autonomie avec Codex et Computer Use > le realtime voice > la gestion du contexte et de la mémoire > le tooling et les connecteurs > les Skills > la génération d'images et surtout la façon dont tout cela fonctionne ensemble. Pris séparément, chaque élément est intéressant. Ensemble, ils changent complètement la manière de travailler. J'ai vu très peu d'articles qui prennent cette approche systémique. C'est dommage, car c'est là, selon moi, que se situe la véritable évolution. Je vais prendre le temps de détailler mes usages concrets, ce qui fonctionne, ce qui me fait gagner du temps et ce qui change réellement mon quotidien.
Supersocks@iamsupersocks

Ne ratez pas le computer use sur Codex, c’est de la magie noire.

Français
4
3
16
2.3K
Pierre ✺
Pierre ✺@pgllmt·
@leploutos Exactement. J’ai fait pareil et on n’est clairement pas les seuls 🤝
Français
1
0
2
231
Le PLOUTOS
Le PLOUTOS@leploutos·
Moi, je suis content de voir que GPT-5.6 Sol et Kimi K3 ont enfin rattrapé Fable 5. Je m'étais réabonné au forfait Claude Max en juin uniquement pour Fable. D'abord, sa sortie a été repoussée au 1er juillet à cause de problèmes liés au gouvernement américain. Bon, soit. Puis Anthropic a annoncé que : - Fable 5 ne resterait inclus dans l'abonnement que pendant une semaine - son utilisation serait limitée à 50 % du quota hebdomadaire - il refuserait de nombreuses tâches de code pourtant classiques pour les transférer vers Opus 4.8 J'ai payé plus de 100 balles pour le forfait Max, et c'est le service auquel j'ai droit ? A ce moment-là, Fable 5 était le meilleur modèle disponible. On n'avait donc pas vraiment d'autre choix que d'accepter. Mais moins de trois semaines plus tard, GPT-5.6 Sol et Kimi K3 sont sortis. Les deux sont désormais au niveau de Fable. Je suis sincèrement content de voir d'autres entreprises capables de rivaliser avec Anthropic. J'en ai assez de leur manière de traiter leurs clients. "La concurrence stimule le progrès. Quand une entreprise domine le marché, ce sont les consommateurs qui en paient le prix." Cette phrase reste toujours aussi vraie. Nous, les indépendants, nous n'avons pas les budgets des grandes entreprises. Nous ne pouvons pas toujours nous permettre les tarifs des API, mais nous avons quand même l'envie de créer et de lancer des produits. Nous méritons un service à la hauteur de ce que nous payons.
Claude@claudeai

Beginning July 20, Claude Fable 5 will be included in all Max and Team Premium plans, at 50% of limits. Pro and Team Standard users will continue to have access to Fable via usage credits, and will receive a one-time $100 credit. Demand for Fable has been challenging to predict, which is why we rolled it out to subscription plans in stages, extending access several times as we secured additional capacity.

Français
10
1
41
4.9K
Pierre ✺
Pierre ✺@pgllmt·
@_mvallenet Ça marche, curieux d’avoir ton retour à l’occasion 🙂!
Français
0
0
1
17
Mikael Vallenet
Mikael Vallenet@_mvallenet·
@pgllmt Pas encore, mais c’est dans ma todo je ferai un post pour donner mon avis mais l’idee m’avait convaincu à voir en pratique 😆
Français
1
0
1
38
Pierre ✺
Pierre ✺@pgllmt·
Un coding agent peut produire un diff propre, testé et cohérent pour le mauvais problème. Hier, j’ai partagé les contrôles que j’applique une fois le diff généré. Aujourd’hui, voici le contrat de tâche que je donne à l’agent avant qu’il touche au code : - Comportement attendu : qu’est-ce qui doit changer ? - Invariants : qu’est-ce qui ne doit surtout pas changer ? - Hors périmètre : que doit-il ignorer ? - Validation : quelles preuves doit-il fournir ? Si je ne peux pas remplir ces quatre blocs, je ne lui demande pas encore de coder. Je lui demande d’explorer le problème et de lister les décisions restantes. Une fois le problème cadré, je lui indique un ou deux fichiers de référence, quand ils existent : l’implémentation la plus proche et les tests qui font foi. Le bon contexte ne raconte pas toute la codebase. Il réduit les décisions que l’agent doit deviner. La suite demain : comment je fais explorer une base de code à l’agent avant de le laisser la modifier.
Français
1
2
42
2.5K
Pierre ✺
Pierre ✺@pgllmt·
Très intéressant, merci pour le partage. Après avoir regardé Showboat, je le vois comme un moyen d’accompagner une PR d’une preuve rejouable : scénario, commandes, sorties et captures. Le reviewer peut ainsi vérifier ce que l’agent affirme, sans que cela remplace la lecture du diff. Tu l’as déjà intégré à un workflow de PR ?
Français
1
0
1
92