PEF

9.7K posts

PEF banner
PEF

PEF

@FegaPierre

L'IA peut nous délivrer des fâcheux ! C'est pour cela qu'ils s'en méfient... Ils préféreraient se la garder pour eux afin d'augmenter l'oppression.

Antananarivo/MADAGASCAR Katılım Nisan 2021
2.7K Takip Edilen610 Takipçiler
PEF retweetledi
Param
Param@ParamSiddh·
Google just killed the document extraction industry. LangExtract: Open-source. Free. Better than $50K enterprise tools. What it does: → Extracts structured data from unstructured text → Maps EVERY entity to its exact source location → Handles 100+ page documents with high recall → Generates interactive HTML for verification → Works with Gemini, Ollama, local models What it replaces: → Regex pattern matching → Custom NER pipelines → Expensive extraction APIs → Manual data entry Define your task with a few examples. Point it at any document. Get structured, verifiable results. No fine-tuning. No complex setup. Clinical notes, legal docs, financial reports, same library. This is what open-source from Google looks like.
Param tweet media
English
32
199
1.8K
123.4K
PEF
PEF@FegaPierre·
@iamsupersocks Tu as bien raison de pointer du doigt ce réel problème amplifié par l"avènement de l'IA @iamsupersocks. D'autant que l'adoption de l'IA comme levier de productivité a propulsé le time to market comme une préoccupation majeure des entreprises qui se veulent innovantes.
Français
0
0
0
11
PEF retweetledi
Supersocks
Supersocks@iamsupersocks·
Oui, c’est exactement le point que je souhaite mettre en avant dans mon post. Les États-Unis sont eux très contraints par leur réseau dans les délais de mise en oeuvre (sans parler du harware pour faire tourner les IA). Les files d’attente peuvent durer plusieurs années, tandis que les grandes turbines, les transformateurs et les équipements haute tension nécessitent désormais des délais considérables de fabrication, d’installation et de raccordement. Le problème n’est donc pas qu’ils ne disposent d’aucune source d’énergie. C’est que la demande progresse plus vite que le réseau et les capacités fermes disponibles. Pour réduire leur « time to power », certains développeurs américains explorent toutes les solutions possibles : production derrière le compteur, colocation avec une centrale existante, alimentation transitoire, turbines modulaires, stockage, piles à combustible ou procédures accélérées. Ces solutions sont parfois plus coûteuses, plus carbonées et loin d’être exemptes de problèmes. Mais elles permettent de commencer à avancer pendant que l’infrastructure définitive se construit. En France, il est ici question, selon ce témoignage, d’un data center de 20 MW à Lyon, déjà très avancé, avec les compétences, le besoin et les financements disponibles. Le délai de raccordement annoncé serait néanmoins de cinq ans, voire sept selon sa position dans la file d’attente. Je ne connais pas encore suffisamment le dossier pour séparer les contraintes techniques des lenteurs procédurales. Il peut être nécessaire de renforcer le réseau local, de construire un poste électrique, de sécuriser des transformateurs ou d’obtenir plusieurs autorisations. Je vais donc creuser. Mais le problème dépasse largement ce seul projet. RTE reconnaît que plus de 200 projets industriels, représentant près de 33 GW, attendent actuellement un raccordement au réseau haute tension. Le gestionnaire souhaite désormais faire évoluer la logique du « premier arrivé, premier servi » vers celle du « premier prêt, premier servi », afin que les projets réellement matures ne restent pas bloqués derrière des dossiers moins avancés. Je rencontre également ce problème dans mon métier. Nous développons des machines qui récupèrent la chaleur fatale des usines et des data centers afin de produire de l'électricité. Dès qu'une partie de cette production doit être injectée sur le réseau, le raccordement peut rapidement devenir un parcours long, coûteux et complexe. Les études, les protections électriques et les règles de sécurité sont indispensables. Mais lorsqu’un besoin industriel est réel, que le projet est mature et que son financement est sécurisé, la procédure ne devrait pas devenir la raison de son abandon. La France dispose pourtant d'une électricité produite à plus de 95 % à partir de sources bas-carbone, d'un réseau fortement maillé et de compétences industrielles reconnues. Elle a même enregistré en 2025 un solde exportateur record de 92,3 TWh selon RTE. Le problème n’est donc pas uniquement de produire davantage d’électricité. Il est aussi de parvenir à la mettre à disposition au bon endroit, à la bonne puissance et dans des délais compatibles avec les investissements industriels. Il ne s’agit pas de copier le modèle énergétique américain. Il s’agit de retrouver cette capacité à adapter les règles, à tester des solutions transitoires et à faire avancer les projets pendant que l’infrastructure définitive se construit.
Alex Ruben@rubenxela

@iamsupersocks Les.delais de raccordement annoncés par RTE sont énormes ! Pour un projet très très avancé de Datacenter de 20 Mégawatt sur Lyon, RTE annonce 5 ans de délais (la durée irait jusqu'à 7 ans en fonction de la position sur la liste) et pourtant toutes les ressources et € sont là !

Français
4
6
19
1.6K
PEF
PEF@FegaPierre·
Kimi K3: 2.8 trillion parameters, the largest "open" model ever announced. Open? Weights land July 27. The API is already paywalled. Self-hosting starts at a $300K node. The real story isn't whether open weights match frontier models. It's the widening gap between downloadable weights and runnable weights — and what moves into that gap. Full breakdown 👇@pierreemmanuelfega/kimi-k3-and-the-end-of-an-illusion-what-open-weight-still-means-e93d768557c1" target="_blank" rel="nofollow noopener">medium.com/@pierreemmanue
PEF tweet media
English
0
0
0
16
PEF
PEF@FegaPierre·
@iamsupersocks Tout à fait et c'est dans leur intérêt commercial de le faire @iamsupersocks. D'ailleurs K3 a déjà été jailbreaké pour créer des applis bien suspectes...
Français
0
0
1
16
PEF retweetledi
Supersocks
Supersocks@iamsupersocks·
@FegaPierre L’écart entre poids téléchargeables et exécutables est réel. Mais ouvrir un 3T permet justement l’audit, le red teaming, la recherche et la distillation vers des modèles accessibles. L’open ne doit pas s’arrêter au 27B : il faut toutes les tailles, du cluster au laptop
Français
1
1
1
150
PEF
PEF@FegaPierre·
Kimi K3 : 2 800 milliards de paramètres, le plus gros modèle « ouvert » jamais annoncé. Ouvert ? Les poids arrivent le 27 juillet. L'API est déjà payante. Et pour l'héberger vous-même, comptez un nœud à 300 K$. Le vrai sujet n'est plus la performance des open weights. C'est l'écart qui grandit entre poids téléchargeables et poids exécutables — et qui se glisse dedans. Mon analyse complète 👇@pierreemmanuelfega/kimi-k3-et-la-fin-dune-illusion-ce-que-open-weight-veut-encore-dire-0ea41fefd47d" target="_blank" rel="nofollow noopener">medium.com/@pierreemmanue
PEF tweet media
Français
2
0
0
196
PEF retweetledi
Superman
Superman@thesupermanmx·
China open-sourced a peanut-sized OCR that parses entire 100-page PDFs in one shot.. It's called Unlimited-OCR. Only 3B params. Runs locally. Every other OCR tool chops your doc into pages and loses the thread. this one reads the whole thing in a single pass. → One-shot "long-horizon" parsing (32K context window) → Multilingual, out of the box → 93% on the standard parsing benchmark (+6 over baseline) → <0.11 error rate past 40 pages → Runs 100% locally on your own hardware → Works with Transformers, vLLM, SGLang, Docker, Ollama, llama.cpp Traditional cloud OCR (Textract, Google Vision, Azure Doc Intelligence) costs $1.50–$15 per 1,000 pages. This runs on your machine. For free. Forever. Baidu built it explicitly to push DeepSeek-OCR one step further. Already at 1.9M downloads on Hugging Face and most people have no idea it exists yet. 100% open source.
English
99
1.1K
10.3K
601.4K
PEF retweetledi
Supersocks
Supersocks@iamsupersocks·
Qwen3.8 2.4T arrive. Attachez vos slips, ça peut secouer. Et surtout : il doit passer open-weight bientôt. Si la promesse tient, on tient peut-être la relève de nos bons vieux 35B MoE et 27B de l’enfer. On a un peu sauté une génération dans les modèles open-weight Qwen, donc j’espère vraiment que la cuvée sera solide, et surtout qu’ils sortiront plusieurs tailles utilisables, pas seulement un monstre impossible à faire tourner hors gros cluster. Dans tous les cas, le message est clair : la Chine ne ralentit pas sur les modèles open-weight. Et pour nous, builders, c’est une raison de plus de continuer à s’équiper, tester, quantizer, self-host et garder une stack prête. Parce que tous ces modèles “pour le peuple” ne servent vraiment que si on a l’infra, les outils et les réflexes pour en profiter.
Qwen@Alibaba_Qwen

Qwen3.8 is launching and going open-weight soon!🌐 With a massive 2.4T parameters, this model is continuously evolving. We believe it’s one of the most powerful model available today, compatible to leading frontier AI models , second only to Fable 5. You don't have to wait to test it. Just now, the Qwen3.8-Max-Preview made its debut on Alibaba’s Token Plan, Qoder, and QoderWork. Be among the very first to try it out. Can't wait to hear what you build. Stay tuned! 🚀  Token Plan international:qwencloud.com/pricing/token-… China:platform.qianwenai.com/pricing/token-…

Français
8
7
26
1.7K
PEF retweetledi
0xMarioNawfal
0xMarioNawfal@RoundtableSpace·
An Anthropic team member's Obsidian setup leaked and 8 million people found out the answer was sitting in Claude's documentation the whole time. One file called CLAUDE.md holds everything about you. How you think, what you're working on, where you get stuck, how you want Claude to talk to you. Claude reads it first every single session before you type a word. The guy who found it went further. Taught Claude to run on a schedule, walking through every note at 7am on its own, finding new connections, linking what belongs together and cleaning what's stale with no command needed. All of it runs on Obsidian. Free app, text files on your drive, no cloud, no lock-in. The most liked comment under the original post said it perfectly. This is the difference between using AI and building a system.
English
26
31
290
74.7K
PEF retweetledi
Alain Weber
Alain Weber@alainpaulweber·
Clément Beaune, la cloche arrogante qui juge ceux qui bossent Sur Sud Radio, Clément Beaune ose répondre à David Lisnard. Ce Haut Commissaire au Plan recyclé de la macronie défend son placard doré avec des rapports poussiéreux sur l’« adaptation à la chaleur » et des « gains de 3-4 ans » sur des projets. Du vent pur. Beaune n’a jamais rien produit de concret. Ministre éphémère des Transports, battu aux législatives, recasé à la place de Bayrou, qui avait lui le bon gout d’occuper ce poste inutile, à titre gracieux. Lui exige salaire plein, 7000 € net + chauffeur. À 44 ans, il a besoin qu’on le conduise, évidemment. Le peuple prend le métro. Ce technocrate sans vision se permet de donner des leçons de cohérence budgétaire à Lisnard, maire qui cartonne à Cannes et porte un vrai projet pour la France. Beaune, incapable de titrer un projet national ou d’écrire trois lignes de fond, accuse les autres de démagogie. Pathétique. Une nullité placée pour services rendus, et qui juge les vrais gestionnaires. Typique de cette caste inutile et arrogante. Lisnard a raison : ce machin coûte cher pour zéro résultat.
Français
76
444
1.3K
22.2K
PEF
PEF@FegaPierre·
Les signaux sont très encourageants @iamsupersocks. Je pense que les puces maison y sont pour quelque chose. Encore une suprémacie qui est remportée par SpaceXAI. D'un autre côté la Chine a déployé un générateur de mico-ondes de 1GW capable de dézingur les sattelites en orbite basse...
Français
0
0
0
13
PEF retweetledi
Supersocks
Supersocks@iamsupersocks·
Le message qui fait plaisir : xAI arrive à la fin de l’entraînement du modèle Grok de 2T de paramètres, contre 1,5T pour Grok 4.5. Il s’agirait de Grok 4.6, même si Musk ne lui donne pas encore ce nom. Musk affirme qu’il est meilleur que Grok 4.5 « en tout point » et qu’il pourrait dépasser Kimi K3, tout en conservant une vitesse et une efficacité en tokens proches du modèle actuel. Et c’est là que ça devient intéressant. Grok 4.5 joue déjà dans la zone de GPT-5.5 et d’Opus 4.8, mais avec un coût par tâche bien inférieur et une vitesse redoutable. C’était la surprise de la semaine dernière quand OpenAI dévoilait SOL. En face, Kimi K3 pousse la logique des modèles bien gras jusqu’à 2,8T de paramètres et prouve que ça améliore les outputs. J’en parlais hier : ce qui m’intéresse dans ces gros modèles, ce n’est pas seulement leur classement sur trois benchmarks, mais leurs comportements. Ils commencent à ressembler à des espèces différentes. J’aime beaucoup Grok comme juge : rapide, direct, efficace (donc peu coûteux), sans passer une éternité à raisonner avant de trancher. Kimi, de son côté, est un monstre notamment pour construire des interfaces (UI). Mais dans mes usages, il reste plus lent et produit beaucoup de reasoning. La facture et la latence montent vite, même s’il semble moins cher qu’Opus 4.8. L’accès via abonnement a l’air intéressant, mais je ne suis pas encore assez convaincu pour en faire un modèle de ma stack quotidienne. Pour l’instant, je l’utilise ponctuellement quand son profil apporte vraiment quelque chose. Si ce modèle 2T tient les promesses de Musk, Grok peut casser la baraque : presque le niveau de Kimi, avec la vitesse et l’efficacité de Grok 4.5. L’entraînement initial doit se terminer la semaine prochaine. Je mise sur de premiers signaux d’ici 10 à 15 jours, mais pas forcément sur une sortie publique aussi rapide. Ça montre aussi que la fête ne fait que commencer et on espère un composer 3 très prochainement également.
Elon Musk@elonmusk

@minchoi Our 2T model, which is better than our 1.5T in every way, will finish initial training next week. It might be able to exceed Kimi, but with speed and token efficiency close to our 1.5T (aka Grok 4.5).

Français
3
3
14
1.3K
PEF retweetledi
Mehdi (e/λ)
Mehdi (e/λ)@BetterCallMedhi·
avec cette histoire de location de climatiseurs in fine bcp de gens commencent enfin à comprendre tout l'enfumage d’une LARGE PARTIE de la frenchtech que je dénonce sans arrêt ici ce que vous avez vu c'est vraiment révélateur de notre écosystème où n'importe quel enfant de bourgeois se fait passer pour un entrepreneur alors qu'il exploite juste la dernière faille du système ou le désespoir des gens pour dans ce cas précis louer des ventilateurs au prix fort(qu’ils achètent temporairement à Cdiscount et rendent au bout de 30 jours en les ayant loués entre temps à des particuliers) bref de vrais rapaces déguisés en visionnaires d’ailleurs ce que je trouve drôle c’est que tout se met en scène avec le même récit larmoyant, l'été où tout a basculé, la grand mère imaginaire a l'ehpad qui n’a plus de Clim et la mission providentielle mdrrr cette petite larme linkedin recopiée de pitch en pitch qui transforme un business banal en épopée humanitaire, ils ont industrialisé l'émotion comme argument de levée et cnest SYSTÉMATIQUEMENT comme ça et le culot suit hein car ces gens qui connaissent rien à leur secteur révisent une heure sur chatgpt et passent soudainement experts sur bfm pour faire la pub de leur startup et le tout sans trembler car leur sentiment d'impunité vient d’un système qui leur a toujours donné raison et les a toujours avantage en raison de leur bonne gueule et leur profil lisse qui rassure parce que derrière le décor c'est un entre soi parfait au sein de FrenchTech avec des gens venus des mêmes écoles, mêmes codes mêmes quartiers privilégiés + le capital de la frentech ouvre son chéquier au garçon qui lui ressemble et appelle ça du flair alors que c'est un miroir guidé par l’homogénéité socioculturelle et souvent c'est l'argent public qui garantit le risque, bpi, CIR, subventions de région… dans la mesure où on socialise la mise et on privatise la gloire et pour moi le + rageant c'est le gâchis, pour un fils de bonne famille avec un nom à particule qu'on propulse malgré son concept de merde combien de gamins de banlieue ou de province avec une vraie idée et une vraie faim se prennent une porte parce qu'ils ont ni le bon nom de famille, ni le bon carnet d'adresses ni la bonne origine étant donné que ce ce pays laisse mourir ses meilleurs talents pour protéger un club privé de fils à papa
Mehdi (e/λ) tweet mediaMehdi (e/λ) tweet media
Français
175
1.6K
7.8K
469.1K
PEF retweetledi
Valenciana
Valenciana@ValencianaAbel·
SOMEONE BUILT A QUERYABLE KNOWLEDGE GRAPH FOR ANY CODEBASE Graphify turns code, schemas, documents, papers, images and videos into a single knowledge graph that AI coding tools can query. WHAT IT OFFERS - Ingests application code, SQL schemas, R scripts, shell scripts and documentation - Maps app code, database design and infrastructure into one graph - Lets AI coding assistants query context across a whole project - Supports Claude Code, Codex, OpenCode, Cursor, Gemini CLI and more - Was trending with 1,623 stars today and more than 88,000 total stars Huge win for Graphify: agents can navigate software context as connected knowledge instead of isolated files.
Valenciana tweet media
English
3
6
35
2.2K