Trorram

1.2K posts

Trorram

Trorram

@Trorram

Pai, tecnologia, IA, Code, entusiasta..

São Paulo Katılım Mart 2009
3 Takip Edilen239 Takipçiler
Trorram
Trorram@Trorram·
🚨 MiniMax M3.1 preview na WAIC 2026 (Shanghai). Foco: pós-treino em coding + corte de alucinação. Multimodal, raciocínio e agent também. Mas: zero benchmark, zero nº de parâmetros, zero contexto, zero preço, zero data. Palco, ainda. #MiniMax #AI #LLM #Coding
Trorram tweet media
Português
0
0
0
46
Trorram
Trorram@Trorram·
O OpenCode passou a oferecer Gemini 3.6 Flash e 3.5 Flash Lite. A combinação de contexto de 1 milhão de tokens com uma opção Lite voltada a menor custo pode tornar agentes de código mais viáveis em projetos extensos. O ponto relevante não é apenas o modelo: é a possibilidade de alternar capacidade e custo conforme a etapa do fluxo. #IA #LLM #AI #ML #Dev #API #Codigo #Agentes #OpenSource #Google
Português
0
0
0
50
Trorram
Trorram@Trorram·
Gemini 3.6 Flash mantém 50 no índice da Artificial Analysis, mas reduz o tempo por tarefa de 2,7 para 1,3 min e o custo de US$ 0,59 para US$ 0,50. O 3.5 Flash-Lite chega a 36 pontos e 350 tokens/s. A disputa agora é eficiência. #Gemini #IA #LLM
Trorram tweet media
Português
0
0
0
40
Trorram
Trorram@Trorram·
A Poolside lançou o Laguna S 2.1, um modelo aberto voltado a agentes de programação e tarefas de longa duração. Pontos principais: • arquitetura MoE com 118 bilhões de parâmetros totais e 8 bilhões ativos por token; • janela de contexto de até 1 milhão de tokens; • modos com e sem raciocínio; • licença OpenMDW-1.1, pesos disponíveis desde o lançamento; • execução possível em uma única NVIDIA DGX Spark. Nos resultados divulgados pela própria Poolside, com trajetórias completas das avaliações disponíveis para auditoria, o modelo alcançou: • 70,2% no Terminal-Bench 2.1; • 78,5% no SWE-bench Multilingual; • 59,4% no SWE-Bench Pro; • 40,4% no DeepSWE. O caso prático mais interessante foi a construção de um mecanismo funcional de renderização HTML/CSS, do zero, em uma sessão de 50 minutos e 181 etapas, sem intervenção humana. Em outro teste, o Laguna tornou o harness da Poolside 5,2% mais rápido e reduziu as alocações de memória em aproximadamente 70%. O avanço relevante não está apenas no benchmark: está na combinação entre persistência em tarefas longas, contexto amplo, pesos abertos e capacidade de operar em hardware que uma equipe pode controlar. Fonte oficial: poolside.ai/blog/introduci… #LagunaS21 #PoolsideAI #InteligenciaArtificial #IA #AgentesDeIA #CodingAgents #Programacao #DesenvolvimentoDeSoftware #EngenhariaDeSoftware #OpenWeights #ModelosAbertos #OpenSourceAI #LLM #MixtureOfExperts #MoE #LongContext #SWEbench #TerminalBench #DeepSWE #NVIDIADGXSpark #HuggingFace #OpenRouter #MachineLearning #GenerativeAI #DevBR
Trorram tweet media
Português
0
0
0
22
Trorram
Trorram@Trorram·
NVIDIA está distribuindo acesso gratuito a 138 modelos de fronteira via NIM — e quase ninguém está aproveitando. Base oficial: build.nvidia.com/models. O catálogo roda em NIM (NVIDIA Inference Microservices) com endpoint OpenAI-compatible, então seu código atual muda em três linhas. O que muda na prática: 1. Catálogo vivo: 138 modelos hospedados — DeepSeek V4 (284B MoE, 1M de contexto), GLM-5.2 (agente/coding), Qwen, Llama, Nemotron, Kimi, GPT-OSS-120B e dezenas de MoE multimodais. Drops novos aparecem primeiro aqui. 2. Free tier sem cartão: developer program gratuito libera ~1.000 créditos de inferência. Sem exigência de empresa. Limite de 40 requisições por minuto. 3. Integração direta com Hermes, Cursor, OpenCode e qualquer cliente OpenAI-SDK — só apontar base_url e trocar o nome do modelo. Setup validado (4 passos): 1. Criar conta grátis em build.nvidia.com e gerar API key em /settings. 2. base_url = integrate.api.nvidia.com/v1 (HTTPS, não HTTP). 3. Authorization: Bearer $NVIDIA_API_KEY. 4. Escolher modelo no catálogo (ex.: minimaxai/minimax-m2.7, deepseek-ai/deepseek-v4-flash, qwen/qwen3-coder). Por que isso importa em 2026: a onda de modelos abertos (DeepSeek, Qwen, GLM) saiu de "interessante" pra "fronteira-adjacente" este ano, e o catálogo NVIDIA é consistentemente um dos primeiros lugares onde os drops novos aparecem em forma hospedada e chamável. Acesso day-one a modelos cuja API oficial às vezes tem waitlist ou restrição regional — atrás de um único endpoint familiar. Fonte oficial: NVIDIA NIM — build.nvidia.com/models (138 modelos, free trial sem cartão, OpenAI-compatible, 40 req/min). Vídeo do autor original: #NVIDIA #NIM #NIMAPIs #InferenceMicroservices #APIGratuita #DeepSeek #GLM5 #Qwen #Kimi #GPTOSS #IA #InteligenciaArtificial #MachineLearning #OpenSource #DevBR #API #LLM #Developer #IA2026 #FrontierModels #ModelosDeIA #BuildWithNIM
Português
0
0
0
59
Sharingan
Sharingan@SharinganAPP·
@Trorram Suporte nativo a Word, Excel, PDF e PowerPoint é onde agente começa a sair da demo e entrar em fluxo real. O teste que mais importa aí é preservar estrutura do arquivo enquanto faz a tarefa. Você viu se ele mantém formatação bem em documentos maiores?
Português
1
0
0
5
Trorram
Trorram@Trorram·
O Hermes Agent acaba de ganhar suporte nativo para documentos Word, planilhas Excel e PDFs — além de uma atualização importante no PowerPoint. Um avanço excelente para tornar a IA mais útil no trabalho cotidiano. 🚀 PR: github.com/NousResearch/h… #IA #InteligenciaArtificial #Automacao #Produtividade #Tecnologia #Desenvolvimento #Programacao #Python #OpenSource #SoftwareLivre #Ferramentas #Documentos #Excel #Word #PDF #PowerPoint #AgentesDeIA #Inovacao #Tech #HermesAgent
Trorram tweet media
Português
1
0
2
22
Trorram
Trorram@Trorram·
A lista do post de @humzaakhalid é o ponto central: 128 skills organizadas por departamento para estruturar uma empresa de uma pessoa. Desenvolvimento — Superpowers, Context7, Skill Creator, MCP Builder, Webapp Testing e Claude-Mem. Design — UI/UX, Taste, Frontend Design, Transitions, Web Artifacts e Brand Guidelines. Marketing — Copywriting, SEO, CRO e lead magnets em marketingskills. Redes sociais — redação de posts, roteiros para Reels e miniaturas em social-media-skills. Finanças — demonstrativos, reconciliação e auditoria. Pequenas empresas — fluxo de caixa, folha de pagamento e faturamento. Jurídico — revisão contratual, NDAs e conformidade. A fonte oficial da Anthropic confirma o fundamento: Agent Skills empacotam instruções, scripts e recursos para ampliar capacidades de agentes. O valor está em transformar processos repetitivos em capacidades reutilizáveis, com validação e controle. Fonte oficial: anthropic.com/news/skills #AgentSkills #ClaudeCode #Claude #Anthropic #InteligenciaArtificial #IA #AgentesDeIA #Automacao #Desenvolvimento #Programacao #Software #MCP #OpenSource #DevBR #Tecnologia #Produtividade #EngenhariaDeSoftware #AIAgents #LLM #Inovacao
Trorram tweet media
Português
0
0
1
51
Trorram
Trorram@Trorram·
Google jogou na mesa o CodeWiki e a documentação como conhecemos mudou de categoria. Lançado em 13 de novembro de 2025 no Google Developers Blog, o CodeWiki varre repositórios inteiros e gera uma wiki estruturada com diagramas de arquitetura, classe e sequência regenerados a cada PR mergeada. Não é Confluence com IA: é uma esteira onde a doc é efeito colateral do próprio código. Três pilares sustentam a proposta: 1. Atualização automática — cada pull request dispara regeneração da wiki. Acabou "atualiza a doc na próxima sprint". 2. Chat Gemini ciente do código — você pergunta em linguagem natural sobre o repo e recebe respostas linkadas direto nas funções e arquivos. 3. Diagramas vivos — fluxos e arquitetura regenerados em tempo real conforme o código muda. Os repositórios featured no preview já incluem pesos pesados: Go (132k stars), Flutter (174k), Kubernetes (120k), React (242k), o python-sdk do MCP (21k) e openclaw (92k). É Google mostrando a régua do que considera maduro. Quem usa vai sentir em três perfis: dev novo num codebase legado tem o "primeiro commit no Dia 1" prometido, sênior para de ser a pessoa-tribuna do onboarding, e time com coding agents entende que AGENTS.md/CLAUDE.md vira insumo crítico — se a doc agente-facing está errada, o agente lê errado com a mesma confiança de quem escreveu código. O ponto-cego continua sendo código privado: a extensão Gemini CLI para rodar CodeWiki em repos internos ainda está em waitlist. Open source já pode testar no codewiki.google. Demo: #Google #CodeWiki #Gemini #IA #AI #LLM #Dev #Bot #API #GPT #ML #MIT #Python #Claude #Tech #OSS #DevBR #Agentes #DocDrift #CodingAgent #GoogleAI #DevTools #AgenticEra #GeminiCLI #OpenSource #DevCommunity
Português
1
0
1
44
Trorram
Trorram@Trorram·
POR QUE MUDA O JOGO 6 benchmarks × 7 modelos × 3 harnesses. SkillOpt é o melhor ou empata em todas as 52 células. bate prompt humano, Trace2Skill, TextGrad, GEPA, EvoSkill. skill do Codex, solta no Claude Code: 22.1 → 81.8. #AI #ML #NLP #DevBR #Python #GitHub #MLOps #Agents
Português
1
0
0
46
Trorram
Trorram@Trorram·
A MICROSOFT LIBEROU O SKILLOPT. Skills de agente que se otimizam sozinhas, sem tocar nos pesos. → rollouts viram edits limitados → só entra se bater a validação → best_skill.md transfere entre modelos +23.5 pts em GPT-5.5 · MIT. #IA #LLM #AI #ML #Agents #SkillOpt #Microsoft
Trorram tweet media
Português
1
0
0
26