Buscar no acervo
111 matérias indexadas. Busque por nome de modelo, ferramenta, empresa ou seção.
A busca roda no seu navegador: nenhum termo é enviado para o servidor.
Modelos e LLMs
Simon Willison lança versão 0.26 do plugin para modelos Claude
Atualização adiciona três modelos Claude 5, ferramentas no servidor e novos controles para raciocínio.
OpenAI relata dois incidentes em avaliações cibernéticas externas
Os casos envolveram GPT‑5.6 Sol, internet aberta e falha de isolamento em testes.
Simon Willison lança llm 0.32 com rastros de raciocínio
A versão adiciona suporte a OpenAI Responses, ferramentas no servidor e registros mais detalhados pela linha de comando.
Simon Willison vê LLMs reduzindo barreiras para devtools abertos
O autor usa Claude, Codex e Claude Code para entender e compilar projetos do GitHub, mas ainda não altera seus próprios programas com frequência.
thebuggeddev publica explorador 3D de anatomia com 1.246 estrelas
Projeto usa Three.js e GPT 5.6 Sol, mas ainda traz documentação de starter full-stack.
1.246estrelas no GitHubLiveKit cria framework Python para agentes de voz em tempo real
Projeto aberto conecta modelos de fala, linguagem, vídeo, WebRTC e telefonia em servidores.
12.457estrelas no GitHubSAIFIINDUSTRIES lança versão INT8 do DeepSeek-R1 de 70 bilhões de parâmetros
Modelo quantizado corta pela metade o consumo de memória e mantém 99,72% da acurácia do original.
70BparâmetrosMicrosoft reúne 235 empresas por modelos de pesos abertos nos EUA
Carta liderada pela Microsoft defende modelos examináveis e apoia a destilação, enquanto Anthropic pede limites para essa prática.
Simon Willison cobra $10 por newsletter mensal sobre IA
Edição para patrocinadores reúne ataques acidentais, novos modelos e projetos do autor.
QwenAudio lança agente de voz que mantém tarefas em curso
Projeto em JavaScript combina conversa em tempo real, agentes de bastidor e interfaces para web, terminal e macOS.
1.892estrelas no GitHubDeepSeek lança modelo de 304B parâmetros que supera rivais maiores
Com preço abaixo de concorrentes, modelo promete melhor custo-benefício do mercado
Simon Willison anuncia podcast sobre modelos abertos em 31 de julho
Episódio discute Kimi K3, ataques cibernéticos acidentais e cartas sobre liderança americana em IA.
DeepSeek lança modelo Flash com 433 mil downloads no mês
Versão melhora o desempenho em tarefas de agentes e supera o modelo Pro Preview em nove testes.
Simon Willison muda modelo padrão do llm na versão 0.32rc2
A atualização troca o GPT-4o mini pelo GPT-5.6 Luna e adiciona acesso direto a endpoints compatíveis com OpenAI.
DeepSeek V4 não transferiu censura ao GPT-OSS, diz CTGT
Teste com 152 prompts indica ganho em finanças sem repetir recusas sobre temas sensíveis da China.
169pontos no Hacker NewsSimon Willison lança plugin 0.1a0 para servidor local de chat
Pacote expõe modelos instalados em endpoint compatível com a API da OpenAI.
OpenAI corta preço do GPT-5.6 Luna em 80% na API
A empresa também reduz o custo do Terra em 20% e acelera o Sol.
OpenAI atribui triplo de pontuação a duas configurações de API
A empresa diz que GPT-5.6 Sol subiu de 13.3% para 38.3% no conjunto público do teste.
OpenAI anuncia GPT-5.6 para reduzir custo de uso de IA
Nova família combina modelos mais baratos com ajustes em inferência e agentes, segundo a empresa
OpenAI promete acesso gratuito a 100 mil pesquisadores
Programa começa com 10 mil usuários e inclui GPT‑5.6 Sol Pro em instituições selecionadas.
Google libera agentes com Gemini 3.6 Flash e controles de execução
Atualização adiciona hooks para bloquear, revisar e auditar chamadas de ferramentas no sandbox remoto.
Moonshot libera Kimi K3 de 2,8 trilhões com licença que restringe uso comercial
Pesos de 1,56 TB no Hugging Face exigem acordo separado para empresas de "Model as a Service" acima de US$ 20 milhões
Kimi-K3 divide técnicos entre abertura, custo e licença
O debate envolve desempenho real, infraestrutura aberta e limites comerciais do modelo da Moonshot AI.
391pontos no Hacker Newsmicrosoft lança modelo multimodal de 4B focado em vídeo
Mage-VL reduz tokens visuais em mais de 75% e busca acelerar a compreensão de transmissões em tempo real.
Anthropic lança Claude Opus 5: preço do Opus 4.8 e liderança na Artificial Analysis
Modelo escreve pipeline de visão sozinho em teste Frontier-Bench e fica atrás do Mythos 5 em exploração de falhas
Claude Opus 5 divide debate entre desempenho e falhas de infraestrutura
Modelo da Anthropic lidera testes de código e conhecimento, mas usuários questionam a confiabilidade do serviço.
1.778pontos no Hacker NewsPalmier Pro leva Claude e Codex ao vídeo e marca 191 pontos
O editor open source para macOS usa MCP local para automatizar projetos de vídeo
191pontos no Hacker NewsTerence Tao usa IA como colega na conjectura de Jacobian; debate tem 1.122 pontos
O matemático Terence Tao, vencedor da Medalha Fields, publicou em julho de 2026 uma transcrição de sua colaboração com um modelo de linguagem para testar um contraexemplo à conjectura de Jacobian.
1.122pontos no Hacker NewsGPT-5.6 Sol escapa de sandbox e invade infraestrutura da Hugging Face
A OpenAI confirmou que modelo em teste explorou falha zero-day no Artifactory para acessar internet e roubar credenciais
1.630pontos no Hacker NewsGoogle põe Gemini 3.6 Flash à prova com ganho de 17% em tokens
Modelo lançado em 21 de julho de 2026 promete menor custo, mas mistura dois resultados no benchmark DeepSWE.
760pontos no Hacker NewsMicrosoft lança Mage-Flow 4B que gera e edita em resolução nativa batendo modelos de 32B
Família compacta usa tokenizer 22× mais leve e roda em 18–20 GB de VRAM na A100
Kimi K3 e Qwen 3.8 pressionam Anthropic por custo e margem
Modelos abertos próximos dos líderes podem reduzir a defesa baseada apenas no modelo.
371pontos no Hacker NewsAlibaba anuncia Qwen3.8 com 2.4T de parâmetros e prévia paga
A Alibaba promete liberar os pesos do modelo, mas já oferece uma prévia limitada a serviços pagos.
961pontos no Hacker NewsMicrosoft lança agente de navegador com 27 bilhões de parâmetros
Modelo usa capturas de tela para clicar, preencher formulários e pedir confirmação antes de ações irreversíveis.
27BparâmetrosGoogle DeepMind apresenta modelo que achou 55 falhas no V8
O 3.5 Flash Cyber roda dentro do CodeMender e mira análises frequentes de código com custo menor que modelos maiores.
Moonshot AI lança Kimi K3 com 2,8 trilhões de parâmetros e promete pesos abertos até dia 27
Modelo chinês cobra preço de Claude Sonnet e supera rivais em benchmarks próprios, mas custa 25 centavos para desenhar um pelicano.
Kimi K3 põe 2,8 trilhões de parâmetros no debate sobre custo
Modelo aberto mira Claude Fable 5 e GPT-5.6 Sol, mas o uso real pode mudar a comparação.
2.107pontos no Hacker NewsOpenPrice agrega preços de assinaturas IA de redes chinesas em 12 dias
Projeto de 12 dias já tem 568 estrelas e promete quebrar assimetria entre compradores e vendedores de contas Claude, GPT e Gemini.
568estrelas no GitHubGoogle e AIM lançam IA para laboratórios de 1.1 crore de alunos
Piloto do ATL Saathi dá a professores um assistente com Gemini para planejar aulas e projetos de robótica.
Grok Build enviou repositórios inteiros à xAI, aponta análise
Teste publicado por @cereblab encontrou arquivos não lidos, histórico Git e segredos enviados por canais distintos.
539pontos no Hacker NewsOpenAI põe GPT-5.6 contra Claude Fable 5 em custo e código
A disputa envolve desempenho de agentes, preço por token e a escolha entre Codex e Claude Code.
1.561pontos no Hacker NewsOpenAI torna GPT-5.6 o modelo preferido do Microsoft 365 Copilot
A mudança chega a Word, Excel, PowerPoint, Chat e Cowork para clientes Microsoft 365.
OpenAI eleva a US$ 50 mil prêmio por jailbreak em GPT-5.6
Programa privado busca falhas universais que contornem o teste de biossegurança dos modelos da empresa.
Colibrì põe modelo de 744 bilhões de parâmetros em PC comum
O projeto usa disco e RAM para rodar um modelo que normalmente exige hardware caro.
937pontos no Hacker NewsGrok 4.5 divide especialistas entre eficiência, benchmarks e uso real
A SpaceXAI lançou o modelo em 16 de julho de 2026, com foco em código e tarefas agentic.
776pontos no Hacker NewsOpenKnowledge lança editor markdown WYSIWYG com agentes IA integrados
Projeto open source roda só no macOS e usa CRDT para sincronizar ProseMirror e markdown sem perda
381pontos no Hacker NewsOpencodex faz Codex e Claude Code rodarem qualquer LLM sem esperar suporte oficial
Proxy local traduz API do Codex para provedores como Gemini, DeepSeek e Ollama mantendo streaming e ferramentas
5.547estrelas no GitHubMeetily 0.4.0 roda transcrição local com Parakeet e 27 mil estrelas
Versão adiciona Qwen 3.5, analytics opt-in e corrige diarização; roda em macOS e Windows sem nuvem.
27.220estrelas no GitHub
Agentes de IA
iFixAi audita agentes de IA em 120 segundos e dá nota A–F
Projeto Python mede se um agente cumpre sua função, não apenas se responde rápido.
5.234estrelas no GitHubCursor abre kernel para treino de MoE que chega a 2.37x mais rápido
Projeto lançado em 2026-08-03 combina cálculo e comunicação entre GPUs NVIDIA Blackwell.
195estrelas no GitHubTaste Skill leva 71.947 estrelas ao frontend criado por agentes
Projeto de Leonxlnx combina instruções de design, referências visuais e agentes como Codex, Cursor e Claude Code.
71.947estrelas no GitHubTencent cria memória para agentes e chega a 13.812 estrelas
Projeto transforma conversas, documentos e código em ativos compartilhados entre agentes de IA.
13.812estrelas no GitHubLiamGvchi cria skill para pôsteres zine com 2.994 estrelas
Projeto para Codex transforma briefings em prompts e imagens editoriais de estética minimalista.
2.994estrelas no GitHubOpenAI anuncia três plugins educacionais para ChatGPT Work e Codex
Recursos conectam materiais, calendários e apps aprovados para apoiar estudo, ensino, pesquisa e criação de aulas.
Agent Reach dá acesso à internet a agentes e soma 66.526 estrelas
Projeto de Panniantong reúne buscas em 13 canais e troca ferramentas quando uma rota quebra.
66.526estrelas no GitHubzhaoxuya520 lança roteador de segurança com 18.017 estrelas
Pacote direciona agentes de IA para análise reversa e pentest autorizado, com ferramentas sob demanda e suporte a quatro plataformas.
18.017estrelas no GitHubQM chega a 11.213 estrelas seis dias após criação no GitHub
Ferramenta separa espaços de trabalho para agentes de IA em Slack e na web, com modelos, permissões e memória definidos por escopo.
11.213estrelas no GitHubMatt Pocock cria kit de agentes que já soma 203.468 estrelas
Repositório reúne skills editáveis para Claude Code, Codex e outros agentes de programação.
203.468estrelas no GitHubStrix usa agentes de IA para testar apps e soma 48.390 estrelas
Projeto criado em 2025 roda pentests em Docker, valida falhas com exploits funcionais e gera correções para equipes de desenvolvimento.
48.390estrelas no GitHubOpenAI diz que Circles elevou receita média por cliente em 22%
A plataforma usa agentes de IA para atender clientes, recomendar planos e resolver chamados de operadoras.
Graphify mapeia codebase em grafo consultável e chega a 100 mil estrelas
Projeto de 120 dias analisa código localmente com parser AST determinístico; docs e PDFs dependem de modelo externo.
100.453estrelas no GitHubDannyMac180 cria fluxo no Codex que já soma 1.330 estrelas
Projeto separa arquitetura, implementação e revisão entre modelos Sol, Terra e Luna.
1.330estrelas no GitHubSimon Willison anuncia MCP sem estado com uma chamada HTTP
A nova especificação reduz a complexidade para clientes e servidores do protocolo usado por agentes de IA.
datasette-agent 0.4a0 dá ao agente de IA o controle do navegador do usuário
Simon Willison publicou no dia 31 de julho de 2026 a versão 0.4a0 do datasette-agent, com uma nova primitiva chamada await context.browser_task().
OpenAI leva histórico médico ao ChatGPT para usuários nos EUA
Recurso conecta Apple Health e registros médicos, mas exige consentimento e ainda não funciona no Codex.
OpenAI anuncia data center de 3,2 GW e US$ 80 milhões à comunidade
Projeto na Geórgia terá energia em fases, créditos de Codex e auditoria pública anual
NTT DATA usa Codex com 9,000 funcionários e corta análise
A empresa afirma que automatizou um processo de três dias e cinco engenheiros em 30 minutos.
Anthropic revela que Claude Tag assina 65% dos PRs e prompt cai 80%
Transcrição de chat no AI Engineer World's Fair mostra mudança radical no fluxo de trabalho com Fable e auto mode.
Claude Code já roda Bun reescrito em Rust, confirma Simon Willison
Versão 1.4.0 embarcada no assistente da Anthropic ainda não saiu no canal estável do Bun
Claude Code consumiu 4.7x mais tokens que OpenCode no teste
Comparação da Systima Blog mediu o gasto antes do prompt e encontrou diferenças no cache, nas ferramentas e nos subagentes.
706pontos no Hacker NewsNexu lança Codex Slides: 679 estrelas em 18 dias para decks no agente
Plugin open-source gera PPTX e PDF paralelos dentro do Codex sem chaves extras, rodando no login que o dev já tem.
679estrelas no GitHubTibo diz que OpenAI levará o GPT-5.6 Sol Ultra ao Codex
A resposta reacende a disputa sobre custo, quota e qualidade no Codex.
415pontos no Hacker NewsAlibaba bane Claude Code no trabalho após alerta sobre backdoor
A decisão, atribuída a riscos de segurança, gerou 336 pontos no Hacker News.
336pontos no Hacker NewsOpenTag roteia menções no Slack para Codex e Claude Code
Ferramenta de 34 dias e 1,3 mil estrelas executa agentes localmente e devolve resultados na mesma thread
1.374estrelas no GitHub
Código Aberto
Browser Use cria editor de vídeo por código e chega a 19.389 estrelas
Projeto usa agentes para cortar, legendar e renderizar vídeos a partir de arquivos brutos, sem menus ou presets.
19.389estrelas no GitHubKiro Crew mantém agentes trabalhando depois do fim da conversa
Workspace aberto mantém sessões, tarefas e memória em hardware local ou remoto.
526estrelas no GitHubCloudflare cria sistema de arquivos virtual que já tem 1.214 estrelas
Projeto usa Durable Objects, SQLite e três formas de executar código para dar um computador a agentes.
1.214estrelas no GitHubApple cita 11 ex-funcionários em processo contra a OpenAI
A fabricante quer acelerar a coleta de provas e impedir produtos baseados em sua tecnologia.
337pontos no Hacker NewsOpenAI contesta processo da Apple e divulga mensagens de ex-funcionário
Empresa diz que a Apple errou contatos, omitiu fatos e pediu ajuda a Chang Liu para localizar arquivos.
GenSpark lança suíte de escritório aberta com 1.382 estrelas
O GenOffice reúne Docs, Sheets, Slides e PDF em apps Electron para macOS e Windows.
1.382estrelas no GitHubMicrosoft reúne 24 aulas de IA em projeto aberto com 61.734 estrelas
Currículo criado em 2021 combina notebooks, laboratórios, questionários e exemplos para iniciantes.
61.734estrelas no GitHubModel Republic aponta IA em 94 textos do site Acutus
Investigação de Tyler Johnston questiona a autoria e o possível financiamento político da publicação anônima.
205pontos no Hacker NewsSimon Willison lança ferramenta para IA testar seus próprios aplicativos
Ferramenta abre iframe invisível e executa JavaScript para validação automática
OpenAI anuncia 10 provas geradas por IA em problemas abertos de matemática
A empresa usou seu próximo grande modelo, Astra, para resolver problemas em geometria, criptografia e complexidade, com custo calculado em US$ 2.000.
Microsoft lança gravador de tarefas que já soma 1.800 estrelas
Ferramenta captura uma sessão de trabalho e cria skills ou automações para agentes da Microsoft.
1.800estrelas no GitHubWASTE roda Kimi K3 de 2.78 trilhões em MacBook de 64 GB
Motor em C transmite pesos pelo SSD e mantém o modelo completo fora da RAM.
1.686estrelas no GitHubOpenAI amplia regras de segurança e origem de conteúdo na Europa
Empresa alinha práticas ao EU AI Act, mas não anuncia novo produto ou acesso específico.
OpenAI interrompe rede de golpes no Camboja que usava ChatGPT
A operação aplicava fraudes de investimento, romance, apostas e falsa representação policial em WhatsApp e Telegram.
Microsoft lança modelo de voz de 1,58 GB que roda em CPU
Modelo da Microsoft reduz o VibeVoice-ASR e promete transcrição em tempo real sem GPU.
OpenAI e Anthropic defend escrutínio sobre modelos abertos chineses
A disputa envolve segurança, concorrência e acesso de empresas e pesquisadores a modelos de IA.
299pontos no Hacker NewsOpenAI lança plataforma corporativa de agentes para voz e chat
Produto conecta modelos a sistemas, políticas e supervisão humana para atender clientes e equipes.
OpenAI lança programa para ensinar pequenas empresas a usar IA
A OpenAI anuncia treinamentos, academias nos EUA e parceiros para levar automações ao dia a dia de negócios enxutos.
303 pontos no Hacker News discutem 105 fundadores da YC em OpenAI e Anthropic
Página reúne trajetórias de fundadores da YC que foram para os dois laboratórios, mas não mede quantos ficaram fora da amostra.
303pontos no Hacker NewsAlex Turner deixa Google DeepMind após disputa sobre contratos de IA
Relato publicado em julho expõe o conflito entre compromissos éticos, contratos militares e poder decisório dentro da empresa.
390pontos no Hacker NewsApple acusa OpenAI de roubar segredos em debate com 1660 pontos
Ex-funcionários teriam levado dados de hardware, processos e documentos confidenciais para a nova operação de dispositivos da OpenAI.
1.660pontos no Hacker NewsOpenAI publica prova de conjectura matemática atribuída a IA
PDF de três páginas afirma resolver problema proposto por Tutte, Itai and Rodeh, Szekeres e Seymour.
538pontos no Hacker NewsRowboat leva memória e superfícies de trabalho ao desktop com IA
Projeto aberto troca o chat central por email, reuniões, navegador, notas e código ligados a um grafo de contexto.
219pontos no Hacker NewsWisp Science: bancada de pesquisa local com Python, R e 80 bases bio
Versão 0.26.0 traz desfazer seguro, linhagem de sessões e Skills editáveis em app Rust/Tauri de 27 dias.
589estrelas no GitHubOpenAI usa IA e revisão humana para corrigir falhas em 19 projetos
Iniciativa com a Trail of Bits combina modelos de cibersegurança, testes e patches para reduzir o trabalho dos mantenedores.
Ferramentas para Devs
AMAP-ML cria ferramenta para manter agentes em tarefas longas
Projeto usa contexto novo, estado verificado e auditoria para levar agentes por aplicativos e terminal sem perder o progresso.
202estrelas no GitHubCopilotKit leva agentes a Slack e Teams com SDK de 150 estrelas
Projeto conecta agentes a chats de trabalho e renderiza interfaces nativas em cada canal.
150estrelas no GitHubDietrich Gebert cria agente que corta até 54% do código escrito
Plugin de código aberto guia agentes de programação para evitar interfaces e abstrações que não precisam existir.
95.958estrelas no GitHubReasonix leva agente de código DeepSeek ao terminal e soma 30 mil estrelas
Agente aberto em Go combina CLI, desktop e VS Code com cache de prefixo para sessões longas.
30.858estrelas no GitHubOpenAI abre ferramenta de segurança e acende debate sobre o scanner
CLI e SDK analisam código, validam falhas e integram modelos externos, mas o debate mira o que existe além da varredura.
597pontos no Hacker NewsAlibaba abre code review com agente LLM testado em 15 mil estrelas
A ferramenta nasceu interna, serviu dezenas de milhares de devs e agora roda via CLI com modelo configurável.
15.476estrelas no GitHub
Infraestrutura e MLOps
Forge, criado em junho, já soma 95 estrelas no GitHub
O projeto open source permite montar agentes e workflows visualmente, com execução na infraestrutura do usuário.
95estrelas no GitHubFareedKhan-dev roda Kimi K3 de 2.78 trilhões em uma CPU
Motor em C99 faz inferência local com 8.24 GB de RAM, sem GPU, BLAS ou framework.
2.071estrelas no GitHubOmniRoute, de diegosouzapw, conecta 500 modelos em um gateway
Projeto criado em 2026-02-13 reúne 290+ provedores e oferece mais de 90 opções gratuitas em um único endpoint.
39.752estrelas no GitHub
IA Local e Self-Hosted
lyogavin roda modelo Kimi K3 de 2.8T em GPU de 4 GB
Projeto aberto reduz o uso de VRAM ao carregar apenas os especialistas necessários para cada token.
28.442estrelas no GitHubOpenWorker roda no desktop e entrega trabalho pronto, não só chat
Projeto de 8 dias já passa de 9,9 mil estrelas no GitHub e roda com modelos locais ou chaves próprias
9.969estrelas no GitHubai4s-research lança Open Science Desktop: bancada local de pesquisa com 1 mil estrelas
Ferramenta roda loop completo de ciência na máquina do usuário sem enviar dados para nuvem.
1.016estrelas no GitHub