aiexpert
Home / Radar
Volume 01 · May 2026

Tech Radar

What to adopt, trial, assess, or hold when building with AI in production. Following the Thoughtworks radar model — four rings, cited evidence per blip, and movement history across volumes.

47Blips
16In Adopt
44New

Esta é a primeira edição do Radar ai|expert — mapa de como AI architects shipping em produção devem pensar sobre stack hoje. Onze zones cobrem do modelo até compliance; quatro rings (Adopt, Trial, Assess, Hold) marcam o nível de confiança pra adotar. O que separa Adopt de Trial neste volume: evidência de produção em múltiplas empresas notáveis, com números operacionais disponíveis publicamente. É um filtro deliberadamente apertado — capability theater não passa. Padrões que dominam o volume: Claude e GPT entram em Adopt no frontier; Llama 4 e Qwen 3 lideram open-weights; vLLM e SGLang continuam como default de inference; MCP virou padrão de integração tool-use cross-vendor; pgvector + Pinecone seguem a divisão self-hosted/managed em RAG. O que está em Hold tem mais a ver com mindshare migrando do que com falha técnica — Chroma e CrewAI ainda funcionam, mas alternativas com mais momentum capturaram a comunidade. Próximo volume sai em Julho/2026, com o radar-analyst agent rodando bimensalmente pra refrescar evidências e propor movimentos.

The map

Click a quadrant to zoom in
ADOPT TRIAL ASSESS HOLD Models 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 Platforms 22 23 24 25 26 27 28 29 30 31 32 Tooling & Agents 33 34 35 36 37 38 39 Practices & Data 40 41 42 43 44 45 46 47 Models Platforms Tooling & Agents Practices & Data

All blips

Adopt

Claude Opus 4.8

Anthropic — flagship maduro pós-4.7: preço cortado, ganho de agentic, long-context 1M. É o fallback de segurança do Fable 5.

Models · Frontier · New
Adopt

Llama 4

Meta — referência de open-weights, ecossistema de fine-tuning + serving mais maduro.

Models · Open-weights · New
Adopt

Qwen 3

Alibaba — open-weights com tool use e código competitivos com fronteira fechada.

Models · Open-weights · New
Adopt

Whisper v4

OpenAI — referência pra transcrição multilíngua, qualidade próxima de humano para áudio limpo.

Models · Specialised · New
Trial

GPT-5.5

OpenAI — iteração sobre a linha GPT-5.x, ~2× o preço do 5.4; ecossistema de tooling segue o mais maduro da turma.

Models · Frontier · New
Trial

GPT-5.5 Instant

OpenAI — novo default GA (substitui 5.3 Instant; API 'chat-latest'). −52,5% alucinações vs 5.3 Instant em prompts de alto risco; reasoning effort none→xhigh.

Models · Frontier · New
Trial

Gemini 3.5 Pro

Google — sucessor da linha 3.x; long-context e multimodal nativo (vídeo/áudio/PDF) seguem como diferencial.

Models · Frontier · New
Trial

Grok 4

xAI — capacidades fortes em reasoning e código, ainda inconsistente em tool use e safety.

Models · Frontier · New
Trial

DeepSeek R2

DeepSeek — reasoning model open-weights com chain-of-thought explícito, custo por token muito baixo.

Models · Open-weights · New
Trial

Gemma 4

Google open-weights — quantizações nativas (INT4/MX), bom equilíbrio capacidade/custo pra small models.

Models · Open-weights · New
Trial

Cohere Rerank v3

Cohere — reranker dedicado pra RAG, ganho de qualidade mensurável sobre re-ranking com LLM.

Models · Specialised · New
Trial

Imagen 4

Google — text-to-image com qualidade fotorrealista forte, recurso comercial via GCP.

Models · Specialised · New
Trial

Voyage 3 embeddings

Voyage AI — embedding model com qualidade no topo dos benchmarks, recomendado pela Anthropic.

Models · Specialised · New
Assess

Claude Fable 5

Anthropic — primeiro modelo público da classe Mythos (09/jun/2026). SOTA em quase todos os benchmarks, mas com hard safety limits.

Models · Frontier · New
Assess

GPT-5.6 Luna

OpenAI — variante 5.6 mais rápida/barata p/ trabalho cotidiano (sumarização, rascunho, automação). Desempenho perto do GPT-5.5; preview limitado.

Models · Frontier · New
Assess

GPT-5.6 Sol

OpenAI — topo da família 5.6 (preview limitado). Coding e security research, novo reasoning 'max' e modo 'ultra' com subagentes; SOTA em Terminal-Bench 2.1. Preço $5/$30 por M (= GPT-5.5).

Models · Frontier · New
Assess

GPT-5.6 Terra

OpenAI — variante 5.6 para alto volume (atendimento, ferramentas internas, análise de documentos). Novos recordes de benchmark; preview limitado.

Models · Frontier · New
Assess

Phi-4

Microsoft — small model treinado em dados sintéticos curados, performance acima do peso em raciocínio.

Models · Open-weights · New
Hold

Claude 4.7 (Opus)

Flagship Anthropic — best frontier model for agentic workflows com long-context (1M tokens) e tool use confiável.

Models · Frontier · Moved out
Hold

GPT-5

OpenAI flagship — capacidade multimodal forte, reasoning competitivo, ecossistema mais maduro de tooling.

Models · Frontier · Moved out
Hold

Gemini 2.5 Pro

Google — 2M context window, multimodalidade nativa (vídeo + áudio + PDF), preço agressivo.

Models · Frontier · Moved out
Adopt

SGLang

Inference engine focado em structured generation e workloads agentic com cache de prefix agressivo.

Inference · New
Adopt

llama.cpp

C++ runtime referência pra inference em CPU + Apple Silicon + edge devices.

Inference · New
Adopt

vLLM

Inference engine open-source default pra serving LLM — PagedAttention + continuous batching.

Inference · New
Adopt

AWS Bedrock

AWS — multi-model gateway gerenciado, governance forte, residency e compliance enterprise-grade.

Infra & Compute · New
Trial

EU AI Act Article 6 trackers

Ferramentas pra classificar sistemas AI segundo categorias de risco do AI Act — obrigatório UE a partir de 2026.

Compliance & Legal · New
Trial

TensorRT-LLM

NVIDIA — máxima performance em hardware NVIDIA, mas configuração e build process complexos.

Inference · New
Trial

Modal

Serverless GPU compute — define funções Python que rodam em GPU, billing por segundo.

Infra & Compute · New
Trial

Together AI

Inference platform pra open-weights — preços competitivos, latência boa, fine-tuning managed.

Infra & Compute · New
Trial

Vercel AI Gateway

Vercel — gateway unificado pra LLMs com fallback, caching, observability built-in.

Infra & Compute · New
Assess

Model Cards 3.0

Spec atualizada pra documentação de modelos — agora cobre training data lineage, intended use, limitações.

Compliance & Legal · New
Assess

MLX

Apple — framework de ML otimizado pra unified memory do Apple Silicon, performance impressionante em M-series.

Inference · New
Adopt

Claude Agent SDK

Anthropic — SDK first-party pra agentes Claude, tool use + multi-step nativos, mais robusto que LangChain.

Orchestration & Agents · New
Adopt

Claude Code

CLI agente terminal-first da Anthropic — adopted rápido por times de engenharia em 2025-2026.

Tooling & DX · New
Adopt

Cursor

IDE AI-first — fork VSCode com integração profunda de model context, tab autocomplete melhor da turma.

Tooling & DX · New
Adopt

MCP (Model Context Protocol)

Protocolo padrão pra integrar contextos externos com LLMs — adopted pela Anthropic, OpenAI, Cursor, etc.

Tooling & DX · New
Trial

LangGraph

LangChain — DAG-based orchestration pra agentes multi-step com state explícito.

Orchestration & Agents · New
Trial

OpenAI Agents SDK

OpenAI — SDK first-party pra agents GPT, lançado em 2025, ainda evoluindo mas com momentum.

Orchestration & Agents · New
Hold

CrewAI

Multi-agent framework — interesse caiu conforme padrões nativos (Claude Agent SDK, OpenAI Agents) maduraram.

Orchestration & Agents · New
Adopt

Braintrust

Eval framework + observability pra LLM apps, integração tight com workflows de development.

Eval & Observability · New
Adopt

Langfuse

LLM observability open-source self-hostable — alternativa robusta a Braintrust/LangSmith.

Eval & Observability · New
Adopt

Pinecone

Vector DB managed — escala 100M-bilhões de vectors com QPS alto e latência consistente.

RAG & Data · New
Adopt

pgvector

Vector extension pra Postgres — default pra qualquer RAG que não precise de escala massiva.

RAG & Data · New
Trial

LlamaParse

LlamaIndex — parser de PDF/documentos complexos com qualidade superior a alternatives open-source.

RAG & Data · New
Trial

Lakera Guard

Guardrails managed contra prompt injection, jailbreaks, PII leakage — API simples.

Safety & Governance · New
Assess

NeMo Guardrails

NVIDIA — framework open-source pra guardrails programáveis via Colang, abordagem flexível mas verbosa.

Safety & Governance · New
Hold

Chroma

Vector DB — perdeu mindshare pra pgvector (self-hosted) e Pinecone (managed) em 2025.

RAG & Data · New