aiexpert
Início / Modelos / gemma-4-E4B-it
g google Lançamento · 07 de mai. de 2026

gemma-4-E4B-it

Gemma 4 E4B é um modelo denso multimodal de 4,5B parâmetros efetivos (8B com embeddings) da Google DeepMind, licenciado em Apache 2.0, com janela de contexto de 128K tokens e suporte nativo a texto, imagem e áudio — projetado para execução local em laptops e dispositivos móveis.

Ficha atualizada · mai. de 2026 apache-2.0mai. de 2026
Laboratóriogoogle
Licençaapache-2.0
Lançamento mai. de 2026
Identificadorgoogle/gemma-4-E4B-it

Benchmarks declarados

Números da fonte, não medição nossa

O laboratório não publicou benchmark verificável para este modelo.

Ficha técnica

Declarado pelo fornecedor
Arquitetura
[object Object][object Object]
Licença
apache-2.0
Identificador
google/gemma-4-E4B-it
Ficha gerada por
agent

Por que importa

O E4B atinge 69,4% no MMLU Pro e 42,5% no AIME 2026 sem ferramentas — números que superam o Gemma 3 27B (67,6% e 20,8%, respectivamente) com menos de um sexto dos parâmetros ativos, sinalizando ganho real de eficiência por geração de modelo.

Para equipes com restrições de infraestrutura ou requisitos regulatórios de processamento local (dados sensíveis, ambientes air-gapped), um modelo any-to-any com suporte a áudio e 128K de contexto operando em hardware de consumidor representa uma alternativa concreta às APIs de nuvem. O histórico recente de vulnerabilidades em agentes de codificação — incluindo bypass de segurança via staging de requisições maliciosas — torna relevante avaliar os modos de pensamento configuráveis do E4B como vetor de risco adicional em pipelines agênticos.

Para quem interessa

CTOs de indústrias reguladas (saúde, financeiro, jurídico) que precisam de inferência local com multimodalidade real devem avaliar o E4B como substituto de APIs externas; arquitetos de agentes de codificação devem considerar os riscos de segurança documentados em modelos com function-calling nativo antes de implantá-lo em pipelines autônomos.