Gemma: Modelos Abertos Baseados na Pesquisa e Tecnologia do Gemini

Resumo

Este trabalho apresenta a Gemma, uma família de modelos abertos leves e de última geração, desenvolvidos a partir da pesquisa e tecnologia utilizadas para criar os modelos Gemini. Os modelos Gemma demonstram um desempenho robusto em benchmarks acadêmicos para compreensão de linguagem, raciocínio e segurança. Lançamos dois tamanhos de modelos (2 bilhões e 7 bilhões de parâmetros) e disponibilizamos checkpoints tanto pré-treinados quanto ajustados. A Gemma supera modelos abertos de tamanho semelhante em 11 de 18 tarefas baseadas em texto, e apresentamos avaliações abrangentes dos aspectos de segurança e responsabilidade dos modelos, juntamente com uma descrição detalhada do desenvolvimento do modelo. Acreditamos que o lançamento responsável de LLMs (Modelos de Linguagem de Grande Escala) é crucial para melhorar a segurança dos modelos de fronteira e para impulsionar a próxima onda de inovações em LLMs.

English

This work introduces Gemma, a family of lightweight, state-of-the art open models built from the research and technology used to create Gemini models. Gemma models demonstrate strong performance across academic benchmarks for language understanding, reasoning, and safety. We release two sizes of models (2 billion and 7 billion parameters), and provide both pretrained and fine-tuned checkpoints. Gemma outperforms similarly sized open models on 11 out of 18 text-based tasks, and we present comprehensive evaluations of safety and responsibility aspects of the models, alongside a detailed description of model development. We believe the responsible release of LLMs is critical for improving the safety of frontier models, and for enabling the next wave of LLM innovations.

Gemma: Modelos Abertos Baseados na Pesquisa e Tecnologia do Gemini

Gemma: Open Models Based on Gemini Research and Technology

Resumo

Support