
LucasVocê chama o Gemini 3.6 Flash pela API Gemini usando o ID de modelo gemini-3.6-flash. O Google lançou...
Você chama o Gemini 3.6 Flash pela API Gemini usando o ID de modelo gemini-3.6-flash. O Google lançou a atualização Flash em 21 de julho de 2026, e o 3.6 Flash é a camada principal: menor custo de saída que o 3.5 Flash, janela de contexto de 1M de tokens e suporte a texto, imagem, vídeo, áudio e PDF como entrada. Neste guia, você vai obter uma chave, testar a primeira chamada com curl e Python, configurar parâmetros e criar um teste de regressão para monitorar a integração.
Prepare estes três itens:
curl, Python ou um cliente de API como o Apidog.Você não precisa configurar faturamento para começar. A camada gratuita do AI Studio permite testar a API, embora tenha limites de taxa.
Não coloque a chave no frontend nem a envie para um repositório. Defina-a como variável de ambiente:
export GEMINI_API_KEY="sua_chave_aqui"
O SDK oficial do Python lê essa variável automaticamente. Para as etapas oficiais de configuração, consulte a documentação da API Gemini do Google.
A API REST usa o método generateContent. Teste com curl:
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
-H "x-goog-api-key: SUA_CHAVE_API" \
-H "Content-Type: application/json" \
-X POST \
-d '{
"contents": [
{
"parts": [
{"text": "Explique como as APIs funcionam"}
]
}
]
}'
Pontos importantes da requisição:
x-goog-api-key.contents para representar o conteúdo da conversa.contents possui um array parts.text.Essa estrutura também permite combinar texto, imagens e arquivos na mesma chamada.
Instale o SDK:
pip install google-genai
Crie um arquivo, por exemplo gemini.py:
from google import genai
client = genai.Client() # lê GEMINI_API_KEY do ambiente
resp = client.models.generate_content(
model="gemini-3.6-flash",
contents="Explique como as APIs funcionam",
)
print(resp.text)
O valor de resp.text contém o texto gerado. A resposta HTTP completa é JSON, e o texto normalmente está em:
candidates[0].content.parts[0].text
Guarde esse caminho: ele será útil para validar respostas em testes automatizados.
A chamada mínima funciona, mas estes parâmetros ajudam a controlar comportamento, custo e formato da saída.
parts. A saída é apenas texto.Consulte a documentação da API Gemini para os nomes e formatos atuais dos campos. Não adivinhe parâmetros: a documentação é a fonte de verdade.
O Gemini 3.6 Flash custa:
A taxa de saída é menor que os US$ 9,00 cobrados pelo 3.5 Flash. Além disso, o 3.6 Flash tende a gerar cerca de 17% menos tokens de saída para a mesma tarefa.
Atenção: o preço de saída inclui tokens de pensamento. Um prompt que exige raciocínio intenso pode custar mais do que o tamanho visível da resposta indica. Para calcular cenários de custo, consulte o guia de preços do Gemini 3.6 Flash.
A camada gratuita funciona pelo AI Studio, mas tem limites por minuto e por dia. O Google também pode usar dados dessa camada para melhorar seus produtos. Use-a para aprendizado, protótipos e testes iniciais; não para tráfego de produção.
Veja mais detalhes em como usar o Gemini 3.6 Flash gratuitamente. Quando precisar de mais capacidade, habilite o faturamento: a mesma chave continua funcionando e você não precisa alterar o código.
O curl confirma que uma chamada funciona naquele momento. Mas ele não monitora mudanças no formato da resposta, expiração de chave ou falhas introduzidas por uma implantação.
Para isso, crie um teste repetível no Apidog.
POST. https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent
x-goog-api-key: {{GEMINI_API_KEY}}
{
"contents": [
{
"parts": [
{
"text": "Explique como as APIs funcionam"
}
]
}
]
}
GEMINI_API_KEY no Apidog e armazene a chave nela.Assim, o segredo não fica salvo na requisição compartilhada e você pode usar valores diferentes para ambientes como desenvolvimento, staging e produção.
Depois de executar a requisição, valide:
200.candidates[0].content.parts[0].text existe.Essas verificações confirmam que a API não apenas respondeu, mas retornou conteúdo no formato esperado pela aplicação.
Mantenha a requisição em uma coleção e agende-a como teste de regressão. Execute-o periodicamente ou no CI para detectar falhas antes que elas cheguem aos usuários.
Baixe o Apidog para criar e executar esse teste. O Apidog não executa o modelo: ele ajuda a garantir que a API Gemini continue respondendo como sua aplicação espera.
A chave está ausente, inválida ou revogada.
Verifique:
x-goog-api-key.Em clientes de API, confira se {{GEMINI_API_KEY}} foi resolvido antes de enviar a requisição.
Você atingiu o limite de taxa da camada gratuita.
Para resolver:
Normalmente, isso indica um ID de modelo incorreto.
Use exatamente:
gemini-3.6-flash
Não use gemini-3.5-flash nem gemini-flash-3.6. O modelo gemini-3.5-flash-lite pertence à linha 3.5 e é um modelo diferente.
Qual é o ID exato do modelo Gemini 3.6 Flash?
Use gemini-3.6-flash no SDK e no caminho REST antes de :generateContent.
A API Gemini 3.6 Flash é gratuita?
Existe uma camada gratuita no AI Studio com limite de taxa. Ela é adequada para prototipagem e aprendizado. Para produção, habilite o faturamento. Consulte como usar gratuitamente.
O que posso enviar ao modelo?
Texto, imagens, vídeo, áudio e PDFs, até o limite de contexto de 1M de tokens. A saída é somente texto.
Por que o custo é maior que o texto visível na resposta?
O preço de saída inclui tokens de pensamento. Prompts que exigem raciocínio intenso podem consumir mais tokens do que a resposta exibida.
A chamada é igual à da API Gemini 3.5 Flash?
A estrutura da chamada é a mesma. Se você já usou a API Gemini 3.5, basta trocar o ID do modelo. O 3.6 Flash reduz o preço de saída e tende a usar menos tokens para a mesma tarefa.
Posso usar a mesma chave em curl, Python e Apidog?
Sim. Uma chave criada no AI Studio funciona nas três opções. Armazene-a como variável de ambiente em cada ferramenta para facilitar rotação e revogação.
Você já tem o necessário para integrar o Gemini 3.6 Flash:
curl.Comece pela camada gratuita, mantenha a chave fora do código e use a documentação oficial como referência para recursos avançados. Quando essa chamada se tornar crítica para seu produto, monitore-a com um teste no Apidog.