POST
/v1/chat/completionsChat completions
Envie um array de messages com papéis system, user e assistant e receba a próxima resposta do modelo. Todos os modelos da família Sinapse 2 foram treinados com foco em português brasileiro.
Parâmetros do corpo
| Parâmetro | Tipo | Obrigatório | Descrição |
|---|---|---|---|
| model | string | sim | ID do modelo. Ex: sinapse-2-pro, sinapse-2-flash. |
| messages | object[] | sim | Histórico da conversa com role e content. |
| max_tokens | number | não | Limite de tokens da resposta. Padrão: 1024. |
| temperature | number | não | Aleatoriedade entre 0 e 2. Padrão: 0.7. |
| stream | boolean | não | Ativa resposta em chunks SSE. Padrão: false. |
Exemplo de requisição
curl -X POST https://api.sinapse.dev/v1/chat/completions \
-H "Authorization: Bearer $SINAPSE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "sinapse-2-pro",
"messages": [
{ "role": "system", "content": "Você é um assistente conciso." },
{ "role": "user", "content": "Explique embeddings em uma frase." }
],
"max_tokens": 200
}'Resposta · 200 OK
{ "id": "cmpl_8xk2w94q", "model": "sinapse-2-pro", "choices": [ { "index": 0, "message": { "role": "assistant", "content": "Embeddings são vetores que capturam o significado de um texto." }, "finish_reason": "stop" } ], "usage": { "prompt_tokens": 28, "completion_tokens": 16, "total_tokens": 44 } }
Playground · resposta com streaming
sandboxsinapse-2-flash
A resposta do modelo aparecerá aqui, token a token.
Modelos disponíveis
| Modelo | Contexto | Entrada / 1M | Saída / 1M | Velocidade |
|---|---|---|---|---|
sinapse-2-pro Raciocínio avançado, visão e código | 200k | R$ 12.50 | R$ 50.00 | 55 |
sinapse-2-flash Melhor custo-benefício para produção | 128k | R$ 1.80 | R$ 7.20 | 88 |
sinapse-2-nano Classificação e tarefas simples em escala | 32k | R$ 0.40 | R$ 1.60 | 100 |
sinapse-embed-1 Embeddings de 1536 dimensões | 8k | R$ 0.25 | — | 95 |