Skip to main content

Visão geral

Modelos de raciocínio são modelos de linguagem avançados otimizados para tarefas complexas de resolução de problemas. Ao gerar etapas detalhadas de raciocínio (cadeia de pensamento), eles melhoram a precisão das respostas em cenários analíticos.

Casos de uso típicos

  • Resolução de problemas complexos: Adequado para tarefas que exigem lógica passo a passo, como raciocínio matemático ou científico.
  • Sistemas de suporte à decisão: Ajuda a explicar a lógica por trás das conclusões ao fornecer processos de raciocínio detalhados.
  • Educação e treinamento: Auxilia os alunos a entender conceitos complexos ao apresentar processos de derivação de forma clara.

Instalação e configuração

Antes de usar modelos de raciocínio, certifique-se de que o SDK mais recente da OpenAI esteja instalado:

Uso da API

Use o endpoint /chat/completions para invocar modelos de raciocínio.

Parâmetros da solicitação

  • max_tokens: Define o número máximo de tokens que o modelo pode retornar.
  • temperature: Recomendado entre 0.5 e 0.7 (sugestão: 0.6) para equilibrar criatividade e lógica.
  • top_p: O valor recomendado é 0.95.

Código de exemplo

Resposta em streaming

Resposta sem streaming


Gerenciamento de contexto

As saídas de raciocínio não são automaticamente transferidas para a próxima rodada de diálogo. Você deve manter manualmente o histórico de mensagens:

Modelos compatíveis

Os seguintes modelos de raciocínio são atualmente compatíveis com a plataforma Novita:

Cobrança

  • A cobrança é baseada no número de tokens tanto para entrada quanto para saída.
  • Consulte a página de preços de cada modelo para regras específicas de cobrança e detalhes de conversão de tokens.

Observações e boas práticas

  • Evite colocar instruções de raciocínio na mensagem system. Em vez disso, deixe a intenção explícita na mensagem user.
  • Para tarefas matemáticas, instrua claramente o modelo, por exemplo: “Please reason step by step and provide a final answer.”
  • Para evitar que o modelo pule etapas de raciocínio, considere solicitar uma quebra de linha antes da resposta final.
Última modificação em 15 de maio de 2026