Última atualização: 2025-12-03
Status: Suportado (compatível com OpenAI)
1. Visão geral
Pensamento Intercalado é uma estrutura avançada de raciocínio que permite que os modelos realizem etapas explícitas de raciocínio entre chamadas de ferramentas. Modelos com Pensamento Intercalado podem:- Refletir sobre o ambiente atual e as saídas das ferramentas
- Decidir a próxima ação com base em raciocínio atualizado
- Manter uma cadeia contínua de raciocínio em várias invocações de ferramentas
- Fornecer pensamento transparente, inspecionável e em várias etapas por meio de
reasoning_detailsoureasoning_content
2. Conceitos principais
2.1 Intercalação
Em vez de executar uma única fase de raciocínio seguida por uma chamada de ferramenta, o modelo realiza:2.2 Detalhes de raciocínio (reasoning_details)
Para alguns modelos, o conteúdo do pensamento do modelo será retornado na forma de uma estrutura separada:
2.3 Requisito de memória de conversa
Para manter a continuidade do raciocínio: você deve anexar a resposta completa do modelo, incluindoreasoning_details, tool_calls e content, aos messages subsequentes.
Não preservar a cadeia pode resultar em:
- Uso incorreto de ferramentas
- Perda de contexto de raciocínio
- Chamadas de ferramentas repetidas ou circulares
- Confiabilidade reduzida
3. Comportamento da API
3.1 Formato da requisição
Nenhuma alteração é necessária do lado do usuário. O Pensamento Intercalado funciona com a API Chat Completions padrão compatível com OpenAI.3.2 Formato da resposta
O modelo pode retornar os seguintes campos:reasoning_content: conteúdo original do pensamentoreasoning_details: segmentos estruturados de raciocínio; este campo é opcionaltool_calls: plano de invocação de ferramentascontent: saída em linguagem natural
4. Exemplo de requisição (MiniMax-M2)
5. Exemplo de resposta (Non-Streaming)
6. Exemplo de resposta em streaming
7. Observações para desenvolvedores
7.1 Modelos que oferecem suporte a Pensamento Intercalado
Todos os modelos que expõemreasoning_details por meio de APIs compatíveis com OpenAI, incluindo:
- MiniMax-M2
- (Em breve) Novita Reasoning Series
- Outros modelos de parceiros com raciocínio habilitado
7.2 Preços
O faturamento é baseado em tokens de raciocínio, seguindo as regras de preços do modelo.reasoning_details aumentará o uso de tokens.
7.3 Tratamento de erros
Você pode encontrar:- Parâmetros de ferramentas ausentes
- Chamadas de ferramentas recursivas ou repetidas
- Suposições incorretas na fase de raciocínio
8. Melhores práticas
✓ Sempre inclua as mensagens completas do modelo na próxima requisição Inclua:contenttool_callsreasoning_details
- Monitore o processo de raciocínio
- Detecte planos de ferramenta incorretos antecipadamente
- Forneça feedback mais rápido ao usuário
- Validadores de parâmetros
- Sandbox de execução
- Proteções contra recursão máxima
9. Resumo
O Pensamento Intercalado aprimora significativamente o raciocínio em várias etapas e a confiabilidade do uso de ferramentas:- Raciocínio passo a passo transparente e inspecionável
- Planejamento adaptativo entre invocações de ferramentas
- Retenção de contexto mais forte em fluxos de trabalho longos
- Totalmente compatível com a API Chat Completions no estilo OpenAI