Evite estouros de contexto (HTTP 400), economize 60% a 90% em faturamento de tokens e mantenha sessões de conversação e programação infinitas sem apagar nomes de código.
from openai import OpenAI
# Redirecione a base_url para o QGAP Context Substrate (Porta 8100)
client = OpenAI(
base_url="http://127.0.0.1:8100/v1",
api_key="sua-chave-do-provedor"
)
response = client.chat.completions.create(
model="meta-llama/llama-3.3-70b-instruct",
messages=[
{"role": "system", "content": "Você é um engenheiro sênior."},
{"role": "user", "content": "Refatore o módulo de autenticação."}
]
)
print(response.choices[0].message.content)