Esta página foi traduzida automaticamente do inglês e pode estar desatualizada. Leia o original
Logs de alterações
Alterações técnicas que afetam produtos, serviços ou a API pública da AIVAX. As datas indicam quando as entradas foram adicionadas ou atualizadas, não datas confirmadas de implantação em produção. Cada item identifica o produto ou serviço afetado; manutenção sem efeito visível ao usuário é omitida.
Quinta-feira, 8 de outubro de 2026 #
Alterações:
- Documentation — New Learn section. O site de documentação agora inclui Learn, um conjunto de 11 módulos e 63 unidades curtas que explicam agentes de IA desde os primeiros conceitos até a produção para leitores sem formação em computação: o que é um agente, modelos de linguagem, prompts e contexto, seleção e parâmetros de modelo, ferramentas e integrações, conhecimento e RAG, fluxos avançados, avaliação e observabilidade, segurança e conformidade, custo e escala, e estudos de caso práticos. As unidades incluem exemplos interativos, tutoriais passo a passo, tabelas comparativas, gráficos e quizzes curtos, e cada uma pode ser marcada como concluída no navegador. Três caminhos de aprendizado sugeridos (Iniciante, Desenvolvedor, Negócio) agrupam os módulos por objetivo. Learn está disponível em inglês e português e está incluído na busca do site.
- Models — Claude Haiku 5.5 added. Adiciona
@anthropic/claude-5.5-haiku(Claude Haiku 5.5), sucessor direto do Claude Haiku 4.5, ao catálogo de modelos de texto. Suporta entrada de imagem e arquivo e chamada de ferramentas, com janela de contexto de 1 M de tokens. O alias@model-router/claude:budgetagora seleciona Claude Haiku 5.5, substituindo Claude Haiku 4.5. Aplicações que usam esse alias podem observar mudanças na qualidade da resposta, latência e custo. Identificadores de modelo explícitos existentes permanecem inalterados. - Inference — Provider selection with
routing_options. As conclusões de chat aceitamrouting_optionscompreset(Balanced,Cheapest,FastestouQuality) eallowed_providers, uma lista ordenada de tags de provedores como["azure-us", "azure-eu", "*"]. A AIVAX tenta cada tag na ordem e passa para a próxima somente quando nenhum provedor correspondente está disponível;"*"corresponde a qualquer provedor.allowed_providerstem padrão["*"], e uma lista vazia é rejeitada. Sem"*", a requisição falha quando nenhum dos provedores listados está disponível.routing_presetestá obsoleto: ainda funciona, mas userouting_options.preset. Gateways de IA aceitam a mesma lista ordenada emparameters.allowedProviders(padrão["*"]), editável no editor de gateway sob Allowed providers para modelos integrados; valores de requisição substituem isso apenas para a requisição. Veja Provider routing. - Inference — Serving provider in responses. Respostas de conclusão de chat e cada bloco transmitido incluem um campo
providerao lado demodelcom a tag do provedor que atendeu ao modelo integrado. Énullpara gateways que usam suas próprias credenciais de provedor. - Models —
filteronGET /v1/models. A lista de modelos aceita um parâmetro de consulta opcionalfiltercom um nome de modelo e retorna apenas as entradas correspondentes: o nome exato ou seus snapshots datados, ordenados da correspondência mais próxima. Sem ele, a lista permanece inalterada. - Models — Provider tags. Os detalhes do provedor na página de Modelos do painel mostram a tag de cada provedor com um botão de copiar, e
GET /v1/modelsa devolve comotagem cada entrada de provedor. Endpoints de provedor em diferentes regiões ou variantes têm tags distintas, comoazure-useazure-eu.
Quarta-feira, 7 de outubro de 2026 #
Alterações críticas:
- Inference —
FileandOtherFilespre-processing now cover every file. Gateways e requisições que habilitam apenas a flag multimodalOtherFilesagora convertem arquivos PDF com OCR ao invés de enviá‑los ao modelo principal sem alterações. Aqueles que habilitam apenas a flagFileagora convertem arquivos não‑PDF com OCR também, sendo cobrados em Unidades de Processamento. Gateways e requisições com ambas as flags ouAllnão são afetados. Para deixar arquivos inalterados, definamultimodal_resolver(oumultimodalResolverParametersdo gateway) sem umfileEngine; nenhum tipo de arquivo será pré‑processado.
Alterações:
- Inference — Per-media multimodal resolver engines. As conclusões de chat aceitam
multimodal_resolver, e gateways de IA aceitammultimodalResolverParameters, com camposimageEngine,audioEngine,videoEngineefileEngine. Cada um seleciona como aquele tipo de conteúdo é convertido em texto antes da inferência:InferenceLow(modelo multimodal menor;Inferenceé um alias),InferenceHigh(modelo multimodal maior e mais preciso, com custo maior),Ocrpara imagens e arquivos (cobrado em Unidades de Processamento, como Fetch e OCR), ouSttpara áudio (speech‑to‑text, cobrado por segundo). OCR aceita URIs de dados base64 e URLs públicas. Resultados de cada motor são armazenados em cache por conteúdo e motor, de modo que mídia repetida não é cobrada novamente. As flagsmultimodal_preprocesse a configuraçãoenabledMultimodalFeaturesdo gateway estão obsoletas, mas continuam funcionando com os motores equivalentes; as novas configurações prevalecem quando presentes. O editor de gateway agora configura um motor por tipo de conteúdo. Veja Multimodal pre-processing. - RAG — Document filters in the Collections MCP and the gateway query tool. A ferramenta de busca do Collections MCP e a ferramenta
querydos gateways de IA que usam a estratégia de consultaQueryFunctionaceitam um argumento opcionalfiltercom a mesma sintaxe do campofilterda busca semântica, comotags has "faq" and updatedAt >= now-30d. Filtros são aplicados antes que os termos de busca sejam incorporados; quando nenhum documento corresponde, a ferramenta retorna nenhum resultado sem cobranças de incorporação ou busca. Um filtro inválido é retornado ao modelo como erro de ferramenta. O RAG automático de gateway ainda não aplica filtros. Veja Document Filters.
Terça-feira, 6 de outubro de 2026 #
Alterações:
RAG — Faster text segmentation without sanitization. Requisições
POST /api/v1/generations/segmentcomsanitizeomitido oufalsenão usam mais um modelo de linguagem. Os limites agora são escolhidos a partir da estrutura do documento (títulos, listas, tabelas, blocos de código, parágrafos e finais de frase) e da similaridade semântica de trechos vizinhos, visando segmentos de aproximadamente 300 tokens. Os segmentos cobrem todo o documento na ordem de origem sem sobreposição e mantêm quebras de linha originais; um limite pode cair no final de uma frase dentro de uma linha. Documentos de cerca de 300 tokens ou menos são retornados como um único segmento. O formato da resposta, cotas e preço por token permanecem inalterados;usage.processing_unitsagora relata os tokens dos documentos submetidos. Requisições comsanitize: truemantêm o comportamento anterior. Veja Text segmentation.Models — Six new semantic decision models. Adiciona
@upstage/solar-decide(Upstage Solar Decide),@cloudflare/clef(Cloudflare Clef),@cloudflare/clef-flash(Cloudflare Clef Flash),@liquid/d1(LiquidAI d1),@perplexity/pplx-decider-v1-27b(Perplexity Decider V1 27B) e@openai/gpt-6-luna-decisions(OpenAI GPT-6 Luna Decisions) ao catálogo de decisões semânticas. Todos seis suportam perguntasnoul,choiceescoreviaPOST /api/v1/generations/decisionse são cobrados por token de entrada nas tarifas publicadas, sem cobrança de token de saída, com ajustes de conta e plano existentes ainda aplicáveis. Eles não são cobertos pela cota diária de decisões semânticas, que permanece limitada ao Julia‑1. Identificadores de modelo existentes permanecem inalterados. Veja Semantic decisions e Pricing.
Segunda-feira, 5 de outubro de 2026 #
Alterações críticas:
- Chat clients — Current date and time are no longer added to the instructions. Integrações de Telegram e WhatsApp, incluindo mensagens agendadas, não adicionam mais a data e hora do servidor às instruções do modelo. Modelos devem obter a hora atual de uma ferramenta. Para manter comportamento dependente de data, como lembretes, habilite a função embutida de data e hora ou o shell (
date) no gateway de IA usado pelo cliente de chat. - Account — Reseller plan renamed to Custom. Contas no plano Reseller agora reportam o plano como
Customao invés deResellernas respostas da API, como no endpoint de saldo, e no cabeçalho de respostaX-Authenticated-Account-Plan. Integrações que comam o nome do plano comResellerdevem aceitarCustom. Contas Custom podem ter limites de taxa definidos como múltiplo dos limites do plano Pro; contas sem múltiplo configurado permanecem sem limites de taxa de plano. Veja Plans and Limits.
Correções:
AI gateways — Shell tool commands without parameters now run. No shell do gateway, chamar uma ferramenta que não tem parâmetros, como
list_scheduled_jobs, agora a executa ao invés de imprimir sua ajuda. Use--helppara visualizar a ajuda.Collections — De-duplication no longer stops before removing documents. Uma tarefa de desduplicação que encontrou documentos duplicados podia parar com zero documentos removidos e sem arquivos de backup, porque a gravação do backup dos documentos removidos falhava. Essas tarefas agora salvam os arquivos de backup, removem os duplicados e incluem os links de download na notificação de conclusão. Tarefas que pararam dessa forma não removeram nenhum documento; inicie uma nova tarefa para tentar novamente.
Alterações:
- Conversations — Provider and routing details. Conversas agora registram o provedor que atendeu à resposta mais recente, sua política de coleta de dados, a variante do modelo (
fast,flexoupriority) quando usada, e a opção de roteamento usada para selecionar o provedor. O endpoint View Conversation os devolve nos camposproviderName,providerDataCollection,modelVarianteroutingOption, e o endpoint List Conversations devolveproviderName,modelVarianteroutingOption. Esses campos sãonullpara gateways que usam suas próprias credenciais de provedor e para conversas armazenadas antes desta mudança. A lista de conversas no painel mostra colunas Provider, Routing e Variant; Provider mostra BYOK quando nenhum provedor foi registrado. A tabela tem rolagem horizontal, e as ações da linha permanecem visíveis. - AI gateways — Time zone and culture for the shell. As opções do shell do gateway aceitam
timeZone, um fuso horário IANA comoAmerica/Sao_Paulo, eculture, comopt-BR. O comandodateusa o fuso horário para sua saída e para datas sem deslocamento explícito, e usa a cultura para nomes de dias e meses. Os padrões permanecem UTC e cultura invariável;date -usempre imprime UTC. - RAG — Document filters for semantic search and answer generation. Os endpoints de busca semântica e geração de respostas aceitam um campo opcional
filterque restringe a busca a documentos que correspondam a condições sobre nome, conteúdo, tags, datas de criação e atualização ou metadados, comotags has "finance" and createdAt >= now-30d. O campo aceita uma string ou um array de strings combinadas comand. Filtros são aplicados antes que os termos de busca sejam incorporados; quando nenhum documento corresponde, a requisição retorna um resultado vazio sem cobranças de incorporação ou busca. Filtros inválidos retornam400 Bad Requestcom a posição do erro. Filtros ainda não estão disponíveis no RAG de gateway de IA ou no Collections MCP. Veja Document Filters. - RAG — Filters and visual results in the collection playground. O playground de coleção tem uma seção Filters onde cada linha é um filtro de documento; todas as linhas devem corresponder e são enviadas como o array
filter. Resultados podem ser visualizados como Visual, mostrando a resposta gerada e cada documento com sua pontuação, metadados e documentos referenciados, ou como JSON bruto. O playground agora usa o rerankerrrfpor padrão; ainda é possível escolher outro reranker.
Sábado, 3 de outubro de 2026 #
Alterações:
- Documentation — Updated reading and search experience. A documentação adiciona busca específica por idioma, temas claro e escuro, navegação móvel e um menu de página para visualizar ou copiar Markdown. Agentes de IA podem usar o índice de documentação e arquivos de texto completo. URLs de documentação existentes continuam resolvendo; alguns guias antigos redirecionam para a documentação atual do produto.
Sexta-feira, 2 de outubro de 2026 #
Alterações:
- Models — Claude Sonnet 5.5 and GPT-6.1 Sol added. Adiciona
@anthropic/claude-5.5-sonnet(Claude Sonnet 5.5), sucessor direto do Claude Sonnet 5, e@openai/gpt-6.1-sol(GPT‑6.1 Sol), uma atualização do GPT‑6 Sol, ao catálogo de modelos de texto. Ambos suportam pensamento, entrada de imagem e arquivo e chamada de ferramentas; GPT‑6.1 Sol também suporta saída estruturada. Os aliases@model-router/claude:mide@model-router/openai:midagora selecionam Claude Sonnet 5.5 e GPT‑6.1 Sol, substituindo Claude Sonnet 5 e GPT‑6 Sol, respectivamente. Aplicações que usam esses aliases podem observar mudanças na qualidade da resposta, latência e custo. Identificadores de modelo explícitos existentes permanecem inalterados.
Quinta-feira, 1 de outubro de 2026 #
Alterações críticas:
- API — Error status codes reflect the failure source. Falhas não são mais retornadas todas como
400 Bad Requestpelos endpoints de conta, RAG, web e geração. Requisições inválidas ainda retornam400, e falhas de autenticação, saldo e permissão que antes apareciam como400agora retornam401,402ou403. Falhas inesperadas da AIVAX retornam500 Internal Server Errorcom mensagem genérica, e serviços externos indisponíveis, incluindo provedores de modelo, retornam503 Service Unavailablecom cabeçalhoRetry-After. Em endpoints compatíveis com OpenAI, o código de erro agora éinvalid_request_error,service_unavailableouserver_errorao invés de sempreserver_error. Clientes que tratam toda resposta não‑2xx como erro de requisição devem tentar novamente em respostas500e503, obedecendo aoRetry-After. Veja Troubleshoot the first request.
Correções:
Chat completions — Malformed tool declarations rejected as invalid requests. Requisições cujas entradas
toolstêm campos ausentes ou com tipo errado agora retornam400 Bad Requestao invés de erro de servidor.Gateways — Bash tool reports invalid options to the model. Opções desconhecidas ou valores que não correspondem aos parâmetros de uma ferramenta agora retornam um erro de comando que o modelo pode corrigir, ao invés de falhar a chamada da ferramenta.
Alterações:
- MCP utilities — Media generation MCP. Um novo servidor MCP hospedado em
https://inference.aivax.net/v1/mcp/media-generationexpõelist_models,generate_imageegenerate_speechpara clientes compatíveis com MCP.list_modelsaceita umtypedeimageouaudio; imagens geradas e fala em MP3 são retornadas como URLs públicas. Use o cabeçalho opcionalX-Mcp-Enabled-Toolspara escolher quais ferramentas o cliente vê. Gerações usam a mesma precificação e limites das APIs de Geração de Imagem e Geração de Fala e exigem saldo positivo. Veja Media generation MCP.
Segunda-feira, 28 de setembro de 2026 #
Correções:
Gateways — Bash tool help accepts nullable parameters. Solicitar ajuda para ferramentas cujos parâmetros aceitam múltiplos tipos, incluindo
null, não falha mais ao listar seus argumentos. A ajuda preserva os tipos aceitos e caminhos de parâmetros aninhados. Nenhuma mudança no esquema da ferramenta é necessária.Chat integrations — Failure notifications restored. Conversas em streaming e não‑streaming novamente tentam enviar “System: something went wrong. Please, try again later.” após uma falha de geração irrecuperável, tentativas de recuperação esgotadas ou um turno que não envia mensagem. Uma falha final é relatada mesmo se uma resposta parcial anterior foi entregue. A entrega de notificações ainda depende da disponibilidade do serviço de mensagens.
Alterações:
Gateways / MCP — Server instructions and remote skills. Fontes MCP podem incluir instruções de servidor e documentos de skill raiz junto com ferramentas, incluindo fontes adicionadas por workers. Ambas as opções têm padrão habilitado; defina
allowClientInstructionsouallowRemoteSkillscomofalsepara excluir esse conteúdo. Descoberta de skill requer que o servidor remoto anuncie capacidades compatíveis; skills de conta permanecem disponíveis. O conteúdo de skill remoto é verificado contra seu tamanho, digest e frontmatter anunciados. Skills dinâmicos, que suportam arquivos, scripts e servidores que requerem o protocolo de descoberta mais recente, não são suportados. Veja MCP functions para compatibilidade e limites de confiança.Gateways — Time zone selection. A configuração de data e hora atual agora oferece um dropdown de fusos horários agrupados por região, incluindo UTC. Fusos horários salvos existentes são preservados ao reabrir a configuração.
Models — Seven new text models. Adiciona
@cohere/command-a-plus,@upstage/solar-mini4,@aion-labs/aion-3.5,@aion-labs/aion-3.5-mini,@qwen/qwen3.8-max-prime,@z-ai/glm-5.3-primee@fireworks/ember-1como modelos de texto selecionáveis, cobrados por provedor nas tarifas de token publicadas, com ajustes de conta e plano existentes ainda aplicáveis. Modelos Upstage e Fireworks agora exibem seus ícones de provedor ao invés do fallback genérico. Identificadores de modelo existentes permanecem inalterados.
Domingo, 27 de setembro de 2026 #
Alterações:
Telegram — Compact tool progress. Respostas transmitidas mostram apenas o último preâmbulo de ferramenta no indicador de pensamento quando a visibilidade de chamada de ferramenta está habilitada, ao invés de acumular blocos de nomes de ferramenta na resposta. A resposta final não contém blocos de progresso de ferramenta. Outros canais de mensagem e respostas não transmitidas permanecem inalterados.
Gateways — Bash tool selection. A lista de ferramentas Bash agora inclui um atalho para
get_date_time(Data e hora atuais). Listas de inclusão e exclusão aceitam padrões curinga sem distinção entre maiúsculas e minúsculas:*corresponde a qualquer número de caracteres, como emsomething_*, e?corresponde a um caractere. Nomes de ferramentas exatos permanecem suportados.Semantic decisions and Agentic Tests — Account rate limits. Limites de conta por minuto aplicam‑se a requisições de decisão semântica e novas execuções de Testes Agenticos; avaliações manuais, agendadas e diretas compartilham o limite de execuções de teste. Requisições acima do limite retornam HTTP 429, enquanto testes agendados aguardam uma verificação de agendamento posterior. Clientes devem espaçar requisições e tentar novamente após o limite de taxa limpar. Limites de inferência existentes ainda se aplicam. Veja Plans and Limits, Semantic decisions e Agentic Tests.
Models — Consistent speech synthesis prices. Preços do catálogo de texto‑para‑fala agora derivam das mesmas tarifas por caractere usadas para calcular uso de síntese, exibidos por 1 000 caracteres. Identificadores de modelo e tarifas de cobrança permanecem inalterados.
Models — Comparable transcription prices. Preços de modelos de fala‑para‑texto são exibidos de forma consistente em USD por minuto, convertendo tarifas horárias e por segundo para comparação sem mudar tarifas de cobrança ou medição de duração.
Image generation — Fixed output and reference prices. Geração de imagem usa preço fixo por saída entregue mais preço por referência para cada saída. Modelos cujos provedores cobram por tokens ou megapixels agora usam estimativas arredondadas ao invés de cobranças de token medido. O processamento de prompt está incluído na estimativa de saída; modelos sem cobrança de referência separada listam taxa de referência zero. Estes são tarifas fixas, não recibos pelo consumo real do provedor. Cobranças de imagem não incluem mais a margem de geração de imagem da AIVAX nem multiplicadores de preço de conta e plano. Veja Image generation.
Models — Subscription coverage. A página de Modelos agora inclui uma coluna “Subscription Usage” para rerankers e modelos de decisão semântica. “Included” identifica modelos elegíveis às cotas diárias do plano; “Excluded” identifica modelos sem cobertura. Elegibilidade não indica a cota restante da conta. Ambos os catálogos de serviço expõem essa elegibilidade como
subscriptionUsage.Subscriptions — Included daily usage allowances. Assinaturas Free, Pro e Max incluem cotas diárias separadas para busca RAG e inserção de embeddings, entrada Reflex (incluindo entrada em cache) e decisões semânticas Julia‑1. Cada item medido é totalmente incluído ou cobrado nas tarifas normais; uma requisição com múltiplos itens pode combinar uso incluído e pago. Isso também se aplica à extração OCR, substituindo cobertura parcial. Itens incluídos aparecem no consumo da assinatura sem entradas de histórico de cobrança de custo zero; indicadores de uso podem exceder a cota base dentro da margem permitida. Itens não cobertos mantêm registros de cobrança normais.
includesSubscriptionModelsé falso enquanto assinaturas de inferência estão desativadas; cobertura de assinatura LLM permanece desativada. O limite diário de tempo de processamento do Reflex permanece separado, e contas de revendedor não recebem cotas de assinatura. Veja Plans and Limits e Pricing.
Sábado, 26 de setembro de 2026 #
Alterações críticas:
- Image generation — Deprecated models removed. Remove
majicMIX-realistic,AbsoluteReality,CyberRealistic,CyberRealistic-Pony,RealCartoon-Realistic,Hassaku-XLeMeina-Mixdos modelos disponíveis. Requisições de API diretas usando esses identificadores agora falham; selecione um modelo ativo. Geração de imagem embutida usaflux-schnellquando nenhum modelo válido está configurado, substituindo o padrãoAbsoluteRealityobsoleto. Revise configurações salvas; estilo de saída e preços diferem.
Alterações:
Image generation — Additional Pollinations models. Adiciona 16 modelos oficiais de imagem raster, incluindo variantes FLUX 1.1 Pro e FLUX 2, variantes MAI Image, GPT Image 2.5 Flare e Sunburst, Qwen Image 2.1 e 3, Grok Imagine Image 2.0, Recraft V4.1 Flash, Krea 2 Medium, DreamShaper 8 LCM e Seedream 5 Pro, com pré‑visualizações geradas por modelo no seletor de imagens. Modelos da comunidade e SVG são excluídos. O catálogo exibe as unidades de cobrança. Veja a entrada de 27 de setembro para a mudança subsequente de cobrança de preço fixo. Gerações falhas não são contadas como imagens entregues. Veja Image generation.
Models — Service model catalogs. A página de Modelos agora inclui tabelas para geração de imagem, fala‑para‑texto, texto‑para‑fala, reranking e decisões semânticas, com descrições fornecidas pelo backend, datas de lançamento, preço base em USD com unidades de cobrança e um menu de Ações em cada tabela de serviço‑modelo para copiar nomes de modelo e abrir documentação de integração. Nomes de modelo mostram um rótulo amigável quando disponível enquanto copiam o identificador aceito pela API. A precificação usa unidades compactas de entrada, entrada em cache, saída, imagem, caractere e duração separadas por setas quando aplicável, com tarifas completas e unidades disponíveis na tooltip. Catálogos são ordenados do mais recente ao mais antigo. Datas de catálogo OpenRouter e nomes amigáveis suplementam metadados de lançamento ausentes; datas de catálogo são rotuladas explicitamente ao invés de apresentadas como datas de lançamento do fabricante. Modelos sem nenhuma data permanecem ao final. Falhas de requisição de catálogo podem ser tentadas novamente de forma independente. Catálogos de informação pública expõem esses detalhes, incluindo o novo catálogo
GET /api/v1/information/speech-models.json. Ajustes de preço de conta e plano ainda se aplicam. Veja Pricing e Semantic decisions.Privacy — Judicial disclosure and retention clarified. A Privacy Policy e os Terms of Use especificam ordens judiciais brasileiras para divulgação, solicitações estrangeiras para preservar logs existentes por até 1 ano, e até 1 ano de logs técnicos e metadados. Clarificam que o conteúdo da conversa é coletado somente quando Conversas está habilitado para a requisição ou conta, e que recursos de conta disponíveis e backups de até 3 meses podem ser divulgados sob ordem judicial brasileira. A licença de conteúdo nos Termos está expressamente sujeita a esses limites.
Generations — Additional decision models. O guia de Semantic decisions explica tipos de perguntas e interpretação de respostas. O endpoint público
GET /api/v1/information/decisions-models.jsonlista nomes canônicos, aliases, tipos de perguntas suportados, comprimentos de contexto, datas de lançamento e preços base por token. Adiciona@respan/span-01,@respan/span-01-lite,@jaredpalmer/kev-4be@supersonic-labs/julia-1como opções de modelo para decisões semânticas. Julia‑1 suportachoice,scoreenoul; seu uso de entrada inclui o estado repetido para cada pergunta. Ajustes de preço de conta e plano existentes se aplicam, e identificadores de modelo e formatos de requisição permanecem inalterados. Veja Plans and Limits e Pricing para limites e tarifas atuais.
Terça-feira, 22 de setembro de 2026 #
Alterações:
- Models — GPT-6 Sol and Luna added. Adiciona
@openai/gpt-6-sole@openai/gpt-6-luna, incluindo suas variantes de raciocínio:pro. Os aliases@model-router/openai:mide@model-router/openai:budgetagora selecionam GPT‑6 Sol e GPT‑6 Luna, respectivamente. Aplicações que usam esses aliases podem observar mudanças na qualidade da resposta, latência e custo. Identificadores de modelo explícitos permanecem inalterados.
Segunda-feira, 21 de setembro de 2026 #
Alterações críticas:
- Gateways — Off-topic moderation is being removed. O limiar dedicado a tópicos fora do escopo não bloqueará mais requisições que se desviem do propósito da conversa. Se sua aplicação depende dessa verificação, revise suas restrições de tópico antes de adotar a mudança; as categorias de moderação restantes não são um substituto equivalente.
- Built-in tools — Advanced web research is being disabled. A ferramenta
AdvancedWebUsageretornará uma resposta indisponível ao invés de realizar a pesquisa. Remova a dependência dessa ferramenta das instruções e fluxos do gateway. A Web Search padrão e a extração de URL permanecem alternativas separadas, não substitutos equivalentes para pesquisas de múltiplas etapas. - Models — Mercury 2.5 model identifier changed. Substitua
@inception/mercury-2.5-previewpor@inception/mercury-2.5em requisições e configurações de gateway. O identificador de pré‑visualização não está mais listado, e o substituto não está mais marcado como pré‑visualização. - Gateways / MCP — MCP tool names are source-qualified. Ferramentas de diferentes fontes MCP não compartilham mais um nome não qualificado no gateway. Revise instruções de gateway, regras de seleção de ferramenta e workers que correspondem a nomes exatos de ferramenta. O nome original da ferramenta no servidor MCP conectado permanece inalterado. Veja MCP functions.
Correções:
- Collections, Gateways, and Generations — Service model availability. Geração de resposta de coleção, roteamento de gateway, utilitários de chat e serviços de processamento de mídia evitam selecionar modelos temporariamente indisponíveis. O Teach Skill e pré‑processamento multimodal podem tentar outro modelo disponível após uma falha recuperável; o sucesso ainda depende da disponibilidade do serviço.
- Teach Skill — Usage calculation. Cobranças de processamento do Teach Skill usam a precificação do modelo associada à requisição concluída, inclusive quando uma tentativa altera o modelo usado. Veja Teach Skill e Pricing.
- Fetch and OCR — More reliable page extraction. Requisições de conteúdo de página canceladas ou expiradas não deixam a extração de página em execução indefinidamente. Isso resolve casos em que a extração de conteúdo web poderia travar.
- Chat clients — Final reply and message history.
completionTextagora seleciona a resposta final gerada pelo assistente ao invés de combiná‑la com texto assistente anterior durante o uso de ferramenta. O campo de respostacreatedMessagesadicionado preserva mensagens recém‑geradas em ordem, incluindo interações de ferramenta; mensagens submetidas não são repetidas. Use esse campo quando precisar do turno completo gerado. - Gateways / MCP — Structured MCP results are retained. Assistentes recebem conteúdo de resultado estruturado além dos blocos de conteúdo suportados, evitando perda de informação quando uma ferramenta MCP retorna saída estruturada.
- Fetch and OCR — X post extraction. Melhorada a extração de texto legível de links de postagens públicas do X. Disponibilidade de conteúdo e restrições de acesso ainda se aplicam.
- Fetch and OCR — Plain-text normalization changed. Conversão para texto plano não colapsa mais espaços internos nem normaliza caracteres Unicode. Espaços circundantes ainda podem ser aparados nos resultados de extração. Aplicações que comparam texto extraído exatamente ou exigem espaçamento normalizado devem fazer essa normalização por conta própria.
Alterações:
- Fetch and OCR — Optional structured extraction. Forneça
responseSchemapara converter conteúdo extraído em JSON. Resultados adicionamextractedObjectejsonProcessingUnitsmantendoextractedTextem caso de sucesso. Sem esquema, os novos campos são nulos e zero respectivamente. Conversão JSON é cobrada separadamente da extração e não está coberta pela cota diária de extração. Veja Fetch and OCR. - Generations — Semantic decisions. Avalie múltiplas perguntas nomeadas contra um estado JSON compartilhado usando
noul(critérios verdadeiro/falso),choiceouscore. Respostas incluem respostas nomeadas, uso de tokens e custo. O serviço requer saldo positivo, e seu uso de tokens contribui para os totais de uso da conta. - Built-in tools — Current date and time. A opção
DateTimepermite que assistentes solicitem a data, hora, dia da semana, fuso horário e deslocamento UTC atuais. DefinadateTimeTimeZonepara o fuso horário desejado; o padrão éAmerica/Los_Angeles, com ajustes de horário de verão, independente do fuso horário do navegador. Fusos horários inválidos são rejeitados. - Models — Additional model choices. Adiciona GLM-5.3-FlashX, Fugu Max, Pareto, Ling 3.0 Flash VL, MiMo‑V2.6‑Pro, MiMo‑V2.6‑Flash, MiMo‑V2.6‑Pro‑UltraSpeed e Grok 4.7 ao catálogo de inferência. Os aliases frontier, mid e budget da Xiaomi agora selecionam modelos MiMo V2.6, enquanto
@model-router/grok:latestseleciona Grok 4.7. Usuários de alias podem observar diferentes qualidade de resposta, latência e custo; disponibilidade e capacidades suportadas dependem do modelo selecionado e do plano da conta. - Inference — Transient-failure recovery. Requisições de inferência podem fazer tentativas de recuperação adicionais quando um provedor está temporariamente indisponível. Isso pode evitar algumas requisições falhas, mas também pode aumentar o tempo de resposta antes de um erro ser retornado.
- Avi Assistant — Updated default model. O assistente do console AIVAX altera seu modelo padrão, o que pode mudar o estilo de resposta, latência e custo de uso. Isso não altera o modelo selecionado nos seus próprios gateways.
- Documentation — Updated service guidance. A visão geral da documentação da API e a orientação do Avi Assistant cobrem sessões de voz, testes agenticos, classificação, segmentação, reranking e extração web, com links de documentação atuais e orientações de cobrança específicas por serviço. Esta é uma atualização de orientação, não a introdução desses serviços.
- Models — DeepSeek V4.1 Flash added. O catálogo de inferência inclui
@deepseek/deepseek-v4.1-flashcom suporte a chamada de ferramentas. Verifique disponibilidade do modelo e elegibilidade do plano antes de selecioná‑lo. - Models — Router selections updated.
@model-router/deepseek:lateste@model-router/deepseek:budgetagora selecionam DeepSeek V4.1 Flash. Aplicações que usam esses aliases podem observar diferentes qualidade de resposta, latência e custo sem mudar o alias. Adiciona@model-router/claude:frontier-mythose@model-router/mercury:latestcomo opções adicionais. - Chat clients — Structured prompt input. Prompts síncronos de cliente de chat aceitam texto simples, uma única mensagem ou um array ordenado de mensagens, incluindo chamadas de ferramenta do assistente e resultados de ferramenta correspondentes. Entrada de mensagem única existente permanece suportada.
instructionsopcional adiciona contexto para aquela requisição sem substituir o contexto da sessão salvo. Veja Chat clients. - Chat clients — Turns without session persistence. Defina
commitcomo falso para gerar uma resposta sem salvar as mensagens submetidas e geradas no histórico da sessão. O padrão permanece verdadeiro. Isto não é uma pré‑visualização gratuita: inferência e ações de ferramenta ainda são executadas. Para continuar uma interação de ferramenta não confirmada, envie a mensagem de chamada de ferramenta do assistente junto com seus resultados de ferramenta. - Agentic Tests — Optional testing notifications. Preferências de notificação de conta podem habilitar resumos semanais de testes e alertas quando um teste atinge três falhas consecutivas. Estes complementam notificações de falha e recuperação existentes. Veja Agentic Tests.
- Fetch and OCR — Rendered web content. Extração de HTML suporta conteúdo de página renderizado, melhorando a cobertura de páginas cujo texto legível depende de scripts. Renderização é cobrada em unidades de processamento; isso não garante acesso a todo site ou página restrita. Veja Fetch and OCR.
