AIVAX

Esta página foi traduzida automaticamente do inglês e pode estar desatualizada. Leia o original

Logs de alterações

Alterações técnicas que afetam produtos, serviços ou a API pública da AIVAX. As datas indicam quando as entradas foram adicionadas ou atualizadas, não datas confirmadas de implantação em produção. Cada item identifica o produto ou serviço afetado; manutenção sem efeito visível ao usuário é omitida.

Quinta-feira, 8 de outubro de 2026 #

Alterações:

  • Documentation — New Learn section. O site de documentação agora inclui Learn, um conjunto de 11 módulos e 63 unidades curtas que explicam agentes de IA desde os primeiros conceitos até a produção para leitores sem formação em computação: o que é um agente, modelos de linguagem, prompts e contexto, seleção e parâmetros de modelo, ferramentas e integrações, conhecimento e RAG, fluxos avançados, avaliação e observabilidade, segurança e conformidade, custo e escala, e estudos de caso práticos. As unidades incluem exemplos interativos, tutoriais passo a passo, tabelas comparativas, gráficos e quizzes curtos, e cada uma pode ser marcada como concluída no navegador. Três caminhos de aprendizado sugeridos (Iniciante, Desenvolvedor, Negócio) agrupam os módulos por objetivo. Learn está disponível em inglês e português e está incluído na busca do site.
  • Models — Claude Haiku 5.5 added. Adiciona @anthropic/claude-5.5-haiku (Claude Haiku 5.5), sucessor direto do Claude Haiku 4.5, ao catálogo de modelos de texto. Suporta entrada de imagem e arquivo e chamada de ferramentas, com janela de contexto de 1 M de tokens. O alias @model-router/claude:budget agora seleciona Claude Haiku 5.5, substituindo Claude Haiku 4.5. Aplicações que usam esse alias podem observar mudanças na qualidade da resposta, latência e custo. Identificadores de modelo explícitos existentes permanecem inalterados.
  • Inference — Provider selection with routing_options. As conclusões de chat aceitam routing_options com preset (Balanced, Cheapest, Fastest ou Quality) e allowed_providers, uma lista ordenada de tags de provedores como ["azure-us", "azure-eu", "*"]. A AIVAX tenta cada tag na ordem e passa para a próxima somente quando nenhum provedor correspondente está disponível; "*" corresponde a qualquer provedor. allowed_providers tem padrão ["*"], e uma lista vazia é rejeitada. Sem "*", a requisição falha quando nenhum dos provedores listados está disponível. routing_preset está obsoleto: ainda funciona, mas use routing_options.preset. Gateways de IA aceitam a mesma lista ordenada em parameters.allowedProviders (padrão ["*"]), editável no editor de gateway sob Allowed providers para modelos integrados; valores de requisição substituem isso apenas para a requisição. Veja Provider routing.
  • Inference — Serving provider in responses. Respostas de conclusão de chat e cada bloco transmitido incluem um campo provider ao lado de model com a tag do provedor que atendeu ao modelo integrado. É null para gateways que usam suas próprias credenciais de provedor.
  • Models — filter on GET /v1/models. A lista de modelos aceita um parâmetro de consulta opcional filter com um nome de modelo e retorna apenas as entradas correspondentes: o nome exato ou seus snapshots datados, ordenados da correspondência mais próxima. Sem ele, a lista permanece inalterada.
  • Models — Provider tags. Os detalhes do provedor na página de Modelos do painel mostram a tag de cada provedor com um botão de copiar, e GET /v1/models a devolve como tag em cada entrada de provedor. Endpoints de provedor em diferentes regiões ou variantes têm tags distintas, como azure-us e azure-eu.

Quarta-feira, 7 de outubro de 2026 #

Alterações críticas:

  • Inference — File and OtherFiles pre-processing now cover every file. Gateways e requisições que habilitam apenas a flag multimodal OtherFiles agora convertem arquivos PDF com OCR ao invés de enviá‑los ao modelo principal sem alterações. Aqueles que habilitam apenas a flag File agora convertem arquivos não‑PDF com OCR também, sendo cobrados em Unidades de Processamento. Gateways e requisições com ambas as flags ou All não são afetados. Para deixar arquivos inalterados, defina multimodal_resolver (ou multimodalResolverParameters do gateway) sem um fileEngine; nenhum tipo de arquivo será pré‑processado.

Alterações:

  • Inference — Per-media multimodal resolver engines. As conclusões de chat aceitam multimodal_resolver, e gateways de IA aceitam multimodalResolverParameters, com campos imageEngine, audioEngine, videoEngine e fileEngine. Cada um seleciona como aquele tipo de conteúdo é convertido em texto antes da inferência: InferenceLow (modelo multimodal menor; Inference é um alias), InferenceHigh (modelo multimodal maior e mais preciso, com custo maior), Ocr para imagens e arquivos (cobrado em Unidades de Processamento, como Fetch e OCR), ou Stt para áudio (speech‑to‑text, cobrado por segundo). OCR aceita URIs de dados base64 e URLs públicas. Resultados de cada motor são armazenados em cache por conteúdo e motor, de modo que mídia repetida não é cobrada novamente. As flags multimodal_preprocess e a configuração enabledMultimodalFeatures do gateway estão obsoletas, mas continuam funcionando com os motores equivalentes; as novas configurações prevalecem quando presentes. O editor de gateway agora configura um motor por tipo de conteúdo. Veja Multimodal pre-processing.
  • RAG — Document filters in the Collections MCP and the gateway query tool. A ferramenta de busca do Collections MCP e a ferramenta query dos gateways de IA que usam a estratégia de consulta QueryFunction aceitam um argumento opcional filter com a mesma sintaxe do campo filter da busca semântica, como tags has "faq" and updatedAt >= now-30d. Filtros são aplicados antes que os termos de busca sejam incorporados; quando nenhum documento corresponde, a ferramenta retorna nenhum resultado sem cobranças de incorporação ou busca. Um filtro inválido é retornado ao modelo como erro de ferramenta. O RAG automático de gateway ainda não aplica filtros. Veja Document Filters.

Terça-feira, 6 de outubro de 2026 #

Alterações:

  • RAG — Faster text segmentation without sanitization. Requisições POST /api/v1/generations/segment com sanitize omitido ou false não usam mais um modelo de linguagem. Os limites agora são escolhidos a partir da estrutura do documento (títulos, listas, tabelas, blocos de código, parágrafos e finais de frase) e da similaridade semântica de trechos vizinhos, visando segmentos de aproximadamente 300 tokens. Os segmentos cobrem todo o documento na ordem de origem sem sobreposição e mantêm quebras de linha originais; um limite pode cair no final de uma frase dentro de uma linha. Documentos de cerca de 300 tokens ou menos são retornados como um único segmento. O formato da resposta, cotas e preço por token permanecem inalterados; usage.processing_units agora relata os tokens dos documentos submetidos. Requisições com sanitize: true mantêm o comportamento anterior. Veja Text segmentation.

  • Models — Six new semantic decision models. Adiciona @upstage/solar-decide (Upstage Solar Decide), @cloudflare/clef (Cloudflare Clef), @cloudflare/clef-flash (Cloudflare Clef Flash), @liquid/d1 (LiquidAI d1), @perplexity/pplx-decider-v1-27b (Perplexity Decider V1 27B) e @openai/gpt-6-luna-decisions (OpenAI GPT-6 Luna Decisions) ao catálogo de decisões semânticas. Todos seis suportam perguntas noul, choice e score via POST /api/v1/generations/decisions e são cobrados por token de entrada nas tarifas publicadas, sem cobrança de token de saída, com ajustes de conta e plano existentes ainda aplicáveis. Eles não são cobertos pela cota diária de decisões semânticas, que permanece limitada ao Julia‑1. Identificadores de modelo existentes permanecem inalterados. Veja Semantic decisions e Pricing.

Segunda-feira, 5 de outubro de 2026 #

Alterações críticas:

  • Chat clients — Current date and time are no longer added to the instructions. Integrações de Telegram e WhatsApp, incluindo mensagens agendadas, não adicionam mais a data e hora do servidor às instruções do modelo. Modelos devem obter a hora atual de uma ferramenta. Para manter comportamento dependente de data, como lembretes, habilite a função embutida de data e hora ou o shell (date) no gateway de IA usado pelo cliente de chat.
  • Account — Reseller plan renamed to Custom. Contas no plano Reseller agora reportam o plano como Custom ao invés de Reseller nas respostas da API, como no endpoint de saldo, e no cabeçalho de resposta X-Authenticated-Account-Plan. Integrações que comam o nome do plano com Reseller devem aceitar Custom. Contas Custom podem ter limites de taxa definidos como múltiplo dos limites do plano Pro; contas sem múltiplo configurado permanecem sem limites de taxa de plano. Veja Plans and Limits.

Correções:

  • AI gateways — Shell tool commands without parameters now run. No shell do gateway, chamar uma ferramenta que não tem parâmetros, como list_scheduled_jobs, agora a executa ao invés de imprimir sua ajuda. Use --help para visualizar a ajuda.

  • Collections — De-duplication no longer stops before removing documents. Uma tarefa de desduplicação que encontrou documentos duplicados podia parar com zero documentos removidos e sem arquivos de backup, porque a gravação do backup dos documentos removidos falhava. Essas tarefas agora salvam os arquivos de backup, removem os duplicados e incluem os links de download na notificação de conclusão. Tarefas que pararam dessa forma não removeram nenhum documento; inicie uma nova tarefa para tentar novamente.

Alterações:

  • Conversations — Provider and routing details. Conversas agora registram o provedor que atendeu à resposta mais recente, sua política de coleta de dados, a variante do modelo (fast, flex ou priority) quando usada, e a opção de roteamento usada para selecionar o provedor. O endpoint View Conversation os devolve nos campos providerName, providerDataCollection, modelVariant e routingOption, e o endpoint List Conversations devolve providerName, modelVariant e routingOption. Esses campos são null para gateways que usam suas próprias credenciais de provedor e para conversas armazenadas antes desta mudança. A lista de conversas no painel mostra colunas Provider, Routing e Variant; Provider mostra BYOK quando nenhum provedor foi registrado. A tabela tem rolagem horizontal, e as ações da linha permanecem visíveis.
  • AI gateways — Time zone and culture for the shell. As opções do shell do gateway aceitam timeZone, um fuso horário IANA como America/Sao_Paulo, e culture, como pt-BR. O comando date usa o fuso horário para sua saída e para datas sem deslocamento explícito, e usa a cultura para nomes de dias e meses. Os padrões permanecem UTC e cultura invariável; date -u sempre imprime UTC.
  • RAG — Document filters for semantic search and answer generation. Os endpoints de busca semântica e geração de respostas aceitam um campo opcional filter que restringe a busca a documentos que correspondam a condições sobre nome, conteúdo, tags, datas de criação e atualização ou metadados, como tags has "finance" and createdAt >= now-30d. O campo aceita uma string ou um array de strings combinadas com and. Filtros são aplicados antes que os termos de busca sejam incorporados; quando nenhum documento corresponde, a requisição retorna um resultado vazio sem cobranças de incorporação ou busca. Filtros inválidos retornam 400 Bad Request com a posição do erro. Filtros ainda não estão disponíveis no RAG de gateway de IA ou no Collections MCP. Veja Document Filters.
  • RAG — Filters and visual results in the collection playground. O playground de coleção tem uma seção Filters onde cada linha é um filtro de documento; todas as linhas devem corresponder e são enviadas como o array filter. Resultados podem ser visualizados como Visual, mostrando a resposta gerada e cada documento com sua pontuação, metadados e documentos referenciados, ou como JSON bruto. O playground agora usa o reranker rrf por padrão; ainda é possível escolher outro reranker.

Sábado, 3 de outubro de 2026 #

Alterações:

  • Documentation — Updated reading and search experience. A documentação adiciona busca específica por idioma, temas claro e escuro, navegação móvel e um menu de página para visualizar ou copiar Markdown. Agentes de IA podem usar o índice de documentação e arquivos de texto completo. URLs de documentação existentes continuam resolvendo; alguns guias antigos redirecionam para a documentação atual do produto.

Sexta-feira, 2 de outubro de 2026 #

Alterações:

  • Models — Claude Sonnet 5.5 and GPT-6.1 Sol added. Adiciona @anthropic/claude-5.5-sonnet (Claude Sonnet 5.5), sucessor direto do Claude Sonnet 5, e @openai/gpt-6.1-sol (GPT‑6.1 Sol), uma atualização do GPT‑6 Sol, ao catálogo de modelos de texto. Ambos suportam pensamento, entrada de imagem e arquivo e chamada de ferramentas; GPT‑6.1 Sol também suporta saída estruturada. Os aliases @model-router/claude:mid e @model-router/openai:mid agora selecionam Claude Sonnet 5.5 e GPT‑6.1 Sol, substituindo Claude Sonnet 5 e GPT‑6 Sol, respectivamente. Aplicações que usam esses aliases podem observar mudanças na qualidade da resposta, latência e custo. Identificadores de modelo explícitos existentes permanecem inalterados.

Quinta-feira, 1 de outubro de 2026 #

Alterações críticas:

  • API — Error status codes reflect the failure source. Falhas não são mais retornadas todas como 400 Bad Request pelos endpoints de conta, RAG, web e geração. Requisições inválidas ainda retornam 400, e falhas de autenticação, saldo e permissão que antes apareciam como 400 agora retornam 401, 402 ou 403. Falhas inesperadas da AIVAX retornam 500 Internal Server Error com mensagem genérica, e serviços externos indisponíveis, incluindo provedores de modelo, retornam 503 Service Unavailable com cabeçalho Retry-After. Em endpoints compatíveis com OpenAI, o código de erro agora é invalid_request_error, service_unavailable ou server_error ao invés de sempre server_error. Clientes que tratam toda resposta não‑2xx como erro de requisição devem tentar novamente em respostas 500 e 503, obedecendo ao Retry-After. Veja Troubleshoot the first request.

Correções:

  • Chat completions — Malformed tool declarations rejected as invalid requests. Requisições cujas entradas tools têm campos ausentes ou com tipo errado agora retornam 400 Bad Request ao invés de erro de servidor.

  • Gateways — Bash tool reports invalid options to the model. Opções desconhecidas ou valores que não correspondem aos parâmetros de uma ferramenta agora retornam um erro de comando que o modelo pode corrigir, ao invés de falhar a chamada da ferramenta.

Alterações:

  • MCP utilities — Media generation MCP. Um novo servidor MCP hospedado em https://inference.aivax.net/v1/mcp/media-generation expõe list_models, generate_image e generate_speech para clientes compatíveis com MCP. list_models aceita um type de image ou audio; imagens geradas e fala em MP3 são retornadas como URLs públicas. Use o cabeçalho opcional X-Mcp-Enabled-Tools para escolher quais ferramentas o cliente vê. Gerações usam a mesma precificação e limites das APIs de Geração de Imagem e Geração de Fala e exigem saldo positivo. Veja Media generation MCP.

Segunda-feira, 28 de setembro de 2026 #

Correções:

  • Gateways — Bash tool help accepts nullable parameters. Solicitar ajuda para ferramentas cujos parâmetros aceitam múltiplos tipos, incluindo null, não falha mais ao listar seus argumentos. A ajuda preserva os tipos aceitos e caminhos de parâmetros aninhados. Nenhuma mudança no esquema da ferramenta é necessária.

  • Chat integrations — Failure notifications restored. Conversas em streaming e não‑streaming novamente tentam enviar “System: something went wrong. Please, try again later.” após uma falha de geração irrecuperável, tentativas de recuperação esgotadas ou um turno que não envia mensagem. Uma falha final é relatada mesmo se uma resposta parcial anterior foi entregue. A entrega de notificações ainda depende da disponibilidade do serviço de mensagens.

Alterações:

  • Gateways / MCP — Server instructions and remote skills. Fontes MCP podem incluir instruções de servidor e documentos de skill raiz junto com ferramentas, incluindo fontes adicionadas por workers. Ambas as opções têm padrão habilitado; defina allowClientInstructions ou allowRemoteSkills como false para excluir esse conteúdo. Descoberta de skill requer que o servidor remoto anuncie capacidades compatíveis; skills de conta permanecem disponíveis. O conteúdo de skill remoto é verificado contra seu tamanho, digest e frontmatter anunciados. Skills dinâmicos, que suportam arquivos, scripts e servidores que requerem o protocolo de descoberta mais recente, não são suportados. Veja MCP functions para compatibilidade e limites de confiança.

  • Gateways — Time zone selection. A configuração de data e hora atual agora oferece um dropdown de fusos horários agrupados por região, incluindo UTC. Fusos horários salvos existentes são preservados ao reabrir a configuração.

  • Models — Seven new text models. Adiciona @cohere/command-a-plus, @upstage/solar-mini4, @aion-labs/aion-3.5, @aion-labs/aion-3.5-mini, @qwen/qwen3.8-max-prime, @z-ai/glm-5.3-prime e @fireworks/ember-1 como modelos de texto selecionáveis, cobrados por provedor nas tarifas de token publicadas, com ajustes de conta e plano existentes ainda aplicáveis. Modelos Upstage e Fireworks agora exibem seus ícones de provedor ao invés do fallback genérico. Identificadores de modelo existentes permanecem inalterados.

Domingo, 27 de setembro de 2026 #

Alterações:

  • Telegram — Compact tool progress. Respostas transmitidas mostram apenas o último preâmbulo de ferramenta no indicador de pensamento quando a visibilidade de chamada de ferramenta está habilitada, ao invés de acumular blocos de nomes de ferramenta na resposta. A resposta final não contém blocos de progresso de ferramenta. Outros canais de mensagem e respostas não transmitidas permanecem inalterados.

  • Gateways — Bash tool selection. A lista de ferramentas Bash agora inclui um atalho para get_date_time (Data e hora atuais). Listas de inclusão e exclusão aceitam padrões curinga sem distinção entre maiúsculas e minúsculas: * corresponde a qualquer número de caracteres, como em something_*, e ? corresponde a um caractere. Nomes de ferramentas exatos permanecem suportados.

  • Semantic decisions and Agentic Tests — Account rate limits. Limites de conta por minuto aplicam‑se a requisições de decisão semântica e novas execuções de Testes Agenticos; avaliações manuais, agendadas e diretas compartilham o limite de execuções de teste. Requisições acima do limite retornam HTTP 429, enquanto testes agendados aguardam uma verificação de agendamento posterior. Clientes devem espaçar requisições e tentar novamente após o limite de taxa limpar. Limites de inferência existentes ainda se aplicam. Veja Plans and Limits, Semantic decisions e Agentic Tests.

  • Models — Consistent speech synthesis prices. Preços do catálogo de texto‑para‑fala agora derivam das mesmas tarifas por caractere usadas para calcular uso de síntese, exibidos por 1 000 caracteres. Identificadores de modelo e tarifas de cobrança permanecem inalterados.

  • Models — Comparable transcription prices. Preços de modelos de fala‑para‑texto são exibidos de forma consistente em USD por minuto, convertendo tarifas horárias e por segundo para comparação sem mudar tarifas de cobrança ou medição de duração.

  • Image generation — Fixed output and reference prices. Geração de imagem usa preço fixo por saída entregue mais preço por referência para cada saída. Modelos cujos provedores cobram por tokens ou megapixels agora usam estimativas arredondadas ao invés de cobranças de token medido. O processamento de prompt está incluído na estimativa de saída; modelos sem cobrança de referência separada listam taxa de referência zero. Estes são tarifas fixas, não recibos pelo consumo real do provedor. Cobranças de imagem não incluem mais a margem de geração de imagem da AIVAX nem multiplicadores de preço de conta e plano. Veja Image generation.

  • Models — Subscription coverage. A página de Modelos agora inclui uma coluna “Subscription Usage” para rerankers e modelos de decisão semântica. “Included” identifica modelos elegíveis às cotas diárias do plano; “Excluded” identifica modelos sem cobertura. Elegibilidade não indica a cota restante da conta. Ambos os catálogos de serviço expõem essa elegibilidade como subscriptionUsage.

  • Subscriptions — Included daily usage allowances. Assinaturas Free, Pro e Max incluem cotas diárias separadas para busca RAG e inserção de embeddings, entrada Reflex (incluindo entrada em cache) e decisões semânticas Julia‑1. Cada item medido é totalmente incluído ou cobrado nas tarifas normais; uma requisição com múltiplos itens pode combinar uso incluído e pago. Isso também se aplica à extração OCR, substituindo cobertura parcial. Itens incluídos aparecem no consumo da assinatura sem entradas de histórico de cobrança de custo zero; indicadores de uso podem exceder a cota base dentro da margem permitida. Itens não cobertos mantêm registros de cobrança normais. includesSubscriptionModels é falso enquanto assinaturas de inferência estão desativadas; cobertura de assinatura LLM permanece desativada. O limite diário de tempo de processamento do Reflex permanece separado, e contas de revendedor não recebem cotas de assinatura. Veja Plans and Limits e Pricing.

Sábado, 26 de setembro de 2026 #

Alterações críticas:

  • Image generation — Deprecated models removed. Remove majicMIX-realistic, AbsoluteReality, CyberRealistic, CyberRealistic-Pony, RealCartoon-Realistic, Hassaku-XL e Meina-Mix dos modelos disponíveis. Requisições de API diretas usando esses identificadores agora falham; selecione um modelo ativo. Geração de imagem embutida usa flux-schnell quando nenhum modelo válido está configurado, substituindo o padrão AbsoluteReality obsoleto. Revise configurações salvas; estilo de saída e preços diferem.

Alterações:

  • Image generation — Additional Pollinations models. Adiciona 16 modelos oficiais de imagem raster, incluindo variantes FLUX 1.1 Pro e FLUX 2, variantes MAI Image, GPT Image 2.5 Flare e Sunburst, Qwen Image 2.1 e 3, Grok Imagine Image 2.0, Recraft V4.1 Flash, Krea 2 Medium, DreamShaper 8 LCM e Seedream 5 Pro, com pré‑visualizações geradas por modelo no seletor de imagens. Modelos da comunidade e SVG são excluídos. O catálogo exibe as unidades de cobrança. Veja a entrada de 27 de setembro para a mudança subsequente de cobrança de preço fixo. Gerações falhas não são contadas como imagens entregues. Veja Image generation.

  • Models — Service model catalogs. A página de Modelos agora inclui tabelas para geração de imagem, fala‑para‑texto, texto‑para‑fala, reranking e decisões semânticas, com descrições fornecidas pelo backend, datas de lançamento, preço base em USD com unidades de cobrança e um menu de Ações em cada tabela de serviço‑modelo para copiar nomes de modelo e abrir documentação de integração. Nomes de modelo mostram um rótulo amigável quando disponível enquanto copiam o identificador aceito pela API. A precificação usa unidades compactas de entrada, entrada em cache, saída, imagem, caractere e duração separadas por setas quando aplicável, com tarifas completas e unidades disponíveis na tooltip. Catálogos são ordenados do mais recente ao mais antigo. Datas de catálogo OpenRouter e nomes amigáveis suplementam metadados de lançamento ausentes; datas de catálogo são rotuladas explicitamente ao invés de apresentadas como datas de lançamento do fabricante. Modelos sem nenhuma data permanecem ao final. Falhas de requisição de catálogo podem ser tentadas novamente de forma independente. Catálogos de informação pública expõem esses detalhes, incluindo o novo catálogo GET /api/v1/information/speech-models.json. Ajustes de preço de conta e plano ainda se aplicam. Veja Pricing e Semantic decisions.

  • Privacy — Judicial disclosure and retention clarified. A Privacy Policy e os Terms of Use especificam ordens judiciais brasileiras para divulgação, solicitações estrangeiras para preservar logs existentes por até 1 ano, e até 1 ano de logs técnicos e metadados. Clarificam que o conteúdo da conversa é coletado somente quando Conversas está habilitado para a requisição ou conta, e que recursos de conta disponíveis e backups de até 3 meses podem ser divulgados sob ordem judicial brasileira. A licença de conteúdo nos Termos está expressamente sujeita a esses limites.

  • Generations — Additional decision models. O guia de Semantic decisions explica tipos de perguntas e interpretação de respostas. O endpoint público GET /api/v1/information/decisions-models.json lista nomes canônicos, aliases, tipos de perguntas suportados, comprimentos de contexto, datas de lançamento e preços base por token. Adiciona @respan/span-01, @respan/span-01-lite, @jaredpalmer/kev-4b e @supersonic-labs/julia-1 como opções de modelo para decisões semânticas. Julia‑1 suporta choice, score e noul; seu uso de entrada inclui o estado repetido para cada pergunta. Ajustes de preço de conta e plano existentes se aplicam, e identificadores de modelo e formatos de requisição permanecem inalterados. Veja Plans and Limits e Pricing para limites e tarifas atuais.

Terça-feira, 22 de setembro de 2026 #

Alterações:

  • Models — GPT-6 Sol and Luna added. Adiciona @openai/gpt-6-sol e @openai/gpt-6-luna, incluindo suas variantes de raciocínio :pro. Os aliases @model-router/openai:mid e @model-router/openai:budget agora selecionam GPT‑6 Sol e GPT‑6 Luna, respectivamente. Aplicações que usam esses aliases podem observar mudanças na qualidade da resposta, latência e custo. Identificadores de modelo explícitos permanecem inalterados.

Segunda-feira, 21 de setembro de 2026 #

Alterações críticas:

  • Gateways — Off-topic moderation is being removed. O limiar dedicado a tópicos fora do escopo não bloqueará mais requisições que se desviem do propósito da conversa. Se sua aplicação depende dessa verificação, revise suas restrições de tópico antes de adotar a mudança; as categorias de moderação restantes não são um substituto equivalente.
  • Built-in tools — Advanced web research is being disabled. A ferramenta AdvancedWebUsage retornará uma resposta indisponível ao invés de realizar a pesquisa. Remova a dependência dessa ferramenta das instruções e fluxos do gateway. A Web Search padrão e a extração de URL permanecem alternativas separadas, não substitutos equivalentes para pesquisas de múltiplas etapas.
  • Models — Mercury 2.5 model identifier changed. Substitua @inception/mercury-2.5-preview por @inception/mercury-2.5 em requisições e configurações de gateway. O identificador de pré‑visualização não está mais listado, e o substituto não está mais marcado como pré‑visualização.
  • Gateways / MCP — MCP tool names are source-qualified. Ferramentas de diferentes fontes MCP não compartilham mais um nome não qualificado no gateway. Revise instruções de gateway, regras de seleção de ferramenta e workers que correspondem a nomes exatos de ferramenta. O nome original da ferramenta no servidor MCP conectado permanece inalterado. Veja MCP functions.

Correções:

  • Collections, Gateways, and Generations — Service model availability. Geração de resposta de coleção, roteamento de gateway, utilitários de chat e serviços de processamento de mídia evitam selecionar modelos temporariamente indisponíveis. O Teach Skill e pré‑processamento multimodal podem tentar outro modelo disponível após uma falha recuperável; o sucesso ainda depende da disponibilidade do serviço.
  • Teach Skill — Usage calculation. Cobranças de processamento do Teach Skill usam a precificação do modelo associada à requisição concluída, inclusive quando uma tentativa altera o modelo usado. Veja Teach Skill e Pricing.
  • Fetch and OCR — More reliable page extraction. Requisições de conteúdo de página canceladas ou expiradas não deixam a extração de página em execução indefinidamente. Isso resolve casos em que a extração de conteúdo web poderia travar.
  • Chat clients — Final reply and message history. completionText agora seleciona a resposta final gerada pelo assistente ao invés de combiná‑la com texto assistente anterior durante o uso de ferramenta. O campo de resposta createdMessages adicionado preserva mensagens recém‑geradas em ordem, incluindo interações de ferramenta; mensagens submetidas não são repetidas. Use esse campo quando precisar do turno completo gerado.
  • Gateways / MCP — Structured MCP results are retained. Assistentes recebem conteúdo de resultado estruturado além dos blocos de conteúdo suportados, evitando perda de informação quando uma ferramenta MCP retorna saída estruturada.
  • Fetch and OCR — X post extraction. Melhorada a extração de texto legível de links de postagens públicas do X. Disponibilidade de conteúdo e restrições de acesso ainda se aplicam.
  • Fetch and OCR — Plain-text normalization changed. Conversão para texto plano não colapsa mais espaços internos nem normaliza caracteres Unicode. Espaços circundantes ainda podem ser aparados nos resultados de extração. Aplicações que comparam texto extraído exatamente ou exigem espaçamento normalizado devem fazer essa normalização por conta própria.

Alterações:

  • Fetch and OCR — Optional structured extraction. Forneça responseSchema para converter conteúdo extraído em JSON. Resultados adicionam extractedObject e jsonProcessingUnits mantendo extractedText em caso de sucesso. Sem esquema, os novos campos são nulos e zero respectivamente. Conversão JSON é cobrada separadamente da extração e não está coberta pela cota diária de extração. Veja Fetch and OCR.
  • Generations — Semantic decisions. Avalie múltiplas perguntas nomeadas contra um estado JSON compartilhado usando noul (critérios verdadeiro/falso), choice ou score. Respostas incluem respostas nomeadas, uso de tokens e custo. O serviço requer saldo positivo, e seu uso de tokens contribui para os totais de uso da conta.
  • Built-in tools — Current date and time. A opção DateTime permite que assistentes solicitem a data, hora, dia da semana, fuso horário e deslocamento UTC atuais. Defina dateTimeTimeZone para o fuso horário desejado; o padrão é America/Los_Angeles, com ajustes de horário de verão, independente do fuso horário do navegador. Fusos horários inválidos são rejeitados.
  • Models — Additional model choices. Adiciona GLM-5.3-FlashX, Fugu Max, Pareto, Ling 3.0 Flash VL, MiMo‑V2.6‑Pro, MiMo‑V2.6‑Flash, MiMo‑V2.6‑Pro‑UltraSpeed e Grok 4.7 ao catálogo de inferência. Os aliases frontier, mid e budget da Xiaomi agora selecionam modelos MiMo V2.6, enquanto @model-router/grok:latest seleciona Grok 4.7. Usuários de alias podem observar diferentes qualidade de resposta, latência e custo; disponibilidade e capacidades suportadas dependem do modelo selecionado e do plano da conta.
  • Inference — Transient-failure recovery. Requisições de inferência podem fazer tentativas de recuperação adicionais quando um provedor está temporariamente indisponível. Isso pode evitar algumas requisições falhas, mas também pode aumentar o tempo de resposta antes de um erro ser retornado.
  • Avi Assistant — Updated default model. O assistente do console AIVAX altera seu modelo padrão, o que pode mudar o estilo de resposta, latência e custo de uso. Isso não altera o modelo selecionado nos seus próprios gateways.
  • Documentation — Updated service guidance. A visão geral da documentação da API e a orientação do Avi Assistant cobrem sessões de voz, testes agenticos, classificação, segmentação, reranking e extração web, com links de documentação atuais e orientações de cobrança específicas por serviço. Esta é uma atualização de orientação, não a introdução desses serviços.
  • Models — DeepSeek V4.1 Flash added. O catálogo de inferência inclui @deepseek/deepseek-v4.1-flash com suporte a chamada de ferramentas. Verifique disponibilidade do modelo e elegibilidade do plano antes de selecioná‑lo.
  • Models — Router selections updated. @model-router/deepseek:latest e @model-router/deepseek:budget agora selecionam DeepSeek V4.1 Flash. Aplicações que usam esses aliases podem observar diferentes qualidade de resposta, latência e custo sem mudar o alias. Adiciona @model-router/claude:frontier-mythos e @model-router/mercury:latest como opções adicionais.
  • Chat clients — Structured prompt input. Prompts síncronos de cliente de chat aceitam texto simples, uma única mensagem ou um array ordenado de mensagens, incluindo chamadas de ferramenta do assistente e resultados de ferramenta correspondentes. Entrada de mensagem única existente permanece suportada. instructions opcional adiciona contexto para aquela requisição sem substituir o contexto da sessão salvo. Veja Chat clients.
  • Chat clients — Turns without session persistence. Defina commit como falso para gerar uma resposta sem salvar as mensagens submetidas e geradas no histórico da sessão. O padrão permanece verdadeiro. Isto não é uma pré‑visualização gratuita: inferência e ações de ferramenta ainda são executadas. Para continuar uma interação de ferramenta não confirmada, envie a mensagem de chamada de ferramenta do assistente junto com seus resultados de ferramenta.
  • Agentic Tests — Optional testing notifications. Preferências de notificação de conta podem habilitar resumos semanais de testes e alertas quando um teste atinge três falhas consecutivas. Estes complementam notificações de falha e recuperação existentes. Veja Agentic Tests.
  • Fetch and OCR — Rendered web content. Extração de HTML suporta conteúdo de página renderizado, melhorando a cobertura de páginas cujo texto legível depende de scripts. Renderização é cobrada em unidades de processamento; isso não garante acesso a todo site ou página restrita. Veja Fetch and OCR.

Digite para pesquisar na documentação.