GPT-5.6 Sol
Tier de maior capacidade da família GPT-5.6. O fornecedor declara max e ultra como níveis de esforço; ultra coordena quatro agentes em paralelo por padrão. Preço inalterado no corte de 30/07.
Um ponto de entrada para modelos, estatísticas de mercado, artigos, papers, autores e padrões. O radar editorial aponta para fontes primárias atuais; os catálogos congelados preservam snapshots, hashes, licenças e limites de inferência.
Preços e disponibilidade abaixo são declarações dos próprios fornecedores, relidas na fonte primária em 13 de agosto de 2026. Preço de modelo muda sem aviso — este radar é datado justamente porque a data é parte do fato. A FORGE trata modelo + harness + ambiente + eval como a unidade de decisão; nenhuma tabela do fornecedor prova superioridade universal.
Tier de maior capacidade da família GPT-5.6. O fornecedor declara max e ultra como níveis de esforço; ultra coordena quatro agentes em paralelo por padrão. Preço inalterado no corte de 30/07.
Tier equilibrado. A OpenAI reduziu o preço em 20% em 30 de julho de 2026 — o corte anterior deste radar publicava os valores de lançamento.
Tier de menor custo. A OpenAI reduziu o preço em 80% em 30 de julho de 2026; o valor publicado no corte anterior estava cinco vezes acima do declarado hoje.
Modelo Mythos-class para projetos longos. A Anthropic declara safeguards adicionais, roteamento automático para modelos menos capazes em domínios sensíveis e retenção de 30 dias para monitoramento de segurança.
Tier de uso geral da família Claude 5. O fornecedor oferece fast mode em research preview para Opus 5, cobrado a US$ 10 / US$ 50 por 1M.
Tier equilibrado. O preço introdutório passou a ser o padrão: o aumento para US$ 3 / US$ 15 previsto para 1 de setembro de 2026 foi cancelado pelo fornecedor.
A Google descreve como seu modelo mais inteligente construído para velocidade. Há tiers Batch e Flex a metade do preço e Priority a 1,8×.
Preço declarado por faixa de prompt: acima de 200k tokens de entrada, a xAI cobra US$ 4 / US$ 12. Input em cache custa US$ 0,50.
Estatísticas de mercado mudam rápido. Cada número abaixo carrega fonte, população e ano; ele informa o desenho da FORGE, mas não substitui métrica própria de produto.
O relatório também registra 362 incidentes documentados de IA, contra 233 em 2024, e 53% de adoção populacional de IA generativa em três anos.
Entre 13 agentes com autonomia de fronteira, apenas quatro divulgavam alguma avaliação de segurança agentic; 20 de 30 suportavam MCP.
No recorte de novembro de 2025 do Claude.ai, augmentation voltou a predominar. Em tráfego de API, tarefas de computação e matemática chegaram a 46%.
O DORA 2025 posiciona IA como amplificador de forças e fraquezas organizacionais. O maior retorno vem do sistema de trabalho, não da ferramenta isolada — fundamento compatível com a tese da FORGE.
Autoria individual aparece quando a fonte oficial a declara. Specs, padrões e relatórios coletivos permanecem atribuídos à instituição responsável — sem inventar um autor.
Relato de um produto agent-first: conhecimento do repositório como sistema de registro, worktrees isolados, feedback legível e invariantes de arquitetura aplicadas mecanicamente.
Descreve initializer, progresso incremental, estado limpo e verificação end-to-end. O artigo credita contribuições de David Hershey, Prithvi Rajasakeran e outros membros dos times code RL e Claude Code.
Especifica orquestração, workspaces isolados, acompanhamento de trabalho e observabilidade. A FORGE usa a fonte como design input, não como prova de conformidade.
AI Index Steering Committee, sete especialistas do AI Agent Index e o programa DORA formam uma base institucional para performance, transparência, adoção e sistemas sociotécnicos.
System cards descrevem avaliações dos fornecedores. NIST, OWASP, OpenSSF e OpenTelemetry acrescentam padrões e controles fora do modelo. Nenhuma camada substitui as demais.
A lista abaixo espelha as 40 entradas dos dois catálogos públicos. Para cada corte, o source catalog registra publisher, classe, grupo de independência e URL; manifests e receipts acrescentam policy, snapshot e hash.
O corte de 17 de julho sustenta o benchmark v1.7; o de 4 de agosto sustenta a FORGE 3.1. O radar editorial de modelos acima é mais recente e permanece separado desses receipts.
Leitura correta: 40 receipts provam aquisição e source binding nos cortes citados. Eles não atestam automaticamente a veracidade integral da fonte, adoção pela frota, resultado de cliente ou maturidade operacional.