FORGE 3.1 · Specified/Shadow — by trustyu.ai

Arquitectura seria.
IA real.
Legado duradero.

Organizamos el conocimiento de mercado, el trabajo asistido por IA y el liderazgo sénior en un proceso verificable. Los resultados, la seguridad y la escala se califican mediante la evidencia de cada producto.

20
fuentes con receipt
12
grupos independientes
3
investigaciones
9
claims proyectadas
dod-loop — feature/auth-flow — PRD
# Loop spec-driven autônomo — ADR-0030
# SPEC → EXPLORE → PLAN → RED → IMPLEMENT → GREEN → SELF-VERIFY

01·SPEC feature-spec ··· ✓ out-of-scope declarado
02·EXPLORE blast-radius ·· ✓ 3 arquivos afetados
03·PLAN blueprint ···· ✓ revisão arquitetural
04·RED contract-first · ↯ 7 testes falham
05·IMPL codegen ····· → mypy: clean, ruff: clean
06·GREEN suite ······ ✓ 7/7 — coverage measured
07·VERIFY smoke ····· ✓ DoD satisfeito

feature-spec-gate ✓ CI gate green — PR ready
agent: claude/auth-flow origem: Claude Code

$
Lo que construimos

Más allá de SaaS.
Software orientado a resultados.

Estas cuatro categorías guían el descubrimiento y el diseño de productos. La idoneidad, la adopción y los resultados comerciales deben validarse en cada contexto.

🏭
SaaS vertical
Software profundo para un segmento específico. Dominio empresarial codificado, no configurado. Ni demasiado horizontal para ser útil, ni demasiado personalizado para escalar.
🤖
Software agéntico
Objetivo: los agentes ejecutan flujos delimitados, con supervisión humana en acciones críticas y evidencia de ejecución.
🧠
IA vertical
Objetivo: el conocimiento del dominio, la personalidad, las barreras de seguridad y los outputs rastreables se evalúan en el producto.
📊
Resultado como Servicio
Hipótesis comercial: vincular el precio a una unidad de valor; la medición y el billing siguen pending.
Nuestra tesis central

La IA no reemplaza a los profesionales.
Los profesionales sénior conducen la IA.

Tratamos la supervisión, la arquitectura y la evidencia como partes del sistema. La investigación source-bound respalda este diseño; no promete una tasa de ganancia universal ni reemplaza la validación del producto.

👤 Profesional sénior

Juicio estratégico, experiencia en el dominio, decisiones arquitectónicas, responsabilidad.

🏗️ Arquitectura y gobernanza

Seguridad por diseño, multi-tenancy y cumplimiento como decisiones versionadas para una evolución duradera.

🔎 Validación empírica

Humano en el loop en los puntos críticos. Pruebas antes del código. Evidencia antes de declarar algo listo.

+
> suma
de sus partes
=

⚡ Ejecución asistida

Los agentes pueden realizar un trabajo repetible dentro de una especificación, límites de capacidad y comentarios verificables.

🔁 Consistencia evaluable

Los estándares, las pruebas y los receipts hacen que el resultado sea inspeccionable; la consistencia sigue midiéndose, no se presume.

📐 Reutilización con calificación

El Template ofrece defaults; cada producto aún necesita demostrar su adopción y sus resultados en el propio SHA.

Riesgo 01

La IA sin gobernanza humana aumenta el riesgo

La capacidad del modelo no reemplaza el aislamiento, el privilegio mínimo, las pruebas, la provenance y la revisión de acciones irreversibles.

Riesgo 02

La adopción sin harness genera fragilidad

La adopción segura depende de un workflow explícito, cambios revisables y decisiones duraderas; un mejor prompt no reemplaza el harness.

Oportunidad

Humano + IA exige ganancias medibles

La calidad requiere criterios de eval y ejecución observable; El costo sólo es útil cuando se vincula a una unidad de valor del producto.

Definición de hecho

Nada está listo
sin pasar por los 7 pasos.

Loop spec-driven definido como default de Template. Desde la ADR-0068, convención de rama, pie de página de origen y asiento de sesión ya no son advertencias y ahora son bloqueantes dentro del gate permanente. La cobertura de cada producto sigue declarándose mediante evidence vinculada a su propio SHA.

01 · SPEC
Especificación
El ser humano define
02 · EXPLORE
Exploración
La IA ejecuta
03 · PLAN
Blueprint
Revisión
04 · RED
Pruebas primero
Gate obligatorio
05 · IMPLEMENT
Implementación
La IA ejecuta
06 · GREEN
Suite Verde
Gate CI
07 · SELF-VERIFY
Autocomprobación
La IA itera

Por qué un DoD formal cambia el juego: La IA sin un oráculo corrector inventa una salida. Con SPEC→RED→GREEN, la IA tiene un objetivo verificable: no un código que parece correcto, sino pruebas que demuestran que es correcto.

✓ spec presente · ✓ tests en el diff · ✓ cobertura por profile/riesgo · ✓ lint limpio
feature-spec-gate — CI check
# ADR-0030 — default verificável por produto

spec-present ······ ok
tests-in-diff ····· ok
coverage evidence · profile + SHA
out-of-scope ····· declared
ruff ············ clean
mypy ··········· clean

gate: EXAMPLE — template default
produto requer evidence própria

$

Protección fuera de alcance: cada característica declara lo que no hace. Elimina el desplazamiento del alcance y evita que la IA expanda el alcance por sí sola.

Ingeniería basada en evidencia

Normas públicas.
Controles verificables.

Las prácticas de arquitectura, seguridad y entrega se traducen en valores predeterminados y controles. La adopción y los resultados siguen dependiendo de la evidencia de cada producto.

🗺️
Diseño basado en dominios
Los contextos acotados, las raíces agregadas y los eventos de dominio son parte del diseño de referencia; cada producto valida el modelo en su propio dominio.
DDD · ADR-0012
🧱
Monolito modular
El monolito modular es el valor arquitectónico predeterminado. La extracción de servicios, la autenticación, la facturación y la IA dependen de la decisión y la evidencia del producto.
Arquitectura limpia
🔒
Seguridad por diseño
El modelo de amenazas STRIDE, los escáneres, el endurecimiento de la cadena de suministro, los ganchos y el RLS son controles de referencia; la presencia y el cumplimiento son verificados por el consumidor.
STRIDE · Cadena de suministro · RLS
📝
Conventional Commits + SemVer
Commitlint, versionado, CHANGELOG y VersionBadge son defaults del workflow; la ejecución debe demostrarse en el repositorio consumidor.
semantic-release · ADR-0023
🧪
Pruebas de riesgo
Las pruebas y la cobertura se miden por profile y riesgo. La ADR-0069 fija el límite de esta proporcionalidad: la profundidad gobierna la batería de calidad y nunca los ejes de seguridad y semántica: un escáner se ejecuta porque el código ha cambiado, no porque el riesgo haya sido clasificado como alto.
Proporcional por eje · ADR-0069
🌍
Multi-tenancy jerárquico
El esquema, RLS, RBAC y la identidad en JWT son valores predeterminados; Un aislamiento eficaz requiere pruebas vinculadas al entorno y al SHA del producto.
RLS · RBAC · 5 roles
💰
FinOps de Build & Deploy
Las reglas para evitar implementaciones innecesarias y medir el uso son parte del diseño. El costo completo y la economía unitaria siguen en la calificación por producto.
Presupuestos · ADR-0027
🔄
Worktrees de aislamiento
Una característica por árbol de trabajo es el protocolo de coordinación. La ausencia de colisiones sigue siendo un resultado observado, no una promesa universal.
1 característica = 1 árbol de trabajo
📋
ADR: decisiones versionadas
Los ADR registran decisiones, estado y evolución; El estado actual y el cumplimiento siguen sujetos a verificación mediante el corte aplicable.
Decisión · Estado explícito
Ciclo del producto

Del problema a
producto calificable.

Seis fases forman el ciclo predeterminado. El producto sólo avanza cuando su evidencia cumple con los criterios aplicables; el humano mantiene la decisión.

P1
Descubrimiento y dominio
Dominio, contextos acotados, personas, dolor real validado.
Explica en 2 minutos quién paga
P2
Arquitectura y alcance
ADR de productos, pila heredada, seguridad antes del commit.
Decisiones documentadas
P3
Arranque e infraestructura
El repositorio recibe CI/CD y los valores predeterminados del entorno.
Control de salud como objetivo
P4
Desarrollo de MVP
Loop de DoD por feature y gates proporcionales al riesgo.
Discreción del piloto
P5
Validación y polaco
E2E, incidencias y coste se miden en la ventana definida.
Evidencia del producto
P6
Lanzar e iterar
La retroalimentación estructurada y el aprendizaje regresan al método.
Resultado validado

Por qué es importante este ciclo: El dominio, la arquitectura y la infraestructura se explican antes de escalar. La reducción de costes de retrabajo y mantenimiento son hipótesis a medir por producto.

Cómo funciona correctamente la IA

Squad especializada.
Roles, herramientas, loops.

El protocolo modela agentes por rol, herramientas permitidas, bucle y asiento. SQ. El siguiente diagrama describe el mecanismo; la adopción y el resultado dependen de la ejecución observada.

El rol define responsabilidad y capacidad; el modelo se selecciona por tarea. Los nombres, precios y estados de los modelos se encuentran en la modelos fechados por radar.

🏛️
Arquitecto
ADR, DDD, decisiones estructurales
Razonamiento de fronteraRevisión · solo lectura
🔐
Seguridad
Modelado de amenazas, SAST, RLS
Revisión críticaAislamiento de solo lectura
💻
backend
FastAPI, SQLAlchemy, Alambique
Ejecución equilibradaHerramientas completas · gates
🖥️
Interfaz
Next.js, TypeScript, shadcn/ui
Ejecución equilibradaHerramientas completas · gates
🤖
Ingeniero de IA
LangGraph, LLMFactory, RAG
Ejecución agenteHerramientas delimitadas · eval
🧪
control de calidad
Contrato primero, dramaturgo E2E
VerificaciónPruebas · lectura
⚙️
SRE/DevOps
CI/CD, implementación, monitoreo
Operación supervisadaGates de aprobación · reversión
✍️
Escritor técnico
ADR, README, especificaciones
Resumen técnicoLectura · redacción de documentos
routing-policy — reviewer:security
# política estável; seleção concreta em runtime

routing:
strategy: task-aware
criteria: [risk, complexity, eval, cost, latency]
tier: frontier-reasoning

tools:
Read ·········· allowed
Grep ········· allowed
Glob ········· allowed
Write ······· DENIED
Bash ······· DENIED

reviewer cannot write code. by design.
squad roster — sessões ativas (SQ)
# ADR-0034 — assento SQ por sessão de IA (D7)

claude·SQ7 · claude/auth-flow ··· :3070 RED→GREEN
codex·SQ3 · codex/webhook-retry :3030 REVIEW
claude·SQ11 · claude/rls-tenant ·· :3110 SPEC

seat alloc: wt new → menor SQ livre (sem colisão)
EXEMPLO · 3 sessões · 1 worktree por sessão

Habilidades especializadas

El catálogo asocia rol, comportamiento esperado, guardrails, DoD y eval-harness. El inventario y la adopción se verifican en el corte aplicable.

Catálogo · Basado en eval

Enrutamiento por tarea, no por rol

El riesgo, la complejidad, la eval, el costo y la latencia deciden el nivel. El modelo concreto puede cambiar sin reescribir los roles, herramientas o gates del escuadrón.

Política estable · catálogo en vivo

Protocolo auditable D1-D7

Trabajo previo obligatorio, sucursales nombradas, relaciones públicas identificadas, árboles de trabajo aislados y asientos de sesión. Coordenada D1–D5 · D6 aislar · D7 identificar.

D1-D7 · Multisesión

Límite de autonomía declarada

Ejecuta SPEC→SELF-VERIFY de forma autónoma, pero escala a humanos en especificaciones ambiguas, decisión estructural sin ADR ni acceso a PRD.

HITL · Gates explícitas
Foundation — defaults de Template

El producto nace con
defaults verificables.

El andamio proporciona una base reutilizable. Cada producto debe demostrar adopción, configuración y cumplimiento en su propio repositorio y SHA.

🔐 Seguridad en profundidad

La canalización, la cadena de suministro, el runtime y los datos reciben controles de referencia. El consumidor debe demostrar presencia, configuración y cumplimiento.

Predeterminado · 5 capas

🏢 Multi-tenancy y RBAC

El esquema, los roles y la identidad en JWT son parte del valor predeterminado. El aislamiento es una propiedad a probar en el contexto del producto.

Valor predeterminado de aislamiento

🚀 CI/CD con doble gate

SemVer y VersionBadge son los valores predeterminados. Desde ADR-0064, la sucursal staging está justificado por tener un entorno de ensayo implementado, no por tipo de repositorio: los que publican por etiqueta o SHA van desde feature → main. La disponibilidad y FinOps requieren medición en el entorno del consumidor.

Sucursal por entorno · ADR-0064

🧪 La calidad como sendero

Las especificaciones, evidencia y cobertura de riesgos se incluyen por defecto; La ejecución sólo se declara con la evidencia del consumidor.

Template default

🌍 i18n Nativo

El producto nace internacionalizado. pt-BR predeterminado, secundaria en-US. Anulación por cliente a través del banco: sin reconstrucción.

Pt-BR · es-US

📡Observabilidad gobernada

El perfil seguro de privacidad de OTel GenAI y el verificador source-bound se integran en el runtime 0.18; el manifiesto SHA256SUMS tiene la firma verificable Ed25519. La telemetría real del producto requiere rollout y evidencia.

OTel GenAI · Shadow
Seguridad en profundidad

Seis capas.
Ninguna confía en la anterior.

El diseño utiliza defensa en profundidad: cada capa tiene su propio control y boundary. ADR y Template definen el default; cada producto debe demostrar que el control está presente y es eficaz.

01
Pipeline
Gitleaks, CodeQL, Trivy y alertas de dependencia conforman el perfil de referencia; el cheque del consumidor demuestra el cumplimiento.
ADR-0028
02
cadena de suministro
El tiempo de recuperación, la revisión de dependencias y el análisis de comportamiento son controles complementarios proporcionados de forma predeterminada.
ADR-0039
03
runtime del agente
Los ganchos y las listas permitidas por rol limitan las operaciones. La política aplicada y su resultado deben aparecer en la evidencia de la tarea.
ADR-0037 0024
04
Datos: aislamiento de tenants
RLS, extensión de acceso y trampilla de escape auditable forman el diseño cerrado a prueba de fallos; Las pruebas del producto demuestran el aislamiento.
ADR-0040
05
Medio ambiente — STG ⊥ PRD
El espacio de nombres de caché, las instancias separadas y la auditoría de infraestructura son invariantes de referencia, verificadas por el entorno.
ADR-0040 · zancada
06
Organización: quién logra el código
Se concede acceso a equipo, nunca la persona: un grant directo de persona→repositorio se trata como un defecto de gobernanza, porque desvincular a alguien dependería de buscar grants dispersos. El default es exposición cero por omisión.
ADR-0067
Caso real · incidente P0 → invariante de plataforma

Un incidente histórico de almacenamiento en caché entre entornos generó tres invariantes de referencia: aislamiento del entorno, aislamiento de tenants y defensa en profundidad. El aprendizaje se codificó en ADR; cada producto aún debe demostrar su adopción.

Orquestación de IA

IA como ejecutor,
No como copiloto.

Los modelos y proveedores cambian rápidamente. La arquitectura propone separar el comportamiento del producto y del proveedor; Las rutas reales requieren evals, telemetría y evidencia de producto.

Anthropic Claude ruta evaluada
Familia de modelos disponible para el socio de ingeniería
La activación por producto requiere eval y política.
OpenAI GPT & Codex ruta evaluada
Ingeniería agente y alternativas de runtime
La activación por producto requiere eval y política.
Google Gemini preparado
Contextos largos y rutas rápidas y de menor coste
Rutas declaradas; la activación requiere eval del producto
xAI Grok radar gobernado
Nueva opción de frontera para el razonamiento y el uso de herramientas.
Evaluar por ADR+ costo, calidad, seguridad y latencia antes de adoptar
Regla de Honestidad: La lista de procesos de ingeniería no prueba la disponibilidad de runtime de ningún producto. El nuevo proveedor sólo debe ingresar con un adaptador, pruebas y evaluación comparable.

Orquestación, no dependencia

LLMFactory es el mecanismo propuesto para separar comportamiento y proveedor; Se debe probar la portabilidad.

Costo vinculado al resultado

El esquema y la telemetría son objetivos. La facturación oficial, la conciliación y la unidad de valor aún requieren evidencia del producto.

Humano en puntos críticos

Los gates ante acciones irreversibles son parte del diseño; La ejecución se verifica por tarea.

RAG por dominio

La incorporación de aislamiento y herencia de conocimientos son valores predeterminados sujetos a pruebas de tenants.

Investigación source-bound

Fuente recibida.
Claim delimitado.

El recorte público aprobado no respalda la TAM, la CAGR ni la productividad comercial universal. Es por eso que estos números abandonan la página hasta que pasan por la revisión de intake y licencia.

20
Fuentes aprobadas
Cada ID de fuente está vinculado a una URL, una instantánea, un hash, una base de uso y un receipt sanitizado.
mechanism · corte 4 de agosto de 2026
12
Grupos independientes
La investigación evita confundir el volumen de enlaces de un mismo editor con la corroboración.
mechanism · catálogo fuente
3
Investigaciones multi-source
Las API/cobertura, el harness multijugador y la publicación source-bound se evaluaron por separado.
Paquete de investigación de mecanismos
9
Claims proyectadas
El propietario, el revisor, la validez, los enlaces de origen y los límites de inferencia son legibles por máquina.
mechanism · claim de proyección
0
Texto externo sin formato
El espejo publica provenance y receipts; Se prohíben los prompt, transcripciones, PII, secretos y corpus externos completos.
Privacidad segura · copia cero
6
Estados públicos
Mechanism, template default, pilot observation, target, pending e historical son estados distintos.

Lo que este corte nos permite decir: La confiabilidad, la seguridad, la provenance, las evals y el costo deben ser propiedades del sistema.. Los resultados comerciales y la adopción de productos quedan fuera de esta evidencia.

Confianza para decidir · evidencia para auditar

El modelo cambia.
Tu negocio continúa.

La pregunta no es sólo “¿qué IA usar?” Y cómo acelerar sin convertir a los clientes, los datos y la inversión en un experimento. FORGE organiza personas, decisiones, controles y evidencia en torno a la IA para que el producto evolucione sin perder sus bases.

01 · VELOCIDAD CON CONTROL

Objetivo: reducir el plazo de entrega con control

El trabajo repetible se puede automatizar; Las decisiones comerciales, arquitectónicas y de riesgo permanecen bajo la responsabilidad de la alta dirección.

02 · INVERSIÓN PROTEGIDA

Objetivo: reducir el coste de cambio de modelo

La separación entre dominio y proveedor es un mecanismo arquitectónico; La portabilidad requiere pruebas del producto.

03 · CONFIANZA DEMOSTRABLE

Decisiones que deben dejar evidencia

Los requisitos, pruebas, aprobaciones y releases solo se pueden reconstruir cuando se vinculan a la fuente, SHA y la persona responsable.

04 · APRENDIZAJE QUE ACUMULA

Un error no tiene por qué convertirse en rutina

El circuito cerrado prevé que las lecciones vuelvan al método como prueba, control o regla; Es necesario medir la eficacia.

Resumen de fuentes aprobadas.
Traducido al método.

La síntesis pública se deriva únicamente de la proyección aprobada. Las fuentes externas pasan por intake, hash, revisión de uso y receipt; un enlace de descubrimiento, por sí solo, no sustenta un claim.

Investigación realizada, no sólo citada. En el corte de RC, 20 fuentes aprobadas de 12 grupos independientes respaldaron 20 recibos verificables, tres estudios y nueve claims rastreables, sin persistir contenido externo sin procesar. Inspeccionar el registro público →

0.8SHA256SUMS histórico con firma Ed25519 verificable
17 de juliofecha corte; no estado actual
20 / 20fuentes aprobadas con recibo verificable
17Capacidades comparadas con el mercado.
Histórico · corte 19 jul 2026

En ese corte se registró la readiness únicamente del marco. Demuestra el mecanismo y la disponibilidad de la base de entonces, no la cobertura, los contratos ni el funcionamiento de cada producto actual.

rollout 3.1: Los defaults de Template, las observaciones piloto y la calificación operacional permanecen como estados separados. Operational y Attested no están declarados.

Las organizaciones citadas son fuentes públicas de investigación y prácticas de mercado; no existe ninguna afirmación de asociación, certificación o respaldo. corte actual source-bound: 4 de agosto de 2026 · 03:27 UTC. Histórico del marco de readiness únicamente conciliado el 19 de julio de 2026.

Tablero de evolución · 17 capacidades

De JARVIS a FORGE.
Lo que realmente cambió.

Esta es la tabla técnica publicada originalmente en la página de inicio y conservada en el benchmark. Compara capacidades, procesos y controles con el consenso del mercado. Los 17 veredictos pertenecen al histórico corte del 17 de julio; FORGE 3.1 aparece por separado para no transformar la especificación o la shadow en prueba operativa.

Mercado de referencia 2025-2026

Estándares de referencia

Las fuentes primarias y normativas definen qué observar en contexto, seguridad, evals, evidencia, operación y costo. No representan asociación ni certificación.

Fuente · JARVIS / Forge 1.x

Método y fundamento

Los Templates P1–P6, ADR, principios de arquitectura, la squad y los productos reales formaron la base. El período es cualitativo: no recibió una columna ni una puntuación retroactiva.

Línea base formal de FORGE 2.0

Proceso repetible

Las habilidades, los árboles de trabajo, SPEC→PR, revisión-remediación, ganchos, MCP, seguridad y FinOps hicieron que el proceso fuera comparable; la transición 2.1 agregó controles y readiness.

Estado de publicación actual · FORGE 3.1

Specified / Shadow

Las coberturas, contratos y harness se definen como evidencia por riesgo y SHA. Fleet Enforced, Operational y Attested permanecen fuera del claim publicado.

Cómo leer: la escala —/D/C/V/A/O significa ausente, documentado, controlado, verificado, atestiguado y en funcionamiento. El estado actual de 3.1 no vuelve a calcular silenciosamente un benchmark congelado.

Método abierto, fuentes y evidencia →
Madurez ausente Ddocumentado Crevisado Vcomprobado Acertificado Ooperante
Diecisiete capacidades comparadas entre el consenso del mercado, FORGE 2.0, FORGE 2.1 y el corte histórico de FORGE 3.0.
EjeConsenso de mercado 2025-2026Forge 2.0Forge 2.1Corte Forge 3.0 · 17 julVeredicto histórico
Ingeniería de contextoMapa breve, conocimiento versionado, divulgación progresiva y frescura mecánica.
CADR, habilidades e instrucciones sólidos pero extensos.
VPresupuestos, fragmentos, historial y registro de capacidades.
VMecánica de verificación de canon y divulgación progresiva.
FuerteLo que queda es una deriva semántica entre anclas y estado de vida.
ADR y estado de vidaDecisión persistente/reemplazada; estado operativo actual separado.
DDecisiones versionadas, estatus con deriva residual.
CCatálogo de gobernanza y estado de vida.
C0039/0040 conciliado y sometido a ratificación.
AlineadoLa frescura semántica todavía requiere revisión humana.
Controles ejecutablesTitular, aplicabilidad, prueba, ejecución, excepción y plazo.
DReglas distribuidas entre ADR y CI.
CCatálogo y perfiles deterministas.
V14 controles, hechos diff y evidencia explícita.
ArribaFalta acreditar cobertura en cada cambio real aplicable.
Desarrollo impulsado por especificacionesEspecificar como fuente, fuera de alcance, contratos antes del código y trace hasta la aceptación.
CBucle SPEC→PR y Contrato-Primero.
CGate y especificaciones de funciones estandarizadas.
VTrace y verificadores independientes.
FuerteMedir defectos y rework evitados, no el uso del Template.
Aislamiento de escrituraUna tarea/workspace/rama; lectura paralela; un solo escritor por artefacto.
CÁrbol de trabajo por característica y protocolo D5/D6.
CAsientos y lista explícitos.
VSuperposición, titularidad y desmontaje de guardas.
FuerteRegistro de desmontaje en cada tarea real.
Sandbox y privilegios mínimosFS, red, secretos y herramientas por tarea; denegación por defecto; credencial corta; HITL.
DAislamiento de barandillas y árboles de trabajo.
CPerfiles de riesgo y capacidades.
CHub #683 y CRM #1621 aprobaron la provenance sin aprobar el agregado; #688 falló.
ParcialFalta de gate global aprobada, aprobaciones/capacidades y cobertura longitudinal.
Gobernanza de herramienta/MCPHerramientas mínimas, esquemas claros, alcances, lista de permitidos y auditabilidad.
CMCP canónico e inventario por repositorio.
CActivación por contexto y fase.
VEnrutamiento de capacidades y contratos validados.
AlineadoPruebe el perfil de la herramienta por tarea y controle el costo del contexto.
evals de IAModelo + harness + entorno; ensayos aislados; graders calibradas; Costo y latencia.
Deval-harness en parte de las habilidades.
CBaseline de cambio de IA y gates.
VCorpus técnico 12/12 con enlace fuente/perfil/SHA.
FuerteEscale hasta 20-50 fallas reales y mida el costo por tarea.
Pruebas y atestaciónEl ejecutor no da fe de sí mismo; enlace de fuente/SHA/perfil; artefacto verificable.
DEvidencia heterogénea sobre IC y PR.
CContratos de evidencia y provenance definida.
CManifiesto SHA256SUMS de runtime 0.8 con firma Ed25519; fixture sintética 6/6 Verified; Observer EVD=2/5 y VER=2/9.
ParcialFalta pack real, cobertura ≥95%, gate global homologada y ventana longitudinal.
cadena de suministroBloqueo/pin inmutable, SBOM, provenance, constructor confiable y verificación.
CBloqueos, escaneos y acciones parcialmente fijados.
CRecolectores de línea de base y evidencia.
VManifiesto SHA256SUMS 0.8 con firma Ed25519 y 9 assets inventariados; Template fijado con rollback 0.7.
FuerteNo declare el nivel SLSA sin cumplir todos los requisitos.
readiness, SLO y reversiónSLI/SLO, presupuesto de errores, reversión probada, runbook y condición de parada.
Dreadiness principalmente manual.
CSLO, cuadro de mando y gates definidas.
CObservador firmado: 11 cambios en 2 días; ventana abierta.
ParcialRequiere ≥20 cambios, 30 días, estabilidad y ejercicios piloto.
Aprendizaje de circuito cerradoLa revisión o incidencia se convierte en prueba, eval, control o mejora duradera.
CRevisar-remediar y versionar el historial.
CRegistros de aprendizaje y propiedad.
VLa retroalimentación produce controles, evals y regresiones probados.
AlineadoMedida de recurrencia evitada y efectividad, no número de registros.
FinOps y economía unitariaCosto por unidad de valor/resultado, atención humana y denegación de billetera.
COmisión de implementación y costo por producto.
CPresupuestos por sucursal, agente y gate.
CM15: Acciones −47,20%/día; minutos por cambio +28,27%.
Arriba en la gobernanzaObjetivo incumplido por 2,80 p.p.; la eficiencia de la unidad retrocedió; Modelos faltantes y tiempo humano.
Roles sénior y control humanoSenior define intención, riesgo y gusto; autonomía proporcional y aprobaciones claras.
DPersonas y roles de escuadrón.
CActivación por riesgo/fase y gates humanos.
CPropietario y decisión explícitos; aprobador técnico único.
Alineado con la advertenciaEl fundador/CTO es hoy el único aprobador técnico real.
Observabilidad agenteAbarca modelos/herramientas, resultados, tokens, costos, políticas y privacidad.
DTelemetría desglosada por producto.
CEsquema de receipts y métricas de harness.
CSubconjunto de seguridad de privacidad de OTel GenAI en runtime 0.8, cubierto por el manifiesto SHA256SUMS firmado.
AtrásFalta la telemetría del producto real vinculada a tokens/costo/resultado/receipt.
provenance/closeout de la emisiónAutoría, decisión, implementación, validación y residual reconstruible.
DLiquidaciones inconsistentes y registros no probados.
DProblema reconocido, aún no hay gate común.
CADR-0051 y gate de closeout en canónico.
Arriba en el contrato.Parcial en la flota; La propagación se producirá por contacto normal.
Adopción y aseguramiento externoUsuario independiente, paquete/licencia, soporte, actualización/reversión y paquete de evidencia.
Sin producto de marco externo.
DEstrategia de extracción documentada.
DConformidad/EEP inventariado por el manifiesto SHA256SUMS firmado en 0.8; sin adoptantes externos.
AtrásNo habrá adoptantes externos independientes hasta que se corte.
Evidencia por estado

No confundas mecanismo
con operación.

Este sitio sólo publica lo que el artefacto correspondiente le permite concluir. La calificación del producto 3.1 permanece pendiente hasta que la evidencia se vincule al repositorio, el perfil y el SHA.

20 / 20
Mechanism
Intake e investigación ejercidas con receipts aprobados al corte del 17 de julio.
Por defecto
Template default
Se pueden crear especificaciones, pruebas y controles en el andamio; el consumidor aún necesita demostrar la adopción.
2 días
Pilot observation
El Observador Histórico registró 11 cambios de shadow; Esto no califica a la flota actual.
Target
Coberturas y contratos
Los thresholds por riesgo, OAS/eventos y ARR v2 son objetivos verificables, no claims entregados.
Pending
Producto 3.1
No hay evidencia elegible publicada para declarar cobertura, operación o attestation universal.
v1.7
Historical
Benchmark, runtime 0.8 y Observer permanecen congelados para su trazabilidad.
Sectores

verticales con
verdadero dolor.

Las siguientes verticales son hipótesis de aplicación y roadmap. Ninguna representa adopción, operación ni resultados comprobados en este corte público.

⚖️
Servicios Legales
Liderar la calificación, gestión de casos y automatización con agentes especializados en el ámbito legal.
● Evidencia 3.1 pendiente
🏥
Salud
Gestión clínica, programación, registros médicos con IA. La alta regulación exige una arquitectura auditable.
● Siguiente
🏗️
Ingeniería y Construcción
Hipótesis: gestión de proyectos, informes asistidos y cumplimiento.
● Pipeline
🎓
Educación
Hipótesis: plataformas adaptativas, tutores y gestión académica.
● Roadmap
🏦
Servicios financieros
Hipótesis: cumplimiento, análisis de riesgos y automatización auditable.
● Roadmap
🚀
Tu vertical
El producto puede partir de los defaults de Template y debe calificarse en su propio contexto. Habla con nosotros.
● Contáctenos
Corte publicado source-bound

Evidencia legible por humanos y máquinas.

20
fuentes
20
receipts
12
grupos
3
investigaciones
9
claims
21
llamadas HTTP
0
llamadas modelo
0
texto externo sin formato
Arquitectura seria. IA real. Legado duradero.

No creemos en el reemplazo humano. El objetivo es combinar conducción senior, IA, DoD formal y roles especializados; Las ganancias y los resultados deben medirse en el contexto de cada producto.

Charla sobre tu proyecto Lee nuestra tesis

¿Construimos juntos la IA de tu mercado?

Reunimos conocimientos de dominio y de ingeniería para especificar, construir y medir un producto en el contexto de su mercado.

contato@trustyu.ai