V4 acierta al separar análisis e ingeniería, exigir evidencia y prohibir resultados de herramientas o pruebas inventados. La mejora clave de V4.1 no es añadir más reglas: es concentrar las no negociables en la instrucción principal y mover los procedimientos detallados a la base de conocimiento.
Publicado porImágenes generadas con GPT Image 2
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: 对上述V4 版本进行评审,并给出你的终稿:. Article summary: ```markdown 评审结论:V4 已经解决了“伪造工具、伪造测试、代码片段冒充完整交付、ADR 无证据转正”等核心问题,整体方向正确,但不建议原样上线。它的主要缺陷不是能力不足,而是规则过密、状态重复、Gem 运行边界不够明确,以及“零依赖、自动循环、完整代码、BMAD 多 Agent”仍存在语义歧义。 终稿建议升级为 Solo Engine v4.1 Final :保留 V4 的研究—决策—工程闭环,把不可妥协规则集中到 Gem. Topic tags: deepresearch, general web, agents, ai, workflow. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visua
V4 tiene una base sólida, pero no conviene publicarla sin cambios. Resuelve problemas importantes: evita fingir búsquedas, compilaciones o pruebas; diferencia el código entregado de la validación real; y evita presentar una conversación de roles como si fueran varios agentes autónomos.
La recomendación final es Solo-Engine v4.1 Final. El cambio central no es ampliar la lista de normas, sino hacerla más ejecutable:
/ana-solo para investigación y decisión, y /ana-bmad para planificación, implementación y verificación.FACT, INFERENCE, ASSUMPTION y UNKNOWN.El enfoque inspirado en BMAD es razonable, siempre que se describa correctamente. La documentación de BMAD distingue agentes, skills y flujos de trabajo; por ello, un único Gem puede usar perspectivas de producto, arquitectura, desarrollo, QA y operaciones, pero no debe afirmar que ejecutó varios agentes independientes.1
10
14
Cuando la instrucción principal, los procedimientos de ingeniería y las plantillas repiten estados, dependencias, ADR y criterios de finalización, aumenta el riesgo de que se aplique una versión parcial o contradictoria de la regla.
Corrección: la instrucción principal debe contener solo el contrato operativo: autenticidad, autorización, límites de herramientas, estados y criterios de cierre. Los detalles se consultan en documentos auxiliares.
Un Gem no obtiene por una instrucción la capacidad de trabajar en segundo plano, mantener una terminal persistente o continuar tras finalizar la sesión.
En V4.1, un bucle automático solo puede existir:
WAITING_VERIFICATION si no hay ejecutor real.No puede significar a la vez «sin runtime», «sin paquetes de terceros» y «sin archivos locales no entregados».
La definición operativa propuesta es:
V4.1 separa tres estados:
| Dimensión | Pregunta que responde |
|---|---|
DELIVERY_STATUS |
¿Se entregaron completos todos los archivos necesarios? |
VERIFICATION_STATUS |
¿Se compiló, ejecutó o probó realmente? |
ENGINEERING_STATUS |
¿Hay evidencia suficiente para declarar terminado el trabajo? |
Sin evidencia de ejecución, se puede entregar código completo y una revisión estática, pero el trabajo queda en WAITING_VERIFICATION. No se puede afirmar «sin errores de compilación» ni «tests en verde».
Para un proyecto nuevo, la entrega debe incluir el cierre mínimo: configuración de construcción, entrada, fuentes, pruebas, recursos necesarios y comando de validación.
Para un repositorio existente, deben entregarse completos todos los archivos añadidos o modificados. No hace falta repetir archivos base que el usuario ya proporcionó y no cambiaron; pero si falta una interfaz, tipo o configuración necesaria para compilar, el Gem debe solicitarla en vez de inventarla.
| Dimensión | V4 | V4.1 Final |
|---|---|---|
| Límites de herramientas y autenticidad | 4,0/5 | 4,8/5 |
| Calidad de análisis, matriz y Deep Recon | 4,5/5 | 4,8/5 |
| Salvaguardas de ingeniería | 4,6/5 | 4,8/5 |
| Cierre de dependencias y entrega | 4,6/5 | 4,9/5 |
| Densidad y aplicabilidad de instrucciones | 2,8/5 | 4,5/5 |
| Recuperación y reconciliación de estado | 4,2/5 | 4,7/5 |
| Puntuación de auditoría | 84,2/100 | 95,5/100 |
Estas puntuaciones son una evaluación de diseño y coherencia de configuración, no un benchmark de ejecución.
| Archivo | Ubicación | Función |
|---|---|---|
00-solo-engine-system.md |
Instrucciones del Gem | Rutas, límites, estados y reglas no negociables |
10-ana-solo.md |
Base de conocimiento | Investigación, extracción de valor, matriz de decisión y Deep Recon |
20-ana-bmad.md |
Base de conocimiento | Escenarios, preflight, implementación, validación y entrega |
30-artifacts.md |
Base de conocimiento | Planes, ADR, registros de verificación, informe de verdad y cápsula de reanudación |
40-three-pass-reading.md |
Base de conocimiento | Método de lectura en tres pasadas |
No conviene cargar a la vez archivos antiguos que definan los mismos conceptos: la recuperación de instrucciones podría traer reglas incompatibles.
search_depth=advanced es un parámetro real de Tavily pensado para consultas detalladas y de alta precisión; prioriza relevancia, pero puede aumentar latencia y coste.2
4
11
Por eso, la regla correcta no es «usar Tavily Advanced», sino esta:
advanced cuando no hubo llamada verificable.Además, «SEO produce información de valor» debería llamarse por defecto extracción de valor: evidencia → significado → valor para el usuario → acción → verificación. El análisis SEO se activa únicamente si el encargo trata de palabras clave, indexación, rastreo, ranking o rendimiento de contenido.
La configuración debe considerarse fallida si ocurre cualquiera de estos casos:
DELIVERY_STATUS=COMPLETE.search_depth=advanced.Elegida: Solo-Engine v4.1 Final.
V4 queda como una buena base experimental. V4.1 es más adecuada como configuración estable porque reduce la duplicación, delimita el runtime con honestidad y convierte la entrega, la evidencia y el cierre de ingeniería en contratos separados.
Si más adelante se incorpora un agente gestionado por API, MCP, un espacio de trabajo persistente o un sandbox de código, la solución no debe ser añadir descripciones ficticias de herramientas al prompt principal. Debe crearse un Runtime Adapter específico que exponga sus capacidades, permisos, persistencia y registros de ejecución.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
V4 acierta al separar análisis e ingeniería, exigir evidencia y prohibir resultados de herramientas o pruebas inventados.
V4 acierta al separar análisis e ingeniería, exigir evidencia y prohibir resultados de herramientas o pruebas inventados. La mejora clave de V4.1 no es añadir más reglas: es concentrar las no negociables en la instrucción principal y mover los procedimientos detallados a la base de conocimiento.
La automatización queda limitada a la sesión actual, al alcance autorizado y a las herramientas que estén realmente disponibles.