mirror of
https://github.com/affaan-m/ECC.git
synced 2026-08-20 14:32:24 +02:00
Model-routing guidance across the rules, skills, and harness-steering docs still recommends Sonnet 4.6 / Opus 4.5-4.6 by name. Readers on the current generation have to map those onto Sonnet 5 / Opus 5 themselves, and the recommendation reads as pinned to a superseded generation. Renames the recommended models in guidance tables and updates two pinned model IDs in code samples: - rules/steering guidance: .cursor, .kiro, and the seven translated performance.md copies (ja-JP, zh-CN, zh-TW, ko-KR, pt-BR, es, tr) - skills/prompt-optimizer complexity-routing table (+ zh-CN copy) - skills/cost-aware-llm-pipeline MODEL_SONNET constant (+ zh-CN, ja-JP) - docs/examples project-guidelines template, which pinned the invalid ID claude-sonnet-4-5-20250514 (+ zh-TW, ja-JP copies) Deliberately left alone: - The "Pricing Reference (2025-2026)" table in cost-aware-llm-pipeline. Renaming those rows while keeping the existing per-token figures would assert Claude 5 pricing this change has not verified. - Executable model config (.opencode/opencode.json, agent.yaml). Those pins change real agent behavior and belong in their own reviewed change. - Historical and illustrative references: the-shortform-guide session transcripts, the ECC-PRO roadmap log entry, gan-style-harness's "Opus 4.5-class"/"Opus 4.6-class" capability tiers, and strategic-compact's deliberately generic "400k Opus 4.x" example. - docs/ATLAS-CLOUD-GUIDE.md, which lists a third-party provider's catalog. Documentation wording only; no behavioral change. Co-authored-by: Phumchai Tanonsi <274848436+phumchai1515-prog@users.noreply.github.com>
56 lines
2.0 KiB
Markdown
56 lines
2.0 KiB
Markdown
# Optimización de Rendimiento
|
|
|
|
## Estrategia de Selección de Modelos
|
|
|
|
**Haiku 4.5** (90% de la capacidad de Sonnet, 3x ahorro de costos):
|
|
- Agentes ligeros con invocación frecuente
|
|
- Programación en pareja y generación de código
|
|
- Agentes workers en sistemas multi-agente
|
|
|
|
**Sonnet 5** (Mejor modelo para codificación):
|
|
- Trabajo de desarrollo principal
|
|
- Orquestación de flujos de trabajo multi-agente
|
|
- Tareas de codificación complejas
|
|
|
|
**Opus 5** (Razonamiento más profundo):
|
|
- Decisiones arquitectónicas complejas
|
|
- Requisitos de razonamiento máximo
|
|
- Tareas de investigación y análisis
|
|
|
|
## Gestión de la Ventana de Contexto
|
|
|
|
Evitar el último 20% de la ventana de contexto para:
|
|
- Refactoring a gran escala
|
|
- Implementación de features que abarca múltiples archivos
|
|
- Depuración de interacciones complejas
|
|
|
|
Tareas con menor sensibilidad al contexto:
|
|
- Ediciones de un solo archivo
|
|
- Creación de utilidades independientes
|
|
- Actualizaciones de documentación
|
|
- Correcciones de bugs simples
|
|
|
|
## Extended Thinking + Modo Plan
|
|
|
|
El extended thinking está habilitado por defecto, reservando hasta 31,999 tokens para razonamiento interno.
|
|
|
|
Controlar el extended thinking mediante:
|
|
- **Toggle**: Option+T (macOS) / Alt+T (Windows/Linux)
|
|
- **Config**: Establecer `alwaysThinkingEnabled` en `~/.claude/settings.json`
|
|
- **Límite de presupuesto**: `export MAX_THINKING_TOKENS=10000`
|
|
- **Modo verbose**: Ctrl+O para ver la salida del pensamiento
|
|
|
|
Para tareas complejas que requieren razonamiento profundo:
|
|
1. Asegurarse de que el extended thinking esté habilitado (activado por defecto)
|
|
2. Habilitar el **Modo Plan** para un enfoque estructurado
|
|
3. Usar múltiples rondas de crítica para un análisis exhaustivo
|
|
4. Usar sub-agentes con roles divididos para perspectivas diversas
|
|
|
|
## Solución de Problemas de Build
|
|
|
|
Si el build falla:
|
|
1. Usar el agente **build-error-resolver**
|
|
2. Analizar los mensajes de error
|
|
3. Corregir de forma incremental
|
|
4. Verificar después de cada corrección
|