Framework open-source para hacer agentes IA fiables en produccion. 6 tiers progresivos: desde controlar tu agente en 10 minutos hasta CI/CD con evaluaciones automaticas.
Open-source framework for making AI agents reliable in production. 6 progressive tiers: from controlling your agent in 10 minutes to CI/CD with automated evaluations.
CLAUDE.md, AGENTS.md, init.sh, feature_list.json, progress.md, session-handoff.md
4 datasets JSONL (32 escenarios), run-evals.py, score-evals.py, ci-gate.py, rubrica 6 dimensiones
4 JSONL datasets (32 scenarios), run-evals.py, score-evals.py, ci-gate.py, 6-dimension rubric
Logger 10 campos, cost tracker, dashboard Grafana, guia PostHog, alertas presupuesto y drift
10-field logger, cost tracker, Grafana dashboard, PostHog guide, budget and drift alerts
Pre-commit lint, post-task verify, context check, cost guard ($10/session), security scan
Diagnostic loop, multi-session, graph engineering, circuit breaker, HITL, model routing, prompt versioning, agent testing
GitHub Action para evals en PR, quality gate, pre-push check
GitHub Action for PR evals, quality gate, pre-push check
git clone https://github.com/pedri77/ia-engineer-framework.git
cp -r ia-engineer-framework/harness/ your-project/
nano your-project/CLAUDE.md
nano your-project/feature_list.json
# Run your AI agent
| Learn Harness Eng (11.3K stars) | ia-engineer-framework | |
|---|---|---|
| Scope | Solo harnessHarness only | Harness + eval + observe + CI + patterns |
| Eval pipeline | No | Runner + scorer + CI gate |
| ObservabilidadObservability | No | Logger + cost tracker + alerts |
| CI/CD | No | GitHub Action + quality gate |
| IdiomaLanguage | InglesEnglish | Espanol nativoSpanish native |
| FormatoFormat | CursoCourse | Copy-paste to production |
| Lock-in | EspecificoSpecific | Claude Code, Codex, Cursor |