4aa5c83481
Merge pull request 'Phase 6: train a second LoRA for real Penpot UI design capability' (#5) from agente-fase6-lora2-penpot into master
master
aleleba2026-08-04 21:36:03 -06:00
1e3726a12f
Fase 5: 21_quantize_nvfp4.py - compat shim para bug de import en llmcompressor 0.12.0
aleleba2026-07-29 22:39:12 +00:00
712097e26b
Fase 5: scripts/21_quantize_nvfp4.py - cuantizacion NVFP4 via llm-compressor
aleleba2026-07-29 22:10:41 +00:00
18d50e670f
Merge pull request 'Phase 4: merge LoRA adapter and run full evaluation gates on the merged checkpoint' (#3) from agente-fase4-merge-eval into master
aleleba2026-07-29 13:19:58 -06:00
19dc5f3227
Fase 4: resultados de las puertas 2, 3 y 4 sobre el checkpoint mergeado
aleleba2026-07-29 19:00:02 +00:00
2762761a8e
Fase 4: puerta 1 - reportar tambien loss ponderado por token (comparable a Trainer)
aleleba2026-07-29 17:49:08 +00:00
ceba5f80cd
Fase 4: puerta 1 (eval-loss offline por bucket) y contenedor/scripts de puertas 2-4
aleleba2026-07-29 17:37:02 +00:00
268451aed7
Fase 4: scripts/20_merge_lora.py - merge streaming shard-a-shard del LoRA sobre el checkpoint base
aleleba2026-07-29 17:28:36 +00:00
7e57987385
Fase 3: versionar el adapter LoRA final (pesos + tokenizer + config)
aleleba2026-07-29 16:16:20 +00:00
c275b2ffbf
Merge pull request 'agente-fase3-training: LoRA training script and completed training run' (#2) from agente-fase3-training into master
aleleba2026-07-29 07:13:46 -06:00
c4a0c404aa
Fase 3: scripts/10_train.py - entrenamiento LoRA con masking manual, target_modules confirmados (incluye out_proj de Gated DeltaNet)
aleleba2026-07-29 04:33:29 +00:00
5f912a15db
Merge pull request 'agente-fase2-dataset: Build Phase 2 v1 training dataset from sanitized sources and synthetic seeds' (#1) from agente-fase2-dataset into master
aleleba2026-07-28 19:54:38 -06:00
3f14aa5cec
Fase 2: 06_validate_dataset.py - validacion con tokenizer/chat_template real (1470/1470 ok, 0 excepciones, 0 filtrados, 0 secretos)
aleleba2026-07-29 00:56:23 +00:00
73e7f721cd
Fase 2: seeds de los 6 buckets (294 ejemplos: penpot 41, otros_mcps 102, skills_adherencia 55, delegacion_subagentes 25, negativos 46, manejo_errores 25)
aleleba2026-07-29 00:49:25 +00:00
837f91060f
Fase 2: 04_sanitize.py - scrubbing de secretos de skills/agentes/plans (10 secretos unicos, gate en verde)
aleleba2026-07-29 00:35:59 +00:00
21bc219f31
Fase 1: dataset de replay generado (720 ejemplos, ok=564 truncated=156 failed=0)
aleleba2026-07-28 12:52:33 +00:00
ef35472398
Fix: OUTPUT_PATH de 03_build_replay.py apuntaba a /workspace/... (ruta de contenedor inexistente en el host)
aleleba2026-07-28 05:42:05 +00:00
4d73be8e1b
gitignore: excluir .worktrees/ (usado por agentes autonomos en background)
aleleba2026-07-28 12:51:44 +00:00
b2aa855a70
Fase 1: schemas de los 5 MCPs y script de generacion de replay
aleleba2026-07-28 05:34:55 +00:00
d121c4465e
Fase 0: scripts de verificacion de hardware e inspeccion de modulos
aleleba2026-07-28 03:52:10 +00:00
572ee0b60e
Fase 0: estructura base de carpetas y docker-compose de training
aleleba2026-07-28 03:42:37 +00:00