11acdac337f06564581bc4bbf9b6327aa57abb27
`calibrate_effort.py` כייל `effort` בלבד, על מודל נעוץ (GENERATION_MODEL). כדי להשוות מודל-ייצור (opus-4-8 מול opus-5) מול הסופיים החתומים של דפנה נדרש ממד שני — ללא מסלול-מדידה מקביל. - `block_writer.write_block(model_override=…)` — אותו חוזה כמו `effort_override` הקיים (נוצר בדיוק ל-#208). מקבל את המזהה הבסיסי בלבד; אסקלציית ההקשר-1M (#216) מוחלת מעליו, כך ש-override לא מאבד בשקט את חלון ה-1M. - `--models` ל-harness (ריק = המודל הנעוץ ⇒ ריצת ברירת-המחדל זהה לקודם). - הדוח מקבל טבלת השוואת-מודלים (block × effort × model) ומסמן ⭐ לפי אותו דירוג style-clean (#213): anti_total → ratioΔ → distance. - כל תא מתעד את `model_used` שה-CLI דיווח בפועל; אי-התאמה מסומנת כאזהרת fallback-שקט במקום להיזקף בטעות למודל המבוקש. invariants: INV-G8 (eval-harness — מדידה, לא הרגשה) · G2 (אין מסלול מקביל: משתמש ב-style_distance/learning_loop הקיימים ובשדה result הקיים `model_used`) · §6 (אין בליעה שקטה — כשל-תא מדווח ומדולג). Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Description
AI Legal Decision Drafting System — MCP server, web upload, RAG search
Languages
Python
65.8%
TypeScript
32.2%
JavaScript
1%
Shell
0.7%
CSS
0.2%