Skip to content

Nicht erhobene Kategorien nicht schätzen, Gesamtscore als Spanne - #14

Merged
GodModeAI2025 merged 1 commit into
mainfrom
learnings/2026-09-16
Sep 16, 2026
Merged

GodModeAI2025 merged 1 commit into
mainfrom
learnings/2026-09-16

Conversation

@GodModeAI2025

Copy link
Copy Markdown
Owner

Fehlen für eine Scoring-Kategorie die Daten (kein Chrome-Zugriff, Profil eingeschränkt sichtbar, Kunde kann nichts ergänzen), bekam sie bisher trotzdem einen Punktwert. Ein Schätzwert sieht im Report so belastbar aus wie ein erhobener, eine 0 behauptet „fehlt“ statt „nicht gesehen“.

  • references/SCORING.md: Abschnitt „Nicht erhobene Kategorien“ mit Reihenfolge (erheben, Kunden fragen, erst dann nicht erhoben), Spannenrechnung Untergrenze/Obergrenze und Rechenbeispiel.
  • PHASE-2-scoring.md, PHASE-8-report.md und die Verifikation in SKILL.md verweisen darauf.
  • scripts/generate_report.js: raw/weighted/pct null wird als „n. e.“ dargestellt, Gesamtscore als Spanne mit erklärendem Absatz, Bewertungsstufe als Untergrenze gekennzeichnet. Mit vollständigen Daten unverändert.
  • tests/run_eval.py: --result akzeptiert null je Kategorie, prüft die gemeldete Spanne und dass sie das erwartete Band berührt. Der Referenzlauf der Fixtures muss weiterhin vollständig sein.

Anregung: kalyanprakash/linkedin-profile-score (Abstention statt Nullwert, Unter- und Obergrenze), Idee übernommen, kein Code.

Fehlen für eine Scoring-Kategorie die Daten (kein Chrome-Zugriff, Profil
eingeschränkt sichtbar, Kunde kann nichts ergänzen), bekam sie bisher
trotzdem einen Punktwert. Ein Schätzwert sieht im Report so belastbar
aus wie ein erhobener, eine 0 behauptet „fehlt“ statt „nicht gesehen“.

- references/SCORING.md: Abschnitt „Nicht erhobene Kategorien“ mit
  Reihenfolge (erheben, Kunden fragen, erst dann nicht erhoben),
  Spannenrechnung Untergrenze/Obergrenze und Rechenbeispiel.
- PHASE-2-scoring.md, PHASE-8-report.md und die Verifikation in SKILL.md
  verweisen darauf.
- scripts/generate_report.js: raw/weighted/pct null wird als „n. e.“
  dargestellt, Gesamtscore als Spanne mit erklärendem Absatz, Bewertungsstufe
  als Untergrenze gekennzeichnet. Mit vollständigen Daten unverändert.
- tests/run_eval.py: --result akzeptiert null je Kategorie, prüft die
  gemeldete Spanne und dass sie das erwartete Band berührt. Der
  Referenzlauf der Fixtures muss weiterhin vollständig sein.

Anregung: kalyanprakash/linkedin-profile-score (Abstention statt Nullwert,
Unter- und Obergrenze), Idee übernommen, kein Code.

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
@GodModeAI2025
GodModeAI2025 merged commit 3cc1c5d into main Sep 16, 2026
1 check passed
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant