Skip to content

Issue W4-MT-01 β€” Artificial Teacher Quality EvaluationΒ #55

Description

@Abdully-dev

πŸ“‹ Overview

A working model is not automatically a good teacher.

Evaluate whether Gemma actually teaches.

🎯 Objectives

Test:

Factual grounding
Retrieval relevance
Explanation quality
Socratic guidance
Weakness adaptation
Hallucination behavior
πŸ”— Call Chain
Test Question
↓
RAG
↓
Gemma
↓
Evaluation
πŸ”— Dependencies

Complete RAG + Gemma pipeline.

βœ… Acceptance Criteria
Test cases are documented.
Poor responses are identified.
Prompt improvements are applied.
Retrieval failures are documented.
🌿 Branch
artificial-teacher-evaluation
🚨 Files Concerned
model/evaluation/
β”œβ”€β”€ test_retrieval.py
└── test_generation.py
Issue W4-MT-02 β€” Complete Offline AI Validation
πŸ“‹ Overview

Prove that the AI system works without internet.

This is a product requirement, not an optional test.

🎯 Objectives
Disconnect internet.
Restart application.
Test retrieval.
Test Gemma.
Test Artificial Teacher.
Verify local vector store.
πŸ”— Dependencies

Complete AI pipeline.

βœ… Acceptance Criteria
No cloud API is required.
Retrieval works offline.
Gemma works offline.
Vector store works offline.
Artificial Teacher works offline.
🌿 Branch
complete-offline-ai-validation
🚨 Files Concerned
model/evaluation/
└── test_offline.py

backend/app/ai/
β”œβ”€β”€ gemma_client.py
└── retrieval_service.py

Activity

Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Metadata

Metadata

Assignees

Labels

No labels
No labels

Type

No type

Projects

No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions