1"""AI Evaluation framework for Lexigram.
2
3Provides evaluators, a harness, and reproducible experiment tracking:
4seed-stable run ids, metric/error streams, digest-verified checkpoints,
5ablation comparisons, and error analysis for completed runs.
6"""
7
8from __future__ import annotations
9
10from lexigram.ai.evaluation.ablation import AblationRunner
11from lexigram.ai.evaluation.analysis import ErrorAnalysis
12from lexigram.ai.evaluation.checkpoints import FileCheckpointStore
13from lexigram.ai.evaluation.config import EvaluationConfig
14from lexigram.ai.evaluation.constants import (
15 DEFAULT_EMBEDDING_MODEL,
16 DEFAULT_THRESHOLD,
17 DEFAULT_TIMEOUT_SECONDS,
18 MAX_RETRIES,
19)
20from lexigram.ai.evaluation.di.provider import EvaluationProvider
21from lexigram.ai.evaluation.exceptions import (
22 AblationError,
23 AnalysisError,
24 CheckpointError,
25 DatasetError,
26 EvaluationConfigError,
27 EvaluatorNotFoundError,
28 HarnessError,
29 TrackingError,
30)
31from lexigram.ai.evaluation.module import EvaluationModule
32from lexigram.ai.evaluation.tracking import LocalTracker, make_run_id
33from lexigram.ai.evaluation.types import (
34 BatchEvaluationResult,
35 EvaluationDataset,
36 EvaluationResult,
37 EvaluationRunContext,
38 EvaluationSample,
39 RunReport,
40)
41from lexigram.contracts.ai.experiment import (
42 AblationResult,
43 AnalysisReport,
44 Checkpoint,
45 CheckpointStoreProtocol,
46 ErrorRecord,
47 ExperimentConfig,
48 ExperimentRun,
49 ExperimentTrackerProtocol,
50 MetricRecord,
51 RunStatus,
52)
53
54__all__ = [
55 "DEFAULT_EMBEDDING_MODEL",
56 "DEFAULT_THRESHOLD",
57 "DEFAULT_TIMEOUT_SECONDS",
58 "MAX_RETRIES",
59 "AblationError",
60 "AblationResult",
61 "AblationRunner",
62 "AnalysisError",
63 "AnalysisReport",
64 "BatchEvaluationResult",
65 "Checkpoint",
66 "CheckpointError",
67 "CheckpointStoreProtocol",
68 "DatasetError",
69 "ErrorAnalysis",
70 "ErrorRecord",
71 "EvaluationConfig",
72 "EvaluationConfigError",
73 "EvaluationDataset",
74 "EvaluationModule",
75 "EvaluationProvider",
76 "EvaluationResult",
77 "EvaluationRunContext",
78 "EvaluationSample",
79 "EvaluatorNotFoundError",
80 "ExperimentConfig",
81 "ExperimentRun",
82 "ExperimentTrackerProtocol",
83 "FileCheckpointStore",
84 "HarnessError",
85 "LocalTracker",
86 "MetricRecord",
87 "RunReport",
88 "RunStatus",
89 "TrackingError",
90 "make_run_id",
91]