Coverage for /home/admin/Documents/AI/applications/lexigram-dev/lexigram/experimental/ai/lexigram-ai-evaluation/src/lexigram/ai/evaluation/__init__.py: 100%

13 statements  

« prev     ^ index     » next       coverage.py v7.15.4, created at 2026-08-25 07:19 +0800

1"""AI Evaluation framework for Lexigram. 

2 

3Provides evaluators, a harness, and reproducible experiment tracking: 

4seed-stable run ids, metric/error streams, digest-verified checkpoints, 

5ablation comparisons, and error analysis for completed runs. 

6""" 

7 

8from __future__ import annotations 

9 

10from lexigram.ai.evaluation.ablation import AblationRunner 

11from lexigram.ai.evaluation.analysis import ErrorAnalysis 

12from lexigram.ai.evaluation.checkpoints import FileCheckpointStore 

13from lexigram.ai.evaluation.config import EvaluationConfig 

14from lexigram.ai.evaluation.constants import ( 

15 DEFAULT_EMBEDDING_MODEL, 

16 DEFAULT_THRESHOLD, 

17 DEFAULT_TIMEOUT_SECONDS, 

18 MAX_RETRIES, 

19) 

20from lexigram.ai.evaluation.di.provider import EvaluationProvider 

21from lexigram.ai.evaluation.exceptions import ( 

22 AblationError, 

23 AnalysisError, 

24 CheckpointError, 

25 DatasetError, 

26 EvaluationConfigError, 

27 EvaluatorNotFoundError, 

28 HarnessError, 

29 TrackingError, 

30) 

31from lexigram.ai.evaluation.module import EvaluationModule 

32from lexigram.ai.evaluation.tracking import LocalTracker, make_run_id 

33from lexigram.ai.evaluation.types import ( 

34 BatchEvaluationResult, 

35 EvaluationDataset, 

36 EvaluationResult, 

37 EvaluationRunContext, 

38 EvaluationSample, 

39 RunReport, 

40) 

41from lexigram.contracts.ai.experiment import ( 

42 AblationResult, 

43 AnalysisReport, 

44 Checkpoint, 

45 CheckpointStoreProtocol, 

46 ErrorRecord, 

47 ExperimentConfig, 

48 ExperimentRun, 

49 ExperimentTrackerProtocol, 

50 MetricRecord, 

51 RunStatus, 

52) 

53 

54__all__ = [ 

55 "DEFAULT_EMBEDDING_MODEL", 

56 "DEFAULT_THRESHOLD", 

57 "DEFAULT_TIMEOUT_SECONDS", 

58 "MAX_RETRIES", 

59 "AblationError", 

60 "AblationResult", 

61 "AblationRunner", 

62 "AnalysisError", 

63 "AnalysisReport", 

64 "BatchEvaluationResult", 

65 "Checkpoint", 

66 "CheckpointError", 

67 "CheckpointStoreProtocol", 

68 "DatasetError", 

69 "ErrorAnalysis", 

70 "ErrorRecord", 

71 "EvaluationConfig", 

72 "EvaluationConfigError", 

73 "EvaluationDataset", 

74 "EvaluationModule", 

75 "EvaluationProvider", 

76 "EvaluationResult", 

77 "EvaluationRunContext", 

78 "EvaluationSample", 

79 "EvaluatorNotFoundError", 

80 "ExperimentConfig", 

81 "ExperimentRun", 

82 "ExperimentTrackerProtocol", 

83 "FileCheckpointStore", 

84 "HarnessError", 

85 "LocalTracker", 

86 "MetricRecord", 

87 "RunReport", 

88 "RunStatus", 

89 "TrackingError", 

90 "make_run_id", 

91]