- Implemented `fetch_corpus.py` to scrape Chinese educational content from Wikipedia, covering subjects like Chinese, Math, English, Chemistry, Politics, History, Geography, Physics, and Biology. - Developed `fetch_corpus_incremental.py` for incremental fetching of missing entries, with automatic retries for rate limiting and support for resuming interrupted downloads. - Created `train_chat.py` for training a dialogue model, including corpus cleaning, vocabulary management, and staged training with adaptive learning rates.
125 lines
3.8 KiB
Python
125 lines
3.8 KiB
Python
"""
|
||
JspaceAI —— 全局工作空间 + J-space 广播的智慧系统
|
||
|
||
模块:
|
||
1. core.py: 核心架构(Expert + JSpaceWorkspace + JSpaceModel,含 RK4/LayerNorm/异构专家)
|
||
2. language_model.py: 语言版 + 自主进化
|
||
3. jlens.py: J-lens 可解释性工具
|
||
4. multimodal.py: 多模态(图像/音频/视频/文本)
|
||
5. realtime.py: 实时 I/O(摄像头/麦克风/扬声器)
|
||
6. evolution.py: 自主进化训练器
|
||
"""
|
||
from .core import (
|
||
Expert,
|
||
JSpaceWorkspace,
|
||
JSpaceModel,
|
||
JSpaceConfig,
|
||
)
|
||
from .baselines import FlatBaseline
|
||
from .task import ContinuousSequenceTask
|
||
from .trainer import Trainer
|
||
|
||
from .language_data import CharTokenizer, CharDataset, load_shakespeare, load_chinese_corpus, load_textbook_corpus, load_corpus
|
||
from .language_model import (
|
||
LanguageConfig,
|
||
JSpaceLanguageModel,
|
||
ExperienceReplay,
|
||
EWCOptimizer,
|
||
ExpertPlasticity,
|
||
)
|
||
from .jlens import (
|
||
JLensConfig,
|
||
JLensProbe,
|
||
JLensSuite,
|
||
WorkspaceAblator,
|
||
DirectedModulation,
|
||
CounterfactualReflection,
|
||
)
|
||
from .multimodal import (
|
||
MultimodalConfig,
|
||
MultimodalJSpaceModel,
|
||
VisualEncoder, VisualDecoder,
|
||
AudioEncoder, AudioDecoder,
|
||
TextEncoder, TextDecoder,
|
||
)
|
||
from .realtime import (
|
||
Frame,
|
||
CameraStream,
|
||
MicrophoneStream,
|
||
AudioPlayer,
|
||
MultimodalStream,
|
||
SensoryMotorLoop,
|
||
)
|
||
from .desktop import (
|
||
InputEvent,
|
||
ScreenCapture,
|
||
KeyboardMonitor,
|
||
MouseMonitor,
|
||
DesktopStream,
|
||
FullSensoryStream,
|
||
)
|
||
from .platform import (
|
||
PlatformInfo, PLATFORM,
|
||
get_screen_size,
|
||
check_camera_permission, check_microphone_permission,
|
||
check_input_monitoring_permission, print_permission_guide,
|
||
)
|
||
from .embodied import (
|
||
MouseActuator, KeyboardActuator, AudioActuator, ScreenActuator,
|
||
Cerebellum, CentralNervousSystem, Hippocampus, BasalGanglia,
|
||
EmbodiedAgent,
|
||
)
|
||
from .autonomous import (
|
||
CuriosityDrive, PersistentState, SelfModel, MetaLearner,
|
||
AutonomousMind,
|
||
)
|
||
from .modules import (
|
||
ExternalModule, SmallModelModule, KnowledgeBaseModule,
|
||
ToolModule, ModuleDock,
|
||
)
|
||
from .evolution import EvolutionTrainer
|
||
|
||
__all__ = [
|
||
# 核心架构
|
||
"Expert", "JSpaceWorkspace", "JSpaceModel", "JSpaceConfig",
|
||
# 对比基线
|
||
"FlatBaseline",
|
||
# 连续序列任务
|
||
"ContinuousSequenceTask", "Trainer",
|
||
# 语言建模
|
||
"CharTokenizer", "CharDataset", "load_shakespeare",
|
||
"load_chinese_corpus", "load_textbook_corpus", "load_corpus",
|
||
"LanguageConfig", "JSpaceLanguageModel",
|
||
"ExperienceReplay", "EWCOptimizer", "ExpertPlasticity",
|
||
# J-lens 可解释性
|
||
"JLensConfig", "JLensProbe", "JLensSuite",
|
||
"WorkspaceAblator", "DirectedModulation", "CounterfactualReflection",
|
||
# 多模态
|
||
"MultimodalConfig", "MultimodalJSpaceModel",
|
||
"VisualEncoder", "VisualDecoder",
|
||
"AudioEncoder", "AudioDecoder",
|
||
"TextEncoder", "TextDecoder",
|
||
# 实时 I/O
|
||
"Frame", "CameraStream", "MicrophoneStream", "AudioPlayer",
|
||
"MultimodalStream", "SensoryMotorLoop",
|
||
# 桌面 I/O
|
||
"InputEvent", "ScreenCapture", "KeyboardMonitor", "MouseMonitor",
|
||
"DesktopStream", "FullSensoryStream",
|
||
# 平台抽象
|
||
"PlatformInfo", "PLATFORM", "get_screen_size",
|
||
"check_camera_permission", "check_microphone_permission",
|
||
"check_input_monitoring_permission", "print_permission_guide",
|
||
# 具身 Agent(输出执行器 + 神经系统)
|
||
"MouseActuator", "KeyboardActuator", "AudioActuator", "ScreenActuator",
|
||
"Cerebellum", "CentralNervousSystem", "Hippocampus", "BasalGanglia",
|
||
"EmbodiedAgent",
|
||
# 自主心智(最重要的能力)
|
||
"CuriosityDrive", "PersistentState", "SelfModel", "MetaLearner",
|
||
"AutonomousMind",
|
||
# 外挂模块系统(可热插拔)
|
||
"ExternalModule", "SmallModelModule", "KnowledgeBaseModule",
|
||
"ToolModule", "ModuleDock",
|
||
# 自主进化
|
||
"EvolutionTrainer",
|
||
]
|