AI学习助手是一款集AI问答、阅读、笔记于一体的学习辅助软件,基于Obsidian平台开发。
- Obsidian笔记软件集成
- AI对话与问答
- 文档管理与阅读
- 插件系统支持
- AI人设自定义 - 通过标签设计定制不同AI角色
- 多文本内容引用 - 支持引用多个文档段落进行AI交互
- 语音识别(ASR) - 本地音视频转文字,支持CPU/CUDA部署
- 文字转语音(TTS) - 选中文本语音播放,支持多种音色
当然可以,以下是按照您提供的格式整理和补充后的完整版本功能列表,包含 V1.01、V1.1、V1.2、V1.3 的功能特性,并统一风格与层级结构:
- Obsidian笔记软件集成
- AI对话与问答
- 文档管理与阅读
- 插件系统支持
- AI人设自定义 - 通过标签设计定制不同AI角色
- 多文本内容引用 - 支持引用多个文档段落进行AI交互
- 语音识别(ASR) - 本地音视频转文字,支持CPU/CUDA部署
- 文字转语音(TTS) - 选中文本语音播放,支持多种音色
-
AI学习助手界面 -
提供直观的操作界面,一键管理Obsidian软件和语音功能。 -
Obsidian插件语音功能 -
在Obsidian Copilot插件中新增语音功能,包括录音转文字、音视频转文字,以及文字转语音,支持自动播放和更自然的对话方式,模拟真实交流。 -
更多AI学习角色 -
提供多样化的AI学习助手角色,并支持问题延伸功能,AI会主动提出相关学习问题,帮助用户深入学习。 -
语音功能优化 -
为CUDA用户升级至更高品质的TTS模型,生成音色更生动自然,支持音色克隆功能。语音服务可根据用户设备性能自动适配最优模型,确保流畅体验。
-
一键部署AI模型:支持LLM与Embedding模型,简化部署流程,助力小白用户快速上手热门模型。
-
新增工作区功能:支持创建定制化人设与RAG检索,增强知识检索能力,搭配学习助手社区提供的学习资源,实现一键下载并开展学习。
-
媒体资源下载:新增Media Download功能,支持视频与字幕资源下载,丰富学习素材获取方式。
-
Copilot体验优化:优化历史对话加载、RAG检索链路及索引建立流程,提升交互流畅度和效率。
-
PDF转Markdown工具:提供一键将PDF转换为Markdown功能,结合工作区功能,方便用户制作个性化学习资料。
-
学习助手启动器优化:新增容器存储位置迁移功能和大模型存储位置变更功能,提升启动器灵活性与用户体验。
-
长文本实时播放优化:优化index-tts推理,支持长文本实时播放(在V100上测试效果显著),语音输出更流畅自然。
Bug修复:
- 修复启动器阅读器多开Obsidian仓库时打开错误的问题。
- 解决启动器工具箱语音功能安装时Podman初始化失败的bug。
- 修复aloud插件将表情文字等特殊符号误读为"fei"的问题,确保语音输出内容准确无误。
如需继续扩展 V1.4 或后续版本规划,也可在此基础上延续该格式。
- 下载AI学习助手安装包
- 安装Obsidian软件
- 配置AI模型(支持本地LM Studio或在线API)
- 参考完整使用文档进行详细配置
遇到问题?欢迎加入QQ群:807831970 进行交流和咨询!
AI学习助手完整使用文档.md- 主要用户文档images/- 文档截图和图片资源CHANGELOG.md- 版本更新记录CLAUDE.md- 项目开发指南
- 更新文档内容:直接编辑markdown文件,保持格式一致
- 添加图片:将截图放入
images/文件夹,使用描述性中文文件名 - 版本记录:重要更新需在
CHANGELOG.md中记录 - 格式规范:使用标准markdown语法,保持目录结构清晰
使用pandoc转换Word文档到markdown:
pandoc "filename.docx" --extract-media=. -o "output.md"文档的目录在visual studio code/cursor等工具中无法直接显示,需要用obsidian打开并安装“Automatic Table Of Contents”插件,这样通过其语法(ctrl+p打开指令面板,输入insert,找到insert table of content并回车,即可根据Markdown的#段落自动构建目录)就可以生成文档目录了。
打开obsidian,安装插件”Better Export PDF“,在待导出的文档上输入ctrl+p打开命令板,搜索命令"Better Export PDF: 导出当前文件为PDF"。它会打开一个窗口,等待其渲染完毕,即可点击"export"导出pdf文件了!。
感谢所有为项目贡献的开发者们!详见贡献者名单。