本地分段长对话引擎 — 让低配电脑也能跑复杂的 AI 私密对话
用 Ollama 本地模型跑复杂长对话时,CPU 经常超时崩溃。PrivateChat 把长请求自动拆成多段,每段独立生成,最后本地组合成完整回复。
✅ 长问题不再超时
✅ 100% 本地运行,零云端调用
✅ 支持预设分段任务
✅ 自动保存输出
# 1. 确保 Ollama 已安装并运行 dolphin3
ollama pull dolphin3
ollama serve
# 2. 安装依赖
pip install -r requirements.txt
# 3. 直接问长问题(自动拆分)
python private_chat.py "详细描述一个复杂的场景..."
# 4. 使用预设分段任务
python private_chat.py --task body_desc_task.json
# 5. 从文件读取
python private_chat.py --file question.txt长问题 → 自动拆分(3-8段) → dolphin3 逐段生成 → 本地组合 → 完整输出
↑ ↑
分段计划(轻量LLM调用) 无云端依赖,隐私安全
在 .env 文件中设置(首次使用从 .env.example 复制):
SYSTEM_PROMPT_FILE=yinyue_system_prompt.txt
OLLAMA_API=http://127.0.0.1:11434/api/chat
OLLAMA_MODEL=dolphin3- NSFW 内容生成(完全本地,无审查)
- 长篇小说/剧本分段创作
- 复杂技术问题分步解答
- 任何需要长时间推理的对话
MIT License — 随意使用、修改、分发。
Built with Ollama + Python. No cloud, no censorship, no limits.