当前位置: 首页 > news >正文

TGW 完整上手指南:从克隆到调参一次讲清

TGW 完整上手指南:从克隆到调参一次讲清

【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen

想在浏览器里跑本地 LLM,又不想折腾 Docker 和依赖地狱——这就是 Text Generation Web UI(TGW)的出场场景。一句话:开源的本地 LLM 网页界面,文本、视觉、工具调用全支持,数据不出本机,还带 OpenAI/Anthropic 兼容 API。

5 分钟把 TGW 跑起来

装什么

不用自己准备环境,官方启动脚本会全包:先拉 Miniforge 建一个隔离的 Python 3.13 环境,再按你的显卡装对应版本的 torch。如果你本机已有干净的 Python 环境,这一步可以直接跳过。

怎么启动

git clone https://gitcode.com/GitHub_Trending/te/text-generation-webui cd text-generation-webui

然后按系统三选一:

Linux./start_linux.shWindows双击start_windows.batmacOS./start_macos.sh

首次运行比较慢,放着等 10 分钟以上很正常。好了之后浏览器开http://127.0.0.1:7860,界面就在。

角色扮演 / 多后端 / 参数预设,一次看够 🎭

先给 AI 立个人设再开口聊

你想做什么:让 AI 扮演特定的人跟你对话。

它怎么做到:改一个 YAML 里的namegreetingcontext三个字段,角色就成了。角色配置目录 里Assistant.yamlExample.yaml是现成例子,抄一份改两行就能用。

效果如何:多角色可以在同一个会话里来回切,人设不会串。连角色形象都能画,比如参考下面这张示例:

大模型塞不进显存?换个后端就行

你想做什么:小显存也要跑大一点的模型。

它怎么做到:Model 标签页里换引擎——Transformers 兼容性最好,llama.cpp 的 GGUF 量化适合低显存部署,ExLlamaV2 走高性能推理,CTransformers 偏 C++ 效率路线。Text Generation Web UI 的对话界面完全不变,只是底下换了台发动机。

生成太放飞?换个预设就行

你想做什么:让输出"稳一点、别乱编"。

它怎么做到:Presets 标签页一键套用参数组合,预设目录 里的Creative.yamlDeterministic.yamlTop-P.yaml直接选。自己调好的组合存下来,下次一条命令复现。

TGW 参数怎么调不翻车 🛠️

关键参数速查

参数作用推荐起步值
temperature生成随机性,越高越放飞0.7 - 1.0
top_p词汇多样性,管风格松紧0.9 - 0.95
top_k候选词数量截断50
min_p过滤低概率词,压复读0.02 - 0.1
repetition penalty防止车轱辘话1.05 - 1.1

高频报错对照

  • 首跑半天没反应→ 还在下环境和依赖,第一次 10 分钟起步,别以为卡死去强杀
  • CUDA out of memory→ 我一开始也以为是模型坏了,其实是显存爆了;换小一点的量化或 llama.cpp 后端
  • 同一句话翻来覆去说→ 加一点 min_p,或重复惩罚 +0.05
  • 7860 端口被占→ 启动命令后面加--port 7861换个门牌号

硬件四句话:

  • NVIDIA:CUDA 是默认路线,最省心
  • AMD:走 ROCm,docs 里有专门的 AMD Setup 文档
  • CPU:能跑,但只建议试小模型
  • Apple 芯片:有专门优化,M 系跑得顺

装完 TGW 还能干嘛

这四点是我用得最多的后续玩法:

  • LoRA 微调:Training 标签页内置训练,数据丢进user_data/training/datasets/目录就能开训
  • OpenAI 兼容 API:启动时加--api,把你原来调 OpenAI 的现成应用指到http://127.0.0.1:7860就能通
  • 社区扩展extensions/目录里 TTS、画图、翻译现成一大堆,装上即启用
  • 多语言对话google_translate扩展挂上就能跨语言聊

打开extensions/目录,挑一个silero_tts这样的 TTS 插件装上启用,生成你的第一句语音。

【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

http://www.cnnetsun.cn/news/4191356.html

相关文章:

  • 如何手写一个高速日期解析器?LogViewer的FastDateTimeParser源码全解
  • 多智能体强化学习中的Sim-to-Real迁移:IDEA方法如何通过效果对齐解决动力学失配
  • 微信聊天记录导出完整教程:用 EchoTrace 一键配置、快速导出与排错
  • 3 步跑通 mmsegmentation 语义分割可视化:把训练状态看得一清二楚
  • 【前端知识点总结】Nginx 指南:从开发到生产的完美衔接
  • 具身智能体记忆系统BrainMem:类脑记忆与任务规划实践
  • SwiftUIRefresh API参考:.pullToRefresh()修饰符参数详解、版本演进与使用注意事项
  • PEEU框架:让GUI智能体通过自主探索与事后经验高效学习任务规划
  • Kubetap 命令全解:如何用 on / off / list 快速代理任意 Kubernetes Service,附全部隐藏参数
  • java-reader面试冲刺篇:Java基础+Redis高频面试题,术语化答题模板助你通关
  • SwiftOpenAI图像生成实战:DALL-E与新ImageGen API创建、编辑一步到位
  • vim-toml 开发者指南:如何读懂项目结构并提交你的第一个 PR
  • Shadplay 源码拆解:Bevy Material trait、AsBindGroup 着色器数据绑定与插件注册完整指南
  • UART协议与IP核验证:从波形到寄存器的工程闭环
  • 论文复现升级:随机性、依赖和评测脚本逐项核对
  • 文本摘要评估框架sumeval完全解析:ROUGE/BLEU一站搞定,多语言支持让评测不再头疼
  • 分布式机器学习中激励相容的梯度上报机制设计与收敛性分析
  • REAP项目解析:从生产日志构建真实AI编程助手评测基准
  • Dockerless验证器:AI代码生成时代的高效安全验证方案
  • 网盘直链下载助手使用指南:8 大平台直链解析与下载器配置
  • 数学建模竞赛复盘:从葡萄酒评价赛题看数据分析与机器学习实战
  • 数学建模竞赛中的炉温曲线优化:从传热模型到工艺参数求解
  • cljfmt、clojure-lsp与depot如何依赖rewrite-clj:构建你自己的Clojure代码工具实战手册
  • 马尔可夫链核心原理与应用:从状态转移矩阵到平稳分布
  • Agentic AI故障诊断:构建分类法与系统性解决方案
  • MediaHelp豆瓣推荐与TMDB智能集成:零配置API密钥,快速构建私人媒体库
  • C++模板类中友元机制深度解析:从语法陷阱到工程实践
  • 手机硬件研发全链路:从SoC选型到量产良率的硬核实践
  • Songloft完整使用指南:从扫描曲库到手机播放的6步快速上手
  • TypeGo:面向具身智能体的类型安全实时操作系统运行时