FEATURED · 精选文章

3 步下载大语言模型:text-generation-webui 模型下载工具手把手教程

发布时间 / 2026/8/31 8:52:21
来源 / 创域科博编辑部
栏目 / 资讯中心
3 步下载大语言模型:text-generation-webui 模型下载工具手把手教程 3 步下载大语言模型text-generation-webui 模型下载工具手把手教程【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen几十个 GB 的权重文件下到 99% 突然断线重新下载又从头开始仓库里十几个量化版本不知道哪几个文件才是真正需要的。这类问题在 text-generation-webui 里有一个专门的工具download-model.py。它内置断点续传、自动重试和 SHA256 校验一条命令就能把模型完整落到本地本文带你用 5 分钟跑通它。它到底帮你省了什么断点续传下载中断后重跑同一命令自动从已下载的字节处继续智能筛选同时存在 PyTorch 和 Safetensors 时只下 SafetensorsGGUF 仓库默认只下 Q4_K_M 量化版本不会傻乎乎地拉几个大文件自动重试单个文件出错最多重试 7 次间隔按指数退避递增完整性校验--check参数逐个比对 SHA256下载信息写入huggingface-metadata.txt自动归类模型存到 user_data/models/LoRA 自动识别并存到 user_data/loras/五分钟上手先拿到项目代码然后在项目根目录执行下载命令git clone https://gitcode.com/GitHub_Trending/te/text-generation-webui cd text-generation-webuipython download-model.py facebook/opt-1.3b第二条命令就是全部主流程。终端会显示每个文件的下载进度完成后打印Download of N files to ... completed.。两个最实用的可选参数python download-model.py facebook/opt-1.3b --threads 8 python download-model.py facebook/opt-1.3b --specific-file model.gguf--threads控制并发文件数默认 4带宽充裕时调高可提速--specific-file只下载指定文件适合 GGUF 单文件场景文件会直接存进user_data/models供 llama.cpp 加载器使用。怎么挑模型格式与体量决策表新手最常见的困惑是几十个 GB 到底挑哪个版本。原则只有一条先按显存定格式再按量化定大小。硬件条件推荐格式说明8GB 及以下显存或纯 CPUGGUFQ4_K_M体积小、兼容性好WebUI 的 llama.cpp 加载器直接加载8~16GB 显存EXL3 / 4-bit Transformers仓库名一般带 EXL3或选带load_in_4bit选项的 Safetensors16GB 以上显存全精度 Safetensors精度最高文件名多为model.safetensors几个判断技巧仓库名带 GGUF 的基本是 GGUF 格式model-00001-of-00004.safetensors这类分片文件脚本会全部下载不用担心漏文件。各加载器的详细参数见 docs/04 - Model Tab.md。踩坑与自救1. 下载中断后不想重来现象终端断开、网络波动文件下了一半原因大文件传输时间本身就长中途断连是常态解决直接重跑同一命令即可脚本会用Range请求从磁盘已有字节处续传不需要任何额外参数2. 想确认下载的文件没损坏现象模型加载报错怀疑权重不完整原因网络层丢字节但进度看起来是 100%解决python download-model.py facebook/opt-1.3b --check逐个输出Checksum validated即通过。3. 校验失败提示 Invalid checksums现象--check后打印Checksum failed及文件名原因本地文件确实损坏或不完整解决加--clean强制丢弃本地残片重新下载python download-model.py facebook/opt-1.3b --clean4. 磁盘空间不足或想指定存放位置现象提示写入失败或默认盘空间不够原因默认全部落到user_data/models下解决用--output /path/to/models指定任意目录或用--model-dir指定存放父目录进阶与生产建议生产环境定期跑--check验证完整性配合--clean重建损坏文件形成固定巡检流程脚本读取HF_ENDPOINT、HF_TOKEN等环境变量见 download-model.py 第 29 行内网镜像源或私有仓库可直接通过环境变量切换命令行不是唯一入口启动 WebUI 后Model 标签页的 Download model or LoRA 区域调用的是同一个下载模块modules/ui_model_menu.py可以点 Get file list 先浏览文件清单再选文件下载更适合不熟悉模型仓库名的新手提示脚本的完整参数列表可以运行python download-model.py --help查看包括--branch、--exclude-pattern、--max-retries等本文只挑了最常用的几个。总结download-model.py把挑文件、下文件、验文件、归目录这四件事压缩成了一条命令断点和校验也都替你做好了。下一步克隆仓库后用python download-model.py facebook/opt-1.3b下载你的第一个模型打开 WebUI 加载它跑通从下载到对话的完整闭环。【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED — 相关阅读

相关资讯

LATEST — 最新资讯

最新发布

TODAY — 本日精选

新闻

WEEKLY — 本周精选

新闻

MONTHLY — 本月精选

新闻