ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

如何完成 Eigent 本地模型部署:vLLM / Ollama / LM Studio 接入教程

如何完成 Eigent 本地模型部署:vLLM / Ollama / LM Studio 接入教程 如何完成 Eigent 本地模型部署vLLM / Ollama / LM Studio 接入教程【免费下载链接】eigentEigent: The Open Source Cowork Desktop - Local and Free Alternative to Claude Cowork and Codex项目地址: https://gitcode.com/GitHub_Trending/ei/eigent这篇文章覆盖 Eigent 本地模型部署的完整流程在 Ollama、vLLM、LM Studio、SGLang 四个引擎里做选型启动各自的本地推理服务在设置页填写端点并验证连接。适合需要把推理留在本机、不想让代码和数据上传到云端的使用者和开发者。读完之后你可以把一个本地大模型接入 Eigent并把它设为默认工作模型。推理全部发生在自己的机器上提示词和上下文不出内网也没有按 token 计费的 API 账单。选哪个引擎按硬件和场景定四个平台的定位不同先看下面这张表你的情况推荐引擎理由第一次用不想碰命令行LM Studio图形界面下载模型、点按钮起服务CPU 或 8GB 显存单机日常使用Ollama一条命令拉取模型管理成本最低有 NVIDIA GPU需要多并发服务vLLM批量推理吞吐高适合长会话高并发、长上下文服务SGLang推理效率优化适合服务端场景显存粗略对应7B 级模型 4bit 量化大约需要 5GB 显存16bit 精度约 14GB1.5B 到 3B 的模型在 2GB 显存甚至 CPU 上也能跑。连接原理OpenAI 兼容接口四个平台对外暴露的都是同一类接口——OpenAI 兼容接口即只要知道 base_url 和模型名两个值就能调用模型。所以 Eigent 这边只需要填本地服务的端点地址标准形如http://localhost:端口/v1和精确的模型名。各平台的差异只在端口Ollama 默认 11434vLLM 默认 8000。服务起来之后配置步骤完全一样。各引擎最短路径配置按上手门槛从低到高排列。LM Studio 配置安装 LM Studio在应用内搜索目标模型并下载。下载完成后在 Local Server 面板启动本地服务默认端口 1234面板里会显示实际端点。记下面板中的模型 ID这就是稍后要填入的模型名。Ollama 本地推理ollama pull qwen2.5:7bOllama 服务默认在后台运行端点为http://localhost:11434/v1模型名填拉取时的名称例如qwen2.5:7b。想看日志就在终端手动运行ollama serve。vLLM 接入vllm serve Qwen/Qwen2.5-1.5B-Instruct在终端启动服务起来后端点为http://localhost:8000/v1模型名按实际加载的填写。需要换端口时通过启动参数修改Eigent 里填的必须与实际端口一致。SGLangSGLang 面向高并发和长上下文场景Eigent 的接法与 vLLM 相同填它的端点和模型名即可无需额外配置。填写端点并验证连接打开 Eigent 的模型设置选择对应的本地模型平台填入端点地址和模型名。点击内置的验证按钮通过说明 Eigent 已经能访问到本地服务。验证通过后可以把该模型设为默认工作模型。验证之前可以先自检服务是否起来curl http://localhost:8000/v1/models返回一段 JSON 模型列表即正常连接被拒绝则说明服务没起或端口填错。连接验证失败速查现象排查方向验证超时、连接失败先确认本地服务是否运行、端口是否被其他程序占用再看服务终端里的报错404 或提示模型不存在模型名要和实际加载的完全一致包括:7b这类 tag 和大小写端口冲突修改服务启动端口并同步更新 Eigent 里填写的地址爆显存或推理很慢模型对显存来说太大换小参数量或更低量化下一步先用 Ollama 跑通一个 7B 量化模型再试 LM Studio 熟悉图形界面流程。并发需求上来后部署 vLLM用多请求压一下吞吐。验证通过后把本地模型设为默认工作模型完整重测一次智能体任务。更多本地模型集成说明见中文 README。【免费下载链接】eigentEigent: The Open Source Cowork Desktop - Local and Free Alternative to Claude Cowork and Codex项目地址: https://gitcode.com/GitHub_Trending/ei/eigent创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表