资讯详情

资讯详情

page-agent + Ollama本地大模型实战:qwen3:14b在RTX3090上跑通GUI Agent

page-agent Ollama本地大模型实战qwen3:14b在RTX3090上跑通GUI Agent【免费下载链接】page-agentJavaScript in-page GUI agent. Control web interfaces with natural language.项目地址: https://gitcode.com/GitHub_Trending/pa/page-agentpage-agent 是一个跑在网页里的 JavaScript GUI Agent让你用一句自然语言就能控制网页界面填表单、点按钮、多步操作无需 Python、无需无头浏览器。本文带你用 Ollama 在本地部署 qwen3:14b 大模型在 RTX 309024GB 显存上完全离线、零费用跑通这个网页 AI 智能体并给出一套可直接照抄的 Ollama 启动参数与连接配置。为什么要把 GUI Agent 跑在本地大模型上 用云端 API 当然方便但本地大模型有三块实打实的好处优势说明 隐私页面 DOM 数据、操作指令全程不出内网敏感后台系统ERP/CRM也能放心用 成本推理免费跑一天也不心疼 token 账单 离线断网、内网隔离环境照样工作page-agent 对本地模型是官方支持场景它只需一个符合OpenAI 接口规范的baseURL而 Ollama 恰好就在11434端口提供了这样的服务。第一步Ollama 安装与模型拉取 安装 Ollama建议 0.15官方已在 Ollama 0.15 上验证过 qwen3:14b拉取模型ollama pull qwen3:14b⚠️选型提醒项目官方文档明确建议——小于 10B 参数的模型通常效果不佳且模型必须支持tool_call。qwen3:14b 是本地部署里兼顾效果与显存14B Q4 量化约 9GB的甜点选择。关键一步Ollama 启动参数90% 的人卡在这里这是最容易翻车的环节。直接用ollama serve启动浏览器一定会被 CORS 拦下。正确姿势是同时放大上下文窗口并开启跨域访问macOS / LinuxOLLAMA_CONTEXT_LENGTH64000 OLLAMA_HOST0.0.0.0:11434 OLLAMA_ORIGINS* ollama serveWindows PowerShell$env:OLLAMA_CONTEXT_LENGTH64000; $env:OLLAMA_HOST0.0.0.0:11434; $env:OLLAMA_ORIGINS*; ollama serve三个参数各管一件事OLLAMA_CONTEXT_LENGTH64000普通页面往往需要 15k token 左右的上下文默认的 4k 会把提示词截断Agent 直接断片OLLAMA_HOST0.0.0.0:11434允许局域网访问OLLAMA_ORIGINS*开启 CORS否则浏览器请求会被直接拒掉验证一下服务是否正常curl http://localhost:11434/v1/models能看到qwen3:14b即可进入下一步。把 page-agent 指向本地模型最快配置方法 ⚡方式一一行 script 快速体验推荐新手在任意网页的 HTML 里加一段脚本通过 URL 参数把模型指到本地 Ollamascript srchttps://cdn.jsdelivr.net/npm/page-agent1.12.3/dist/iife/page-agent.demo.js?autoInittruebaseURLhttp://localhost:11434/v1modelqwen3:14blangzh-CN crossoriginanonymous/script国内访问 jsDelivr 困难时可换成 npmmirror 镜像源路径相同。加载后页面右下角会出现一个对话面板直接输入「点击登录按钮用户名填张三」这类指令即可。方式二npm 集成到自有项目推荐生产npm install page-agentimport { PageAgent } from page-agent // 本地 Ollama 无需 apiKey const agent new PageAgent({ baseURL: http://localhost:11434/v1, model: qwen3:14b, language: zh-CN, }) await agent.execute(筛选出待审核订单逐条点击通过)核心逻辑都在 PageAgent.ts 中它由三部分组成核心 Agent 循环 DOM 控制器 浮动 UI 面板。大模型客户端则封装在 packages/llms/src/index.ts内置了失败自动重试默认 2 次小模型偶发的格式错误通常能自动恢复。实测qwen3:14b 在 RTX 3090 上的表现 官方文档明确记录了这条组合的测试结论Ollama 0.15 qwen3:14b 在 RTX 3090 24GB 上测试通过详见 docs/developer-guide.md 与 models/page.tsx。实际体验大致是✅单页操作点按钮、填表单、勾选、切换标签——成功率很高中文指令理解自然✅多步任务「打开设置 → 关闭深色模式 → 保存」这类 3~5 步的链路可以稳定完成⏱️速度3090 上 14B 模型每步响应约几秒到十几秒比云端旗舰模型慢但日常办公节奏够用⚠️短板复杂页面几百个交互元素下定位偶有偏差这是模型能力边界换更大的 27B/32B 模型会有改善page-agent 基于文本化 DOM而非截图所以 14B 级别的模型就够用了——不需要多模态能力这是本地小显存用户能玩起来的根本原因。常见问题排查清单 症状原因与解法浏览器控制台报 CORS 错误没开OLLAMA_ORIGINS重启 Ollama 并带上该环境变量Agent 中途断片、操作错乱上下文窗口太小把OLLAMA_CONTEXT_LENGTH提到 64000tool call 格式报错模型 tool_call 能力偏弱可确认模型支持函数调用或换更强的本地模型面板没出现检查autoInit参数是否为true或手动调用agent.panel.show()请求体结构含tool_calls、usage 统计等定义在 types.ts排查接口问题时可以对照。延伸阅读 想进一步折腾这几份资料值得收藏本地 LLM 完整配置指南Ollama / LM Studiomodels/page.tsx开发者工作流与 Ollama 环境变量示例docs/developer-guide.md核心 Agent 实现packages/core/src/PageAgentCore.tsLLM 客户端与重试机制packages/llms/src/index.ts项目中文说明docs/README-zh.md本地大模型 GUI Agent 的组合意味着你的内网系统、私有后台第一次有了听得懂人话的自动化能力——而且数据一步都不出公司。先按上面的参数把 Ollama 拉起来五分钟之内你的网页就会多一个随叫随到的 AI 助手。【免费下载链接】page-agentJavaScript in-page GUI agent. Control web interfaces with natural language.项目地址: https://gitcode.com/GitHub_Trending/pa/page-agent创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
觉得有用,分享给同行:

为您的企业打造数字门面

稳重轻奢商务风格,端正雅致视觉,长效耐看不易过时。

立即咨询 →