ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

手把手零基础玩转OpenGlass:不到百元把普通眼镜变成AI智能眼镜的完整搭建教程

手把手零基础玩转OpenGlass:不到百元把普通眼镜变成AI智能眼镜的完整搭建教程 手把手零基础玩转OpenGlass不到百元把普通眼镜变成AI智能眼镜的完整搭建教程【免费下载链接】OpenGlassTurn any glasses into AI-powered smart glasses项目地址: https://gitcode.com/GitHub_Trending/op/OpenGlass想象这样一个画面你只是随手翻开一本书或盯着一块路牌耳边就响起翻译好的句子刚见过一面的客户再次出现你的眼镜已经悄悄提醒你这位是上周聊过项目的王总。这不是科幻电影的特效而是开源项目 OpenGlass 正在做的事——把任意一副普通眼镜改造成具备人物识别、实时翻译、物体识别能力的AI智能眼镜。而完成这一切所需的硬件成本甚至比一顿双人餐还便宜。OpenGlass智能眼镜的现场调试场景玩家正在操作设备验证识别效果一分钟看懂OpenGlass记住这三个关键词就够了 拼装像搭乐高一样把现成的ESP32 S3开发板、小电池和3D打印镜腿支架组合起来全程不需要焊接功底 识别镜片上不是屏幕而是摄像头。拍到的画面交给AI模型做图像理解再通过手机App呈现结果 零布线硬件与手机之间走蓝牙App界面由Expo构建浏览器打开就能用OpenGlass的整个工程可以拆成两道工序硬件做打下手采集画面和声音软件做掌勺负责识别和问答。你不需要是电子工程师也不需要是算法专家跟着下面的工序一步步来即可。实战主线从零件到跑通四步走完第一步把零件清单当成购物车来配项目采用市面上随手可买的现货组件核心清单只有三样组件说明Seeed Studio XIAO ESP32 S3 Sense集成了摄像头与麦克风的主控板也是整副眼镜的算力底座3.7V小容量锂电池提供随身电源250mAh左右的规格足够日常佩戴3D打印眼镜固定架用仓库提供的STL文件打印把主板固定到任意眼镜腿上 小技巧没有3D打印机也别急网上的打印代工服务几十元就能搞定或者先用胶带/热缩管临时固定先把流程跑通再追求美观。第二步三步完成固件刷写别漏掉那个关键开关固件相当于眼镜的开机自检程序它负责初始化摄像头、采集画面并通过蓝牙推给手机。刷写过程只需要Arduino IDE一个软件打开firmware/firmware.ino在工具→开发板里选择XIAO_ESP32S3并选对串口端口重点来了在工具→PSRAM下拉菜单中务必设置为OPI PSRAM。这一步就像开车前系安全带跳过它会导致内存不足、运行直接崩溃点击上传等待进度条走完OpenGlass固件上传前必须将PSRAM设为OPI PSRAM这是最容易踩坑的一步如果用命令行更顺手仓库里的firmware/readme.md提供了arduino-cli的完整写法一条编译命令里带上PSRAMopi参数即可。第三步五分钟配好密钥让AI正式上岗刷完固件剩下的工作全在电脑端。克隆仓库后安装依赖git clone https://gitcode.com/GitHub_Trending/op/OpenGlass cd OpenGlass yarn install随后打开sources/keys.ts这是整条链路里唯一需要你手动填信息的地方。它像一个通讯录告诉系统该找谁干活Groq负责问答推理响应速度飞快填入API密钥即可Ollama负责本地图像识别填上http://localhost:11434/api/chat这样的本机地址OpenAI可选作为图像识别的云端备选方案填好后在终端执行ollama pull moondream:1.8b-v2-fp16拉取轻量识别模型最后yarn start启动应用浏览器会自动打开本地链接。第四步戴上眼镜做效果调优识别慢了这样救首次运行后如果识别速度不理想优先从模型入手——模型体积与速度是跷跷板的两端。仓库默认推荐的moondream:1.8b-v2-fp16就是为低功耗场景打磨过的轻量选手若追求更强理解力可以在sources/agent/imageDescription.ts里把模型切换为llava-llama3甚至llava:34b-v1.6代价是响应时间变长。 小技巧调优前先跑一遍仓库自带的yarn prompts脚本它会用同一批测试图批量对比多个模型的识别效果结果以markdown形式写回prompts/series_1/目录谁强谁弱一目了然不用拿真眼镜一遍遍试错。成果实证一次真实的路人识别测试项目在prompts/series_1/目录下内置了数十张真实场景测试图配合prompts/generate.ts脚本可以完整复现作者的评测流程对同一张照片分别用多个模型生成描述再让大模型基于描述回答具体问题。OpenGlass进行人物识别效果测试画面中的目标被摄像头捕捉并进入AI分析流程实测对比会发现一个有趣的现象轻量模型的回答快而简大模型则慢而全。比如面对同一张街拍图moondream能立刻给出人行道上有两个人其中一人穿红色外套的概括而llava:34b会补充路牌文字和周边环境细节。这正是OpenGlass设计得聪明的地方——把看懂画面和组织语言拆成两步小模型负责廉价快速的视觉理解大模型负责基于描述做问答推理两者各司其职。进阶玩法老手必试的三个深度用法1. 自定义提示词让识别长在你的需求上imageDescription里默认的提示词是描述画面并转录文字你可以改成只回答画面中出现的品牌logo或重点描述人物的服装特征让眼镜变成你的专属信息过滤器。2. 让固件采集节奏匹配你的场景在firmware/firmware.ino里能找到图像采集频率的控制逻辑。散步记录想省电就把间隔调大演讲提词就调小甚至可以在特定按键触发下才抓拍把续航和体验都握在自己手里。3. 把问答能力换成私有化部署如果你不想依赖Groq云端可以用sources/modules/ollama.ts走完全本地链路Ollama 同时承担视觉与问答配合llama3系列模型整条识别管线不出一台电脑适合对隐私敏感的场合。新手问答三个最容易卡壳的问题Q1连上开发板后端口一直找不到怎么办先确认USB线是数据线而不是充电线很多线只能充电然后在Arduino IDE里重新插拔设备观察工具→端口列表是否刷新。Windows用户在设备管理器里能看到对应COM口Linux/macOS用户可用arduino-cli board list查看设备挂载情况。Q2浏览器打开App后一片空白识别毫无反应八成是Ollama服务没就绪。先确认本机ollama serve是否在运行再检查keys.ts里的地址是否可访问浏览器直接打开该地址应返回JSON。最后确认模型是否已下载终端执行ollama list能看到模型列表才算齐活。Q3一运行就重启/崩溃是不是硬件坏了优先检查PSRAM设置99%的崩溃都源于工具→PSRAM没有切到OPI PSRAM。这个选项在部分版本里默认不显示需要先把开发板类型选成XIAO_ESP32S3才会出现。收尾清单照着做今晚就能戴上你的AI眼镜备齐ESP32 S3 Sense开发板、电池、3D打印支架三件套用Arduino IDE刷入firmware/firmware.ino确认PSRAM为OPI PSRAM克隆仓库并yarn install在sources/keys.ts填入Groq与Ollama配置ollama pull moondream:1.8b-v2-fp16拉取轻量模型yarn start启动应用戴上眼镜完成第一次识别识别卡顿运行yarn prompts对比模型效果后择优切换需要强调一点项目团队已将该方案迁移并整合进Omi仓库继续迭代但OpenGlass的代码库依然完整保留着从固件到App的每一行实现是学习端侧AI硬件云端大模型协同架构的绝佳教材。如果你在DIY过程中改了固件采集逻辑、优化了提示词或者做出了更酷的镜架——欢迎把改动提交为Pull Request让更多人戴上你设计的AI之眼。仓库地址https://gitcode.com/GitHub_Trending/op/OpenGlass【免费下载链接】OpenGlassTurn any glasses into AI-powered smart glasses项目地址: https://gitcode.com/GitHub_Trending/op/OpenGlass创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表