进阶TypeScript

VisionClaw让Ray-Ban眼镜拥有实时AI助手

VisionClaw 是一个面向 Meta Ray-Ban 智能眼镜的开源实时 AI 助手,结合语音、视觉与代理操作,基于 Gemini Live 和 OpenClaw 构建,用 TypeScript 编写,在 GitHub 上已收获约 2500 颗星。

2.5K 星标
483 分叉
39 问题
8 浏览
TypeScript
Other
收录日期

项目概述

VisionClaw 是一个面向 Meta Ray-Ban 智能眼镜的开源实时 AI 助手,结合语音、视觉与代理操作,基于 Gemini Live 和 OpenClaw 构建,用 TypeScript 编写,在 GitHub 上已收获约 2500 颗星。

智能眼镜这类硬件, 最让人期待的其实不是镜片本身, 而是它能不能真正“看懂”你眼前的世界。VisionClaw 这个开源项目, 就是冲着这个方向去的——它把 Meta Ray-Ban 智能眼镜变成一台随身 AI 助手, 支持实时语音对话、视觉理解, 还能执行一些代理操作。

一个项目, 三条能力线

从 GitHub 页面上的描述看, VisionClaw 的核心是 Real-time AI assistant, 也就是说它主打实时交互。具体能力可以拆成三块:

  • 语音交互: 对着眼镜说话, 就能获得 AI 回应, 不需要掏出手机。
  • 视觉理解: 眼镜摄像头捕捉的画面, 会成为 AI 判断的输入, 相当于让 AI“看到”你所看到的。
  • 代理操作: 不只是聊天, 还能替你完成某些动作, 比如提醒、查询或控制其他设备。

这三块能力并不算新鲜, 但组合在一起, 并且跑在一副大众消费级眼镜上, 就有了点意思。

技术栈与现状

VisionClaw 由 Intent-Lab 团队创建, 项目用 TypeScript 编写, 目前(仓库数据)已有 2489 颗星, 关注度不低。它依赖 Gemini LiveOpenClaw 这两个外部组件——前者负责多模态 AI 推理, 后者则可能是代理执行层的支撑。对于开发者来说, 这意味着你需要具备一定的 JavaScript/TypeScript 基础, 并且愿意去阅读项目文档和源码。

这类项目最典型的使用场景, 是开发者或极客用户自己动手, 把“买来的眼镜”变成“自己的 AI 终端”。

它能做什么, 以及你会踩的坑

如果你正好有一副 Meta Ray-Ban 智能眼镜, 并且熟悉命令行和 API 配置, VisionClaw 可以让你提前体验一下“随身 AI”是什么感觉: 走在路上问它路边的建筑是什么, 或者让它帮你记下眼前屏幕上的文字。不过, 它毕竟是一个年轻的开源项目, 官方公开的技术细节有限, 很多实用配置需要你自己去摸索。

另外要提醒一点: 依赖 Gemini Live 意味着你需要准备相应的开发者 API 接入方式, 这可能涉及费用或区域限制。项目本身是开源的, 但运行它的云服务未必免费。

上手提示

  • 先去看仓库的 README 和 issue 区, 了解当前对 Meta Ray-Ban 型号的支持情况。
  • 准备好 Node.js 环境和 TypeScript 编译工具链, 再处理 Gemini API key。
  • 如果只是好奇, 可以先从代理功能入手, 语音和视觉的联动调试会更折腾一些。

VisionClaw 目前仍在快速迭代, 适合喜欢折腾、愿意参与到早期项目的开发者。它未必是最终答案, 但至少让人们看到, 智能眼镜离“有用”又近了一步。

VisionClaw开源AI助手智能眼镜实时语音视觉理解代理操作Gemini LiveOpenClawTypeScriptMeta Ray-Ban

项目评分

0.0 (0 评价)

分享

常见问题

VisionClaw: 让Ray-Ban眼镜拥有实时AI助手 是什么?

VisionClaw 是一个面向 Meta Ray-Ban 智能眼镜的开源实时 AI 助手,结合语音、视觉与代理操作,基于 Gemini Live 和 OpenClaw 构建,用 TypeScript 编写,在 GitHub 上已收获约 2500 颗星。

VisionClaw: 让Ray-Ban眼镜拥有实时AI助手 用什么语言开发?

VisionClaw: 让Ray-Ban眼镜拥有实时AI助手 主要使用 TypeScript 开发。

VisionClaw: 让Ray-Ban眼镜拥有实时AI助手 使用什么开源协议?

VisionClaw: 让Ray-Ban眼镜拥有实时AI助手 基于 Other 协议开源。

相关项目

暂无结果

探索更多

相似工具

PakBot

PakBot

PakBot是巴基斯坦首个AI助手,支持乌尔都语、英语、旁遮普语、信德语、普什图语等多种语言。用户可免费进行文本聊天、图像生成、语音对话和网络搜索。它旨在降低语言障碍,让南亚用户用母语获取AI服务。

Tomo

Tomo

Tomo 是一个内置在 WhatsApp 和 Telegram 中的 AI 个人助理,无需安装新应用,只需像朋友一样发消息即可管理日程、自动同步 Google Calendar。它记住上下文、主动提供每日简报,并学习你的习惯,让 AI 无缝融入日常聊天。

MyPersonalContext

MyPersonalContext

MyPersonalContext 是一款解决 AI 个性化孤岛问题的工具,为用户提供便携式记忆,让 Claude、Spotify 等 AI 共享用户上下文,实现真正的个性化。开发者也无需从头构建用户语境,提升 AI 体验的一致性。

FFM PRO AI

FFM PRO AI v3.5 FLASH 是一款智能AI助手,专注于学习、编码、写作、问题解决和知识问答。通过简洁的聊天界面,用户可以快速获取精准答案、代码辅助或创意灵感。其响应速度出众,适合学生、开发者和日常使用者。基础功能完全免费,无需注册即可体验。

Mirror

Mirror

Mirror 是一款专注持久记忆的个人 AI 助手。它通过构建用户思想、模式和目标的「活身份图谱」,在每次对话中调用记忆,提供每日反思、情绪记录和语音交互。隐私加密,数据永不售卖。

Vexide

Vexide是一个集自然语言对话、网页搜索、图像生成、视觉分析、编程辅助和项目管理于一体的AI工作空间。它旨在消除多工具切换的繁琐,让用户在一个平台上完成从信息查询到创意输出再到代码编写的多种任务,适合追求效率的个人和团队。

评论

评论

0
0/500 字符

暂无评论

成为第一个评论的人

开源项目

探索、学习和贡献开源AI项目,推动人工智能技术的发展

查看全部