1. 创意名称 + 创意介绍
创意名称:瞳伴 EyeBuddy
想解决的问题:
中国有 1700 万全盲/重度视障人士、数千万低视力人群(含老年群体)、6000-8000 万色盲色弱者——他们上网时面临三个核心困境:屏幕阅读器读不了图片和图表、低视力用户找不到鼠标光标、色盲用户分不清红绿图表和表单验证色。现有工具各自为战,没有一站式解决方案。
为什么会想到做这个:
我长期参与无障碍和助老志愿活动,亲眼见过视障朋友上网时的真实困境——他们可能用一个 1x1 像素的追踪图片就让屏幕阅读器"哑巴"了,可能把鼠标移到屏幕角落就再也找不回来,可能面对一张红绿柱状图完全看不出哪根高哪根低。这些不是抽象的"用户痛点",是我真实见过的场景。
产品形态:
瞳伴 EyeBuddy 是一个浏览器插件(Chrome/Edge),一个插件同时服务三类视障人群:AI 页面描述(全盲用户)、文字朗读+高亮(低视力/全盲用户)、鼠标十字准星(低视力用户)、色盲校正滤镜(色盲用户)。点击插件图标弹出控制面板,按需开启功能。四大功能,一个插件,一站解决。
2. 目标用户及痛点
面向用户:
- 全盲/重度视障人士(使用屏幕阅读器上网)
- 低视力人群(看得见屏幕但看不清,含老年群体)
- 色盲/色弱人群(红绿色盲占 99%)
使用场景:
- 全盲用户浏览新闻网站,屏幕阅读器遇到图片就"哑巴"了 → 开启 AI 描述,听图片内容
- 低视力用户浏览网页,看不清文字但想听内容 → 开启文字朗读,悬停段落自动朗读+黄色高亮标记
- 低视力用户浏览网页,鼠标一不留神就找不到在哪 → 开启十字准星,一眼定位
- 色盲用户看数据图表,红绿柱状图分不清哪根高 → 开启色盲校正,颜色变可区分
当前痛点:
- 没有 AI 图片描述:NVDA、争渡等屏幕阅读器只能读文字和 alt 文本,遇到图片/图表/复杂布局就"哑巴"。Chrome 内置的 AI 描述依赖 Google 服务,国内不可用,且描述质量差
- 文字朗读缺少视觉反馈:现有读屏工具朗读时没有高亮标记,用户不知道正在读的是哪段文字
- 没有鼠标定位辅助:Windows 放大镜太粗糙,没有专门的鼠标定位工具。低视力用户鼠标一丢就找不回来
- 色盲工具各自为战:Chrome 有色盲滤镜但只是纯滤镜,没有 AI,没有鼠标增强,没有读屏。用户需要装 N 个插件
瞳伴怎么解决:
| 功能 | 服务人群 | 技术方案 |
|---|---|---|
| AI 页面描述 | 全盲/重度视障 | 截取网页画面 → 通义千问 Qwen-VL 生成中文描述 → 语音播报 |
| 文字朗读+高亮 | 全盲/低视力 | 悬停段落自动朗读 + 选中文字即时朗读 + 黄色高亮标记正在朗读的内容 |
| 鼠标十字准星 | 低视力/老年 | 全屏贯穿青色十字线 + 8px 空心圆环交汇点,高对比发光 |
| 色盲校正 | 色盲/色弱 | SVG 色彩矩阵滤镜,红绿色盲/绿色弱/蓝黄色盲三种模式一键切换 |
3. 价值与意义
社会价值:
中国有近亿人的视障群体被数字鸿沟隔绝。瞳伴不替代任何现有工具,而是增强它们——视障人士继续用 NVDA/争渡,装上瞳伴后,图片能"听"到了,文字能"读"了,鼠标能"找"到了,颜色能"分"了。一个插件,三种视障,四大功能,一站解决。这不是锦上添花,是让近亿人能平等上网的基础设施。
商业价值:
基础版免费(通义千问免费 API + 纯前端实现,零边际成本),Pro 版可订阅更多 AI 配额和自定义准星样式,企业版可卖无障碍合规检测服务。色盲校正和鼠标准星零 API 成本,天然适合免费获客 + 增值变现。
4. 创意产物
已使用 TRAE 完成完整可运行的浏览器插件 Demo,包含:
- Manifest V3 插件架构
- 四大功能模块(AI 页面描述 + 文字朗读高亮 + 鼠标十字准星 + 色盲校正)
- 控制面板 UI + 首次引导流程
- 通义千问 Qwen-VL API 集成 + Web Speech API 语音合成
(demo页面展示)
HTML 创意产物文件随帖上传。
瞳伴EyeBuddy展示页.html (51.8 KB)
