耗时一年花费10万,我终于为盲人大哥装上了“眼睛”【B站AI创造公开赛】

合集 · 盲人的AI“眼睛” (2)

  1. 18:53
    耗时一年花费10万,我终于为盲人大哥装上了“眼睛”【B站AI创造公开赛】
  2. 18:32
    "失去"双眼,我用自制的AI眼镜体验失明的一天...
Description
距离上一次我们在发布盲人眼睛的原型已经过去十个月,这十个月收集了b站的观众们的建议,基于这些意见,我们对盲人眼睛的软硬件进行了完全的重构。
今天终于我们要迈出最关键的一步,让视障朋友张大哥亲自测试它...

Comments

gunselking 6d ago

我觉得很多盲人最需要的是自己在整个空间的哪个位置,比如自己在房间的客厅还是卧室,面对的是什么方向,比如面对的是厨房,面对的是卫生间,最大算力其实是人的大脑,只要给的数据够多,大脑自己会进行计算和判断,盲人最大的问题是无法获取数据,而不是大脑算不过来。我在想只要告诉盲人前面有什么左边有什么右边有什么,该怎么走由大脑自己做出计算,这样就对算力要求会低很多。

♥ 83 ↩ 10

似白非白白白 4d ago

作为一个厚天失明,目前全盲的人,给up一些建议,首先是方向问题,作为盲人来说,我们最害怕的就是失去方向感,就比如正常人闭上眼睛原地转几个圈之后也会失去方向感,这个时候让我们知道大概方向是很重要的,就像是盲人在自己熟悉的环境比如家里行动就很自如,因为他很熟悉这个环境,就算不小心失去了方向也能很快靠着触摸周围的东西来快速获取自己所在的位置,但是这是在熟悉的环境里,并且空间都不会太大,如果是在户外,需要快速找到一个标的物来告诉我们面朝的方向和大概位置,这个时候这个标的物就很重要,就比如在机场要能第一时间锁定到现在面朝的是几号登机口,或者xx号出站口在你的左边之类的,让我们能知道个大概位置,当然这是在身处于有明显文字参照物的环境下,如果是在一个纯粹的以物体为环境的空间里,那就需要相对准确的物体识别能力了,另外在交互问题上,体感配合语音是没错的,但是建议是语音尽量简洁,比如视频里面大哥说让识别苹果手机,就不用重复一遍:“好的,我现在就开始识别苹果手机,识别到会马上告诉你” 这么一句冗长且无用的信息,直接说:好的,开始识别 就可以了 另外关于语音,语速对于我们盲人来说绝对不是问题,可以尽量快一点,但是人声尽量选择别太尖锐,也就是情绪别太高抗和兴奋,高频尽量少一些的语音,不然听着会很累和烦躁 最后我想说的一点是,视频里的张大哥看得出来是个很热心的好人,但是很多残障人士出于自尊心的原因会刻意表现得格外自信,这个我也十分理解,但是往往这样会出现一个问题就是过于主观,就比如大哥视频里说了一句:“盲人都是走马路,只有摆拍的才走人行道” 这句话真的很可怕,我知道最近在盲人这个群体里面出现了一些很恶心的事情,但是不能因为想表达自己不是那种人就说这种很情绪化甚至没道理的话,你别说盲人了,正常人都是应该走人行道的,既是规矩,也是安全,大哥这样一说简直是把本来就水深火热的盲人出行问题搞得更加雪上加霜,试想一下如果这种言论传播开来,正常走在人行道上的盲人会面临多少本不必要的质疑,我想告诉大家,绝大部分盲人都是愿意自食其力,遵守社会规则的,我们很感谢也很乐意接受大家的善意,但是我们并没有要求自己要有多大的特权,假装盲人摆拍这种恶心人的事情真的只是很小很小一部分,篇幅有限,暂时就说这么多,如果up有需要我也愿意提供一些盲人的经验,也希望up的产品能早日落地,也谢谢每一个心怀善意的人

♥ 513 ↩ 23

Aimj落 56m ago

线上拼多多客服售前,售后,回复 每小时30-35

♥ 2

灼烂之星 7d ago

如果你有足够好的量产计划和商业变现的方案,或许我们集团公司可以给到up一定的资金和技术上的支持,甚至是客源的支持,加油吧!有需要可以和我们聊聊落地的事情[星塔旅人_赞]

♥ 293 ↩ 17

YQ4869 6d ago

之前看过另外一个盲人UP,她剪视频是用的屏幕识别,那个语音播报的速度也是快得跟电报一样,盲人听东西应该跟我们不一样,可能我们觉得吵,他们就觉得密度刚好合适

♥ 50 ↩ 2

卧槽昵称已存在 5d ago

吊...看标题我还以为戴上这个眼镜盲人就能像正常人一样看见了呢[笑哭]

♥ 26 ↩ 6

饭点已到 7d ago

法律方面也要搞一下,不是打击积极性,万一把人引导到沟里,或是处在一个空中平台有个孔洞掉下去,引起的纠纷可不轻松。

♥ 380 ↩ 4

菜狗本菜_ 6d ago

弹幕这家伙在说什么呢?[惊讶]

♥ 117 ↩ 11

林阴破晓 7d ago

我就是个盲人,马上9月份开学要升学了,正在面临新校园,完全不熟悉的路线。对这眼镜表示非常的期待,支持

♥ 776 ↩ 73

CantonMing 7d ago

听取明眼人的建议、跟着明眼人的思路走,是永远做不出盲人真心满意的产品的[笑哭]即便是盲人,在技术革新到来前也不完全知道他们想要的、真心满意的产品到底是长什么样!乔布斯曾说过「…顾客并不知道自己想要什么,直到我们拿出自己的产品,他们才会发现,这就是我要的东西…」

♥ 74 ↩ 4

积云没有雨 6d ago

既然都在眼镜上配震动了,有没有考虑做一套手部的穿戴设备或者改造一下盲杖,让手部设备和盲杖可以通过震动去引导盲人找东西,就像VR手柄一样

♥ 5 ↩ 1

whocareyourname 23h ago

up 主你好,我之前在香港大学期间研发了一套光源检测 pipeline ,延时可以跑到 50 毫秒以下。感谢您这个伟大的发明,我们也曾想把我们的应用放在盲人视觉导航上,虽然做的是光源检测,但其实也利用了 OpenWorld Object Detection,理论上是能检测万物的。下图为我们做出来的效果。如有需要,我愿意开源与您分享,祝好![打call][打call]

♥ 112 ↩ 1

维多利亚面包 6d ago

视频15:27秒的部分。在伸手拿取物品的时候,手已经伸过头了还一直提示向前。原因是语音提示是基于眼镜的位置进行判断的,你手虽然伸过头了但是头部是静止的,所以语音会发出错误的指令。建议以后可以在此基础上增加一个手环辅助手部的定位,毕竟目前的AI已经能够估算物品的距离了,在这基础上匹配一个手环的距离,能够对手部运动作出更加精准的指令提示。

♥ 644 ↩ 14

雪初音天下第一可爱 6d ago

我给个我自己的拙劣建议。我在日本是做老人相关的工作的,其中有不少是残障人士,包括看不见,听不见,偏瘫等等。而在对于视障人士的学习中,有一个导引原则是避免高频出现方向指示,只需要告诉什么方向有什么,剩下的可以由老人自己的经验判断。比如引导视障老人回座位的时候,我们会先告诉他朝哪个方向走,途中如果有障碍物再提示往哪个方向靠,如果拥挤会让他停下。接近桌位后会告诉他桌子在左手边前方还是右手边前方,吃饭也是用时钟法告诉他几点钟方位有什么东西,取东西也是先告诉它东西在什么地方,还是拿桌子举例,先引导到桌子前,然后引导他的手触碰到桌子边缘,然后再告诉他东西在左手边还是右手边,近还是远,剩下的让老人自己摸索就可以,这个叫自立支援,要尊重既存能力,这和张老师提出的能干的自己干是一样的

♥ 150 ↩ 4

哒咩哒咩巴嘎米袋 6d ago

我一开始还以为增强视觉,原来是AI播报,那其实不用做成眼镜的形状,骨传导耳机不就行了。

♥ 13 ↩ 3

_为众人抱薪者 6d ago

快进到被商业化然后需要充值vvvvvvvvip才能识别物体

♥ 2 ↩ 1

男儿本色0 6d ago

小小建议,1,建议做成类似导航的播报,还要提示前方距离情况,比如前方5米有台阶,排水沟,电箱,有洞,或有水,挡路的杂物等提前报警。2,对移动的人能分出小孩,孕妇,老人,能提前让路。3,震动小电机可以安装帽子带头上,十字排列,分别表示前后左右,中心点代表方向正确,控制人行走,手上也可以做一套成手套带着,控制手去拿东西。

♥ 21 ↩ 4

L1YYYI 6d ago

可以把摄像头做成超广角的,因为左右视野有盲区,人看不见的时候很难走直线

♥ 3

十万伏特十 7d ago

我觉得取物的语音太吵了,太信息轰炸。建议同步加一层音轨,类似倒车雷达,明亮的叮叮声越靠近越急促。语音提示非及时提醒的可间隔两三秒,配合雷达音和震感估计体验会上一个台阶。而且雷达音的响动频率可以起到让人预判和目标物体的距离的作用。

♥ 516 ↩ 56

莳緔灬芊芊 6d ago

盲人的听力语速快的要死 我都听不清楚 他们能听到[藏狐]

♥ 8 ↩ 4