【漫士】数学读心术:大数据怎么猜你喜欢?

合集 · 彻底理解AI (5)

  1. 16:19
    【硬核科普】AI究竟是怎么生成图片和视频的?
  2. 21:12
    【硬核科普】GPT等大模型是怎么工作的?为啥要预测下一个词?
  3. 1:28:58
    90分钟!清华博士带你一口气搞懂人工智能和神经网络
  4. 12:27
    【漫士】AI为什么会出现幻觉?该如何解决?
  5. 23:37
    【漫士】数学读心术:大数据怎么猜你喜欢?
Description
-

Comments

AprilWind233 2025-07-25

挺准的其实,有一次我给朋友发笑死了,回头它给我推花圈[微笑]

♥ 1041 ↩ 14

长河劫 2025-07-25

虽然来迟了但是依然点开B站就是漫士[兔兔岛_睡觉]俺果然已经把自己的茧养的棒棒的了[桃源_给花花]

♥ 753 ↩ 20

教育守卫者国崩小炮 2025-07-25

虚假的资本做局:“我被资本做局了” 真正的资本做局:我、老爸与老妈仿佛三个世界的人,被定向推送强化认知到几乎完全无法沟通,强行说话,“说一句解释半天”,时间根本不够用[无语]

♥ 511 ↩ 9

饿狼传说m 2025-07-25

我感觉一点也不准啊,有时候我想搜点什么东西,点了几个相关视频后,了解差不多了就不想看了,但之后主页推荐来还会一直出现。我只是一时兴起想看,不是一直想看啊[笑哭]

♥ 360 ↩ 15

十二中白队 2025-07-25

淘宝有一点巨傻,我都买完了还给我推送我买过的。

♥ 310 ↩ 18

飞天闪客 2025-07-25

晚了七分钟来,还没看视频

♥ 340 ↩ 22

RandomSeed42 2025-07-25

勘个误,17分钟提到的两种方法,一种是召回+排序,另一种是双塔,其实并不准确。业界基本上只有召回+排序这个框架,可能具体会更多层一些召回+粗排+精排+重排这样。目前已经很少用原始的协同过滤做召回了,其实都是用双塔模型做召回,不过协同过滤也可以称为一个双塔模型就是了。 据我所知所有业界主流没有用双塔直接作为推荐系统的,原因很简单,双塔的优点是速度快,可以离线算好item测的向量建立索引进行相似最近邻检索,所以用来做召回很合适;但是缺点是没办法进行特征交叉,这导致了他的效果和基于dnn的精排比非常差。如果只用双塔做推荐系统,那估计是一些对时延的要求非常高的小场景。

♥ 229 ↩ 9

Netheril 2025-07-25

看到了漫士「所有人都喜欢我」的妄想,[喜极而泣]

♥ 156 ↩ 5

為什麼你能醒來 2025-07-25

大数据还是太狠了 给老爸推妻子出轨,给老妈推丈夫家暴,给姐姐推男女对立,但是还好给我推的是漫士[doge]。

♥ 131 ↩ 8

Sch-Katze 2025-07-25

现在可以自查成分和推荐机制了[doge]

♥ 111 ↩ 15

Movielover4103 2025-08-06

最后一段话真的说得太棒了,发人深省!特地给它摘抄了下来: “算法从来不会只给你推喜欢的内容,茧房外的内容一直会出现在你的视野中,而真正锁上茧房的,不是数学算法背后被预先设置的阴谋,而是本身这个平台信息来源和社交圈层的有限,以及我们自己每一次追随多巴胺和底层冲动,习惯性地忽略了自己本来不感兴趣的内容。所以说,推荐算法本质上是一面镜子,它尽力地映照着每个人喜好背后真实的自己。茧房这个隐喻真的很妙,毕竟茧房的每一根丝都是里面的蚕自己吐出来的”——漫士沉思录

♥ 90

云海星河com 2025-07-25

是的,我刚刚还在想这个问题,就刷到了这个视频。 果然只能说是大数据吗?

♥ 75 ↩ 10

沌舒刻言 2025-07-25

不准,我看到的很多都说不准,包括我自己遇到的推荐页. 后面是我个人的观察,不 03:40 这种偏好限制了我看到很多好东西,从而优质的更低曝光,而会推的反而会占据过多的群体相似;   .... 09:00 长尾的,需要的内容的积累量变而质变巨大的主动互动 11:00 就会出现内容的标签来自于打标签的人的当时理解,但人力毕竟有限(时间精力) 19:17 对于目前不是那种单纯的自我愉悦,反而是在信息太过残缺时不考虑人的成长属性就断言,然后错的离谱.你们先从算法计算机的旁观角度出来,从实际生活的行动者的角度看看吧, 现在这种氛围越发不对劲,要改啊 还有很多人说,一个家里每个人看到的那部分都不一样,就很拉扯,具体我记不清了去找历史记录也没找到,但说这个问题的真的很多,不可否认是普通人过多观看了那些吸引他们眼球的那部分内容,会站在他们自己视角说的内容,情绪宣泄得反而投射到现实呈放大效应, 如: https://www.bilibili.com/video/BV1DuGwzMEAq.如果还是没学会自己主动搜索改变自己的标签.接着根据要达到的指标进行的数据统计分析还会对这情况进行加强,接着就演变成:https://www.bilibili.com/video/BV1MDu1zEER4. 20:00 这个在另一个地方已经看过了,但忘记了在哪 21:00 这之后才是目前更复杂算法讲解的开始,同质化的内容,用户留存率更低;所以还推你不喜欢的内容,(这里为什么换成推有利于人成长的内容?); 22:50 这里太仓促了,这里的内容讲人话就像在说:“算法会推不同的给你,但是,你不喜欢1秒就划走了,所以锁上茧房的是你自己,是你自己的多巴胺和底层冲动”. [笑哭]普通人也很难承认这个并改变 而且说真的,有时周末就2天,如果想买哪个东西,刷刷刷,某电商上面反反复复看得都是那几个卖家,[笑哭] 还有人生不同阶段无常,有时某一特殊时期搜素过度全面,也会反而进去别的人群营造的茧房,被集体性污染,还时不时被激回顾创伤等,  我很介意视频最后像旁观者那样把责任都扔给了每个用户, 信息的缔造者,尤其是已经有用户留存规模的地方, .... 想说也有责任,但是这何尝不是一种控制呢,各自好之为止.目前希望我们所选的皆是因对未来有美好的想象而参与的创造[保卫萝卜_哇],继续往前努力改善吧.

♥ 71 ↩ 6

一条狗的研究 2025-07-25

我觉得讲的不太好。首先是协同过滤和矩阵补充算法相比,低秩假设比协同过滤的假设要强很多。然后就是关于冷启动部分,这部分解释是乱的,神经网络并不能解决冷启动问题,现在的神经网络仍然是基于协同过滤的相似性原理啊,本质仍然是把相似的特征嵌入成相似的向量。要解决你说的理解具体内容的问题,靠的是多模态特征,nlp和cv那边的模型,本质还是embedding思想,这才应该重点介绍下吧。像是后面提到的双塔也没必要,提了也不是很到点子上,双塔能减少计算量靠的是用户和物品分离之后可以离线储存结果,需要的时候直接调用就行,你也没说到重点。

♥ 58 ↩ 32

晶晨幻风 2025-07-25

我有的时候感觉这些算法挺烦人的,有的时候我只是多看了几个up主的视屏,b站就疯狂给我推送这个up主的其他视频,但我喜欢的只是其中一些内容;另外,本人学生党,课余时间喜欢看一些竞赛题和科普等,但b站总是给我推荐什么“分数逆袭”之类的广告,几乎每次刷新都会有一个甚至几个类型的广告,但其实我现在用不上(但确实是很烦的),并且我休息的时候会看一些乱七八糟的东西,休息完了,刷新发现没有喜欢/需要看的视频了,有的时候刷视频真的感觉很无聊,所以我一直都很讨厌这些算法

♥ 45 ↩ 1

-Doggee- 2025-07-25

我把b站的个性化推荐关了,不然总给我推荐一些让我焦虑的视频[笑哭]

♥ 41 ↩ 6

羽化首阳山 2025-07-25

难道不是软件窃取了我的个人隐私和剪切板吗?[笑哭]

♥ 44 ↩ 17

害怕的狗XGGGGGGGG258 2025-07-25

我是算法,我看得出来评论区很多人对煌片很感兴趣🤖

♥ 69 ↩ 8

看啥呢给我也看一眼 2025-07-25

1:22[辣眼睛]我正和妈妈一起看视频[捂脸][捂脸][无语][无语][无语]有点尴尬...…

♥ 47 ↩ 11

蓝石丹丹某 2025-07-25

漫士沉思录100个视频纪念打成[打call]

♥ 36 ↩ 4