二零醚酱 2025-03-26 我最近也对MOE有点着迷……为什么我反而更觉得MOE更接近人脑的运行方式 处理智能任务并不是整个模型(大脑)进行运作,而是拆分给各个不同的模块各司其职,,,,从进化生物学的角度看,牵一发而动全身式的反射模型只存在于无脊椎低等动物上🤔🤔🤔 ♥ 91 ↩ 4
旁光侯 2025-03-31 达芬奇精神有问题,没法长时间专注一件事,所以他的大部分研究都是半吊子,缺实物,缺验证,哪怕完成了,也是马上丢一边。所以达芬奇虽然是全才,可还是以画家出的名。 ♥ 32 ↩ 3
小小车二世 2025-03-26 这是我的一个小想法 用chatGPT和自己的想法设定的 有意者可以拿取作为小说设定多方向强弱计算系统(概念总结)核心理念:通过模拟人脑的思维方式,系统可以动态调整不同计算方向的算力分配,形成一个能够深度思考、逻辑推理并自适应优化的AI架构。系统结构1. 主算力(核心计算模块)负责主要的逻辑推理、数据处理和计算任务。能够动态调整自身计算方向,以适应问题需求。2. 副算力(辅助计算模块)用于支持主算力,计算次要但相关的信息。如果发现副算力的计算结果有价值,则可以转移到主算力中加强计算。3. 游离算力(备用计算模块)处于待命状态,随机处理外部信息并提供新的角度。在需要时可以被调用,为主算力或副算力提供支持。4. 中央控制单元(指挥中心)负责管理主算力、副算力和游离算力的分配与协调。通过数据分析判断哪些方向的计算需要增强,哪些需要减少。框架系统(逻辑控制与优化)1. 自适应模块监测用户行为,调整计算逻辑,使AI更符合用户的思维模式。避免遗忘关键信息,如故事背景、人物设定等。2. 模板机制预设不同风格、历史、文化、语言的模板,确保输出内容符合特定时代或背景。仅在用户明确激活时启动,防止逻辑混乱(如中世纪内容不出现现代科技)。3. 审核与优化系统检查计算结果是否符合逻辑,是否存在错误或不合理的地方。如果发现问题,会重新计算或进行优化,以提高结果的质量。运作模式(模拟人类思考方式)1. 动态算力调节如果某个计算方向有效,则增加算力支持;如果无效,则减少算力投入。例如:在解数学题时,逻辑计算模块的算力会增强,而情感分析模块的算力会降低。2. 多角度思考允许多个方向的计算同时进行,并选择最佳的结果。例如:遇到难题时,一部分算力尝试数学推理,一部分算力尝试类比已有知识,一部分算力进行假设实验。3. 持续学习与优化通过不断分析自身计算的有效性,调整未来的计算方式。结合外部数据(如网络搜索)增强知识储备。可能的应用场景1. 高级AI助手:可以提供更精准、更符合人类思维的建议和分析。2. 自动创作系统:能根据不同风格、文化、时代背景生成符合逻辑的故事、 ♥ 32 ↩ 15
Comments
我最近也对MOE有点着迷……为什么我反而更觉得MOE更接近人脑的运行方式 处理智能任务并不是整个模型(大脑)进行运作,而是拆分给各个不同的模块各司其职,,,,从进化生物学的角度看,牵一发而动全身式的反射模型只存在于无脊椎低等动物上🤔🤔🤔
♥ 91 ↩ 4
那只是达芬奇的创作专家计算全做完要75年可达芬奇没有活够75年
♥ 85 ↩ 3
我的天哪[笑哭],前几楼不是钩子就是真伪史,这就是当代互联网魅力时刻吗
♥ 56 ↩ 4
啥也没有全靠编[doge]这很欧洲[doge]
♥ 45 ↩ 8
达芬奇精神有问题,没法长时间专注一件事,所以他的大部分研究都是半吊子,缺实物,缺验证,哪怕完成了,也是马上丢一边。所以达芬奇虽然是全才,可还是以画家出的名。
♥ 32 ↩ 3
这是我的一个小想法 用chatGPT和自己的想法设定的 有意者可以拿取作为小说设定多方向强弱计算系统(概念总结)核心理念:通过模拟人脑的思维方式,系统可以动态调整不同计算方向的算力分配,形成一个能够深度思考、逻辑推理并自适应优化的AI架构。系统结构1. 主算力(核心计算模块)负责主要的逻辑推理、数据处理和计算任务。能够动态调整自身计算方向,以适应问题需求。2. 副算力(辅助计算模块)用于支持主算力,计算次要但相关的信息。如果发现副算力的计算结果有价值,则可以转移到主算力中加强计算。3. 游离算力(备用计算模块)处于待命状态,随机处理外部信息并提供新的角度。在需要时可以被调用,为主算力或副算力提供支持。4. 中央控制单元(指挥中心)负责管理主算力、副算力和游离算力的分配与协调。通过数据分析判断哪些方向的计算需要增强,哪些需要减少。框架系统(逻辑控制与优化)1. 自适应模块监测用户行为,调整计算逻辑,使AI更符合用户的思维模式。避免遗忘关键信息,如故事背景、人物设定等。2. 模板机制预设不同风格、历史、文化、语言的模板,确保输出内容符合特定时代或背景。仅在用户明确激活时启动,防止逻辑混乱(如中世纪内容不出现现代科技)。3. 审核与优化系统检查计算结果是否符合逻辑,是否存在错误或不合理的地方。如果发现问题,会重新计算或进行优化,以提高结果的质量。运作模式(模拟人类思考方式)1. 动态算力调节如果某个计算方向有效,则增加算力支持;如果无效,则减少算力投入。例如:在解数学题时,逻辑计算模块的算力会增强,而情感分析模块的算力会降低。2. 多角度思考允许多个方向的计算同时进行,并选择最佳的结果。例如:遇到难题时,一部分算力尝试数学推理,一部分算力尝试类比已有知识,一部分算力进行假设实验。3. 持续学习与优化通过不断分析自身计算的有效性,调整未来的计算方式。结合外部数据(如网络搜索)增强知识储备。可能的应用场景1. 高级AI助手:可以提供更精准、更符合人类思维的建议和分析。2. 自动创作系统:能根据不同风格、文化、时代背景生成符合逻辑的故事、
♥ 32 ↩ 15
什么文艺复兴,明明是文艺复制好吧[吃瓜]
♥ 26 ↩ 4
刹俾啊,up主在讨论人工智能,评论在讨论某个人物是真是假
♥ 17 ↩ 2
短期可能MoE,长期可能dense,但dense可能自己发育不起来
♥ 17
亚里士多德和达芬奇很可能不是一个人,而是一群人借了这些人的名字发表成果,主要目的是冒充这些人引起更多人关注自己的理论[doge]
♥ 16 ↩ 4
Gpt现在不知道还是不是dense
♥ 13 ↩ 1
非常典型的对比就是Qwen QwQ VS Deepseek R1。 R1性能更为稳定和全面;而QwQ占用显存更低,而且在部分性能上反而可以压R1一头。
♥ 9
评论让我知道了即使学习成本再低,若之也依然存在
♥ 7
你们知道吗,其实我与达·芬奇之间少一个奇字[doge]
♥ 6 ↩ 3
不不否认也不认同西方所谓的“文艺复兴”的真实性[doge]
♥ 6 ↩ 5
合成专家统治[星星眼] 团体自由意志[星星眼] 数字化民主[星星眼]
♥ 6
MoE只是工程上的妥协
♥ 5 ↩ 1
现在信息这么发达,还有人信达芬奇
♥ 5 ↩ 8
欸但是MoE模型是不是各个专家专精的领域或者方面也是人类未知的,总之并不是开发人员设定的 就是说通过训练,自己形成了对不同问题的分块分专家处理🤔
♥ 4 ↩ 1
让子弹再飞一会[吃瓜],最近各家的更新效果都太好啦,谁知道还会不会有新东西呢
♥ 4