ZeroSearch:无需真实搜索也能激发模型搜索能力

合集 · 通义前哨站 (71)

  1. 1:02:05
    【直播回放】ICLR 2025论文解读(上)——通义实验室篇
  2. 1:11
    智能体工作流评估新框架:WorFBench
  3. 1:20
    这是通义千问的来时路。
  4. 15:23
    从单图到可驱动3D数字人生成技术讲解
  5. 1:15
    有人问Qwen2.5-Omni 和VL的区别?
  6. 1:27:46
    【直播回放】ICLR 2025论文解读(下)——通义实验室篇
  7. 2:03
    通义万相2.1的3D VAE是什么?
  8. 1:29
    多模态大模型解题新思路:mPLUG-Owl3
  9. 0:42
    行业首发全栈MCP服务,尽在百炼平台~
  10. 1:29
    通义万相2.1首尾帧生视频模型开源
  11. 1:23
    【玩转MCP】手把手教你自定义部署MCP服务
  12. 1:23
    【玩转MCP】手把手教你搭建专属MCP Agent
  13. 1:57
    超写实3D数字人大模型(LAM)技术报告解读
  14. 1:34
    表情、声音、说话风格一键复刻!
  15. 0:23
    我们为千行百业而来。
  16. 0:40
    Qwen3 来了!
  17. 1:20
    Thinking Budget:让大模型灵活思考
  18. 0:56
    Qwen3+MCP带来哪些新场景?
  19. 1:00
    太好了,是Qwen的Deep Research,我们有救了
  20. 1:07
    通义万相视频编辑统一模型VACE开源发布
  21. 10:01
    【直播回放】通义万相视频编辑统一模型VACE开源
  22. 2:14
    如果有Wan Day,它会是什么样子?
  23. 2:42
    ZeroSearch:无需真实搜索也能激发模型搜索能力
  24. 3:24
    今天来复习一下Qwen2.5-VL技术报告!
  25. 3:15
    ParScale:一种全新的大模型Scaling Law
  26. 2:01
    大模型如何持续进化,实现精准检索?
  27. 59:14
    【直播回放】Qwen3-Embedding模型深度解析
  28. 2:40
    语音识别怕噪声?CoGenAV 来破局!
  29. 0:37
    在这里,了解通义千问的一切
  30. 1:36
    微表情捕捉、潜台词翻译,AI“读心专家”就位!
  31. 1:47
    理解画面捕捉细节,你的AI音效师来啦!
  32. 5:03
    框架开源,无需邀约,即刻体验!
  33. 0:57
    Qwen Vlo|描绘你关于世界的想象
  34. 1:51
    10分钟,打造你的专属实时语音交互应用!
  35. 1:41
    手机也能跑 Qwen3?手把手教你部署!
  36. 1:10
    一句话玩转网页开发!
  37. 1:04:15
    【直播回放】Ask Qwen3 Anything 2025年04月30日10点场
  38. 52:16
    如何让AI有理有据地识别情绪?
  39. 5:10
    来吧,上船,起航!
  40. 1:16
    👂听说,Qwen3-Coder其实也能听懂大白话?
  41. 1:57
    人人都是大导演!通义万相2.2来了!🤩
  42. 1:05
    Github 5K+🌟WebAgent研究团队新作:WebShaper来啦
  43. 1:57
    书画双全!Qwen-Image开源🖌
  44. 2:04:47
    【直播回放】Qwen-Image技术报告解读和模型实战攻略01
  45. 1:05
    音画传情 声启万相
  46. 3:39
    什么呀?语音识别现在也要调监控啦🧐?
  47. 4:03
    AgentScope1.0:终结智能体黑盒🗃️,打造生产级可控应用
  48. 1:41
    🎙️ 开麦即真:CosyVoice 全面升级
  49. 1:20
    不止入戏,更能入景🎬
  50. 2:35
    说得更好、更准、更自然:Qwen3-TTS上线
  51. 6:55
    原生全模态不降智
  52. 2:03
    Qwen3-VL 看懂、理解并响应世界
  53. 0:58
    多图编辑进化,万物皆可一键“同框”!
  54. 0:41
    大就是好!Qwen3-Max 正式亮相
  55. 0:41
    通义万相2.5:一句指令,玩转图像魔法
  56. 0:44
    别让声音困住你的效率
  57. 0:47
    通义万相2.5:一句话实现“Vibe PSing”!
  58. 0:48
    通义万相2.5:让声音当你的视频“导演”!
  59. 1:21
    通义万相2.5:让画面“声”动起来!
  60. 0:54
    通义万相2.5:能听懂,也能准确执行!
  61. 4:52
    Qwen3-Omni API上新:声形意合,令出智随
  62. 1:15
    Fun-CosyVoice 3 重磅升级|更快、更准、更强表达力
  63. 1:21
    Fun-ASR 全新升级|企业级抗干扰
  64. 0:39
    「通义万相2.6」来啦!所有角色,听我指挥
  65. 0:51
    Qwen-Image-Layered:下一代图像生成基础模型 🚀
  66. 0:55
    进来复习!是谁8步推理1秒出图
  67. 1:39
    【能干活的高情商语音搭子】
  68. 3:19
    Qwen3-TTS上新,支持跨物种克隆音色!
  69. 0:57
    Qwen-Image-2512 正式开源发布!
  70. 1:16
    除夕!Qwen3.5来了!
  71. 2:53
    Qwen-Audio-3.0-Realtime 发布:懂倾听,更聪明的实时语音方案
Description
🔥 轻量级模拟搜索,零API成本训练:ZeroSearch通过轻量级的监督微调,将大语言模型(LLM)转化为模拟搜索引擎,实现质量可控的文档生成,避免了真实搜索引擎带来的不稳定性和高昂的API成本。 
🔥 课程式强化学习,逐步提升推理能力:引入课程式训练策略,逐步增加生成文档的噪声水平,迫使模型在更具挑战性的检索场景中提升推理能力,实现从易到难的学习过程。
🔥 高效训练框架,性能超越真实搜索:实验表明,使用3B参数的模拟器即可激发LLM的搜索能力,7B模拟器性能可与真实搜索引擎媲美,14B模拟器甚至超越真实搜索引擎,训练成本暴降88%。
📚 论文地址:arxiv.org/pdf/2505.04588
🌐 项目主页:alibaba-nlp.github.io/ZeroSearch
💻 代码库:github/Alibaba-NLP/ZeroSearch

Comments

jingyuan000 2025-05-27

其实就是拿搜索的资料来训练一个专门负责提供稳定资料的小模型,然后让大模型问小模型,避免让大模型直接接触不稳定的搜索结果导致的质量波动

♥ 80 ↩ 7

闪电的主人wjc 2025-05-27

就是直接拿真实引擎训练太费钱,而且没有ground truth也不方便训练,你们之间搞了个小模型,可以自己控制搜索出来的信噪比,让大模型先学习怎么在搜索结果里找出有用信息,这样再把大模型接入搜索引擎就可以实现比较好的搜索效果了。但是,你也没有解决你一开始提出来的,让大模型先搜索再回复产生的搜索引擎api费用啊。只能说是,解决了文档质量参差不齐问题。

♥ 70 ↩ 5

浮芒Friman 2025-05-27

这个工作主要就两个点吧 1. 用小模型来提供模拟搜索环境 2.在这个环境上对大模型做工具调用训练

♥ 28 ↩ 1

解冻者 2025-05-28

! 这玩意真的会对个人ai爱好者提供超大的帮助。自己炼个小模型,想让他具有联网搜索能力。就得砸钱买搜索引擎api,但是用api特化模型的某项功能又很烧钱,而且搜索引擎的搜索结果极不可控,不仅“让模型在训练时在未出新手村时就可能大魔王”,而且训练结果又不能得到保证。 这玩意儿是真的不错,我之前就设想,要是有个模型能够模拟搜索结果,让这个模型来训练自己的模型的搜索能力,既能省钱又能提升训练结果,没想到通义给做出来了。 真是印证了我之前在其他视频评论区说过的话:“只要是你想要,但是在网上找不到的,过段时间通义肯定会给你做出来!”

♥ 20

风致气息 2025-06-13

做个比喻就是防止新兵蛋子直接上战场找不着北,建了个训练场逐步增加难度训练模拟实战,让新兵逐渐适应

♥ 15 ↩ 1

Notrie_事亮亮 2025-05-27

01:01 捉个虫,noisy貌似拼成nosiy了

♥ 13 ↩ 1

板凳刘520 2025-05-27

我深度体验了QWen3模型、豆包;你们还是不如deepseek,更别说chatgpt了,光说排行榜名次没啥用的

♥ 11 ↩ 20

懒得取名字best 2025-05-27

哪个吊大的说一下,开头提出的问题是大模型在联网搜索时调用api价格高昂,所以就用小模型来储存互联网上面的资源然后进行清洗,再之后大模型直接问小模型得到小模型的输出后大模型再结合这个输出来进行回答,是这个意思吗?

♥ 6 ↩ 6

Castor_WONG 2025-05-27

Qwen3 235B-A22B 经常输出错误的内容您有什么头绪伐,我现在得Grok3和Qwen混着用。比如问ResNet18在哪些Stage开始Stride2的下采样我把何神的Paper都发它了它都能说错

♥ 5 ↩ 2

Earthquakes地震 2025-05-27

📑

♥ 4

ST4RLYTE 2025-05-28

这个motivation太好了[打call] 搜索好多时候导致模型输出和检索到的内容强相关,不仅质量下降(llm自己的正确直觉被低质量内容影响),甚至还影响指令跟随,不听话。 许多具有时效性的东西也必须靠搜索,所以这真的是个痛点 希望早点用上[doge]

♥ 3

Guanyc 2025-05-27

没搞懂,既然没有连接外部资源,那这个搜索,是搜的哪里?

♥ 3 ↩ 6

至高机器智能 2025-06-04

qwen也不错啊[doge],用深度搜索来写一个自己不太了解的领域的综述很好用,就是只能搜国内网站。主要是比Gemini的额度高[吃瓜]

♥ 2 ↩ 1

沧海潮 2025-05-28

讲完专业的,大部分用户更关心通义官网能不能直接用上?

♥ 2

CthulhuMythos 2025-05-28

和rag这种对比呢[doge]

♥ 2

該昵称正在被使用 2025-05-27

现在唯一想的是让淘宝也接入模型,尤其是客服,我觉得用大模型促销起来可能会比人类好很多,首先大模型能够准确的理解人类意图,同时有海量的知识储备,这样一来它的销售能力不是一般人类能够比拟的[呲牙]

♥ 2

林一二onetwo 2025-09-03

标题还是说明一下,这是给开发者用的模拟环境吧,不是给普通用户用的,不然我也不会点进来了,被误导了

♥ 1

正二十三等星 2025-08-12

所以qwen网页端什么时候能优化一下性能和适配夜间模式[吃瓜]

♥ 1

Castor_WONG 2025-05-27

Qwen3 235B-A22B 经常输出错误的内容您有什么头绪伐,我现在得Grok3和Qwen混着用。比如问ResNet18在哪些Stage开始Stride2的下采样我把何神的Paper都发它了它都能说错

♥ 1

微分之商 2025-05-27

能不能让模型应用搜索工具的时候学会优化搜索指令啊,我经常遇到搜出来的东西不行的情况,ai再怎么会辨别文档好坏,没有好文档的话也没法帮我呀。

♥ 1