ZeroSearch – 阿里通义开源的大模型搜索引擎框架
2025-05-12 15:21:17 小编:六六导航站
ZeroSearch是什么
ZeroSearch 是阿里巴巴通义实验室开源的创新大模型搜索引擎框架,基于强化学习激励大模型的搜索能力,无需与真实搜索引擎交互。框架爱基于大模型预训练知识,转化为检索模块,根据查询生成相关或噪声文档,动态控制生成质量。在多个问答数据集上,ZeroSearch 的性能超过谷歌搜索,大幅降低训练成本(降低80%以上)。基于轻量级监督微调和课程学习机制,ZeroSearch 逐步提升模型推理能力,支持多种强化学习算法,具有很强的扩展性和通用性。

ZeroSearch的主要功能
无需真实搜索引擎交互:模拟搜索引擎的方式,激励大模型的搜索能力,避免与真实搜索引擎(如谷歌)的交互,降低成本和不可控性。动态控制文档质量:支持生成相关或噪声文档,基于调整提示中的关键词,灵活控制生成文档的质量,为训练提供多样化的检索场景。降低成本:相比使用真实搜索引擎进行强化学习训练,ZeroSearch 的训练成本大幅降低(超过80%),让大规模训练更加可行。支持多种模型和算法:兼容不同参数规模的大模型(如3B、7B、14B),支持多种强化学习算法(如PPO、GRPO)。ZeroSearch的技术原理
模拟搜索引擎:基于大模型自身的知识,转化为模拟搜索引擎,根据查询生成相关或噪声文档,替代真实搜索引擎。轻量级监督微调:基于少量标注数据对大模型进行微调,生成高质量或低质量的文档,适应不同的训练需求。课程学习机制:在训练过程中逐步增加文档的噪声水平,让模型从简单场景开始,逐步适应更具挑战性的任务,提升推理能力。基于 F1 分数的奖励机制:用 F1 分数作为奖励信号,专注于答案的准确性,确保模型生成的答案与真实答案尽可能匹配。多轮交互模板:设计明确的推理、搜索和回答阶段,基于结构化的标签(如ZeroSearch的项目地址
项目官网:https://alibaba-nlp.github.io/ZeroSearch/GitHub仓库:https://github.com/Alibaba-nlp/ZeroSearchHuggingFace模型库:https://huggingface.co/collections/sunhaonlp/zerosearcharXiv技术论文:https://arxiv.org/pdf/2505.04588ZeroSearch的应用场景
智能问答系统:快速准确地回答用户问题,适用智能客服和智能助手。内容创作:帮助创作者获取信息,生成初稿或提供灵感,适用新闻、文案和学术写作。教育与学习:为学生提供即时解答,支持在线教育和智能辅导。企业知识管理:帮助员工快速检索公司内部资源,提高工作效率。研究与开发:为研究人员提供最新研究成果,加速研究进程。- 猜你喜欢
-
MusicTGA-HR提示指令
-
RappingAI提示指令
-
Boomy提示指令
-
TwoShot提示指令
-
Weet提示指令
-
Muzaic Studio提示指令
-
-
HookGen提示指令
-
DadaBots提示指令
- 相关AI应用
-
Playlistable提示指令
-
Riffusion提示指令
-
WZRD提示指令
-
-
Cyanite.ai提示指令
-
Piano Genie提示指令
-
Synthesizer V提示指令
-
Cosonify提示指令
-
Musico提示指令
- 推荐AI教程资讯
- ZeroSearch – 阿里通义开源的大模型搜索引擎框架
- Chatlog – 开源AI聊天记录分析工具,自动解析、可视化和挖掘聊天记录
- HunyuanCustom – 腾讯混元开源的多模态定制视频生成框架
- VoiceCanvas – 开源AI语音合成平台,支持多语言、多音色、声音克隆服务
- DeerFlow – 字节跳动开源的深度研究框架
- WebThinker – 人民大学联合智源研究院等机构推出的深度研究智能体
- Multiverse – Enigma Labs推出的全球首款AI生成多人游戏模型
- Open Code Reasoning – 英伟达开源的代码推理AI模型
- KuaiMod – 快手推出的自动化短视频质量判别框架
- VITA-Audio – 开源的端到端多模态语音大模型,低延迟、推理快
- 精选推荐
-
Koolio.ai2025-02-19提示指令
-
Epagestore.ai2025-02-05法律助手
-
ChatMindAI2025-01-27提示指令
-
Soundraw2025-02-24提示指令
-
Superpower ChatGPT2025-02-01提示指令
-
Learning Prompt2025-01-02提示指令