11月23日消息,昨日夸克大模型公布了其面向搜索、生产力工具和资产管理助手的大模型技术布局。据介绍,夸克大模型接连登顶C-Eval和CMMLU两大评测榜单,多项性能优于GPT-4。在医疗健康领域,夸克大模型已经可以将问答内容的幻觉率降低至5%。
夸克技术负责人蒋冠军表示,夸克大模型是面向搜索、生产力工具和资产管理助手的应用型大模型。在搜索应用中,将通过图文多模理解、专业知识生成、交互方式创新进一步拓宽应用场景,提升用户体验。
夸克大模型的优势源自于智能技术实力与搜索业务基础,蒋冠军认为,夸克大模型有四大优势:第一、最全面的通用知识数据和行业知识数据,以及知识理解和评估体系;第二、得益于搜索技术体系的积累,拥有千亿级参数平台的模型训练能力;第三、拥有长期智能化产品经验的智能技术产运团队。第四、拥有全行业的知识增强技术体系及能力。
蒋冠军向网易科技等媒体表示,夸克数据非常全面,几乎覆盖了所有中文范畴的知识,并且覆盖千行百业。“搜索引擎本身就是海量的网页数据,我们的数据库里有千亿级网页。这意味着需要有一个非常好的离线系统或工程系统,去处理大规模的网页数据,去做对齐、去重、分析等工作。这个能力本身跟大模型所需要的能力非常匹配,因为大模型就是要大算力,传统搜索引擎就具备大算力。”
他提到,夸克去做大模型,在团队人才储备上也具备优势。“我们在通用搜索里,有网页搜索、图片搜索、视频搜索、文档搜索等等,支持这些搜索功能的技术体系和技术同学,就是大模型需要用到的多模技术能力和人才体系。所以说技术团队在这方面的积淀,相对来说是比较深厚的。”
面向未来,要解决大模型的应用问题,关键要解决知识正确性问题。据悉,基于搜索产品和智能技术积累,夸克大模型在知识增强上的优势可以大幅提升知识正确性。同时,在医疗健康领域,夸克已经可以将问答内容的幻觉率降低至5%。夸克大模型也将是持续推动夸克App产品体验创新和迈向新一代搜索的技术底座。
日前,阿里巴巴智能信息事业群发布全栈自研、千亿级参数的夸克大模型,将应用于通用搜索、医疗健康、教育学习、职场办公等众多场景。夸克大模型的整体水平超越GPT-3.5,在多语言翻译、写代码、安全合规、内容创作等方面处在国内行业头部水平。
另外,在最新的百亿参数测试集中,夸克同样在法律、医疗、问答等多个领域中排名第一,夸克大模型在不同参数量级的对比中均表现优秀。
在大模型技术落地层面,夸克大模型的能力体现在四个方面,可以帮助用户提升工作、学习效率。知识能力,拥有广泛的知识覆盖、信息搜集和多语言支持等,支持外接专业知识增强,提升跨领域的知识和语言理解能力;对话能力,具备较强的上下文理解、语境推理、关键信息保持和记忆能力,更好地适应不断变化的语境,理解用户的意图和需求,确保对话回复准确、合理、连贯;创作能力,能够根据主题或关键词,生成连贯、有逻辑、有深度的文本内容,支持续写、润色、仿写、批改等多种不同写作需求;安全能力,具备较好的世界观、价值观,对于明显的虚假信息,均能做到准确识别、正确回答或者给出合理指引。
据悉,夸克大模型将全面升级夸克在搜、用、存上的智能化体验,帮助用户进一步提升效率。同时,基于多年累积的搜索优势,夸克将借助AI驱动推进搜索革新,加速迈向下一代搜索。(一橙)