尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

RAG,在企业AI中释放LLM大模型的潜力

RAG,在企业AI中释放LLM大模型的潜力 前言从自然语言处理到计算机视觉等生成式AIGenAI超越了传统的单一数据源模型以整合各种模式的多种数据源使自然语言大模型LLM更接近于模仿人类的能力。随着企业从谨慎探索转向快速整合GenAI在企业关键业务职能中的采用率将稳步上升为企业带来核心竞争力提升等优势。一方面很多用户都想将GPT这样的LLM引入到企业建立企业自己的专属大模型。而另一方面即使像GPT-4这样功能强大的LLM在处理特定领域或实时信息方面依然面临众多挑战。单独使用LLM会面临两个问题答案可能过时响应可能出现错误。根据Vectara的幻觉排行榜即使是表现最好的LLM系列的幻觉率也在1.5%到1.9% 之间。为了克服这些潜在问题企业可以使用数据流将新信息导入其数据集并部署检索增强生成RAG使大模型的响应更加准确且与上下文相关。RAG通过与大模型微调(Fine Tune)技术、知识图谱等各种技术协同作用正在彻底改变数据的处理、解释和使用方式从而实现更准确、上下文感知和个性化的AI应用。这种超强组合正在被OpenAI、微软、AWS、阿里云等应采用领跑LLM的发展与应用。企业为什么选择“RAG”训练数据的质量、数量和多样性等对生成式AI模型的性能影响巨大而模型架构、训练技术和所解决问题的复杂性等因素也发挥着重要作用。当前幻觉问题、信息不准确、计算成本上升、资源有限以及对实时动态信息的需求等都是企业级LLM解决方案需要解决的核心问题。为此RAG应运而生。那么什么是RAG呢OpenAI ChatGPT、Google Gemini等AI应用的背后均由LLM驱动。LLM可以理解、总结、生成和预测新内容。但是这些大模型生成的内容仍然可能不一致并在一些知识密集型任务中败北尤其是那些超出其初始训练数据的任务或者需要最新信息的任务。这种情况下LLM可能会返回虚假信息也称为AI幻觉。LLM通常是离线训练的这使得模型不理解后来的任何数据。另外当LLM的训练数据不足时也可能影响响应的质量。为解决这些问题人们提出了RAG技术。RAG是一种人工智能框架和自然语言处理技术可从外部知识来源检索数据用于大型语言模型LLM通过在响应中添加相关的检索数据来增强用户的提示有助于减少明显的知识差距和AI 幻觉在需要尽可能多的最新和准确信息的领域如医疗保健应用中显得更为重要。同时RAG是一种经济高效且可扩展的方法可以提高LLM的质量和实用性而无需使用新数据重新训练模型适用于任何需要外部知识的领域或任务如医疗诊断、法律建议或产品评论。用户可以自定义RAG以使用不同的知识源如数据或专有信息以满足特定的需求和偏好。另外RAG可以提高LLM的性能。RAG在请求到达公共LLM之前拦截请求并使用专有组织数据来增强用户的请求。它将修改后的提示转发给LLM以获得更准确和相关的响应。RAG提示拦截流程通过简单的四步方法简化了获得高度相关答案的过程首先用户提交请求。用户提出问题或寻求特定信息。此初始步骤是建立查询的基础和用户的意图。其次请求被拦截并得到扩充。RAG拦截并添加到原始请求中。该增强功能改进了请求确保它能够从LLM中获得最相关和最全面的答案。另外向LLM提交增强查询。RAG将请求转发给LLM并提供更多详细信息。上下文的注入确保了LLM的响应是准确的并且经过精心定制以解决请求的细微差别和特殊性。最后返回Tailored响应。通过上述步骤丰富了答案是与初始查询一致的更准确、更相关的响应。这种个性化方法确保了答案的准确性尤其适用于特定的个人化需求。应用RAG有哪些好处目前来看RAG优势包括在内容生成上RAG提供最新信息从相关、可靠和最新的来源提取信息综合信息通过组合来自检索和生成模型的相关信息来合成数据以产生响应减少AI幻觉由于LLM基于外部数据因此模型编造或返回错误信息的机会较小。在应用上RAG增加了用户信任用户可以访问模型的来源提高了内容的透明度和信任度并允许用户验证其准确性可用于多个任务除了聊天机器人之外RAG还可以针对各种特定用例进行微调如文本摘要和对话系统。在成本上RAG降低计算和财务成本企业不必花费过多时间和资源来不断使用新数据训练模型同时变得更容易训练由于RAG使用检索到的知识源因此减少了在大量训练数据上训练LLM的需求。大公司都用RAG干什么企业选择RAG最重要的原因是减少幻觉提供更准确、相关和值得信赖的输出同时保持对信息源的控制并能够根据其特定需求和领域定制。通过RAG等技术可以减少LLM幻觉的能力在不同的企业中都得到了验证。OpenAI在不同的领域全面应用RAG技术。早期OpenAI将大型语言模型(LLM)与图形数据库Neo4j等相结合从图形数据库中获取相关信息用于生成响应以执行RAG。同时OpenAI通过聊天记录搜索功能全面投入RAG。10月30日OpenAI宣布推出一项新功能允许用户在ChatGPT网络上搜索其聊天记录。用户能够快速轻松地访问历史对话记录从而参考过去的讨论或从离开的地方继续操作。此功能由OpenAI收购的Rockset公司开发旨在利用Rockset的高级分析来增强OpenAI的检索基础设施Rockset正在与OpenAI合作以应对AI应用大规模面临的复杂数据库挑战。Rockset通过其RAG功能增强了LLM的功能对于希望利用专有数据降低幻觉风险的OpenAI企业客户来说非常有价值。目前Rockset采用融合索引方法将行、列和搜索索引相结合支持跨多种数据类型和格式进行快速搜索。目前还没有其他数据库公司提供此特定服务。另外Rockset融合了关键词搜索、向量搜索等功能以提供精确的关键词匹配以及语义丰富的搜索结果从而获得更相关和上下文感知的结果。微软CEO Satya Nadella在Microsoft Build 2024说RAG是任何AI驱动的应用的核心尤其是在当今的企业中。而微软Azure AI搜索使运行任何规模的RAG成为可能使用最先进的检索系统提供高度准确的响应。ChatGPT、数据助手以后都由Azure AI搜索提供支持。Azure AI搜索功能已经作为一种服务向用户提供。作为RAG体系结构中经过验证的信息检索解决方案Azure AI搜索提供了强大的索引和查询功能利用Azure云的基础设施和安全性确保可靠和安全的性能。在Microsoft Build 2024上微软同时宣布将RAG整合到Copilot中从而可以更轻松地将设备上数据用于企业应用提供了在平台内构建向量存储的正确工具并支持语义搜索。今年7月Microsoft开源了GraphRAG一种基于图形的RAG方法支持对私有或以前未见过的数据集进行问答。GraphRAG现已在 GitHub上提供。与传统的RAG方法相比GraphRAG提供了结构化的信息检索和全面的响应生成。GraphRAG代码存储库附带一个解决方案加速器提供托管在Azure上的易于使用的API体验无需编码即可部署。另外GraphRAG采用大型语言模型LLM从任何文本文档集合中自动提取知识图谱。这种基于图的数据索引可以通过以分层方式检测密集连接节点的“社区”在用户查询之前报告数据的语义结构。阿里云于今年推出了企业级大模型检索增强生成RAG解决方案。其主要应用场景包括企业知识库、智能客服、电商导购、课程助手、搜索场景升级等。目前来看阿里云RAG的优势包括知识准确且更新及时答案可追溯成本相对较低开放性和自由度高部署方便快捷等。例如通过阿里云百炼平台等企业只需少量代码即可搭建RAG应用提供一站式、全托管的大模型定制与应用服务。另外蚂蚁对外开源的Graph RAG框架其运作核心是紧密结合信息检索与大模型能力。从索引环节看通过大语言模型服务高效提取文档三元组并存入图数据库检索过程中利用大语言模型服务抽取并泛化查询关键词随后在图数据库里遍历子图精准定位局部子图生成阶段将局部子图转化为文本格式和问题一起让大模型处理输出高质量回答。和传统RAG框架比起来蚂蚁的Graph RAG融入知识图谱技术能敏锐捕捉文本关联过滤冗余信息构建更完整的知识网络为开发者提供了极具价值的开源工具。另外腾讯元宝、月之暗面的Kimi、智谱清言、文心一言等LLM都采用了各自的RAG技术其工作流程基本涵盖三个方面检索从预先建立的知识库中检索与问题相关的信息增强将检索到的信息用作生成模型的上下文输入以增强模型对特定问题的理解和回答能力生成结合LLM生成符合用户需求的回答。目前LLM在应用RAG时正在解决两大挑战一是延迟检索阶段可能会增加额外的延迟尤其是在需要实时响应的应用中二是保持数据一致性需要确保检索到的数据与生成任务的上下文保持一致。长上下文并不会杀死 RAG毫不夸张地说2024年大模型的上下文窗口不断突破上限成为大模型吸引用户的一个重要指标。如Anthropic Claude 3的上下文窗口为200K特定用例高达 100 万个令牌Google Gemini 1.5的上下文长度窗口为1M开源的Meta Llama 3后来居上其Gradient的用例将LLama-3 8B的上下文长度从8k扩展到超过1048K。从长上下文长度到无限上下文长度的竞赛Microsoft、Google、Meta、OpenAI以及国内的阿里云、腾讯云等所有大公司都在朝着这一方向迈进从而引发了“长背景与RAG”的争论。其实RAG有其自身的一系列局限性如虽然它在模型需要满足特定信息需求的知识密集型情况下最有用但在推理密集型任务中却不是那么有效了。模型可能会因不相关的内容而分心尤其是在答案不明确的冗长文档时。有时大模型选择依赖其内置内存而忽略检索到的文档中的信息。由于RAG大规模运行的硬件要求比较高使用RAG的成本就可能提高因为检索到的文档必须临时存储在内存中以便模型访问。另一项支出是计算模型在生成响应之前必须处理增加的上下文。如果长上下文LLM真的可以取代RAG那么还应该能够从上下文中检索特定事实对其进行推理并根据它返回答案。但是即使是长篇大论的LLM也不能避免顽固幻觉的出现同时随着长语境中文字的数量的增加LLM的性能也会下降。此外还需要考虑延迟因为每次用户提交查询时都必须向LLM提供完整的上下文或完整信息才能获得结果此要求可能会带来大量开销从而造成延迟。因此长上下文并不会杀死RAG只会增强它。将RAG与长上下文LLM相结合可以创建一个强大的系统能够有效且高效地大规模检索和分析数据。另外RAG不再局限于向量数据库匹配未来还将引入许多高级RAG技术可显著改善检索。例如将知识图谱KG集成到RAG中通过利用来自KG的结构化和互连数据RAG系统的推理能力可以大大增强。超越RAGLLM和RAG的组合来在执行传统上需要人类智能的任务许多行业都有用例包括教育、客户服务和创意领域等。将RAG与LLM结合使用使数据分析和访问民主化可以促进更明智的决策增强创造力并提高解决各个领域问题的效率。在生产环境中部署RAG模型需要仔细规划并遵守最佳实践以确保模型可靠且安全地执行特别需要注意首先确保数据安全和隐私。企业必须实施强大的安全措施以保护训练和部署RAG模型时使用的敏感数据包括使用安全的API、加密和访问控制来保护专有信息。其次持续监控和评估。在生产中持续监控和评估RAG模型包括定期评估模型的性能、准确性和相关性以确保继续满足企业要求。最后微调和域适应。为了保持RAG模型的准确性和相关性企业应不断微调模型并使其适应其特定领域包括根据新数据重新训练模型并调整检索系统以反映知识库中的更改。未来随着技术的发展RAG-LLM组合可以通过多种方式帮助使数据更易于访问、个性化、相关和可操作如增强的个性化和相关性。未来的RAG系统可能会更擅长通过使用历史数据、个人偏好和上下文来为个人定制响应。跨领域融合知识。RAG技术在各个领域都有应用包括医疗保健、教育、金融和客户服务。将专有组织数据与LLM庞大知识库集成可以提供深入而广泛的见解和答案。例如RAG可以通过将医学文献与医疗保健领域的个体患者记录相结合实现更加个性化的患者护理。实时信息更新。随着组织不断更新其数据库RAG系统可以快速整合最新信息。弥合知识鸿沟。RAG有可能通过向非专家提供专业、难以访问的信息来实现知识普及化可以创造公平的竞争环境使较小的实体能够访问与大型组织相同的信息从而推动创新和竞争差异化。合乎道德和负责任的使用。RAG有责任确保AI合乎道德负责任地使用尤其是在数据隐私和安全方面。未来的发展必须提高透明度、用户同意协议以及审计和解释数据使用和响应生成的能力。解决偏见和错误信息。解决检索的数据和LLM的训练数据中偏见和错误信息的挑战至关重要。未来的RAG系统必须采用更复杂的机制来识别、减轻和纠正偏见。协作式人机交互。RAG的未来涉及人类和A之间更深入的协作。RAG系统不仅有可能提供信息而且可以作为创造性问题解决、研究和创新的合作伙伴并可能会导致新形式的协作智能其中AI的数据处理和模式识别功能可以放大人类的创造力和直觉。最后为什么要学AI大模型当下⼈⼯智能市场迎来了爆发期并逐渐进⼊以⼈⼯通⽤智能AGI为主导的新时代。企业纷纷官宣“ AI ”战略为新兴技术⼈才创造丰富的就业机会⼈才缺⼝将达 400 万DeepSeek问世以来生成式AI和大模型技术爆发式增长让很多岗位重新成了炙手可热的新星岗位薪资远超很多后端岗位在程序员中稳居前列。与此同时AI与各行各业深度融合飞速发展成为炙手可热的新风口企业非常需要了解AI、懂AI、会用AI的员工纷纷开出高薪招聘AI大模型相关岗位。最近很多程序员朋友都已经学习或者准备学习 AI 大模型后台也经常会有小伙伴咨询学习路线和学习资料我特别拜托北京清华大学学士和美国加州理工学院博士学位的鲁为民老师给大家这里给大家准备了一份涵盖了AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频全系列的学习资料这些学习资料不仅深入浅出而且非常实用让大家系统而高效地掌握AI大模型的各个知识点。这份完整版的大模型 AI 学习资料已经上传CSDN朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】AI大模型系统学习路线在面对AI大模型开发领域的复杂与深入精准学习显得尤为重要。一份系统的技术路线图不仅能够帮助开发者清晰地了解从入门到精通所需掌握的知识点还能提供一条高效、有序的学习路径。但知道是一回事做又是另一回事初学者最常遇到的问题主要是理论知识缺乏、资源和工具的限制、模型理解和调试的复杂性在这基础上找到高质量的学习资源不浪费时间、不走弯路又是重中之重。AI大模型入门到实战的视频教程项目包看视频学习是一种高效、直观、灵活且富有吸引力的学习方式可以更直观地展示过程能有效提升学习兴趣和理解力是现在获取知识的重要途径光学理论是没用的要学会跟着一起敲要动手实操才能将自己的所学运用到实际当中去这时候可以搞点实战案例来学习。海量AI大模型必读的经典书籍PDF阅读AI大模型经典书籍可以帮助读者提高技术水平开拓视野掌握核心技术提高解决问题的能力同时也可以借鉴他人的经验。对于想要深入学习AI大模型开发的读者来说阅读经典书籍是非常有必要的。600AI大模型报告实时更新这套包含640份报告的合集涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师还是对AI大模型感兴趣的爱好者这套报告合集都将为您提供宝贵的信息和启示。AI大模型面试真题答案解析我们学习AI大模型必然是想找到高薪的工作下面这些面试题都是总结当前最新、最热、最高频的面试题并且每道题都有详细的答案面试前刷完这套面试题资料小小offer不在话下这份完整版的大模型 AI 学习资料已经上传CSDN朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】
返回列表