
文章针对Java程序员提供转型AI的实用建议强调工程化思维在AI开发中的重要性。从基础Python调用大模型API入手逐步介绍RAG、LangChain、LangGraph等核心技术并辅以代码示例。最后提出工程化思维和模型微调等进阶方向帮助读者顺利进入AI领域。全文适合希望利用现有技能快速转型的程序员学习。开个好头AI 爆发到现在已经好几年了但是依旧还有一些老一辈艺术家在坚持古法编程也不知道是因为什么不去接受 AI 带来的生产率提高好让你早点下班。但是也有一些朋友已经提前走上了转型的道路还是那句话时代的轮子来了你不跑你只能被当成养料。但是如何转型一脸懵啊看了那么多各家培训机构吹的牛逼动不动转型就是 2、30k我看了我也眼红但是不知道路线咋整那么看完这篇文章可能对你是有一点点帮助了。到目前为止市面上的岗位已经慢慢的变得稳定从开始的 Prompt 工程师到后来的 RAG 工程师再到现在的 Agent 开发工程师说明大模型发展的速度也是越来越快。最开始让你会写 Prompt 再到现在让你必须得会构建 Agent个人需要掌握的能力也是要求越来越高。不过薪资也是足够吸引人你会 AI 和不会 AI 带来的薪资完全是两码事而且据我了解现在招人的简介中多多少少都会写一句会 AI 的优先。说到正事从21 年开始市面上的 crud boy 就已经趋近于饱和了在这之后找工作的人应该多多少少有点感触。但是学 Java 的人他具备非常良好的后端业务思维而且少部分人是具备整体的架构思维。什么意思就是他知道一个接口我应该让前端给我什么样的参数参数规范是什么走到后端应该落哪个表落完表后对整个业务系统的影响是什么。那么这个思维在 AI 开发中就显得尤为重要。所谓的 vibe coding无非就两种模式一种是 Spec 工程计划模式另一种就是纯自然语言交互模式当你具备了工程化的思维时就能很好的指挥 AI 开始干活了。然后我们再说大模型开发该怎么学到目前我了解到的岗位一个是算法工程师。顾名思义这个岗位属于是顶尖那批人我们是用轮子的他们是造轮子的。另一个就稍微简单AI 应用开发工程师属于是在造好的轮子上拼凑汽车。前者我也不太了解因为我确实不会那些技术什么大模型原理moe 架构我一个都不会。后者是 AI 应用工程师这一块我们要学起来就稍显简单虽然东西也一样的多但是上手之后进展巨快。但是怎么学问 der 包问 ds别费那时间直接找培训机构的学习路线图。我不是让你报班我也不打广告但是这是上班摸鱼自学的最快方式。举个例子看一个某马的学习路线截个图上面的路线清清楚楚里面涉及到的核心算法也没有想的那么复杂所以想的那么多不如每天摸鱼看看文档。直接开始首先你会 Java那么你学 Python 的基础就一定非常快什么玩意儿 for 循环whileif-else 都是小问题。并发编程也只是跟 Java 的写法不一样而已核心原理一通百通但是刚开始写 Python 代码肯定会不适应怎么办让 AI 写。目前主流的两种大模型协议各大厂商都在遵守一个是 OpenAI 协议一个是Anthropic协议没办法谁让人家牛逼能站在领先的角度。OpenAI常见的url 中就比如 /v1 地址比如https://token-plan-cn.xiaomimimo.com/v1Anthropic后缀包含anthropic比如https://token-plan-cn.xiaomimimo.com/anthropic你不用理会这两种有什么区别只需要知道能通过这种方式去调用就可以。而且现在有非常多的大模型可以免费白嫖 api再不济充 10 块钱给 ds 也能用用所以你的第一步就是先学会用 python 调用大模型 api知道里面的返回结果分别是什么意思。比如这段代码import requests # 配置 base_url https://token-plan-cn.xiaomimimo.com/v1 api_key tp-xxxx # 请求 url f{base_url}/chat/completions headers { api-key: api_key, Content-Type: application/json } data { model: mimo-v2.5-pro, messages: [ { role: system, content: You are MiMo, an AI assistant developed by Xiaomi. Today is date: Tuesday, December 16, 2025. Your knowledge cutoff date is December 2024. }, { role: user, content: please introduce yourself } ], max_completion_tokens: 1024 } response requests.post(url, headersheaders, jsondata) # 输出 if response.status_code 200: result response.json() print(✅ 回答, result[choices][0][message][content]) else: print(❌ 失败, response.status_code, response.text)不出意外你能得到这段结果{“id”:“f4b89f8447d942de9a2b64c76cc73107”,“choices”:[{“finish_reason”:“stop”,“index”:0,“message”:{“content”:“Hi there! I’m MiMo, your friendly AI assistant from Xiaomi. I’m here to help answer questions, brainstorm ideas, or just chat—whether it’s about tech, daily life, or random curiosities. I aim to be helpful, creative, and always supportive. What can I do for you today?”,“role”:“assistant”,“tool_calls”:null,“reasoning_content”:“Okay, the user just asked me to introduce myself. This is a straightforward request with no hidden agenda—probably a new user testing the waters or just being friendly. As MiMo from Xiaomi, I need to keep it warm, positive, and helpful to build rapport, while highlighting my capabilities without overwhelming them. Key points: Start with a greeting, state who I am and my purpose, list core strengths in a casual way, end with an open invitation to chat. Avoid any technical jargon or negativity; stick to engaging, supportive tone per the primary principle.”}}],“created”:1781079350,“model”:“mimo-v2.5-pro”,“object”:“chat.completion”,“usage”:{“completion_tokens”:181,“prompt_tokens”:55,“total_tokens”:236,“completion_tokens_details”:{“reasoning_tokens”:113},“prompt_tokens_details”:{}}}其中的一些关键参数了解一下completion_tokens输出 tokenprompt_tokens输入 tokentotal_tokenstoken 合计message 模型的返回结果只要你看到这些数据那么恭喜你你已经入门了可以去找 20k 的工作了走到这一步你就可以开始发散你的思维了做一个 demo 出来怎么做让 AI 给你画个前端对接一下你的后端不管是 python 还是 Java对接你用的大模型地址和 apikey然后聊天框发起访问拿到结果渲染界面demo 就算完成然后做什么走完上面的流程开始研究 ragrag 要学什么东西才算完整可以去看我的上一篇文章中有详细的描述这里只讲一些基础什么是 ragrag 是一个系统他通过在你与大模型对话的过程中通过检索数据库来增强你给大模型的上下文让大模型能根据你的私有知识回答问题。从这里开始我建议你全部主攻 python 语言来开发Java 暂时放一边。python 中有成熟的 rag 框架比如 llamaindexLangchain 等等。不过还是建议你从 0 开始慢慢实现一个 rag 流程你需要准备一些文档比如任何一本电子书你的工作笔记你的情书都可以将它们整理成比较简单的数据结构。然后将数据塞进 Chroma、Faiss、Milvus 等等数据库在然后就可以开始借助你刚刚做的那个 demo我们就可以将它继续完善成一个带 rag 的demo 了你要实现查询改写就是将你的原始问题通过提示词让大模型给出不同的问题出来因为你的原始问题可能并不能很好的检索到文档这时候就得以量取胜。然后就把你检索出的结果通过提示词拼凑起来交给大模型告诉大模型结合你的上下文一起给出回答这时候你的 demo 就算是完成了对 rag 的整合你也已经具备了rag 工程师的水准。import chromadb import requests # 1. 配置信息你的密钥 MIMO_API_KEY tp-xxxx MIMO_BASE_URL https://token-plan-cn.xiaomimimo.com/v1 # 2. 初始化 Chroma 向量库 # 本地持久化 Chroma会自动创建文件夹 client chromadb.PersistentClient(path./chroma_db) # 创建/获取集合 collection client.get_or_create_collection(namedemo_knowledge_base) # 先插入几条演示数据真实场景是你提前导入的文档/知识库 demo_docs [ 小米MiMo是由小米公司开发的AI助手知识截止到2024年12月。, Chroma是一个轻量级开源向量数据库专门用于存储和检索文本向量。, RAG 检索增强生成先检索知识库再给大模型生成回答。, 大模型调用需要API-KEY认证请求格式遵循OpenAI规范。 ] # 给 Chroma 添加数据 collection.add( documentsdemo_docs, ids[fid{i} for i in range(len(demo_docs))] ) # 3. 核心 RAG 流程函数 def rag_chat(user_question): 完整 RAG 流程 1. 接收用户问题 2. 从 Chroma 检索相关知识 3. 拼接提示词 4. 调用 MiMo 大模型 5. 返回最终回答 print(f 用户问题{user_question}/n) # -------------------- 步骤1从 Chroma 检索相关文档 -------------------- results collection.query( query_texts[user_question], n_results2 # 取最相关的2条 ) retrieved_docs results[documents][0] print( 检索到知识库内容) for idx, doc in enumerate(retrieved_docs): print(f{idx1}. {doc}) # -------------------- 步骤2拼接提示词 -------------------- context_str /n.join(retrieved_docs) prompt f 你是小米MiMo助手请根据下面的知识库内容回答用户问题。 如果知识库没有相关信息就说“根据现有知识无法回答”。 知识库内容 {context_str} 用户问题{user_question} 请直接给出简洁回答。 # -------------------- 步骤3调用 MiMo 大模型 -------------------- url f{MIMO_BASE_URL}/chat/completions headers { api-key: MIMO_API_KEY, Content-Type: application/json } data { model: mimo-v2.5-pro, messages: [ {role: system, content: 你是MiMo由小米开发的AI助手。}, {role: user, content: prompt} ], max_completion_tokens: 1024 } response requests.post(url, headersheaders, jsondata) if response.status_code ! 200: return f请求失败{response.status_code} {response.text} # -------------------- 步骤4解析并返回回答 -------------------- answer response.json()[choices][0][message][content] return answer # 4. 运行测试 if __name__ __main__: # 测试问题1 question 什么是RAG final_answer rag_chat(question) print(/n MiMo 最终回答/n, final_answer)经历了简单 rag 之后这时候你会了解到知识图谱知识图谱在原本简单的 rag 之上增强了发散的能力为每一个节点增加了图检索的功能这会让你的 rag 变得更加强大。继续升级这时候你就要开始学一些主流的框架了比如 Langchainlanggraph。如果你学过 Langchain4j那么 langchain 对你来说就是小 case如果没学过那也不影响。你就要开始用 Langchain 开始创建出你的第一个 Agent这会直接让你前面做的 demo 代码完完全全的简化你只需要配置一些简单的 apikeyurl 以及 Id 就能直接调通大模型的响应。当你学会了基础调用后你就会了解到什么是 tooltool 怎么在实际的调用中是用。什么又是长短期记忆在我们整个业务系统中起什么作用。然后就是会话摘要如何借助中间件来对我们的上下文做管理。到这时就可以收手了差不多可以了Langchain 的核心也就这些可以开始花时间研究 langgraph 了import requests from langchain.tools import tool from langchain_core.prompts import ChatPromptTemplate, MessagesPlaceholder from langchain_core.output_parsers import StrOutputParser from langchain_core.runnables import RunnablePassthrough from langchain_chroma import Chroma from langchain_core.documents import Document from langchain_core.embeddings import Embeddings from langchain.agents import create_openai_tools_agent, AgentExecutor from langchain_core.memory import BaseMemory from langchain.memory import ConversationSummaryMemory, ConversationBufferMemory from typing import List, Dict # 【1】配置你的 MiMo 大模型 MIMO_API_KEY tp-xxx MIMO_BASE_URL https://token-plan-cn.xiaomimimo.com/v1 MODEL_NAME mimo-v2.5-pro # ------------------------- 自定义 MiMo 模型适配 LangChain 1.x------------------------- class MiMoChatModel: def __init__(self, api_key, base_url, model): self.api_key api_key self.base_url base_url self.model model def bind_tools(self, tools): self.tools tools return self def invoke(self, input_data): headers {api-key: self.api_key, Content-Type: application/json} # 处理 Agent 消息格式 messages input_data.get(messages, []) data { model: self.model, messages: messages, max_completion_tokens: 1024 } resp requests.post(f{self.base_url}/chat/completions, headersheaders, jsondata) resp.raise_for_status() return resp.json()[choices][0][message][content] # 初始化模型 llm MiMoChatModel(MIMO_API_KEY, MIMO_BASE_URL, MODEL_NAME) # 【2】自定义工具Tool tool def search_weather(city: str) - str: 查询指定城市的天气参数 city 是城市名 return f{city} 今天天气晴朗温度 25℃微风。 tool def calculate(a: int, b: int, op: str) - str: 简单计算器a b 为数字op 为 - * / if op : return str(a b) if op -: return str(a - b) if op *: return str(a * b) if op /: return str(a / b if b !0 else 错误) return 不支持的操作 tools [search_weather, calculate] # 【3】RAG 向量库Chroma class DummyEmb(Embeddings): def embed_documents(self, texts): return [[0.1]*5 for _ in texts] def embed_query(self, text): return [0.1]*5 vector_db Chroma( collection_namefull_rag_demo, embedding_functionDummyEmb(), persist_directory./chroma_agent_demo ) # 插入知识库 vector_db.add_documents([ Document(page_contentMiMo 是小米公司开发的AI助手知识截止到2024年12月。), Document(page_contentRAG 检索增强生成先检索知识库再回答问题。), Document(page_contentLangChain 1.x 使用 LCEL 语法支持 Agent Memory RAG 一体化。) ]) # RAG 检索工具 tool def rag_search(query: str) - str: 从公司知识库检索信息用于回答内部知识问题 retriever vector_db.as_retriever(search_kwargs{k:2}) docs retriever.get_relevant_documents(query) return /n.join([d.page_content for d in docs]) tools.append(rag_search) # 【4】记忆 会话摘要Memory # 摘要记忆自动总结历史不会无限膨胀 memory ConversationSummaryMemory( llmllm, return_messagesTrue, memory_keychat_history, output_keyoutput ) # 【5】创建 AgentLangChain 1.x 标准 prompt ChatPromptTemplate.from_messages([ (system, 你是强大的 MiMo 助手能使用工具、记忆对话、检索知识库。), MessagesPlaceholder(variable_namechat_history), (user, {input}), MessagesPlaceholder(variable_nameagent_scratchpad), ]) # 创建 Agent agent create_openai_tools_agent(llm, tools, prompt) agent_executor AgentExecutor( agentagent, toolstools, memorymemory, verboseTrue, return_intermediate_stepsTrue ) # 【6】测试全流程对话 if __name__ __main__: print( * 60) print(开始全功能对话输入 exit 退出) print( * 60) while True: user_input input(/n你) if user_input.lower() in [exit, quit]: print(结束对话) break result agent_executor.invoke({input: user_input}) print(/n MiMo, result[output]) # 查看自动生成的会话摘要 print(/n 会话摘要, memory.buffer)langgraph 怎么学搞懂什么是图构成整个图的三要素点状态边你把 langgraph 想象成一张巨大的蜘蛛网上面每一个交叉处就是一个点点与点之间存在不同的边。他们之间要相互工作就必须有一个中央的状态管理。如果 Langchain 是构建单一的 Agent那么 langgraph 就是非常多不同的 Agent通过一个状态State来管理你不用关心这个 state 存储什么数据他就是一个类什么都能存。from typing import TypedDict, Annotated from langgraph.graph import StateGraph, END import operator # 1) State状态三要素之一 class AgentState(TypedDict): # 全局共享状态 question: str context: str # RAG 检索结果 tool_result: str # 工具调用结果 answer: str # 最终回答 messages: Annotated[list, operator.add] # 对话历史自动合并 # 2) Node节点三要素之二 def node_rag_retrieve(state: AgentState): RAG 检索节点 print(→ 执行 RAG 知识库检索) return {context: RAG 结果LangGraph 三要素 State、Node、Edge} def node_tool_call(state: AgentState): 工具调用节点模拟计算器 print(→ 执行工具调用计算器) return {tool_result: 计算结果100 200 300} def node_llm_answer(state: AgentState): 大模型生成回答 print(→ 大模型生成最终回答) answer f根据检索{state[context]}/n根据工具{state[tool_result]} return {answer: answer} # 3) Edge边 路由三要素之三 def route_question(state: AgentState): 条件路由决定走 RAG 还是 工具 q state[question].lower() if langgraph in q: return rag elif 计算 in q or 多少 in q: return tool else: return llm # 构建流程图 workflow StateGraph(AgentState) # 添加节点 workflow.add_node(rag_node, node_rag_retrieve) workflow.add_node(tool_node, node_tool_call) workflow.add_node(llm_node, node_llm_answer) # 设置入口 workflow.set_entry_point(rag_node) # 添加条件边 workflow.add_conditional_edges( rag_node, route_question, { rag: rag_node, tool: tool_node, llm: llm_node } ) # 普通边 workflow.add_edge(tool_node, llm_node) workflow.add_edge(llm_node, END) # 编译图 app workflow.compile() # 测试运行 if __name__ __main__: user_question LangGraph 三要素是什么100200 等于多少 result app.invoke({ question: user_question, messages: [{role: user, content: user_question}] }) print(/n *50) print(最终回答) print(result[answer])最终boss恭喜你学到这里你已经能应付市面上的大部分工作了那么剩下的进阶是什么呢工程化的思维以及对模型的微调工程化的思维指的是你能完美熟练的运用上方的各种技术将它们融合整理成一个大的系统进行对外暴露这其中包括token 计费系统可观测平台rag 召回率调优大模型网关等等至于模型的微调如果不是特定领域下我是不建议你去微调的微调后的模型能力可能并没有增强多少反而可能降低但是微调的作用也很明显比如医疗场景生成病历微调后的模型能对更多的专业医疗名词进行描述书写最后也是奉上一张学习路线图祝你早日转行成为一名合格的 AI 摸鱼工程师最后2026年技术圈的分化愈发明显降薪裁员潮持续蔓延传统开发、测试等岗位大批缩水不少从业者陷入职业焦虑与之形成鲜明对比的是AI大模型相关岗位迎来疯狂扩招薪资逆势飙升150%大厂更是直接开出70-100W年薪疯抢具备实战能力的大模型人才甚至放宽年龄限制只求能快速落地技术、创造价值很多程序员、职场新人纷纷入局大模型领域绝非盲目跟风而是实实在在看到了不可替代的价值优势这也是2026年最值得抓住的职业风口1、窗口期红利入门门槛友好不同于成熟赛道的“内卷式招聘”2026年大模型人才缺口巨大简历只要达标掌握基础AI应用具备简单项目经验年龄、学历均非硬性要求小白可快速入门转行程序员也能无缝衔接2、技术可复用上手速度翻倍如果你有前后端开发、测试、数据分析等基础在大模型落地、系统部署、Prompt工程等环节会更具优势无需从零开始复用原有技术能力就能快速进阶3、懂业务更吃香竞争力翻倍单纯懂技术已不够2026年大厂更看重“技术业务”的复合型人才有垂直领域金融、医疗、工业等经验者能精准定位模型落地痛点薪资比纯技术岗高出30%以上更重要的是即便没有转型需求用AI大模型工具为工作赋能、提升效率也已经成为80%企业的硬性要求——不会用大模型提效未来很可能被行业淘汰那么2026年小白/程序员该如何高效学习大模型很多人想入门大模型却陷入两大困境要么到处搜集零散资料不成体系越学越懵要么被收费高昂的课程割韭菜花了钱却学不到实战技能白白浪费时间走弯路。今天就给大家精心整理了一份2026年最新、免费、系统化的AI大模型学习资源包覆盖从零基础入门到商业实战、从理论沉淀到面试通关的全流程所有资料均已整理归档无需拼凑直接领取就能上手学习小白可照做程序员可进阶扫码免费领取全部内容1、大模型系统化学习路线这份学习路线结合2026年行业趋势和新手学习规律由行业专家精心设计从零基础到精通每一步都有明确指引帮你节省80%的无效学习时间少走弯路、高效进阶避免踩坑。2、从0到进阶大模型学习视频教程从入门到进阶这里都有跟着老师学习事半功倍。3、大模型学习书籍电子文档涵盖2026年最新技术要点包括基础入门、Transformer核心原理、Prompt工程、RAG实战、模型微调与部署等内容4、AI大模型最新行业报告报告包含腾讯、阿里、甲子光年等权威机构发布的核心内容还有2026年中文大模型基准测评报告、AI Agent行业研究报告等帮你站在行业前沿把握技术风口。5、大模型项目实战配套源码项目包含Deepseek R1、GPT项目、MCP项目、RAG实战等热门方向还有视频配套代码手把手教你从0到1完成项目开发既能练手提升技术又能丰富简历为求职和职业发展加分。6、2026大模型大厂面试真题2026年大模型面试已全面升级不再单纯考察基础原理而是转向侧重技术落地和业务结合的综合考察很多程序员和新手因为缺乏针对性准备明明技术不错却在面试中失利。适用人群四阶段学习规划共90天可落地执行第一阶段10天初阶应用该阶段让大家对大模型 AI有一个最前沿的认识对大模型 AI 的理解超过 95% 的人可以在相关讨论时发表高级、不跟风、又接地气的见解别人只会和 AI 聊天而你能调教 AI并能用代码将大模型和业务衔接。大模型 AI 能干什么大模型是怎样获得「智能」的用好 AI 的核心心法大模型应用业务架构大模型应用技术架构代码示例向 GPT-3.5 灌入新知识提示工程的意义和核心思想Prompt 典型构成指令调优方法论思维链和思维树Prompt 攻击和防范…第二阶段30天高阶应用该阶段我们正式进入大模型 AI 进阶实战学习学会构造私有知识库扩展 AI 的能力。快速开发一个完整的基于 agent 对话机器人。掌握功能最强的大模型开发框架抓住最新的技术进展适合 Python 和 JavaScript 程序员。为什么要做 RAG搭建一个简单的 ChatPDF检索的基础概念什么是向量表示Embeddings向量数据库与向量检索基于向量检索的 RAG搭建 RAG 系统的扩展知识混合检索与 RAG-Fusion 简介向量模型本地部署…第三阶段30天模型训练恭喜你如果学到这里你基本可以找到一份大模型 AI相关的工作自己也能训练 GPT 了通过微调训练自己的垂直大模型能独立训练开源多模态大模型掌握更多技术方案。到此为止大概2个月的时间。你已经成为了一名“AI小子”。那么你还想往下探索吗为什么要做 RAG什么是模型什么是模型训练求解器 损失函数简介小实验2手写一个简单的神经网络并训练它什么是训练/预训练/微调/轻量化微调Transformer结构简介轻量化微调实验数据集的构建…第四阶段20天商业闭环对全球大模型从性能、吞吐量、成本等方面有一定的认知可以在云端和本地等多种环境下部署大模型找到适合自己的项目/创业方向做一名被 AI 武装的产品经理。硬件选型带你了解全球大模型使用国产大模型服务搭建 OpenAI 代理热身基于阿里云 PAI 部署 Stable Diffusion在本地计算机运行大模型大模型的私有化部署基于 vLLM 部署大模型案例如何优雅地在阿里云私有部署开源大模型部署一套开源 LLM 项目内容安全互联网信息服务算法备案…扫码免费领取全部内容7、这些资料真的有用吗这份资料由我和鲁为民博士(北京清华大学学士和美国加州理工学院博士)共同整理现任上海殷泊信息科技CEO其创立的MoPaaS云平台获Forrester全球’强劲表现者’认证服务航天科工、国家电网等1000企业以第一作者在IEEE Transactions发表论文50篇获NASA JPL火星探测系统强化学习专利等35项中美专利。本套AI大模型课程由清华大学-加州理工双料博士、吴文俊人工智能奖得主鲁为民教授领衔研发。资料内容涵盖了从入门到进阶的各类视频教程和实战项目无论你是小白还是有些技术基础的技术人员这份资料都绝对能帮助你提升薪资待遇转行大模型岗位。这份完整版的大模型 AI 学习资料已经上传CSDN朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】