×
<在线客服<
描述
021-53098865


欢迎来到雅菲奥朗官网
欢迎来到雅菲奥朗官网
描述
SRE Foundation培训  
雅菲奥朗SRE Foundation课程介绍了使组织能够可靠和经济地扩展关键服务的原则和实践。SRE Foundation培训是为那些关注大规模服务可用性的学员量身定制的课程。雅菲奥朗携手DevOps Institute推出SRE Foundation认证培训,成为国内首家SRE授权培训和考试机构。
相关课程
  • 课程详情
  • 课程天数2天

    课程安排

    Day 1 建立 FDE 认知体系(What & Why)

    Day 2 实操模块(How)

    课程安排


    Day 1:认知篇

    Day 2:实操篇

    主题

    FDE 是什么 · 为什么 AI 项目会失败 · 怎么做

    模块:AI 技术实战

    形式

    案例驱动讲授 + 互动讨论

    动手实操为主,讲授为辅

    定位

    统一认知,建立共同语言

    补齐短板,带走可落地的工作方法

    时长

    约 6 小时

    约 6 小时

    课程概览

    第一天学习内容 聚焦 FDE 的角色认知与行业全景。通过全球标杆案例和经典失败案例,帮助学员理解 FDE 是什么、为什么 AI 项目需要 FDE、以及 FDE 在项目全生命周期中的工作方式。内容以案例驱动讲授为主,配合互动讨论和 ROI 计算练习,为 Day 2 的实战模块建立共同语境。

    第二天学习内容 以 Vibe Coding(用自然语言描述需求、AI Agent 生成代码、工程师负责审查和调试)为核心工作方式,在一天内带领学员从零搭建可运行的 AI 系统。上午解决"怎么用 AI 工具写代码",下午解决"怎么把 AI 系统部署上线"。全程动手实操,讲授时间不超过 30%。

    课程目标

    学员能够:

    • 通过 NHS、Airbus 等全球标杆案例,准确描述 FDE 的核心定义,区分 FDE 与售前顾问、实施工程师等相邻角色;

    • 通过 IBM Watson Health、Amazon AI 招聘、Microsoft Tay、Zillow iBuying 四个经典失败案例,理解 AI 项目四类失败模式及其根因;

    • 掌握效率型、质量型、收入型三类 ROI 量化公式,能在项目启动阶段完成初步 ROI 测算;

    • 描述 AI 项目全生命周期四阶段(售前诊断→工程集成→上线交付→持续运营)的核心任务;

    • 理解国内 AI 落地的合规要点、私有化部署选型和决策链沟通策略;

    • 配置并独立使用 opencode 等 Code Agent 工具完成代码生成任务;

    • 了解 2026 年主流大模型的特点与选型原则,判断需求适合 RAG 还是 Agent 方案;

    • 用 Vibe Coding 从零搭建一个可运行的 RAG 问答系统;

    • 理解 Agent 的工作原理,搭建一个带工具调用的简单 Agent;

    • 了解 AI 应用容器化部署和基础监控的基本流程;

    • 通过培训,顺利获取工信部人工智能工程师(高级)证书;

    课程受众

    • 企业内所有参与 AI 项目落地的团队成员。

    • 传统实施或项目交付背景,希望快速建立 AI 原型搭建能力的学员。

    • 需要在客户现场独立完成 PoC 交付的驻场工程师。


    课程内容

    第一天课程内容:

    第1讲:FDE 是什么——角色起源与定位

    • FDE 的起源:从 Palantir 的 NHS 和 Airbus 案例理解角色的诞生

    • FDE 能力三角模型:技术深度(能动手)× 业务宽度(能翻译)× 交付韧性(能落地)

    • FDE 与相邻角色(解决方案架构师、售前工程师、传统实施工程师)的本质差异

    • FDE 的五个常见误解与真相

    • AI 时代 FDE 的行业趋势:OpenAI DeployCo(40亿美元)、Anthropic Applied AI(15亿美元)

    第2讲:为什么 AI 项目会失败——经典案例与 ROI 框架

    • 四个全球经典失败案例深度拆解:IBM Watson Health(数据不可用·40亿美元)、Amazon AI 招聘(业务不配合)、Microsoft Tay(合规卡住·16小时下线)、Zillow iBuying(ROI 说不清·3亿美元损失)

    • ROI 量化框架:效率型 / 质量型 / 收入型三类公式

    • 项目启动 10 项检查清单(每项标注对应的案例教训)

    • 互动练习:ROI 计算与口径对齐

    第3讲:FDE 怎么工作——AI 项目全生命周期

    • AI 项目四阶段全景:售前诊断 → 工程集成 → 上线交付 → 持续运营

    • 每阶段核心任务、交付物与典型风险

    • 案例贯穿:将四个失败案例精确归因到各阶段

    • FDE 独有职责:反馈闭环——从 Airbus 内部项目到 Skywise 行业平台的演化

    第4讲:国内落地的特殊性——合规、私有化与决策链

    • 五个合规踩坑实战案例学三部法规(数据安全法、个保法、生成式 AI 办法)

    • 私有化部署三种模式与选型:公有云 API / 私有云部署 / 完全私有化

    • 国内大型企业四层决策链与沟通策略

    • 国内平台速览:Dify、阿里云百炼、百度智能云


    第二天课程内容:

    第5讲:Vibe Coding 快速上手——让 AI 帮你写代码

    • 主流 Code Agent 工具速览:opencode、Claude Code、Cursor

    • Vibe Coding 核心原则:描述意图、给足上下文、分步迭代、逐行审查、用 AI 解释代码

    • opencode 安装配置与三种使用模式(含接内网模型的方法)

    • 2026 年主流模型速查:GPT-4.1、Claude Sonnet 4.6、DeepSeek-V4、Qwen3.5

    • 实操:用 opencode 完成一个提示词工程任务——投诉工单分类器搭建与调优

    第6讲:RAG 系统搭建实战——让模型懂你的数据

    • RAG 核心原理与推荐技术栈速览(Docling 解析、硅基流动 Embedding、Chroma 向量库)

    • 实操:用 opencode 从零搭建一个知识库问答系统

      • 文档解析与分块

      • 向量化与检索

      • 答案生成与来源引用

    • 效果评测入门:用 Ragas 诊断系统薄弱环节并调优

    第7讲:Agent 入门 + 部署与监控概览

    • Agent 与普通 LLM 的本质差异:从"问答"到"用工具完成任务"

    • 实操:为刚才的 RAG 系统添加一个工具调用能力(如自动读取文件)

    • AI 应用部署要点:Docker 容器化与离线部署基本流程

    • 上线后怎么保证不翻车:监控两层次(基础设施层 + 业务质量层)


    考试认证 :

    证书名称:人工智能工程师(高级)

    发证单位:工业和信息化部教育与考试中心

    考试形式:现场笔试/在线机考  

    •     考试时长:60分钟

    •     考试形式:闭卷考试

    •     考试题型:单选题

    •     考题数量:50题

    •     通过分数:满分为100分,通过分数线为60分。

     

    课程天数2天

    课程安排

    Day 1 建立 FDE 认知体系(What & Why)

    Day 2 实操模块(How)

    课程安排


    Day 1:认知篇

    Day 2:实操篇

    主题

    FDE 是什么 · 为什么 AI 项目会失败 · 怎么做

    模块:AI 技术实战

    形式

    案例驱动讲授 + 互动讨论

    动手实操为主,讲授为辅

    定位

    统一认知,建立共同语言

    补齐短板,带走可落地的工作方法

    时长

    约 6 小时

    约 6 小时

    课程概览

    第一天学习内容 聚焦 FDE 的角色认知与行业全景。通过全球标杆案例和经典失败案例,帮助学员理解 FDE 是什么、为什么 AI 项目需要 FDE、以及 FDE 在项目全生命周期中的工作方式。内容以案例驱动讲授为主,配合互动讨论和 ROI 计算练习,为 Day 2 的实战模块建立共同语境。

    第二天学习内容 以 Vibe Coding(用自然语言描述需求、AI Agent 生成代码、工程师负责审查和调试)为核心工作方式,在一天内带领学员从零搭建可运行的 AI 系统。上午解决"怎么用 AI 工具写代码",下午解决"怎么把 AI 系统部署上线"。全程动手实操,讲授时间不超过 30%。

    课程目标

    学员能够:

    • 通过 NHS、Airbus 等全球标杆案例,准确描述 FDE 的核心定义,区分 FDE 与售前顾问、实施工程师等相邻角色;

    • 通过 IBM Watson Health、Amazon AI 招聘、Microsoft Tay、Zillow iBuying 四个经典失败案例,理解 AI 项目四类失败模式及其根因;

    • 掌握效率型、质量型、收入型三类 ROI 量化公式,能在项目启动阶段完成初步 ROI 测算;

    • 描述 AI 项目全生命周期四阶段(售前诊断→工程集成→上线交付→持续运营)的核心任务;

    • 理解国内 AI 落地的合规要点、私有化部署选型和决策链沟通策略;

    • 配置并独立使用 opencode 等 Code Agent 工具完成代码生成任务;

    • 了解 2026 年主流大模型的特点与选型原则,判断需求适合 RAG 还是 Agent 方案;

    • 用 Vibe Coding 从零搭建一个可运行的 RAG 问答系统;

    • 理解 Agent 的工作原理,搭建一个带工具调用的简单 Agent;

    • 了解 AI 应用容器化部署和基础监控的基本流程;

    • 通过培训,顺利获取工信部人工智能工程师(高级)证书;

    课程受众

    • 企业内所有参与 AI 项目落地的团队成员。

    • 传统实施或项目交付背景,希望快速建立 AI 原型搭建能力的学员。

    • 需要在客户现场独立完成 PoC 交付的驻场工程师。


    课程内容

    第一天课程内容:

    第1讲:FDE 是什么——角色起源与定位

    • FDE 的起源:从 Palantir 的 NHS 和 Airbus 案例理解角色的诞生

    • FDE 能力三角模型:技术深度(能动手)× 业务宽度(能翻译)× 交付韧性(能落地)

    • FDE 与相邻角色(解决方案架构师、售前工程师、传统实施工程师)的本质差异

    • FDE 的五个常见误解与真相

    • AI 时代 FDE 的行业趋势:OpenAI DeployCo(40亿美元)、Anthropic Applied AI(15亿美元)

    第2讲:为什么 AI 项目会失败——经典案例与 ROI 框架

    • 四个全球经典失败案例深度拆解:IBM Watson Health(数据不可用·40亿美元)、Amazon AI 招聘(业务不配合)、Microsoft Tay(合规卡住·16小时下线)、Zillow iBuying(ROI 说不清·3亿美元损失)

    • ROI 量化框架:效率型 / 质量型 / 收入型三类公式

    • 项目启动 10 项检查清单(每项标注对应的案例教训)

    • 互动练习:ROI 计算与口径对齐

    第3讲:FDE 怎么工作——AI 项目全生命周期

    • AI 项目四阶段全景:售前诊断 → 工程集成 → 上线交付 → 持续运营

    • 每阶段核心任务、交付物与典型风险

    • 案例贯穿:将四个失败案例精确归因到各阶段

    • FDE 独有职责:反馈闭环——从 Airbus 内部项目到 Skywise 行业平台的演化

    第4讲:国内落地的特殊性——合规、私有化与决策链

    • 五个合规踩坑实战案例学三部法规(数据安全法、个保法、生成式 AI 办法)

    • 私有化部署三种模式与选型:公有云 API / 私有云部署 / 完全私有化

    • 国内大型企业四层决策链与沟通策略

    • 国内平台速览:Dify、阿里云百炼、百度智能云


    第二天课程内容:

    第5讲:Vibe Coding 快速上手——让 AI 帮你写代码

    • 主流 Code Agent 工具速览:opencode、Claude Code、Cursor

    • Vibe Coding 核心原则:描述意图、给足上下文、分步迭代、逐行审查、用 AI 解释代码

    • opencode 安装配置与三种使用模式(含接内网模型的方法)

    • 2026 年主流模型速查:GPT-4.1、Claude Sonnet 4.6、DeepSeek-V4、Qwen3.5

    • 实操:用 opencode 完成一个提示词工程任务——投诉工单分类器搭建与调优

    第6讲:RAG 系统搭建实战——让模型懂你的数据

    • RAG 核心原理与推荐技术栈速览(Docling 解析、硅基流动 Embedding、Chroma 向量库)

    • 实操:用 opencode 从零搭建一个知识库问答系统

      • 文档解析与分块

      • 向量化与检索

      • 答案生成与来源引用

    • 效果评测入门:用 Ragas 诊断系统薄弱环节并调优

    第7讲:Agent 入门 + 部署与监控概览

    • Agent 与普通 LLM 的本质差异:从"问答"到"用工具完成任务"

    • 实操:为刚才的 RAG 系统添加一个工具调用能力(如自动读取文件)

    • AI 应用部署要点:Docker 容器化与离线部署基本流程

    • 上线后怎么保证不翻车:监控两层次(基础设施层 + 业务质量层)


    考试认证 :

    证书名称:人工智能工程师(高级)

    发证单位:工业和信息化部教育与考试中心

    考试形式:现场笔试/在线机考  

    •     考试时长:60分钟

    •     考试形式:闭卷考试

    •     考试题型:单选题

    •     考题数量:50题

    •     通过分数:满分为100分,通过分数线为60分。

     

课程天数:2天
 
SRE介绍了通过自动化、工作方法和组织重组的混合措施来提高服务可靠性的一系列实践。雅菲奥朗SRE Foundation是为那些关注大规模服务可用性的学员量身定制的课程。国际开发运维考试协会DevOps Institute(DOI)总部位于美国佛罗里达州,旨在推动前沿运维技术最佳实践和标准的全球普及与应用,DOI足迹已遍布全球30余个国家。DevOps Institute致力于帮助企业IT加快产品交付速度和实现数字化转型。DevOps Institute的认证课程主要涵盖DevOps,SRE,IT服务管理,敏捷服务管理(CASM)、持续交付、持续集成,DevSecOps(安全DevOps)及DevOps实践培训等。雅菲奥朗携手DevOps Institute推出SRE Foundation认证培训,成为国内首家SRE授权培训和考试机构。

一、为什么要学习SRE?
传统运维模式(Dev/Ops分离的团队模式)冲突的焦点:
战略层面:
1、直接成本相对清晰。
2、间接成本差异较大(背景、技术能力、工具习惯、工作目标)。
初步演变为目标与方向上的分歧以及内部沟通严重问题,上升到部门之间的信任与尊重。
战术层面:
传统研发团队和运维团队分歧的焦点主要在软件新版本、新配置的变更的发布速度上。
执行层面:
1、开发团队宣称不再进行大规模的程序更新,改为功能开关调整、增量更新和补丁化(大变更→小变更)。为了绕开运维团队设立的各种流程,从而更快地上线新功能。
2、绕过运维团队设立的新服务/变更发布流程,新功能上线速度是加快了,但事件仍在重现,使得服务质量很差。
冲突解决之道:SRE
SRE模型的优势:
1)运维人数相对少;
2)开发团队和运维团队的冲突焦点消除;
3)促进产品部门水平提高,因为SRE团队和研发团队之间的成员可以自由流动。

二、SRE Foundation课程的学习内容
SRE(Site Reliability Engineering)Foundation℠课程介绍了使组织能够可靠和经济地扩展关键服务的原则和实践。引入站点可靠性维度需要组织重新调整、对软件工程和自动化的关注以及采用一系列新的工作模式。
SRE课程强调了SRE的发展及其未来的方向,并为参与者提供了实践、方法和工具,让整个组织的人员都参与到可靠性和稳定性中,通过使用真实场景和案例故事证明了这一点。课程结束后,学员将有切实的收获,例如理解、设置和跟踪服务水平目标(SLO)。
该课程是通过利用关键的SRE资源,与SRE领域的思想领袖接触,并与支持SRE的组织合作,以提取现实生活中的最佳实践而开发的,旨在教授开始采用SRE所必需的关键原则和实践。本课程使学习者能够顺利完成SRE基础认证考试。

三、SRE Foundation课程的学习目标
1、SRE基础课程的学习目标包括实际了解:
2、SRE的历史及其在谷歌的出现
3、SRE与DevOps和其他流行框架的相互关系
4、SRE背后的基本原则
5、服务水平目标(SLO)及其用户关注点
6、服务水平指标(SLI)和现代监控环境
7、错误预算和相关的错误预算政策
8、人力及其对组织生产力的影响
9、有助于消除琐事的实际步骤
10、可观察性,表明服务的健康状况
11、SRE工具、自动化技术和安全重要性
12、反脆弱性,我们对失效和失效测试的方法
13、引入SRE带来的组织影响

四、SRE Foundation课程的目标学员
DevOps从业人员
任何对现代IT领导和组织变革方法感兴趣的人
业务经理
商业利益相关者
顾问
IT主管
IT经理
IT团队领导
产品负责人
Scrum大师
软件工程师
现场可靠性工程师
系统集成商
工具供应商

五、SRE Foundation课程的教学模式
16小时的讲师指导培训
课堂练习和讨论
行业案例故事
作业练习

六、参加SRE Foundation课程的收获
SRE代表了对行业现存管理大型复杂服务的最佳实践的一个重要突破,由于Google目前的全球领先地位,SRE模式可以为广大企业提供深度模仿或借鉴。
对于企业客户而言,通过学习和掌握SRE课程,将带来以下收获:
1. 国际知名的DevOps Institute学院(DOI)推出的SRE认证课程代表了这个领域的最新知识体系,学习课程可以明显提高团队人员知识水平和创新能力;
2. 此次课程可以帮助现有的SRE团队将现有的SRE实践和国际理论标准结合,强化SRE实践能力;
3. 课程可以帮助团队掌握SRE四个关键价值(1.一套指导思想、2.一套方法论、3.一套激励方法、4.一个专业能力发展);
4. 学习后将安排认证考试,通过后可获得DOI的官方认证,可以大大提升团队信心;
5. 2020年是SRE课程为国内第一批,认证证书也将是国内首批发放,实施后将明显提升公司在SRE方面的社会公信力和公司品牌形象。

七、雅菲奥朗SRE课程,讲什么?
1. 互联网时代的IT运维精英能力分析
2. 如何成为稀缺高薪SRE人才
3. Google SRE起源与实践总结
4. SRE自动化实践
5. 服务水平目标和错误预算
6. 减少琐事(TOIL)
7. 监控和服务水平指标
8. SRE工具及自动化
9. 反脆弱性和从失败中学习
10. SRE框架和发展趋势

雅菲奥朗SRE Foundation认证培训