AIUnlimited
🌳

AI基础

🌱
AI 种子

从零开始

🌿
AI 萌芽

打好基础

🌳
AI 枝干

付诸实践

🏕️
AI 树冠

深入探索

🌲
AI 森林

精通AI

🔨

AI精通

✏️
AI 草图

从零开始

🪨
AI 雕刻

打好基础

⚒️
AI 匠心

付诸实践

💎
AI 打磨

深入探索

🏆
AI 杰作

精通AI

📘

AI实战

📖
理解开源模型

开源模型的基础知识和资源

🎯
问题到模型任务

将业务问题转化为模型任务

⚡
跑通第一个模型

30分钟快速看到第一个结果

🔧
微调与评测

微调模型并评估性能

🚀
应用系统

构建实际AI应用系统

🎨
生成式AI

探索AIGC的开源模型

🤖
Agent智能体

学习Agent框架和MCP工具

📐
基础补充

LLM基础知识和评测

🎓

Claude 学院

🤖
Claude 101 入门

用 Claude 学习 AI 基础知识

💻
Claude Code 101 入门

让 Claude 成为你的结对编程伙伴

🤝
Claude Cowork 入门

与 Claude 协作完成复杂项目

⚙️
Claude 平台 101

使用 Claude API 构建应用

实验室

已加载 7 个实验
🧬神经网络沙盒🤖AI 还是人类?🥋提示工程道场🏁算法竞速🧠AI 知识挑战🏗️系统设计画布
🎯模拟面试进入实验室→
🚀

职业发展

🚀
面试发射台

开启你的旅程

🌟
行为面试精通

掌握软技能

💻
技术面试

通过编程轮次

🤖
AI与ML面试

ML面试精通

🏆
Offer与未来

拿下最好的Offer

立即开始
AIUnlimited

AI 教育平台

沪ICP备18025655号-11

学习

  • AI基础
  • AI实战
  • Claude学院
  • 实验室
  • 职业发展

社区

  • 关于
  • 常见问题

支持

  • 服务条款
  • 隐私政策
  • 联系我们
AI & 工程学习计划›🌱 AI 种子›课程›机器是怎么学习的
🧠
AI 种子 • 入门⏱️ 12 分钟阅读

机器是怎么学习的

机器如何学习🧠

在上一课中,我们了解到人工智能是从经验中学习的软件。但这实际上是如何运作的呢?机器如何从一无所知到识别你的脸或推荐你下一首最喜欢的歌曲?

让我们探索智能软件背后的秘密。


🔄 学习循环

每个机器学习系统都遵循相同的基本周期:

  1. 数据 - 机器给出了很多例子
  2. 模式 - 它在这些示例中查找重复出现的模式
  3. 预测 - 它使用这些模式来猜测新数据
  4. 反馈 - 它发现它的猜测是对还是错
  5. 改进 - 不断调整并再次尝试,每次都变得更好

把它想象成学习做饭。您遵循食谱(数据),注意什么有效(模式),尝试自己的变化(预测),品尝结果(反馈),并在下次调整调味料(改进)。

显示机器学习循环的圆形图:数据流向模式识别,然后流向预测,然后流向反馈,然后流向改进,再循环回模式识别
机器学习周期:数据、模式、预测、反馈和持续改进
🤯

Google 用于检测垃圾邮件的人工智能每分钟处理超过 1000 万条可疑邮件。每次用户将某些内容标记为“垃圾邮件”或“非垃圾邮件”时,系统都会学习并更新其模式 - 每次点击都会变得更加智能。


📚 监督学习 - 和老师一起学习

最常见的机器学习类型称为“监督学习”。它的工作原理就像跟着老师学习一样,老师会给你答案。

它的工作原理如下:

  1. 你给机器提供了数千个带有标签的例子(正确答案)
  2. 机器研究这些带标签的例子
  3. 它学习将输入连接到正确标签的模式
  4. 当它看到新的、未标记的数据时,它会预测答案

真实示例:垃圾邮件过滤器

想象一下您向机器显示 100,000 封电子邮件。每个邮件都被人类标记为 “垃圾邮件” 或 “非垃圾邮件”。

机器注意到模式:

  • 带有“WIN FREE MONEY”字样的电子邮件往往是垃圾邮件
  • 来自地址簿中联系人的电子邮件往往是真实的
  • 带有数十个感叹号的电子邮件通常是垃圾邮件

在研究了足够多的示例后,它可以查看从未见过的全新电子邮件并预测它是否是垃圾邮件 - 无需任何人编写特定规则。

🤔
Think about it:

监督学习依赖于标记数据——有人必须提供正确的答案供机器学习。您认为谁给所有这些数据贴上标签?在许多情况下,需要成千上万的工作人员仔细标记图像、文本和音频。人工智能的“智能”往往始于人类的大量努力。

🧠小测验

机器学习中的”监督学习”是什么意思?


🔍 无监督学习 - 寻找隐藏模式

如果您没有答案怎么办?如果您只有大量数据并且希望机器自己找到有趣的模式怎么办?

这就是无监督学习。没有老师,没有标签,没有正确答案。机器探索数据并将相似的事物分组在一起。

现实示例:客户分组

想象一下,一家超市拥有数百万顾客的购买数据,但没有标签。人工智能分析数据并发现自然群体:

  • A组:购买有机蔬菜、散养鸡蛋和燕麦奶
  • B 组:购买冷冻披萨、薯片和碳酸饮料
  • C 组:购买尿布、婴儿食品和湿巾
第 2 课,共 17 课已完成 0%
←什么是AI?一个友好的介绍

讨论

登录 参与讨论

没有人告诉机器这些团体的存在。它通过发现购物数据中的模式自行找到它们。超市现在可以向每个群体发送相关报价。

🧠小测验

无监督学习与监督学习有何不同?


🐕 强化学习 - 尝试和错误

第三种是强化学习,它的工作原理很像训练狗。

当狗按照命令坐下时,你就给它零食(奖励)。当它咬你的鞋子时,你说“不”(惩罚)。随着时间的推移,狗会知道哪些行为会带来奖励,哪些行为会带来麻烦。

强化学习的工作原理相同:

1.人工智能在环境中采取行动 2.它收到奖励(正)或惩罚(负) 3.随着时间的推移,它会调整策略以最大化奖励 4.它尝试数百万种不同的方法,直到找到最好的一种

现实世界示例:玩游戏的人工智能

谷歌的 AlphaGo 通过与自己玩数百万局来学会玩古老的棋盘游戏围棋。每一次胜利都是一种奖励;每一次失败都是一种惩罚。它尝试了疯狂的策略,从失败中吸取教训,并最终比历史上任何人类玩家都更好。

同样的方法还用于训练机器人行走、教自动驾驶汽车导航以及优化数据中心的能源使用。

🤯

AlphaGo 在训练期间与自己进行了超过 3000 万场比赛。一个人每天玩一款游戏大约需要 82,000 年才能玩那么多游戏。人工智能将所有这些经验压缩到短短几周内。


🗺️ 三种类型的比较

|类型 |有标签吗? |类比|示例| |------|------------|---------|---------| | 监督 |是的 |带着答案学习 |垃圾邮件过滤器、医疗诊断| | 无人监督 |没有 |整理凌乱的抽屉|客户分组、异常检测 | | 强化 |否(使用奖励)|用零食训练狗 |游戏人工智能、机器人、自动驾驶汽车 |

🤔
Think about it:

想想你是如何学会骑自行车的。是有人监督(有人确切地告诉你该怎么做)、无人监督(你自己找到平衡)还是强化(你跌倒、调整并再次尝试)?大多数人类学习实际上是这三者的混合。人工智能学习风格的灵感来自于我们如何自我学习。


🔑 要点

  • 机器通过一个循环进行学习:数据→模式→预测→反馈→改进
  • 监督学习 使用带标签的示例 - 就像跟随老师学习一样
  • 无监督学习发现没有标签的数据中的隐藏模式
  • 强化学习使用奖励和惩罚 - 就像训练狗一样
  • 所有三种类型都为您每天使用的人工智能系统提供动力
🧠小测验

哪种类型的机器学习最像用零食和命令训练宠物?

💡

不需要成为数学家或程序员才能理解机器学习。从本质上讲,它是关于从经验中学习——每个人从出生那天起就自然而然地做的事情。人工智能只是用数据而不是生活经验来做到这一点。


下一步是什么?

现在您已经了解了机器如何学习,下一课将向您展示已经装在您口袋里的人工智能。您的智能手机充满了智能功能 - 让我们来揭开它们的面纱。