什么是人工智能  | Andrew Ng/是 DeepLearning.AI 的创始人、AI Fund 的普通合伙人、Coursera 的董事长和联合创始人

人工智能已广泛落地于图像、文本、语音、生成内容和机器人等场景。内容先从计算机视觉谈起,分别说明图像分类、人脸识别、物体检测、图像分割和视频跟踪如何把照片或视频转化为对象类别、位置和像素级边界,再转入自然语言处理,展示文本分类、情感识别、信息检索、命名实体识别与机器翻译在邮件、评论、搜索和文档整理中的作用。随后介绍语音识别、唤醒词检测、说话者识别和语音合成,并概述生成式人工智能在文本、图像、音频生成上的用途,以及机器人中的感知、运动规划和控制。结尾还提醒,机器学习不仅适用于非结构化数据,也同样适用于结构化数据,并引出监督学习、无监督学习和强化学习等更大的技术框架。

正文

如今,人工智能已成功应用于图像和视频数据、语言数据、语音数据以及许多其他领域。在本视频中,您将看到应用于这些不同应用领域的人工智能调查。我希望这能激发一些想法,告诉你有朝一日如何将这些技术也用于自己的项目。让我们来看看。


计算机视觉

深度学习的主要成功之一是计算机视觉。让我们来看一些计算机视觉应用的示例。

  • 图像分类和物体识别是指将这样的照片作为输入,然后告诉我们这张照片中的内容。在这种情况下,它将是一只猫。我看到的不仅仅是识别猫,人工智能算法能够识别特定类型的花,人工智能能够识别特定类型的食物。将照片作为输入并将其分类为哪种对象的能力正在各种应用中使用。

一种特别引人注目的图像分类类型是人脸识别。这就是当今人脸识别系统的工作方式。用户可以注册一张或多张自己的脸部照片,向人工智能展示他们的样子。给定一张新图像,那么人工智能系统可以说,这是同一个人吗?这是你吗?还是这是一个不同的人?这样它就可以根据个人的身份决定是否应该开门、解锁手机、解锁

THE END
分享
评论 抢沙发

请登录后发表评论

    暂无评论内容