书签 分享 收藏 举报 版权申诉 / 35
上传文档赚钱

类型湖南大学人工智能课件2.pptx

  • 上传人(卖家):三亚风情
  • 文档编号:2823693
  • 上传时间:2022-05-29
  • 格式:PPTX
  • 页数:35
  • 大小:1.13MB
  • 【下载声明】
    1. 本站全部试题类文档,若标题没写含答案,则无答案;标题注明含答案的文档,主观题也可能无答案。请谨慎下单,一旦售出,不予退换。
    2. 本站全部PPT文档均不含视频和音频,PPT中出现的音频或视频标识(或文字)仅表示流程,实际无音频或视频文件。请谨慎下单,一旦售出,不予退换。
    3. 本页资料《湖南大学人工智能课件2.pptx》由用户(三亚风情)主动上传,其收益全归该用户。163文库仅提供信息存储空间,仅对该用户上传内容的表现方式做保护处理,对上传内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知163文库(点击联系客服),我们立即给予删除!
    4. 请根据预览情况,自愿下载本文。本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
    5. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007及以上版本和PDF阅读器,压缩文件请下载最新的WinRAR软件解压。
    配套讲稿:

    如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。

    特殊限制:

    部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。

    关 键  词:
    湖南大学 人工智能 课件
    资源描述:

    1、第二章第二章 智能智能AgentAgent内容提要 Agents和环境 理性Agent 环境的性质 Agent的类型与结构 Agent通过感知器感知环境并通过执行器对所处的环境产生影响 人类Agent 眼睛,耳朵为感知器 手,脚,声道为执行器 机器人Agent 摄像头,红外距测仪为感知器 马达为执行器Agent函数将任何感知历史数据映射为行为:Agent程序通过在物理系统上运行来实现Agent函数Agent = 体系结构 + 程序感知器:地点和内容(eg. A,Dirty)行为:向左,向右,洗尘,无操作理性agent:对于每一可能的感知数据序列,一个理性的agent应该采取一个行为以达到最大的

    2、性能。理性判断的4个因素性能度量先验知识可以完成的行动截至到此刻的感知序列一个Agent应该根据它感知的信息和它能够进行的行为而做正确的事情正确的行为将使得Agent能够取得最大的成功性能度量:一个客观的标准来评价Agent的行为的成功性Eg.真空器agent的性能度量可以是它清洗区域的数量,花费的时间,消耗的能量,产生的噪音等等Eg.真空洗尘器8个小时内清理的灰尘总量来度量性能?以行为来度量性能不如以结果来度量性能全知:明确知道它的行动产生的实际结果并且作出相应的动作理性不等同于全知(已知的知识都是有限的)理性不等于完美:理性是使期望的性能最大化完美是使实际的性能最大化理性agent能够进行

    3、信息收集。理性的agent应该具有自主性,能够进行学习从环境的感知信息中根据历史经验来学习任务环境:包括性能(Performance),环境(Environment),agent的执行器(Actuators)和传感器(Sensors),英文缩写为PEAS对于每一个智能agent,必须说明其PEAS参数Eg.自动驾驶出租车性能度量环境执行器传感器Eg.自动驾驶出租车性能度量:安全性,快速性,交通违规,舒适度,利润环境:马路,其他交通工具,行人,乘客执行器:方向盘,加速油门,刹车,语音合成器传感器:摄像头,红外或声纳,速度表,GPS,键盘,麦克风Eg.医疗诊断系统性能度量:病人的健康性,病人花费环

    4、境:病人,医院,工作人员执行器:显示屏(询问,测试,诊断,治疗方案)传感器:键盘(输入症状,现场检测,病人的回答)Eg.挑拣零件机器人性能度量:正确挑拣的零件所占的百分比环境:零件传送带,容器执行器:机器人手臂和手传感器:摄像头,关节感知器Eg.交互式英语教学者性能度量:最大化学生成绩环境:学生执行器:显示屏(练习题,建议,正确答案)传感器:键盘完全可观察的完全可观察的 vs.vs.部分可观察的部分可观察的一个agent的传感器在每个时间点上都能获取环境的完整状态一个agent的传感器在每个时间点上都能获取环境的部分状态真空洗尘器?自动驾驶汽车?单单agent vs.agent vs.多多ag

    5、entagent单agent独自运行 eg.字谜游戏多agent同时运行 eg.国际象棋国际象棋 vs. 驾驶出租车?确定的确定的 vs. vs.随机的随机的环境的下一个状态完全取决于当前状态和agent执行的动作部分可观察?出租车驾驶?真空吸尘器?片段式的片段式的 vs. vs. 延续式的延续式的agent的经历被分成一个个原子片段,在每个片段中agent感知信息并完成单个行动,下一个片段不依赖于以前的片段检查次品零件的机器人?国际象棋?静态的静态的 vs. vs. 动态的动态的环境在agent计算的时候不会变化(vs.会变化)半动态的:环境本身不变化但agent的性能评价随时间变化出租车,

    6、国际象棋,填字游戏?离散的离散的 vs. vs.连续的连续的环境的状态,时间的处理方式以及agent的感知信息和行动都有离散/连续之分国际象棋,出租车驾驶?环境的性质决定了agent的设计最难处理的情况:部分可观察的,随机的,连续的,动态的,延续式的,多agent的一个agent用agent函数来表示agent函数将感知数据序列映射为行为 Agent程序以传感器得到的当前感知信息为输入以执行器的行动为输出仅仅以当前感知为输入而不是以整个历史感知为输入缺点表太大创建表时间长非自主性,需人工填写即使能够学习,也需要很长的时间四种基本的类型简单反射agent基于模型的反射agent基于目标的agen

    7、t基于效用的agent基于当前的感知选择行动,不关注感知历史环境是完全可观察的还是部分可观察的?Eg. 真空吸尘器问题,刹车问题Agent根据感知历史维持内部状态Agent随时更新内部状态信息除了根据感知信息之外,还要根据目标信息来选择行动效率比较低,需要推理搜索和规划算法当达到目标的行为有很多种的时候,需要考虑效率环境是部分可观察的和随机的,不确定下的决策过程可以通过基于效用的agent来实现。效用的作用多目标相冲突时多目标在不确定环境中一个目标有多种行为可以达到时4个组件性能元件:相当于整个agent评判元件:反映性能元件做得如何学习元件:负责改进提高问题产生器:提出一些新的有建设性的探索尝试Eg.出租车行驶 Agents和环境 理性Agent 环境的性质 Agent的类型与结构QA?

    展开阅读全文
    提示  163文库所有资源均是用户自行上传分享,仅供网友学习交流,未经上传用户书面授权,请勿作他用。
    关于本文
    本文标题:湖南大学人工智能课件2.pptx
    链接地址:https://www.163wenku.com/p-2823693.html

    Copyright@ 2017-2037 Www.163WenKu.Com  网站版权所有  |  资源地图   
    IPC备案号:蜀ICP备2021032737号  | 川公网安备 51099002000191号


    侵权投诉QQ:3464097650  资料上传QQ:3464097650
       


    【声明】本站为“文档C2C交易模式”,即用户上传的文档直接卖给(下载)用户,本站只是网络空间服务平台,本站所有原创文档下载所得归上传人所有,如您发现上传作品侵犯了您的版权,请立刻联系我们并提供证据,我们将在3个工作日内予以改正。

    163文库