首页 / 行业
智能决策从虚拟到现实——强化学习落地
2019-07-30 10:55:00
迄今为止,大部分人工智能落地的技术都在预测技术方面,而不是决策技术,目前决策技术的应用落地还很少。对此,俞扬以诊断报告作比喻,形象地指出,日常生活中想达到目的,比如看到诊断报告识别问题,我们不可能等着病的发生,而是想办法将病治愈。但是决策方面落地的技术非常少,据俞扬介绍,以往决策的途径可以分成以下三种。
南京大学人工智能学院俞扬教授
第一种是写规则,即通过程序员将决策方式或企业决策的解决方法写入系统中,这是决策技术的现状;第二种是做规划,将要解决的目标写下来,用机器找到决策,虽然机器自动解决问题,但问题的定义还是由人来做,一旦定义出现错误,定义的和真实的情况不符合,那么系统就没有任何途径能够修正这个定义。第三种途径是基于学习的途径,即基于数据驱动的途径,通过环境感知来定义应该解决什么样的问题。俞扬表示,第三种方法看起来更有可能解决真实环境中做决策的问题。
机器学习的三大技术
若将机器做决策放在学习的框架上,则可以分为无监督学习、监督学习和强化学习三大类技术。其中,无监督学习的数据没有任何标记,它所做的事是分析数据,从中发现数据结构是什么。而监督学习是目前落地最多的技术,通过很多标注的数据,告诉机器图像中是什么样的对象,让机器可以在数据中预测、识别到对象。
强化学习是机器学习中的一个重要研究领域,从大量数据中反复学习找到最优解,只从最终产生的结果来倒推模型应该是什么,正好对应做决策。俞扬指出,实际上这两年强化学习在做决策方面有很大突破,突破主要是在规模上,此前大热的AlphaGo与AlphaGo Zero都是经过深度强化学习后,在游戏中“碾压”了人类。
强化学习面临的困境
虽然强化学习发展较快,但目前所有的成功案例都发生在电子环境下。俞扬认为,主要原因是现在的算法效率太低。因此也出现很多批评的声音,说强化学习,特别在引入深度学习后,需要的数据样本量更大,导致这种方法无法直接应用于实际中。
俞扬指出,在很多传统工业,特别是机器人设计中,大家可能会很熟悉做模拟器。模拟器通常用于高成本的行业,在传统工业里,为了减少和真正环境的交互,通常在模拟器里先进行设计。那么,能否让机器在模拟器中学习决策呢?俞扬以购物平台为例,指出机器在了解买家行为的过程中,通过多代理模仿学习,根据买家数据进行观察再行动。他表示,机器学习决策所面临的环境更大程度上更困难,因为它是一个开放环境,而不是和固定的物理定律打交道。
最新内容
手机 |
相关内容
智能传感器助力打造数字经济数字世
智能传感器助力打造数字经济数字世界,数字,经济,传感器,助力,智能,及时发现,PCM1801U智能传感器是一种能够感知环境并将感知结果转不只是芯片 看看传感器技术我们离
不只是芯片 看看传感器技术我们离世界顶级有多远,传感器,芯片,位置,测量,交通,用于,传感器技术是现代科技中至关重要的一部分,它们被消除“间隙”:力敏传感器如何推动新
消除“间隙”:力敏传感器如何推动新颖的HMI设计,传感器,智能手机,交互,交互方式,操作,用户,随着科技的不断发展,人机交互界面(HMI)的设射频前端芯片GC1103在智能家居无线
射频前端芯片GC1103在智能家居无线通信IoT模块中应用,模块,芯片,无线通信,智能家居,支持,数据交换,射频前端芯片GC1103是一种低功耗所有遥不可及,终因AI触手可及
所有遥不可及,终因AI触手可及,出行,平台,无人驾驶汽车,导致,人工智能,学习,人类历史上,有许多事物曾被认为是遥不可及的,然而随着科技面向6G+AI,鹏城云脑的演进
面向6G+AI,鹏城云脑的演进,鹏城,人工智能,数据存储,脑可,智能终端,智能,随着科技的不断进步,人们的生活方式也在不断改变。6G+AI(人工黑芝麻智能助力亿咖通科技旗下首款
黑芝麻智能助力亿咖通科技旗下首款智能驾驶计算平台成功量产交付,智能驾驶,计算,助力,首款,交付,智能,近年来,智能驾驶技术逐渐成为智能家居中的MEMS传感器
智能家居中的MEMS传感器,传感器,智能家居,控制,用户,温度传感器,系统,MEMS(微机电系统)传感器是智能家居中的关键技术之一。它们是一