攻陷无人区:百度大脑破解了这个AI技术应用顽疾

亿欧网 中字

或许从此以后,AI技术将不仅仅是做加法,更有可能产生技术细节之间的乘法效应。从百度大脑3.0公布的技术案例,我们已经可以看出类似乘法效应:

在AI开发者大会期间,对多模态深度语义理解技术最直接的感受,在于技术能力突破之后应用边界的想象力爆棚。

比如说百度大脑3.0带来的视觉语义化技术,可以让机器从看清到看懂视频的内容。比如在新零售场景中,摄像头可以通过视频语义化来直接理解顾客的行为动作,以及选取了哪些商品。这样就无需再有复杂的识别条码、刷脸等流程,顾客可以真正的拿起商品就走,产生毫无时间影响的购物体验。

另一个多模态深度语义理解的技术应用,是语音语义一体化带来的。在使用语音导航长Query时,我们经常要简单明了的说清楚导航目标,但假如我们的导航需求比较复杂,或者我们也不太清楚具体的地名,那就会很麻烦。导航中的AI识别只能进行文本唤醒,无法去理解使用者的想法。

在百度开发者大会现场,我们已经见识到在语音语义一体化技术加持后,百度地图的用户可以像绕口令一样说出大量内容,百度大脑会同步听清、听懂和理解相关含义,给出最佳导航路线。

类似的案例还有很多,从中我们可以发现,多模态深度语义理解让AI技术沙漏中的每一颗沙子,都可以排列组合出未知中的惊喜。

戳破最后隔膜:百度大脑3.0的3件礼物

当开发者想要从传统AI赛道,进入神秘的深层人机交互,需要的并不是高屋建瓴的设想,也不是多么科幻的技术示范。而是脚踏实地,真正建立可以按部就班展开学习、尝试与创造的多模态AI路径。而百度大脑的3.0升级,带来了多模态世界的3个礼物,可以说是带给开发者的核心保障:

1、告别算力问题的“昆仑”:在AI开发者大会上,百度大脑3.0首次将芯片纳入技术体系,推出了百度自主研发的中国第一款云端全功能AI芯片“昆仑”。据了解,昆仑的AI任务处理速度比此前我们常用的FPGA方案快30倍以上。高性能、高性价比,且具有易用性的云端AI芯片,可以与百度的整体AI技术体系结合,带给百度大脑的用户与开发者更多想象力。

2、跳跃的PaddlePaddle:在今年的开发者大会上,百度公布了PaddlePaddle 3.0,在与自主芯片结合,打造全栈解决方案和平台化建设之余,新的PaddlePaddle还开放了多种平台,为不同层级的开发者提供更简单的开发与训练。其中AutoDL可以自动地进行网络结构设计;AI Studio是一个非常实用的在线训练平台。灵活利用更加富有生态化意味的PaddlePaddle,开发者的工作或将得到翻天覆地的变化。

3、便捷获取AI的开发者权能:开发者另一个核心需求,是有足够多的技术应用支撑,来满足天马行空的想象力。假如只有高度抽象,雷同程度很高的技术开放,那么大家很难找到自己的开发机会,尤其是在多模态语义理解带来的全新契机面前。而百度大脑3.0全面开放了110多项AI能力,满足了开发者的技术拼图需求。李彦宏在开发者大会的开场白中说,百度的目标是Everyone Can AI。那么百度大脑的技术拼图和全栈架构,将是百度分享AI,建立开发者权能的必经之地。

百度大脑的升级,可以看做众多AI应用核心的突破。未来无数令人惊喜的AI应用,都将建立在百度大脑的跃升之上。当多模态底层技术不再是奢望,高度拟真的人机交互也就不再遥远。从百度大脑3.0开始,一个沙漏已经倒转,趋于理论最高值的AI未来,正在快速向这个世界挺进。

声明: 本文系OFweek根据授权转载自其它媒体或授权刊载,目的在于信息传递,并不代表本站赞同其观点和对其真实性负责,如有新闻稿件和图片作品的内容、版权以及其它问题的,请联系我们。
侵权投诉

下载OFweek,一手掌握高科技全行业资讯

还不是OFweek会员,马上注册
打开app,查看更多精彩资讯 >
  • 长按识别二维码
  • 进入OFweek阅读全文
长按图片进行保存