每经AI快讯,北京时间3月7日,谷歌和柏林工业大学的团队重磅推出了史上最大的视觉语言模型——PaLM-E,参数量高达5620亿(GPT-3的参数量为1750亿)。作为一种多模态具身视觉语言模型(VLM),PaLM-E不仅可以理解图像,还能理解、生成语言,可以执行各种复杂的机器人指令而无需重新训练。谷歌研究人员计划探索PaLM-E在现实世界场景中的更多应用,例如家庭自动化或工业机器人。他们希望PaLM-E能够激发更多关于多模态推理和具身AI的研究。(澎湃)
上一篇
冯仑因2857.38万被列为被执行人,回应称“系合同诈骗”
下一篇
顺威股份:目前公司经营范围暂无变化
每日经济新闻客户端
National Business Daily Mobile Version
年初5天清仓21吨银条,狂赚2.47亿元的物业公司被套了:上半年炒贵金属亏损8340万元!老板娘是知名地产大佬夫人
超3900只个股下跌!农业板块大爆发,算力租赁概念下挫 | A股早盘
直线拉升!韩股大爆发,涨超3%,SK海力士涨超8%,三星电子涨近5%;美国要求韩国将存储芯片作为首个对美投资重点!日股走低|日韩股市