马斯克即将迎来“关键一战”。2月16日消息,马斯克在社交平台X上表示,Grok3大模型将于太平洋时间周一晚上8点(北京时间周二12点)发布,届时将进行现场演示。马斯克称其为地球上最聪明的人工智能。马斯克还称,“整个周末都...
太平洋时间2月16日晚8点,特斯拉CEO马斯克宣布xAI公司即将发布Grok3大模型,并将进行现场演示。马斯克对Grok3寄予厚望,称其为“地球上最聪明的人工智能”,具有极强推理能力,表现优于现有所有已发布产品。目前,xAI正洽谈潜在投资者,计划筹集约100亿美元资金,估值或达750亿美元。
2月16日,腾讯回应称微信正灰测接入DeepSeek,在灰度测试范围的用户可在对话框顶部搜索入口免费使用。此外,腾讯多个产品如腾讯云AI代码助手、腾讯元宝等也在探索接入。腾讯称AI搜索基于微信生态及全网内容,能提供更全面回答,且不会使用用户个人信息。知名经济学者盘和林认为,微信此举给了消费者替代方案,对双方都有好处。
2月10日,清华KVCache.AI团队联合趋境科技发布KTransformers开源项目更新,支持24G显存在本地运行DeepSeek-R1、V3的671B“满血版”。更新发布后,不少开发者测试发现,显存消耗比技术文档中提到的还要少,实际内存占用约380G,显存占用约14G。有用户对方案成本进行分项分析后称,只要不到7万元就能实现R1模型的本地运行,与A100/H100服务器动辄200万元的价格相比,便宜了95%以上。不过,该方案也有诸多限制,如推理速度和适用模型等。
DeepSeek横空出世,近期引发券业热议。其超强能力让券商分析师既兴奋又焦虑,有人认为它将取代很多投研工作,也有人认为在专业领域帮助有限。DeepSeek向记者提出五大问题,基金公司人士认为其虽可提升效率,但不能完全替代卖方研究。未来,能提供个性化、差异化研究服务的券商或将更受青睐,中小型券商也有望利用技术平权逆袭。
近日,中国AI初创公司深度求索(DeepSeek)训练出性能可与海外头部企业模型相媲美的模型,吸引全球目光。该模型降低了算力需求,但FutureLabs未来实验室首席专家胡延平在接受每经记者采访时指出,算力与硬件仍在增强。他同时提到,低成本、高效能的技术创新,促使思考和重估算力基础设施投资,AI应用进入快速导入期。未来,AI将走向内生智能和自主智能。
2月13日,《每日经济新闻》记者获悉,腾讯AI助手“腾讯元宝”迎来重大更新,同时支持混元和DeepSeek两大模型,打开腾讯元宝并进入对话界面,即可免费使用DeepSeek-R1满血版模型。图片来源:腾讯元宝网页截图记...
今日凌晨3点,OpenAI首席执行官萨姆·奥尔特曼公布GPT-4.5和GPT-5的消息。未来几个月内将推出GPT-5,几周内先发布GPT-4.5。GPT-5将整合技术应用于ChatGPT等平台,非思维链模型在某些领域不太可靠。免费版ChatGPT能无限制使用GPT-5对话,ChatGPTPlus和Pro订阅用户能以更高智能水平运行。这些模型将融入更多功能。
2月12日,Gartner高级总监分析师方琦接受《每日经济新闻》记者采访时表示,DeepSeek成功的关键因素在于偏研究型的导向,以及大量工程师持之以恒的创新。针对DeepSeek带来的开源闭源之争,方琦认为,这可能要从商业路径来探讨。以Meta的Llma3为例,模型开源完善了其生态圈,增强了与苹果等主要渠道的议价权。另外,方琦提到,在AI时代,会用AI的人淘汰不会用AI的人。
每经北京2月11日电(记者杨昕怡)豆包大模型团队今日宣布,团队提出了全新的稀疏模型架构UltraMem,该架构有效解决了MoE(混合专家模型)推理时高额的访存问题,推理速度较MoE架构提升2~6倍,推理成本最高可降低83%。该研究还揭...
当地时间2月10日,Anthropic发布新报告,深入剖析了各行业的AI使用情况。该研究基于数百万次匿名对话,发现AI在软件开发等领域广泛应用,但在体力劳动密集型行业使用率较低。工资处于中高水平的特定职业,如计算机程序员和文案撰稿人,是AI使用率最高的职业。报告还指出,目前,AI在超过一半的用例中更多是作为辅助工具,但在43%的任务中已经实现了自动化。
据外媒周一报道,马斯克率投资者拟974亿美元收购OpenAI,律师称周一已提交收购要约。马斯克的xAI支持此次收购,或在交易后与OpenAI合并,他还获多个投资方支持。马斯克已向法院提起多项诉讼,OpenAI则回应其主张无依据。
据外媒报道,软银即将向OpenAI投资400亿美元,使其投后估值达3000亿美元,软银将成最大股东。此笔资金部分用于OpenAI对星际之门的承诺,该项目由特朗普于今年1月宣布成立。OpenAI于2022年底推出ChatGPT后,与多家公司展开竞争。本周一,软银承诺每年花30亿美元用于自身及旗下子公司的OpenAI技术,随后传出此轮融资消息。
2月6日,据外媒报道,李飞飞等研究人员用不到50美元和16张英伟达H100GPU,耗时26分钟训练出s1-32B人工智能推理模型。据外界分析,该模型基于预训练模型微调,成本未涵盖前期“烧钱”部分,且只在特定测试集上超过o1-preview,未超过“满血版”o1和DeepSeek-R1。在“白菜价”的背后,李飞飞团队重点研究了如何以简单方式实现“测试时拓展”,即模型在推理时多次迭代优化结果,还构建了高质量数据集s1K,降低了训练成本。
今日凌晨3点,OpenAI宣布向所有用户开放ChatGPT搜索功能,无需注册。该搜索能更快抓取网络信息,可解读用户搜索想法并提供源地址。同时,OpenAI加大研发布局人形机器人,上周五提交人形机器人商标申请,去年11月重建机器人团队。此外,OpenAI还投资了挪威机器人初创公司1XTechnologies,与FigureAI终止合作。
2月5日,A股三大股指收盘涨跌不一,DeepSeek概念掀涨停潮。多家平台宣布上线DeepSeek大模型,如中国联通、京东云、华为计算、安恒信息、腾讯云、百度智能云、阿里云等。DeepSeek以中国技术团队和本土算力资源引领全球技术创新,有望推动AI应用和终端技术普及,加速AGI时代到来。国海证券认为其突破提振了全球AI工作者信心,激发了创新活力。