3月6日凌晨,国产大模型团队Monica发布全球首款通用AIAgent——Manus。目前,全网都在求邀请码。每经记者实测发现,Manus在一句话写新闻、编代码和制作报告分析及PPT等任务上都能轻松拿捏。而且,Manus的记忆能力超强,服务器重新连接后也能接着完成之前断掉的任务。
3月6日,一支中国团队正式发布通用型AIAgent产品Manus。该产品在GAIA基准测试中取得SOTA成绩,超越OpenAI同层次大模型。Manus不仅提供想法,还能将想法付诸实践,真正解决问题。其具备超强学习能力和适应性“数字大脑”,能理解复杂指令、自主学习及跨领域协同。团队计划后续开源部分技术以推动AI社区发展。
周三,Alphabet旗下谷歌宣布正在测试全新AI搜索模式“AIMode”,该功能允许用户提出更复杂的多部分问题,整合多个查询结果,提供连贯、深入的答案。此功能基于最新旗舰AI模型Gemini2.0构建,具备处理文本、图像和视频的能力。该功能将首先向订阅谷歌AI套餐的付费用户开放,标志着谷歌搜索商业模式的转变。
在2025世界移动通信大会(MWC2025)上,华为多位高层透露了中国AIToken流量的惊人增长。华为董事、ICTBG(信息基础设施业务集团)CEO杨超斌透露,过去8个月,中国市场AI生成的Token流量增长33倍,其中15倍来自付费Token。而且,自DeepSeek模型推出以来,中国市场每Token的价格已经下降97%。
自今年2月以来,腾讯元宝的广告投放覆盖了腾讯视频、搜狗、豆瓣、B站等各大平台。腾讯为推动元宝的发展投入约3亿元,并迅速在春节后推进全线产品智能化升级。元宝于2月13日接入DeepSeek-R1满血版,随后进行密集更新迭代,几乎每两天一次更新,包括支持微信搜索、图片信息理解等功能。
3月3日,记者获悉,智谱完成超10亿元战略融资,投资方包括杭州城投产业基金、上城资本等。杭州布局科技以未来产业为主,民营经济发达,政府积极优化营商环境并提供资金支持。智谱已在杭州成立新公司,其大模型已广泛应用于多个行业。2025年将是智谱的开源年,其将发布全新大模型并开源。
2月28日,DeepSeek公开了Fire-Flyer文件系统和轻量级数据处理框架Smallpond。3FS面向现代SSD和RDMA网络,能将固态硬盘带宽利用到极致。在该系统开源前数小时,OpenAI推出GPT-4.5。以R1模型在低谷期的每百万Tokens的输出价格计算,GPT-4.5的价格是R1的近270倍。
2月27日,DeepSeek一次性开源了两个工具和一个数据集,分别是DualPipe、EPLB(专家并行负载均衡器)以及训练和推理框架的性能分析数据。同日凌晨,英伟达公布首份财报,其2025财年第四财季营收同比增长78%,CEO黄仁勋点赞DeepSeek并强调推理模型计算需求将更高。
美东时间2月26日盘后,英伟达发布截至1月26日的2025财年第四财季报告。数据显示,虽然业绩好于预期,但英伟达营收同比增速已是连续四个季度滑坡,数据中心业务同比增速也是最近四个季度以来最低。CEO黄仁勋强调Blackwell芯片需求强劲,并指出,由于新的推理方法需要逐步思考“如何最好地回答”问题,下一代AI将需要比旧模型多100倍的计算量。
2月24日,DeepSeek正式开启开源周并率先发布优化版MLA技术——FlashMLA。用户只需满足特定环境要求,即可一键配置使用。DeepSeek表示,该技术已测试完备,可投入生产环境。此前,DeepSeek的技术发布曾引起美股和A股震动。寒武纪(688256.SH)股价上个交易日20cm涨停创新高,今天截至收盘又大涨5.14%。
2月26日,DeepSeek宣布开源DeepGEMM计算库。该库简洁高效,仅300行核心代码,但性能出色,能榨干GPU性能潜力。自2月21日DeepSeek官宣将启动“开源周”以来,英伟达股价在三个交易日中已累跌近10%。美东时间周三美股盘后,英伟达将公布2025财年第四季度财报。黄仁勋能否顶住DeepSeek的冲击呢?
2月25日,DeepSeek宣布开源其DeepEP代码库,这是首个用于混合专家模型训练和推理的开源专家并行通信库。虽然EP技术能以较低的通信成本完成模型训练,但中金认为,这种通信设计技术的进展并不一定会使高速通信的需求减少。值得注意的是,DeepEP代码库开源后半小时,兆龙互连股价一度拉升7.53%。这背后有无关联?
每经杭州2月25日电(记者叶晓丹)阿里云旗下视觉生成基座模型万相2.1(Wan)开源,此次开源采用最宽松的Apache2.0协议,14B和1.3B两个参数规格的全部推理代码和权重全部开源,同时支持文生视频和图生视频任务,全球开发者...
TDCowen近日发布报告称,微软已经取消与美国两家以上运营商的数据中心租约,容量达“数百兆瓦”,同时还削减了海外数据中心投资规模。微软2月24日“罕见”回应,但拒绝对报告置评。市场开始质疑,AI领域的资本支出盛宴是否已近尾声?高盛指出,这或表明微软将继续审慎地投资AI算力,但同时关注回报。
今日凌晨2点,Anthropic发布首个双思维模型Claude3.7Sonnet,该模型有标准和扩展两种思考模式,在代码能力等方面表现出色,还发布了专用于代码的AgentClaudeCode。Anthropic称其为唯一“混合”模型,将立即投入使用,此举或为其赢得竞争优势。该公司正洽谈筹集35亿美元融资,估值或增至615亿美元。
2月23日,清华大学与瑞莱智慧联合团队(以下简称“清华瑞莱联合团队”)推出大语言模型RealSafe-R1。据悉,该模型基于DeepSeekR1进行深度优化与后训练,在确保性能稳定的基础上,实现了安全性的显著提升。瑞莱智慧方面表...