羊城晚报全媒体记者 王丹阳
在此前35天“更新”30次后,3月21日深夜,腾讯混元大模型团队正式推出了能秒回、处理超长文本自研深度思考模型混元T1正式版,目前已上线于腾讯云官网,并即将在腾讯元宝上线。相比以往,这次深夜“上新”也是腾讯摒弃了传统及主流的纯Transformer架构,首次将混合Mamba架构无损应用于超大型推理模型。
深夜“上架”能秒回更便宜
值得关注的是,作为腾讯自研的强推理模型,T1吐字速度达到60~80token/s,在实际生成效果表现中远快于DeepSeek-R1。
目前,用户在使用DeepSeek-R1等推理模型时,由于模型需要进行深度思考,并在提供回答前列出详细的思维链,虽然能够体现较高的智能化水平,但存在响应速度慢、不够高效的短板。
混元T1正式版则吐字快、能秒回,还擅长超长文处理。在体现推理模型基础能力的常见基准测试上,如大语言模型评估增强数据集MMLU-PRO中,混元T1取得87.2分,超越了DeepSeek-R1,仅次于o1。在CEval、AIME、Zebra Logic等中英文知识及竞赛级数学、逻辑推理的公开基准测试中,混元T1的成绩也达到业界领先推理模型的水平。
同在3月21日深夜,混元T1已在腾讯云官网上线。价格方面,输入价格为1元/每百万tokens,输出价格为4元/每百万tokens,输出价格为DeepSeek标准时段的1/4,与DeepSeek优惠时段一致。
年研发投707亿元全速推AI
腾讯发布的最新财报显示,2024年第四季度,腾讯资本开支同比增长386%至365.8亿元,2024年全年资本开支达到767.6亿元,同比增长221%,创历史新高,占总营收的11.6%;研发投入方面,2024年全年的AI研发投入达到706.9亿元,2018年至今累计投入3403亿元。
腾讯董事会主席兼首席执行官马化腾在业绩会上表示,在过去一两个月里,AI得到了很大发展,尤其是在DeepSeek横空出世后,腾讯在云业务、“元宝”(AI应用)上都积极拥抱DeepSeek。
马化腾在业绩会上还表示:“数月前,我们重组了AI团队以聚焦于快速的产品创新及深度的模型研发,增加了与AI相关的资本开支,并加大了我们对原生AI产品的研发和营销力度。我们相信这些增加的投资,会通过提升广告业务的效率及游戏的生命周期而带来持续的回报,并随着个人AI应用的加速普及和更多企业采用我们的AI服务,创造更长远的价值。”
腾讯元宝的日活跃用户数在2月至3月增长超20倍。自2月以来,腾讯元宝接入DeepSeek满血版和全新混元模型,双核驱动元宝高速进化、日更级迭代,35天版本更新30次。除此之外,目前,腾讯已有元宝、微信、腾讯文档、QQ浏览器、QQ音乐、微信读书等数十款产品及业务接入DeepSeek。
编辑:郑健龙


财经自媒体联盟

4000520066 欢迎批评指正
All Rights Reserved 新浪公司 版权所有