据媒体报道,腾讯控股在竞争对手阿里巴巴启动人工智能会议的同日,推出了其最新且性能最强的图像生成模型“混元”Hy Image 3.5预览版,释放出追赶字节跳动等行业领军者的强烈信号。

腾讯声明称,该模型较前代产品性能显著提升,正被整合至包括“元宝”聊天机器人、电影编辑及设计工具在内的多款产品中。此举表明腾讯正加速探索文本之外的应用场景,致力于为其微信生态中的十亿级用户构建具备任务执行能力的人工智能。受市场对于能协助购物、叫车等任务的“AI智能体”兴趣激增的影响——类似Meta以智能体为核心的Muse应用近期登顶下载榜——腾讯股价在香港交易中上涨逾7%。

重组AI基础设施,聚焦产品落地

Allspring Global Investments基金经理Gary Tan指出,部分投资者将腾讯与Meta进行类比,看重微信独特的社交生态及其在支持大规模个人AI助手方面的潜力。

这家集社交媒体与游戏业务于一体的巨头,曾在突破性大语言模型的研发进度上落后于同业。为此,腾讯近期聘请前OpenAI研究员姚顺宇担任首席AI科学家,全面重组公司的人工智能基础设施和基准测试标准。姚顺宇曾公开批评仅为了刷高排行榜分数而训练模型的做法,强调腾讯将转而专注于产品整合及解决实际问题。

自姚顺宇加入以来,腾讯持续吸纳顶尖人才。前OpenAI计算机视觉研究员田永龙于今年7月加盟,目前领导混元团队下的视觉语言模型研发工作。

内部测试对标行业主流模型

腾讯在深圳总部数百名内部设计师中对Hy Image 3.5预览版进行了测试。公司表示,该模型取得了与字节跳动Seedream 5.0 Pro相当的效果,并略优于Alphabet旗下Google的Nano Banana Pro以及阿里巴巴的Qwen-Image-3.0 Pro。尽管腾讯拥有数千名可能从中受益的游戏设计师和艺术家,但公司并未就其质量优势提供具体的量化数据。