微软发布两款新AI模型:图像生成与实时语音能力同步升级

微软正式推出两款生成式AI模型变体。其中,MAI-Image-2.5-Pro面向对画面质量要求较高的广告设计、品牌主视觉、图片编辑和图内文字生成场景。微软表示,该模型能够根据自然语言要求修改图片,并提高图片中文字的准确性和可读性,目前已进入公开预览阶段。

同步上线的MAI-Voice-2-Flash主要面向客服、语音智能体和大规模实时语音交互。与MAI-Voice-2相比,新版本生成速度提高约一倍,价格降低32%,同时保留较自然的语调和声音表现,适合对响应速度要求较高的应用。

微软正在加快将自研模型接入现有产品。MAI-Image-2.5已成为Bing Image Creator的默认模型,并被用于PowerPoint图像生成与编辑以及OneDrive部分图片编辑功能;MAI-Voice-2-Flash则已进入Dynamics 365 Contact Center和Azure Voice Live,为企业客服及语音智能体提供支持。

此次更新表明,微软的AI布局正在从依赖单一通用大模型,转向针对图像、语音、编程和推理任务建立自研模型家族。企业部署AI时,也开始更加关注画面质量、响应速度、调用成本和实际产品集成,而不只是模型排行榜成绩。


上一篇:

发表回复

评论列表

    Loading...

    联系我们

    在线咨询: QQ交谈

    微信:叁叁

    邮件:794033364@qq.com

    工作时间:周一至周五,9:30-18:30,节假日休息

    微信