微软正式推出两款生成式AI模型变体。其中,MAI-Image-2.5-Pro面向对画面质量要求较高的广告设计、品牌主视觉、图片编辑和图内文字生成场景。微软表示,该模型能够根据自然语言要求修改图片,并提高图片中文字的准确性和可读性,目前已进入公开预览阶段。
同步上线的MAI-Voice-2-Flash主要面向客服、语音智能体和大规模实时语音交互。与MAI-Voice-2相比,新版本生成速度提高约一倍,价格降低32%,同时保留较自然的语调和声音表现,适合对响应速度要求较高的应用。
微软正在加快将自研模型接入现有产品。MAI-Image-2.5已成为Bing Image Creator的默认模型,并被用于PowerPoint图像生成与编辑以及OneDrive部分图片编辑功能;MAI-Voice-2-Flash则已进入Dynamics 365 Contact Center和Azure Voice Live,为企业客服及语音智能体提供支持。
此次更新表明,微软的AI布局正在从依赖单一通用大模型,转向针对图像、语音、编程和推理任务建立自研模型家族。企业部署AI时,也开始更加关注画面质量、响应速度、调用成本和实际产品集成,而不只是模型排行榜成绩。
评论列表
Loading...