微软必应再强化！接入OpenAI DALL·E模型，文字生成图像-人工智能-PHP中文网

首页

科技周边

人工智能

微软必应再强化！接入OpenAI DALL·E模型，文字生成图像

PHPz

Mar 31, 2023 pm 10:39 PM

ai微软

微软必应完善文字生成图像能力，Adobe 今日也发布 Firefly，杀入生成式 AI 这场游戏。

昨晚实在是有些热闹。

一边英伟达 GTC 正在进行中，一边谷歌正式开放了 Bard 的测试，这里微软必应也不甘寂寞。

今日，微软正式宣布，必应搜索引擎接入了 OpenAI 的 DALL·E 模型，增加了 AI 生成图像的功能。

也就是说，在接入 ChatGPT 之后，必应再次强化，Bing Image Creator 能够让用户用 DALL·E 模型生成图像。

「对于拥有必应预览版权限的用户，Bing Image Creator 将完全集成到必应聊天体验中，首先在创意模式下推出。」微软消费者营销主管 Yusuf Mehdi 解释道。「通过输入图像描述，提供位置或活动等额外语境，选择艺术风格，Image Creator 将根据用户的想象生成图像。」

必应具有三种响应模式：创意模式、平衡（balanced）模式和精确（precise）模式。创意模式下必应生成的结果通常是「原创和富有想象力的」，而精确模式则倾向于准确性和相关性，以获得更真实和简洁的答案。目前 Image Creator 只能在创意模式下使用。

值得一提的是，即使没有必应预览版的使用权限，用户也可以通过直接访问 bing.com/create 单独使用 Image Creator 来尝试其图像生成功能，目前仅支持英文输入。微软表示，随着时间的推移，它将支持更多的语言输入。

此外，微软还在必应中推出了新的 AI 支持的视觉故事（visual Stories）和 Knowledge Cards 2.0。

我们简单为大家梳理介绍下 OpenAI 文本生成图像的 DALL·E 系列研究。

2021 年 1 月 6 日，OpenAI 博客发布了两个连接文本与图像的神经网络：DALL・E 和 CLIP。DALL・E 可以基于文本直接生成图像，CLIP 则能够完成图像与文本类别的匹配。这两项研究的发布，引起了社区极大的关注。

据博客介绍，DALL・E 可以将以自然语言形式表达的大量概念转换为恰当的图像，可以说是 GPT-3 的 120 亿参数版本，可基于文本描述生成图像。

DALL・E 示例。给出一句话「牛油果形状的椅子」，就可以获得绿油油、形态各异的牛油果椅子图像。

2 个月后，DALL·E 的论文和代码公开。

项目地址：https://github.com/openai/DALL-E
论文地址：https://arxiv.org/abs/2102.12092

2022 年 4 月 7 日左右，DALL・E 迎来了升级版本 ——DALL・E 2。与 DALL・E 相比，DALL・E 2 在生成用户描述的图像时具有更高的分辨率和更低的延迟。并且，新版本还增添了一些新的功能，比如对原始图像进行编辑。

OpenAI 还公布了 DALL・E 2 的研究论文《Hierarchical Text-Conditional Image Generation with CLIP Latents》。

论文地址：https://cdn.openai.com/papers/dall-e-2.pdf

此次必应接入的 DALL・E 应该是经过更新迭代的。这在一定程度上，弥补了当前 ChatGPT 在跨模态生成方面缺失的体验。不过等到 GPT-4 多模态能力开放后，也许能为我们带来更多新的体验。

最后提一句，今日还有一项生成式 AI 的发布引起了业内人士的关注与讨论。

那就是 Adobe 发布 Firefly。这是一系列用于创意表达的生成式 AI 模型，让用户可以通过键入命令快速修改图像。目前，Firefly 开放了测试版本，感兴趣的读者可以申请体验。

如今看来，生成式 AI 这场游戏有越来越多的玩家涌入，竞争也变得越来越激烈。

以上是微软必应再强化！接入OpenAI DALL·E模型，文字生成图像的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文转载于：51cto。如有侵权，请联系admin@php.cn删除

个人黑客将是一只非常凶猛的熊May 11, 2025 am 11:09 AM

网络攻击正在发展。通用网络钓鱼电子邮件的日子已经一去不复返了。网络犯罪的未来是超个性化的，利用了容易获得的在线数据和AI来制作高度针对性的攻击。想象一个知道您的工作的骗子

教皇狮子座XIV揭示了AI如何影响他的名字选择May 11, 2025 am 11:07 AM

新当选的教皇狮子座（Leo Xiv）在对红衣主教学院的就职演讲中，讨论了他的同名人物教皇里奥XIII的影响，他的教皇（1878-1903）与汽车和汽车和汽车公司的黎明相吻合

Fastapi -MCP初学者和专家教程-Analytics VidhyaMay 11, 2025 am 10:56 AM

本教程演示了如何使用模型上下文协议（MCP）和FastAPI将大型语言模型（LLM）与外部工具集成在一起。我们将使用FastAPI构建一个简单的Web应用程序，并将其转换为MCP服务器，使您的L

dia-1.6b tts：最佳文本到二元格生成模型 - 分析vidhyaMay 11, 2025 am 10:27 AM

探索DIA-1.6B：由两个本科生开发的开创性的文本对语音模型，零资金！这个16亿个参数模型产生了非常现实的语音，包括诸如笑声和打喷嚏之类的非语言提示。本文指南

AI可以使指导比以往任何时候都更有意义May 10, 2025 am 11:17 AM

我完全同意。我的成功与导师的指导密不可分。他们的见解，尤其是关于业务管理，构成了我的信念和实践的基石。这种经验强调了我对导师的承诺

AI发掘了采矿业的新潜力May 10, 2025 am 11:16 AM

AI 增强型矿业设备矿业作业环境恶劣且危险重重。人工智能系统通过将人类从最危险的环境中移除并增强人类能力，帮助提高整体效率和安全性。人工智能越来越多地用于为矿业作业中使用的自动驾驶卡车、钻机和装载机提供动力。这些 AI 驱动的车辆能够在危险环境中精确作业，从而提高安全性和生产力。一些公司已经开发出用于大型矿业作业的自动驾驶采矿车辆。在挑战性环境中运行的设备需要持续维护。然而，维护会使关键设备离线并消耗资源。更精确的维护意味着昂贵且必要的设备的正常运行时间增加以及显着的成本节约。 AI 驱动