跳到正文
千机 API

多模态

文本之外的能力:视觉理解、图文混合、音视频输入输出的模型与产品进展。

最新精选

第 21–21 条 · 共 21 条
3月14日周二
  1. OpenAI News

    OpenAI 发布 GPT-4,多模态模型可接收图像和文本输入

    OpenAI 发布 GPT-4,这是其扩大深度学习规模进程中的一个重要里程碑。GPT-4 是大型多模态模型,可接收图像和文本输入并输出文本;在多项专业和学术基准上达到人类水平表现,但在许多现实场景中仍不如人类。

    这则公告概述了 GPT-4 的输入输出形式及其基准表现,为理解模型发布时披露的能力范围提供了直接信息。