# GPT-4 支持视觉功能

**URL:** https://meta.discourse.org/t/gpt-4-with-vision-available/295462
**Category:** Feature
**Tags:** ai, ai-bot
**Created:** [2024年二月15日 11:32 UTC](https://meta.discourse.org/t/gpt-4-with-vision-available/295462 "2024-02-15T11:32:21Z")
**Posts on this page:** 7
**Page:** 1

<div class="post-metadata">

### Author: ![tpetrov](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/tpetrov/32/164643_2.png) [@tpetrov](https://meta.discourse.org/u/tpetrov)
#### Post date: [2024年二月15日 11:32 UTC](https://meta.discourse.org/t/gpt-4-with-vision-available/295462/1 "2024-02-15T11:32:21Z")

</div>

在 AI 插件设置中，我可以看到这个可启用的 AI 机器人列表：

 ![image](https://global.discourse-cdn.com/meta/original/4X/6/e/c/6ec7bab180ac9ad84c35b3969e679dee83815f82.png)  
我想知道 gpt-4-turbo 机器人是“gpt-4-turbo-preview”还是“gpt-4-vision-preview”。  
也就是说，它有视觉能力吗？  
如果它是“gpt-4-turbo-preview”，是否也会添加视觉能力？我认为这会很有用，因为例如截图可以帮助机器人理解用户的查询。

---

<div class="post-metadata">

### Author: ![Jagster](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/jagster/32/192154_2.png) [@Jagster](https://meta.discourse.org/u/Jagster)
#### Post date: [2024年二月15日 11:39 UTC](https://meta.discourse.org/t/gpt-4-with-vision-available/295462/2 "2024-02-15T11:39:12Z")

</div>

我不知道答案，但 Vision 与 4 相同，它有很多问题，可能会有问题。但据我所知，应该有一个 Vision 的独立模型，并且 Discourse 不使用自己的命名风格。

---

<div class="post-metadata">

### Author: ![merefield](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/merefield/32/176214_2.png) [@merefield](https://meta.discourse.org/u/merefield)
#### Post date: [2024年二月15日 11:40 UTC](https://meta.discourse.org/t/gpt-4-with-vision-available/295462/3 "2024-02-15T11:40:53Z")

</div>

FYI 此功能在 [Discourse Chatbot 🤖](https://meta.discourse.org/t/discourse-chatbot-now-smarter-than-chatgpt/256652) 中受支持（适用于“基本”模式）

---

<div class="post-metadata">

### Author: ![Jagster](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/jagster/32/192154_2.png) [@Jagster](https://meta.discourse.org/u/Jagster)
#### Post date: [2024年二月15日 11:42 UTC](https://meta.discourse.org/t/gpt-4-with-vision-available/295462/4 "2024-02-15T11:42:14Z")

</div>

（没有 RAG 会让它有点无力；否则它会带来很多乐趣）

---

<div class="post-metadata">

### Author: ![merefield](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/merefield/32/176214_2.png) [@merefield](https://meta.discourse.org/u/merefield)
#### Post date: [2024年二月15日 11:42 UTC](https://meta.discourse.org/t/gpt-4-with-vision-available/295462/5 "2024-02-15T11:42:46Z")

</div>

请致电 Sam Altman ☎ ，他需要为视觉模型添加功能。

---

<div class="post-metadata">

### Author: ![sam](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/sam/32/102149_2.png) [@sam](https://meta.discourse.org/u/sam)
#### Post date: [2024年二月15日 22:08 UTC](https://meta.discourse.org/t/gpt-4-with-vision-available/295462/6 "2024-02-15T22:08:07Z")

</div>

目前 `gpt-4-turbo` == `gpt-4-0125-preview`，即没有视觉功能。

@keegan 正在探索一些视觉集成：

> <https://github.com/discourse/discourse-ai/pull/470>
>
> This PR adds a new feature where you can generate captions for images in the com…poser using AI.
> 
> \## Preview
> 
> https://github.com/discourse/discourse-ai/assets/30090424/f5a7deb4-2eb4-41dd-9efb-134a225ba5d4

特别是通过视觉 API（包括开放和闭源模型）为图像添加字幕。

我真的很喜欢……通过与机器人开始私信、上传图像并询问相关信息这种“演示”能力，但需要考虑流程，因为我们需要在模型之间切换。

也许“自动工具”的概念在这里可行，所以如果我们看到上传，我们会自动路由到工具，然后再回到主模型……我会考虑一下。

在技术上，在我们的架构中连接这个功能并不复杂。

---

<div class="post-metadata">

### Author: ![tpetrov](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/tpetrov/32/164643_2.png) [@tpetrov](https://meta.discourse.org/u/tpetrov)
#### Post date: [2024年二月16日 08:48 UTC](https://meta.discourse.org/t/gpt-4-with-vision-available/295462/7 "2024-02-16T08:48:34Z")

</div>

谢谢 Sam！

根据 [Vision - OpenAI API](https://platform.openai.com/docs/guides/vision)

> [@](#):
>
> - GPT-4 Turbo with vision 的行为可能与 GPT-4 Turbo 略有不同，因为我们会在对话中自动插入系统消息。
> - GPT-4 Turbo with vision 与 GPT-4 Turbo 预览模型相同，在文本任务上的表现同样出色，但增加了视觉能力。

Vision 和 turbo 应该基本相同（但不确定，还没有经过彻底测试）。
