AI 是怎样生成图片的?
图像生成模型利用训练中学到的模式,根据条件产生图片。
从数据、学习到大语言模型,理解 AI 为什么看起来越来越聪明。
共 10 篇文章
AI 怎样看图片、生成图片、听声音和控制机器人。
图像生成模型利用训练中学到的模式,根据条件产生图片。
音频生成模型可产生语音、音乐或其他声音,具体能力依训练任务而定。
图像分类、目标检测和分割是不同视觉任务。
能看、听、说的 AI 系统通常组合多种输入表示和输出能力。
AI 处理图片时先使用像素等数值表示,再通过模型提取和组合信息。
语音转文字用模型把音频映射成文本。
声音模型处理随时间变化的音频信号。
图片理解把视觉线索与任务联系起来,但无法可靠知道照片之外的一切。
视频理解需要处理画面随时间的变化,可能还结合音频。