图像与视觉
图像上传、视觉分析、隐私边界和图像生成基础。
9 项内容 (6 篇文章 · 3 个视频)
从这里开始
浏览完整内容之前,先阅读几篇推荐文章。
此主题下的更多内容
6 分钟阅读使用视觉参考,但不盗用他人风格
创作者会通过参考图像和艺术家的作品来学习,生成式工具也可能在这一过程中被滥用。这套AI图像实践兼顾同意与公平的参考方式,拒绝克隆在世艺术家的风格,同时保留学习创作技法的空间。
初级
6 分钟阅读AI图像工具会错在哪里,以及为何检测器解决不了
AI生成与AI编辑图像可能包含有用的视觉线索,但线索会变化,检测结果也取决于所用模型、编辑方式与测试数据。应核对来源和出处,而不是把一个分数当作认证。
初级
7 分钟阅读在用AI编辑或分享他人照片之前,先取得同意
把朋友的照片上传到AI工具去除背景、替换笑容或变成插画,看似只是一次私下的小修改。对照片中的人来说,这可能是一个影响更大、他们却从未有机会参与的决定。
初级
7 分钟阅读AI语音与音频:从克隆到播客再到翻译
为语音克隆、旁白、转录和翻译提供的一张入门导览,涵盖同意、披露、隐私与验证边界。
初级
48 分钟2024年Midjourney终极新手指南
Future Tech Pilot. 如果你已经决定尝试Midjourney,这份指南会从头到尾带你走完整个流程,包括提示词结构、stylize / chaos / weird参数、图像提示、混合、缩放和平移,以及风格调校。虽然界面仍在不断演变,但这里介绍的内容依然适用,其中形成提示词的思路也能顺畅迁移到v7。
初级
48 分钟你究竟应该使用哪款AI图像生成器?
Matt Wolfe. Matt使用同一组提示词测试Midjourney、DALL·E、Adobe Firefly、Stable Diffusion、Leonardo等工具,并按照准确度、写实度、插画、标志、文字和价格等维度进行评分。此后模型阵容已有变化,因此应把具体产品结果视为历史记录;真正有用的是这套可重复的比较方法。
初级
4 分钟GPT-4o视觉能力现场演示
OpenAI. 视频用四分钟展示了一个人把手写的线性方程举到摄像头前,ChatGPT在不直接给出答案的情况下辅导他解题。这是最清晰、最简短的演示,能让你切实体会“模型真的能看到我展示的内容”;与我们找到的其他操作演示相比,它也更准确地呈现了文章推荐的使用场景——手写笔记、简单数学题和拍摄的文档。
AI新手
