管中窥豹:Midjourney V8 图片评价初探
各位 AI 创作者,大家新年好。在春节期间,Midjourney 一口气连发 5 份公告,宣告 V8 版本模型即将上线。这几份公告可视为一个小小的新年惊喜,既让我们对 MJ V8 充满期待,也体现出 Midjourney 模型系统按每年一大版本节奏稳步推进的自信与从容。
这 5 份公告实际对应 5 轮图片评价任务。每轮,Midjourney 官方都提供一个评价链接,邀请用户对 V8 模型生成的图片进行偏好选择,以辅助新模型完成最终训练。我也饶有兴趣地参与了最后一轮(Final Round)的图片评价。
下面,就一起来看看我的这次 V8 图片评价体验。
点击评价链接进入系统后,界面与开启“个性化档案”(Personalized Profile)时一致:每次展示两张图片,可选择更喜欢的一张;若两张均不满意,也可跳过该组。
从展示的图片来看,V8 模型的图像生成效果与当前广泛使用的 V6/V7 模型有明显区别:
- 跳过率显著降低:在 V8 评价过程中,我跳过一组图片(即两张均不满意)的情况较少;相比之下,在旧模型(如 V5 或 V7)下做同类评价时,跳过率则高得多。为作对比,我在旧模型中新建了一个个性化档案,需重新评价 200 张图片——过程中跳过的图组数量明显更多。
- 人物表现力大幅提升:V8 在人物体态、动作、表情、眼神及皮肤质感等方面的刻画更为自然,所传达的情绪也更真实、细腻。其人物图像仿佛出自一位经验丰富的摄影师之手,借助精良设备与专业镜头语言传递情感。
- 商品与空间呈现更趋专业:V8 在商品摄影、室内设计及建筑设计效果图方面的表现再上台阶。评价中出现的几张商品图,具有极强的“大片感”。
- 大场景构建能力显著进化:场景构建本就是 Midjourney 的强项,但若用 V7 生成较多大场景图,会发现一个常见问题:场景中次要人物(可称为“群众演员”)常存在动作僵硬、面部特征模糊、细节缺失等瑕疵。虽在整体画面中不显突兀,但缺陷确实存在。而在本次 V8 评价中出现的若干大场景图里,场景细节表达更为细腻,大量次要人物的姿态、位置与基本特征交代得更清晰、更合理。这一进步,进一步削弱了图像中的“AI 感”,使生成的概念图更接近真实商业级影像。
由于本次评价样本量有限,以上观察仅基于数百张图片的初步浏览。但已足以体现 Midjourney 研发团队旺盛的进取心,以及公司致力于深度变革广告业、品牌传播、建筑设计、室内设计与影视行业的雄心。