Midjourney 更新 V8.2 编辑模型,图像质量提升
Midjourney 更新 V8.2 编辑模型以提升图像质量。若用户在过去 24 小时内遇到问题,可重新尝试并继续反馈。官方表示后续还有更多更新。
Midjourney 更新 V8.2 编辑模型以提升图像质量。若用户在过去 24 小时内遇到问题,可重新尝试并继续反馈。官方表示后续还有更多更新。
Bolt 支持构建一种 Awwwards 风格的 Hero 区块,鼠标扫过时汽车会从技术线框图过渡为照片级渲染图。该效果在 Bolt 中搭建完成,官方账号发布了演示视频。
Kling AI 发布八月创作者精选,主题为"平行世界的你会是谁",用想象力把观众带到新的地方。该内容在 Twitter 上获得 15 条回复、9 次转发、122 个赞和 359129 次浏览。
Midjourney 宣布当天开始测试其首个 V8.2 编辑模型。该模型支持按指令编辑、用其他图片生成图像(最多 4 张参考图)、基于笔刷的 inpainting 和 outpainting,并可与 personalization、moodboards 和 srefs 配合使用。
Kling AI 发布一段短视频,画面围绕婚礼场景展开,文案以“Till death do us part? Not for this guy”点出反转让誓言落空。原帖由 Kling AI 官方账号发布,互动数据为 12 条回复、6 次转发、94 次点赞、119814 次浏览。
Replicate 上线 Recraft v4 系列全部变体,包括 v4 styles、v4 svg、v4 styles pro 和 v4 styles pro svg 四条模型链接。用户可在 Replicate 上逐一试用这些版本。
Recraft V4 Styles 上线,可生成并使用风格参考,直接输出可用于生产的位图或 SVG 矢量文件。发布后前 48 小时享受 50% 折扣。
微软 AI 发布 MAI-Image-2.6,在 Artificial Analysis 图像编辑榜单位列第一,超过自家 MAI-Image-2.5-Pro、Reve 2.1 和 OpenAI 的 GPT Image 2,微软因此占据该榜前两名。
HeyGen 推出 Look Packs,可在更换服装与场景的同时保留同一张人脸,面向房产、法律、健身、教育、健康等行业,让客户每次播放看到的都是同一个人。
HeyGen 上线数字人像精修功能,可在几秒内清除瑕疵、淡化皱纹、增强妆容并调整打光,且精修程度完全可控。官方称效果"依然是你本人",精修一次即可在每条视频中保持最佳状态,无需摄像机和重新拍摄。
微软 AI 的 MAI-Image-2.5-Pro 在 Artificial Analysis 图像编辑榜单首次登顶,超过 Reve 2.1、GPT Image 2 和微软自家的 MAI-Image-2.5,在文生图榜单排名第 7。
MAI-Image-2.6 在文生图 benchmark 排名第 2,同一模型在图像编辑排行榜上拿下第 3。该模型由此被定位为可胜任各类图像生成任务的全能选手。
Fish Audio 在 fish.audio/app/image-vide… 推出图像转视频创作入口,用户可直接开始创作。该推文未披露所用模型、参数规模或可用范围等细节。
微软 AI 的 MAI-Image-2.6-Preview 在 Arena.ai 单图编辑榜以 1,420 分升至第 3 名,较 MAI-Image-2.5 提升 19 分、排名从第 5 前进两位,超过 Google Nano Banana 和 Meta Muse Image。
Fish Audio 推出多模态创作平台 Fish Creative(@FishCreativeHQ),创作者可在同一空间把想法转成角色、场景和可直接发布的视频。语音由 S2.1 Pro 生成并支持内联情感标签,也可克隆自己的声音;口型同步、图像与视频、音效均在同一画布内完成。
Gemini 将在未来几天逐步上线水印开关,用户可在设置中开启或关闭"Show watermark",自行决定用 Gemini 生成的图像(Nano Banana)、视频(Omni)和歌曲(Lyria)是否显示可见水印。不可见的 SynthID 水印和 C2PA 元数据将始终保留在后台,法律强制要求保留水印的国家除外;Gemini 与 Flow 已支持该开关,Search 随后跟进。
Grok Imagine Image 2.0 现已上线 Replicate,这是来自 @grok 的最新图像模型,支持清晰的文字渲染与精准编辑。
开发者 @AparnaSoneja 用自拍在 Ready Player Me 生成 3D 化身,经 Mixamo 绑定骨骼后,在 Bolt 上发布了一个会挥手回应的作品集。
MiniMax 官方发文称 H3 开源一周内已在 Hugging Face 衍生出接近 300 个模型,ComfyUI 版本下载量近 700 万。社区把约 60B 参数、BF16 下需约 120GB 内存的 H3 压缩到 42.5GB 以在消费级显卡本地推理,Redis 作者 antirez 还为其编写了面向 Apple Silicon 的原生引擎 h3.c。
Ideogram 发布 Ad Resizer,上传一份设计并选择所需版位,即可导出适配 Instagram、Facebook、YouTube、联网电视、展示广告和印刷等渠道的整套广告素材,极端宽高比也能处理。该工具已在 Ideogram 应用和 API 上线。
Kling AI 分享了一段由创作者 mr.cobra_ai 生成的视频,呈现一个"无人知晓其存在的地方"。该推文获得 165 次点赞、12 次转发、10 条回复,浏览量约 26 万次。
微软的 MAI-Image-2.6 在 Text-to-Image Arena 以 1336 分位列第二,比第一名的 GPT Image 2(Medium)低 45 分,领先第三名 Grok Imagine Image 2.0(Low)20 分,超过 Nano Banana、Meta 等对手。
Kling AI 发布一条预告内容,称"没人对这项发现做好准备",仅附一段视频,未披露具体模型、功能或发布时间。该帖未提供任何可核实的参数、版本号或可用性信息。
MiniMax H3 技术团队在周五晚的 Reddit AMA 和 ComfyUI Live 直播中,回应了模型架构、长视频续写、画质局限与后续开源计划等问题。
Kling AI 发布了一段名为 "Tiny Paws, Big Glam" 的视频,展示小动物与华丽造型的视觉效果。该内容在 Twitter 上获得 525 次点赞、47 次转发和 17 条评论,浏览量约 57.6 万次。
ShipAny Image Lite 图片站模板上线,核心功能为 AI image generator 加落地页,主打极速上线。该模板采用扁平化设计,访问地址为 shipany.ai/zh/templates/i…
Kling AI 分享了一段以"失落的埃及影像"为题的生成视频,配文称"LOST EGYPTIAN FOOTAGE FOUND"。该内容在 X 上获得 20 个点赞、3 条回复、1 次转发和 1632 次浏览。
Google 宣布从今天起把最新图像生成能力带到网页版 Google Earth,由 Nano Banana 2 驱动。用户可放大地点后点击 “create image”,用文本提示词结合卫星与 3D 影像重新想象全球各地场景,功能现已面向所有人开放。
Ideogram 宣布 P-Image-Ideogram 现已在 API 及多个合作平台上线,包括 ComfyUI、runware、replicate、LeonardoAi。
Ideogram 的 P-Image-Ideogram 用四个示例展示写实、文字渲染与风格多样性。该模型支持 JSON 提示词和布局控制,官方称其在同价位中质量最佳。
Ideogram 发布 P-Image-Ideogram 图像模型家族,与 PrunaAI 联合开发,主打质量、速度与成本之间的帕累托最优权衡。该家族提供四种质量模式,支持原生 1K 和 2K 生成,每张图像起价 0.003 美元,现已在 API 及所有合作平台上线。
PrunaAI 联合 Ideogram 推出 P-Image-Ideogram,主打高质量风格化生成,具备较强的排版与版式能力。该模型已优化至单张图片低至 $0.003 的成本。
Kling AI 发布了一条受 @Kennyslowbirds 启发的创作内容,互动数据为 0 条评论、0 次转发、1 个点赞、2361 次浏览,由 xgo.ing 提供支持。
Ideogram 上线 Object Remover 功能,可圈选路人、电线或杂物等干扰元素并将其从画面中移除,场景还原后如同这些物体从未存在,图像其余部分保持不变。该功能由 xgo.ing 提供支持。
Ideogram 上线 Object Remover 功能,用户选中不需要的文字、Logo 或字幕即可将其移除,并重建下方干净表面,同时保留纹理、透视与光照。
Ideogram Object Remover 在 RemovalBench 上超越 Nano Banana 2、FLUX Erase 和 GPT Image-2 等领先图像编辑模型,在去除质量上排名第一,同时单次请求价格最低。
Ideogram 发布 Object Remover,可选中任意对象、文字或干扰元素并抹除其全部痕迹,包括阴影、倒影和细微光照变化,且不虚构内容、不影响画面其他部分。该功能已在 ideogram.ai/apps/object-remover 上线,Ideogram 称其对象移除效果达到 SOTA。
Ideogram 发布 Ideogram 4.0,一个 9.3B 参数的开源权重 Diffusion Transformer 图像模型,称其在 LMArena 和 Design Arena 上超过所有开源权重图像模型,X-Omni 英文 OCR 文字渲染得分为 0.97,行业平均为 0.30–0.50。
Midjourney 发布 V8.2,并将其设为平台默认模型。官方称此次更新聚焦美学、个性化与图像质量,新风格更具创意、大胆、前卫和新鲜感,个性化效果也优于以往。
MAI-Image-2.5-Pro 今日在 Foundry 开放预览,Microsoft 称其为最高保真度的专业级图像模型。该模型面向超高质量图像、精细编辑和图像内文字精确渲染,并与同家族其他图像模型一起供开发者按质量、速度、成本的权衡选择。