跳到正文

图像生成

AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。

3条精选相关主题AI 视频多模态产品更新

最新精选

第 1–3 条 · 共 3 条
9月20日周日
  1. Qwen(@Alibaba_Qwen)AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里开源 Qwen-Image-2.1:7B 图像生成与编辑模型,支持 RGBA 图层

    阿里 Qwen 团队发布并开源 Qwen-Image-2.1,称其为 Qwen-Image 系列中兼顾均衡与成本效益的图像生成模型。该模型为 7B 轻量架构,统一支持图像生成与编辑,可原生生成和编辑 RGBA 透明图层,支持最多 10 张参考图与局部精确控制,并针对多图输入大幅加速推理。权重已在 ModelScope、Hugging Face 和 GitHub 开放。

    为什么值得看

    阿里开源 Qwen-Image 系列的轻量图像生成与编辑模型,可对照其与闭源模型在速度、透明图层上的差异。

7月7日周二
  1. AI at Meta BlogAI 评估 · 82/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta Superintelligence Labs 发布 Muse Image 并预览 Muse Video

    Meta Superintelligence Labs 发布其首个媒体生成模型 Muse Image,并预览 Muse Video。Muse Image 以智能体方式运行,调用搜索和编码工具,能自我改进并随测试时算力扩展而提升,已上线 Meta AI 应用、meta.ai、美国 Instagram Stories 及部分国家的 WhatsApp。

    为什么值得看

    Meta Superintelligence Labs 首发的图像生成模型,其智能体式工具调用与推理时算力扩展为图像生成提供了新范式。

7月1日周三
  1. Google DeepMind BlogAI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash

    Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)和 Gemini Omni Flash(gemini-omni-flash-preview)两款模型。

    为什么值得看

    官方给出两款新模型的价格、延迟与定位差异,读者可据此判断图像到视频链式工作流的成本与适用边界。