Lovart 无限画布接入 GPT-Image 2.5,涂鸦可转多风格成图
ChatGPT Images 2.5 已上线 Lovart 无限画布,支持把任意尺寸的涂鸦转成多种风格的精细成图。三项能力包括 Smart Sketch(草图生成丰富场景)、Sharp Vector(从屏幕放大到巨型显示设备)和 Precise Edit(局部精准修改且不损失画质)。
ChatGPT Images 2.5 已上线 Lovart 无限画布,支持把任意尺寸的涂鸦转成多种风格的精细成图。三项能力包括 Smart Sketch(草图生成丰富场景)、Sharp Vector(从屏幕放大到巨型显示设备)和 Precise Edit(局部精准修改且不损失画质)。
MiniMax Design H3 结合 Blender 可生成室内视频场景,通过参照 Blender 搭建的场景,实现以往难以做到的室外到室内无缝转场。创作者 Toshi 表示,先用 Blender 做出一定程度的场景再交给 H3 参照,效果较好,该流程被视为视频制作工作流的更新。
阿里云于 9 月 11 日升级 Token Plan 个人版,原有价格及 Credit 额度不变,Standard 和 Pro 套餐新增 Agent Harness 工具权益与用量,覆盖搜索、网页解析、图像生成、语音处理、代码执行等 12 项能力,均通过 MCP 标准协议开放,可直接接入自有 Agent 应用。
Genspark 上线 Gen-1 Slides,这是一款只做演示文稿的专用模型,号称达到前沿模型质量,价格约为其 1/17。Genspark 借此对比通用前沿模型"什么都做、也让你为全部能力付费"的现状,强调按单一任务训练可大幅降低成本。该模型已在 genspark.ai/ai_slides 上线。
LovartAI 转发并称赞创作者 AmirMušić 分享的工作流:从一张参考图出发,生成完整品牌系统、品牌规范、包装与动态设计,且全程保持清晰的创意方向。该推文附有一篇文章链接,原文未披露具体模型、参数或生成耗时。
Datasette 发布 1.0a39 和 0.65.4 安全版本,此前使用 Claude Fable 5.1、GPT-5.6 Sol 和 GPT-6 Astra 进行了大规模审计,并修复了多种 bug。在公开网站上运行 Datasette 实例的用户应尽快升级。
Browser Use 云平台现可运行 DeepSeek V4.1 Flash,其性能达 GPT 5.6 Sol xhigh 的 97%、Claude Opus 5 的 95%,智能体成本低 30 倍。新用户可用 15 美元免费额度运行 100 个复杂网页智能体任务。
OpenAI 发布 ChatGPT for Financial Services,这是一套定制的 ChatGPT Work 体验,将内置金融数据与 GPT-6 Astra 的推理能力结合。团队可用于开展研究、构建金融模型并制作定制化客户材料。
Termany 作者 idoubi 表示,这条推文为 termany.sh 带来大量新用户,并感谢大家对 Termany 的喜爱。团队正在开发一项重要新功能,下一个版本会更好。
Ollama 宣布其应用现已支持启用 ChatGPT,用户需先下载 Ollama 并在应用中开启该功能,下载地址为 ollama.com/download。
ChatGPT 设置中可自定义模型选择器里显示哪些模型,本地模型和云端模型都能被选中。该功能通过设置项管理模型的可见范围。
Ollama 宣布 ChatGPT Desktop(Codex 应用)现在可以配置为使用 Ollama 模型。用户需下载或更新到 Ollama 0.34 即可开始使用。
Genspark 与 Fireworks AI 合作,其 AI 幻灯片(ai_slides)每天生成 12 万份,并用到 Fireworks AI 的训练平台。目前该功能定价仅为 Opus-5 的 1/17,用户可通过 genspark.ai/ai_slides 试用。
OpenAI 已暂停 200 美元/月 ChatGPT Pro 档的新订阅和升级,Free、Go、Plus 及 100 美元 Pro 用户目前无法升级到 200 美元档,现有订阅不受影响。
Ollama 宣布 DeepSeek-V4.1-Flash 正在其云端逐步上线,首批面向 Max 和 Team 账户开放。Ollama 表示正在快速增加容量,以便向所有订阅用户开放。
Genspark 品牌负责人 Kim Vo 与 @filupmolina 正在直播对话,后者是走红的「AI Lemonade stand」项目创作者。直播主题是如何让 AI 智能体在真实世界完成各种出格任务,内容可在 YouTube 观看。
Cursor 推出 Projects 功能,现已进入 beta 阶段并从今日起逐步推送。该功能详情发布在 cursor.com/blog/projects,官方未披露更多参数或可用范围信息。
Cursor 项目内的 Agents 可共享记忆和生成的产物,包括计划与演示等文件。这些文件会在你的设备和 Agents 的电脑之间自动同步。
Cursor 发布 Projects,一种新的工作方式,不再为每个任务单独创建对话,而是在单一持久线程中与一个协调智能体协作。该智能体始终在线,可主动通过子智能体管理任务,并随时间改进。
OpenAI Developers 宣布 GPT-Live-1 已在 API 中可用,可把 ChatGPT 的自然双向对话能力接入应用,构建边听边说的语音智能体。该能力支持开发者自选模型与 harness。Greg Brockman 转发了这一消息,称其用于帮助开发者创造新类型的应用。
Greg Brockman 表示,美国临床医生即日起可通过 ChatGPT for Clinicians 免费获取 GPT-6 Astra(Pro)访问权限。Karan Singhal 提供了注册入口。
Google Sheets 现在可以把任意表格变成一个应用,表格本身就充当该应用的数据库,并且不只用来展示数据,也能录入新内容。使用步骤为点击右上角的 Gemini 图标,在设置中点击 Create canvas,然后描述你想要的应用即可完成。作者称这一能力可能取代数百家做类似工具的初创公司。
Dropbox、Box 和 SharePoint 即日起原生集成进 ChatGPT Library,覆盖 ChatGPT 与 ChatGPT Work。本周起向付费用户推送。
Midjourney 发问:最想在哪里接受 Midjourney Scanner 的全身超声扫描?该帖获 93 赞、43 条回复、8 次转发,浏览量 39474,由 xgo.ing 提供支持。
OpenAI 展示了一项分析溯源功能:可将数字和论断追溯到具体段落与表格,并预览引用处的支撑原文,让用户在写作过程中随时核对证据。
OpenAI 支持用企业自有的 Excel、Word 和 PowerPoint 模板生成可编辑的财务模型、研究报告和 pitchbook。该能力由 OpenAI 官方账号发布,推文获得 520 次点赞、76 条回复和 21 次转发,浏览量约 24.1 万。
Stack Overflow 重新上线五年前下线的 Developer Story,首日支持展示用户"专长"领域,并允许自行控制哪些专长被突出显示。该功能将进入个人资料核心位置,后续还会展示来自其他站点的非 SO 贡献数据,并作为更大计划 Stack Identity 的基础,官方称其目标是成为互联网上可验证的开发者工作证明层。旧版 Dev Story 数据因当初为隐私合规下线时已删除,不会恢复。
Dify 推出 New Agent,可将同一个 Agent 放进 Workflow,与数据库、自定义逻辑、API 和人工审核组合使用。Agent 负责需要判断的环节,Workflow 推动流程继续运转。用户可通过 cloud.dify.ai 试用。
HeyGen 宣布开源实时 AI 体验框架,该框架与 OpenAI 合作构建,结合 GPT-Live-1、TryLiveAvatar 和 HyperFrames。代码已发布在 GitHub 的 heygen-com/liv 仓库,官方同时展示了多个演示。
Google AI Studio 推出 Gemini API 文档首个预览版,文档直接集成在 AI Studio 中,与开发环境同处一地。官方称该文档平台为从零重建,目的是带来更好的整合度与便利性,用户可通过 ai.studio/docs 体验并反馈。
Google AI Studio 推出文档功能,用户可通过 aistudio.google.com/docs 试用。该消息由 Logan Kilpatrick 发布,未披露更多模型或参数细节。
Fish Audio 放出体验链接 fish.audio/app/,邀请用户自行试用。该条内容未披露具体模型版本、功能细节或参数信息。
Devin Desktop 现已开放下载,地址为 devin.ai/download。该消息由 Windsurf 发布,未披露版本号、功能细节或支持平台信息。
Google AI Studio 上线了面向人类和智能体的完全集成文档体验,用户可直接在 AI Studio 内使用。Logan Kilpatrick 表示这一功能是他期待了 2.5 年的成果,也是进一步重构体验的第一步。
Gemini API 文档迁至 ai.dev/docs 并整合进 Google AI Studio,用户可在一个页面内阅读指南、获取 API key 和测试模型。
Gemini 应用 for Windows 即日起面向 Windows 10 和 11 全球上线,用户可在 Windows 设备上直接使用 Gemini 应用。官方博客同步介绍了该应用如何简化日常工作。
三个新 skills 可给任意应用加上语音能力:/add-dictation 说话即输入文字,/add-voice 与 Grok 实时对话,/add-read-aloud 把任意回复朗读出来。这些 skills 可从 marketplace 安装。
Google Gemini 应用现已登陆 Windows,用户可通过 Alt + Space 快捷键随时唤起。该应用支持打磨草稿、总结长文档、头脑风暴创意,以及在常用工具和日常应用旁生成自定义图像和视频。
Google 发布图像工具 Google Pics,基于 Nano Banana 构建,可生成、精修和共同创作图像。它支持单独编辑图中特定对象而不影响其余画面、直接修改或翻译图片内的文字、多人共享协作,以及从单个提示词生成多个方案。
OpenAI 在 ChatGPT Work 中推出新的 Data agent,用户只需提问,就能把公司数据转成答案、交互式看板并采取行动。使用方式是先在 ChatGPT Work 中添加 Data Plugin,连接已有的数据源与上下文,然后开始对话。