Cursor 项目内 Agents 共享记忆与计划、演示等生成产物
Cursor 项目内的 Agents 可共享记忆和生成的产物,包括计划与演示等文件。这些文件会在你的设备和 Agents 的电脑之间自动同步。
Cursor 项目内的 Agents 可共享记忆和生成的产物,包括计划与演示等文件。这些文件会在你的设备和 Agents 的电脑之间自动同步。
Cursor 发布 Projects,一种新的工作方式,不再为每个任务单独创建对话,而是在单一持久线程中与一个协调智能体协作。该智能体始终在线,可主动通过子智能体管理任务,并随时间改进。
OpenAI Developers 宣布 GPT-Live-1 已在 API 中可用,可把 ChatGPT 的自然双向对话能力接入应用,构建边听边说的语音智能体。该能力支持开发者自选模型与 harness。Greg Brockman 转发了这一消息,称其用于帮助开发者创造新类型的应用。
Greg Brockman 表示,美国临床医生即日起可通过 ChatGPT for Clinicians 免费获取 GPT-6 Astra(Pro)访问权限。Karan Singhal 提供了注册入口。
Google Sheets 现在可以把任意表格变成一个应用,表格本身就充当该应用的数据库,并且不只用来展示数据,也能录入新内容。使用步骤为点击右上角的 Gemini 图标,在设置中点击 Create canvas,然后描述你想要的应用即可完成。作者称这一能力可能取代数百家做类似工具的初创公司。
Dropbox、Box 和 SharePoint 即日起原生集成进 ChatGPT Library,覆盖 ChatGPT 与 ChatGPT Work。本周起向付费用户推送。
OpenAI 展示了一项分析溯源功能:可将数字和论断追溯到具体段落与表格,并预览引用处的支撑原文,让用户在写作过程中随时核对证据。
OpenAI 支持用企业自有的 Excel、Word 和 PowerPoint 模板生成可编辑的财务模型、研究报告和 pitchbook。该能力由 OpenAI 官方账号发布,推文获得 520 次点赞、76 条回复和 21 次转发,浏览量约 24.1 万。
Genspark 与 Fireworks 发布开源模型 Gen-1 Slides,在幻灯片生成任务上对标 Claude Opus 5,输入 token 价格约为后者的 1/17。该模型基于 MiniMax M3 通过 Fireworks Lab 的长时程 RL 后训练而来,已在 Genspark AI Slides 中作为默认模型上线。
Genspark 祝贺 OpenAI 发布 GPT-Live,并称先跑了 80 通真实餐厅预订电话:任务完成率相比上一代翻倍以上,理解准确率 92%,打断处理更顺畅,轻声的 mm-hmm 不再打断它,句中插入新问题也能无停顿切换。
Stack Overflow 重新上线五年前下线的 Developer Story,首日支持展示用户"专长"领域,并允许自行控制哪些专长被突出显示。该功能将进入个人资料核心位置,后续还会展示来自其他站点的非 SO 贡献数据,并作为更大计划 Stack Identity 的基础,官方称其目标是成为互联网上可验证的开发者工作证明层。旧版 Dev Story 数据因当初为隐私合规下线时已删除,不会恢复。
Dify 推出 New Agent,可将同一个 Agent 放进 Workflow,与数据库、自定义逻辑、API 和人工审核组合使用。Agent 负责需要判断的环节,Workflow 推动流程继续运转。用户可通过 cloud.dify.ai 试用。
HeyGen 宣布开源实时 AI 体验框架,该框架与 OpenAI 合作构建,结合 GPT-Live-1、TryLiveAvatar 和 HyperFrames。代码已发布在 GitHub 的 heygen-com/liv 仓库,官方同时展示了多个演示。
Google AI Studio 推出 Gemini API 文档首个预览版,文档直接集成在 AI Studio 中,与开发环境同处一地。官方称该文档平台为从零重建,目的是带来更好的整合度与便利性,用户可通过 ai.studio/docs 体验并反馈。
Google AI Studio 推出文档功能,用户可通过 aistudio.google.com/docs 试用。该消息由 Logan Kilpatrick 发布,未披露更多模型或参数细节。
Fish Audio 放出体验链接 fish.audio/app/,邀请用户自行试用。该条内容未披露具体模型版本、功能细节或参数信息。
Devin Desktop 现已开放下载,地址为 devin.ai/download。该消息由 Windsurf 发布,未披露版本号、功能细节或支持平台信息。
Google AI Studio 上线了面向人类和智能体的完全集成文档体验,用户可直接在 AI Studio 内使用。Logan Kilpatrick 表示这一功能是他期待了 2.5 年的成果,也是进一步重构体验的第一步。
Gemini API 文档迁至 ai.dev/docs 并整合进 Google AI Studio,用户可在一个页面内阅读指南、获取 API key 和测试模型。
Gemini 应用 for Windows 即日起面向 Windows 10 和 11 全球上线,用户可在 Windows 设备上直接使用 Gemini 应用。官方博客同步介绍了该应用如何简化日常工作。
三个新 skills 可给任意应用加上语音能力:/add-dictation 说话即输入文字,/add-voice 与 Grok 实时对话,/add-read-aloud 把任意回复朗读出来。这些 skills 可从 marketplace 安装。
Google Gemini 应用现已登陆 Windows,用户可通过 Alt + Space 快捷键随时唤起。该应用支持打磨草稿、总结长文档、头脑风暴创意,以及在常用工具和日常应用旁生成自定义图像和视频。
Google 发布图像工具 Google Pics,基于 Nano Banana 构建,可生成、精修和共同创作图像。它支持单独编辑图中特定对象而不影响其余画面、直接修改或翻译图片内的文字、多人共享协作,以及从单个提示词生成多个方案。
OpenAI 在 ChatGPT Work 中推出新的 Data agent,用户只需提问,就能把公司数据转成答案、交互式看板并采取行动。使用方式是先在 ChatGPT Work 中添加 Data Plugin,连接已有的数据源与上下文,然后开始对话。
NVIDIA 推出 BioNeMo Inference Runtime(BioIR),在高通量蛋白质组规模下加速生物分子结构预测模型。该运行时基于 NVIDIA GPU,采用优化 kernel 并在适用场景使用 CUDA Graphs 提速,同时保留原有 PyTorch 工作流。
Bolt Slides 迎来重大更新,支持在画布上直接编辑幻灯片,一键重排、复制和删除页面,并可在演示时于幻灯片上绘制标注。新增演讲者备注演示视图,支持导出 PDF 或发布到真实 URL,现已上线 bolt.new。
Mem0 在 12 次默认流程测试中每次都能保存稳定偏好(如“I prefer dark mode”),但临时工作更新(如“the migration is blocked”)只保存了 2/12 次。同一阻塞信息改为结构化字段后,保存率达到 12/12。
Gemini API skills 迎来更新,官方将 Interactions API skill 合并进主要的 `gemini-api-dev` skill,并做了简化,以提供更简洁的设置。相关代码托管在 google-gemini 的 GitHub 仓库。
GPT Image 2.5 已在 lovart.ai 上线,提供最高 31 天的无限使用额度。用户可在该平台持续生成图片,不再受次数限制。
ChatGPT Images 2.5 已上线 Lovart,带来 Smart Sketch、Sharp Vector 和 Precise Edit 三项能力。Smart Sketch 可把涂鸦变成细节丰富的场景,Sharp Vector 支持从屏幕到超大显示屏的缩放,Precise Edit 能在不损失画质的前提下做精准修改。
LovartAI 推出 Flare 与 Sunburst 两项能力。Flare 主打快速生成、透明素材,支持规模化创作;Sunburst 主打更锐利的细节、更丰富的纹理、更干净的文本,并在多次编辑间保持质量一致。
GPT Image 2.5 已在 Lovart 上线,用户可获得最长 31 天的无限量创作权限。该版本主打不受限的生成能力,具体功能与定价细节尚未公布。
Lovart.ai 宣布上线 GPT Image 2.5,用户可在该平台获得最长 31 天的不限量生成额度。原文未披露具体功能细节与定价。
超级小爱基于 Xiaomi MiMo 模型引入 RAG-Planning 并将推理从 think 模式切换为 no-think 模式,模型耗时平均下降约 35%,端到端最快快出 3 到 6 秒。全双工升级把拒识、判停和打断统一决策,配合三级 Session 压缩体系使上下文 Token 量下降 60%—86%,支持边听边说与随时插话。小米澎程 SkyNomad 已搭载专家版超级小爱。
Google 的 Logan Kilpatrick 表示,Gemini 3.8 Cyber 在许多网络防御基准和真实用例上比 Mythos 更强。该模型已在 Google 内部被 Chrome、Wiz 和 Cloud 广泛使用,并将很快向外部扩展。原文附有 deepmind.google/models/gemini/ 链接。
TechHalla 用 Midjourney 搭配 Hailuo AI 的 H3 提示词,做出了与 MJ 风格匹配的运动生成视频。相关提示词已在推文中公开,原帖可在 Twitter 查看。
Character.AI 推出 c.ai/series,用户可在该页面观看全部剧集内容。官方账号以「pick your thrill」宣传,并附上 c.ai/series 链接引导直接观看。
终端工具 termany.sh 发布了一款 Windows 98 经典主题。开发者 Benn 称其最新 Termany 主题采用了 Windows 98 外观,并表示搭配 Claude 和 Codex 使用体验良好,推荐经常与编码智能体协作的用户尝试。
Browser Use 的云端服务已在 cloud.browser-use.com 上线。该消息由 Browser Use 官方账号发布,未披露模型版本、价格或功能细节。
Browser Use 与 Link 合作推出面向早期用户的支付方案:智能体发起付款请求后由用户确认,Link 随即生成一次性虚拟卡,全程三步即可接入。该功能让 AI 智能体在不直接接触用户真实卡号的情况下完成支付。