跳到正文

#Agent

今日 159 条
10月9日周五
  1. AI前线AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    模力工场联合 InfoQ 等举办 1024 AI 社区日,10 月 24 日杭州开启报名

    模力工场联合极客邦科技旗下 InfoQ、极客时间、AI 原住民、OPC 举办的 1024 AI 社区日将于 2026 年 10 月 24 日在杭州云谷中心举行,首批报名已开启。

  2. AI前线AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从 AI 工具到经营智能体:快手分销增长 Agent 实践

    快手技术专家祁慧在 AICon 2026 深圳站分享了分销增长 Agent 的实践,将 AI 经营能力从单点工具演进为主从结构的 Multi-Agent 经营大脑:主 Agent 负责全局诊断与规划,选品、定价、建联等子 Agent 独立执行并回传结果。团队同步搭建数据智能基建,通过沉淀经营知识库、商达合作知识图谱、Skill 接口与商家经营画像,并对小模型做 GRPO 微调以降低成本与响应时延。

  3. AI前线AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 GPT-6.1 Sol 上线 Ultrafast 极速模式,单价为标准模式 6 倍

    OpenAI 于 10 月 8 日在 Responses API 中为 GPT-6.1 Sol 增加 Ultrafast 极速模式,向所有 API 用户开放,开发者无需更换模型名,只需将服务档位设为 ultrafast。

  4. DatawhaleAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TRAE 全面升级:TraeWork 与 TraeCode 合并,新增 Agent 模式

    TRAE 将 TraeWork 和 TraeCode 双端合并为全新 TRAE,新增 Agent 模式,可在同一窗口管理所有项目、调度多个 Agent,需要深入代码时一键切回 IDE 修改同一工程。

  5. AINLPAI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软开源 Agent Lightning v1.0:把真实 Agent 接进强化学习

    微软开源 Agent Lightning v1.0,一套面向 AI Agent 的强化学习框架,让开发者保留现有工具调用、上下文管理和任务执行流程,用实际任务反馈训练底层模型。

  6. 阿里研究院AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    安筱鹏:AI如何重构全球汽车产业竞争格局

    阿里云智能集团副总裁安筱鹏在2026云栖大会汽车行业峰会上提出,AI正同步重构汽车产业的经济模型、产品形态与竞争规则,使行业呈现高固定成本、低边际成本特征。全球汽车产业利润池中传统业务占比将从2021年的90%降至2035年的44%,Robotaxi市场年复合增长率超88%,2035年规模达1300亿~4150亿美元。自动驾驶、智能座舱、AI生产力由此成为三大竞技场。

  7. 新智元AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌 Gemini 4 Argon 现身 Google Cloud 与 Antigravity,最快今日发布

    谷歌下一代模型 Gemini 4 Argon 尚未官宣,已被曝密集现身多个平台,最快将于本周甚至数小时内发布。爆料称其发布卡片已上线谷歌内部系统及部分 Pro 用户界面,并已进入 Google Cloud 控制台,在编程工具 Antigravity 中被设为默认模型,还出现了真实的代码提交记录。

  8. CSDNAI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    开发者用 Claude Opus 5.5 打造 7 款开源软件对标 Adobe 全家桶

    前 Square 工程师 Brandon Thomas 带四人团队借助 Claude Opus 5.5,用 Rust 开发了 ArtCraft 套件中的 7 款开源应用。

  9. idoubi(@idoubicc)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sumus 上线 Generative UI:AI 智能体在聊天中直接生成交互工具

    Sumus 正式上线 Generative UI,其 AI 智能体现在可以在对话中直接给出可交互工具,用于对比房源、调整数字和规划下一次补货,入口为 sumus.im。

  10. 跨国串门儿计划AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 工程师谈 Claude Code:提示词、运行框架与 Agent 安全边界

    Anthropic 工程师 Thariq Shihipar 在播客中谈 Claude Code,认为 Agent 写代码已成许多人的默认方式,真正拉开差距的是能否把需求讲清楚。

  11. Z PotentialsAI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nous Research 完成 9000 万美元 B 轮融资,估值 15 亿美元并推出企业版 Agent

    AI Agent 创企 Nous Research 完成 9000 万美元 B 轮融资,估值达 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 及 1789 Capital 参投,累计融资 1.58 亿美元。

  12. Z PotentialsAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    深度|RSI 的早期产业形态,最可能出现在企业 Agent

    Pyromind 押注 RSI 产业化的早期形态出现在企业 Agent 上线后的持续学习,用 AutoRL 和 Reward Data Flywheel 把真实任务反馈转化为可训练、可评估的模型能力。

  13. meng shao(@shao__meng)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Addy Osmani 拆解工程师对 AI Coding Agent 的两极感受:创造、知晓与重要三种喜悦

    Addy Osmani 认为「爱写代码 vs 爱交付」的划分过于简单,工程师面对 AI Coding Agent 的喜悦可分三种来源:创造的喜悦(心流,最安全)、知晓的喜悦(心智模型,最危险,可能让构想能力退化)、重要的喜悦(判断力权重不降反升)。他拒绝把对 AI Agent 的失落感病理化,认为悲伤是对工作有真实依恋的证明,建议主动守护构成职业认同的核心。

  14. Anton Osika – eu/acc(@antonosika)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 在动手开发前先勾勒应用外观,实测搭建梗图生成器

    Lovable 在正式开始构建前会先勾勒出应用的大致外观。有用户用它搭了一个梗图生成器,可根据提示词自动挑选图片并撰写文案。

  15. 歸藏的AI工具箱AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok Bot 生成 AI 早报视频的提示词与流程

    作者用一段提示词让 Grok Bot 每天早上 9 点整理前一天 AI 资讯,并试做出约 90 秒的中文讲解视频,采集、写代码和渲染全部跑在它的云端虚拟机上。

  16. 有新NewinAI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    《State of AI Report 2026》:OpenAI 与 Anthropic 亲自下场做交付,软件产业分工正被改写

    10 月 8 日发布的《State of AI Report 2026》指出,OpenAI 与 Anthropic 今年 5 月组建企业部署服务公司,前线工程师进入客户现场把模型接入业务系统并持续维护。

  17. Qdrant(@qdrant_engine)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangGraph 接入 Qdrant 作为长期记忆存储层

    LangGraph 现已支持将 Qdrant 作为长期记忆的存储层,通过新的 memory store 集成,让 AI 智能体的记忆可跨对话保存与召回。Qdrant 为 LangGraph 的记忆系统带来向量原生存储与语义搜索,智能体可按语义而非精确匹配检索相关记忆,用于存储用户偏好、历史交互等上下文。

  18. Qdrant(@qdrant_engine)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangGraph 文档更新并发布 Qdrant 集成

    LangGraph 文档已在 docs.langchain.com 更新,涵盖 Python 版用法。同时 LangGraph 的 Qdrant 集成包已发布到 PyPI,可通过 pip 安装使用。

  19. 架构师之路AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    架构师之路《一起玩AI》直播:要不要学 skill、要不要手搓 skill

    架构师之路在《一起玩AI》系列首讲《30分钟写好skill》中给出三个答案:需要写 skill、需要学写 skill、但不一定手搓 skill。他指出 skill 本质是文件夹而非提示词,description 是触发器,公式为具体能力清单+触发场景+用户关键词,正文按一句话定位、分步流程、边界与禁忌、Gotchas、快速参考表五段组织,其中 Gotchas 需用真实材料跑出来。

  20. 大淘宝技术AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    淘宝直播数字人互动 Harness-Aware Training 实践:让 Agent Model 随 Harness 一起进化

    淘宝直播提出 Harness-Aware Training(HAT),把动态执行环境 Harness 状态显式纳入训练分布,通过 HSA-SFT、General OPD、HSA-RL 三阶段训练,让模型读懂当前 Harness 而非背下某一版配置。

  21. InfoQ 中文AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AICon 北京 2026 议题征集启动:寻找把 AI 做进真实生产的人

    AICon 全球人工智能开发与应用大会北京站启动议题征集,会期为 2026 年 12 月 18 日至 19 日,地点在北京新云南皇冠假日酒店。

  22. InfoQ 中文AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    金融监管领域的 Harness 实践:让知识与数据驱动 Agent 稳定运行

    中软融鑫总工程师于浩军在 AICon 2026 深圳站分享金融监管报送场景的 Harness 实践,通过知识底座、数据底座、受控状态机与全链路可追溯机制,把自由发挥的 Agent 改造成“宁可不答、不能答错”的受控系统。

  23. 量子位AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Aether AI 发布因果智能体 CRIS-0,机器人实现 0.2 秒急停与秒级重规划

    Aether AI 发布因果智能体系统 CRIS-0 的官方 Demo,机器人在关闭微波炉门时因人手突然插入实现 0.2 秒紧急悬停。该系统由 UCSD 助理教授、CMU 因果学派学者黄碧薇创立的 Aether AI 打造,核心是因果原生的 Agent 架构,通过统一状态与因果变量、统一工具接口和因果世界模型 CausalWM 推演动作后果。

  24. 量子位AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    联想天禧自研代码智能体 TianxiCode 以 71% 解决率登顶 SWE-bench-Live

    联想天禧 AI 自研的专业代码智能体框架 TianxiCode 配合 DeepSeek-v4.1-Flash,在 SWE-bench-Live(Lite 分榜)中以 71% 的问题解决率登顶全球第一,并通过官方 Verified 核验。TianxiCode 具备跨文件多跳检索、自驱动规划与多轮工具调用、闭环补丁生成与测试驱动自愈三大能力,未来将落地联想 AI 硬件产品。

  25. 量子位AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TRAE 将 Code 与 Work 双端合并,新增 Agent 模式与 IDE 模式

    TRAE 将 TraeCode 和 TraeWork 双端融合升级为新 TRAE,提供 Agent 模式和 IDE 模式两种工作方式,切换入口在右上角。Agent 模式作为全局工作台,可在同一窗口管理项目并把写代码、出文档、准备交付材料分给多个 Agent 并行推进;IDE 模式保留 SOLO 和 IDE 玩法,用于逐行细改代码。

  26. 国际大厂AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    我不需要 AI 智能体当行政助理,我需要它当妻子

    Business Insider 资深记者 Katie Notopoulos 撰文称,她对 AI 智能体的期待不是充当行政助理,而是像妻子一样打理生活。文章为个人观点的评论,未涉及具体模型或产品。

  27. 国际大厂AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克和谷歌相继把 Claude Opus 5.5 接入自家智能体

    新智元报道称,马斯克宣布 Grok Bot 将按任务接入 Claude Opus 5.5,一天后谷歌在 Google Cloud 发布会上把 Claude Opus 5 与 Sonnet 5.5 集成进 Gemini Business 企业智能体,Claude 模型首次与 Gemini 自家模型同时出现在选择器中。

  28. 国际大厂AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ARR突破1亿美元,Meshy创始人胡渊鸣的48条创业思考

    Meshy.ai 创始人、CEO 胡渊鸣在公司 ARR 突破1亿美元后,写下48条创业反思,分"温度与原则""时间与 Founder Mode""AI 与人""团队与管理""战略与执行"五个板块。他提出管理者不能"惩罚责任心",创始人不应向下属索取情绪价值;并称公司几乎无限 Token,但面试仍要求手写代码。

  29. 国际大厂AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软 Microsoft 365 Family 订阅将支持共享 Copilot 等 AI 权益

    微软将允许 Microsoft 365 Family 和 Premium 订阅者把 Copilot 及 AI 使用权益共享给同一套餐下最多五人,并可为未成年家庭成员管理 AI 访问权限。

  30. LangChain BlogAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Snyk 如何把内部支持 Agent 做成客户功能:基于 LangChain 与 LangGraph 的 Snyk Assist

    Snyk 将其内部支持 Agent 转为客户功能 Snyk Assist,一个基于 LangChain 和 LangGraph 构建、在 LangSmith 中管理可观测性的对话式 Agent,可查询未解决问题、检查软件包漏洞、创建支持工单或记录功能请求。

  31. 硅星人ProAI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TRAE 合并 Code 与 Work,加入 Agent 工作台

    TRAE 将 TraeWork 与 TraeCode 合并,保留已有开发能力,并加入 Agent 工作台,用统一界面跨项目分配任务、调度多个 Agent 并行工作。

  32. 硅星人ProAI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ACC 2026 × WorkBuddy 超级个体极限挑战赛开启招募:20 个席位,两天用 Agent 交付成果

    ACC 2026 × WorkBuddy 超级个体极限挑战赛开启招募,寻找 20 位挑战者,带着一件自己真正想办成的事到 ACC 现场,用 WorkBuddy 的专家团、Skills、连接器、自动化、资料库等能力在两天内交付可当场检查的成果。

  33. AI Will(@FinanceYF5)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok Bot 可直接搜索、阅读和监控 X,最多创建 3 个 Bot 自动化品牌运营

    Grok Bot 现在可以直接搜索、阅读和监控 X,用户最多可创建 3 个 Bot,把品牌的社区运营、内容策略和用户分析自动化。发帖者称这对运营品牌账号的人几乎是一个"作弊码"。

  34. AI Will(@FinanceYF5)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    在 X 上管理品牌账号:用 3 个机器人做社区管理、内容策略与数据分析

    Ish Verduzco 提出在 X 上管理品牌账号的三个机器人玩法:24/7 社区经理每日扫描品牌提及、汇总可扩散推文与产品反馈、推送每日摘要和紧急预警;内容策略师分析品牌历史推文的互动、回复与书签数据,推荐内容方向并构建语气/风格技能;分析师则梳理过去 30/60/90 天的互动与回复,找出有影响力账号并同步给团队。

  35. Harrison Chase(@hwchase17)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jerry Liu:eval driven development,用定义 eval 替代显式工作流

    Jerry Liu 提出「eval driven development」:如今只要定义一个 eval 并围绕它爬山,就能解决几乎任何任务,而不必直接定义确定性的或智能体的工作流。他认为数据提供方的工作就是为所有经济活动定义 eval,让前沿模型什么都能做,人的职责则变成指明方向——定义要解决什么、如何衡量做好。最复杂流程仍需显式的工作流构建界面,但多数任务可压缩为目标加 eval 指令。

  36. Harrison Chase(@hwchase17)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Harrison Chase:eval 驱动开发不适用于更自主的 AI 智能体

    Harrison Chase 认为,eval 驱动开发只适用于范围狭窄的任务,对更自主的 AI 智能体并不奏效,因为一旦度量变成目标就不再是好度量(Goodhart 定律)。Hunter Gerlach 提出的路径是:不断创建新的高价值 eval,同时对抗 Goodhart 定律,再回到第一步循环。

  37. Geek(@geekbb)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    纯 Rust 项目重写 Photoshop 图层功能,支持 CLI 与 MCP 驱动

    一个纯 Rust 项目从零重写了 Photoshop 的图层、蒙版、调整图层和矢量功能,可直接打开、编辑并保存真实的 PSD 文件。项目支持通过 CLI 或 MCP 交给脚本和 AI agent 驱动,代码托管在 github.com/openhausfun/ph。

  38. Viking(@vikingmute)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用户吐槽 ChatGPT:复杂需求原地打转、频繁推翻方案,考虑取消订阅

    有用户吐槽 ChatGPT 在复杂需求上表现很差:原地打转、主观能动性不足,需不断催促才继续干活,产出多为半成品,还常推翻自己最早方案导致补丁代码堆积。该用户称其表达不像人话、需反复解释,加上 computer use 后 token 消耗飞快,正考虑取消订阅。

  39. 量子位AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌发布办公Agent,可动态调用Claude系列模型

    Google Cloud发布署名Thomas Kurian的长文,推出通用办公Agent Gemini Agent,支持跨应用调用工具、定时与事件触发任务、多子Agent协作,并能依据任务在效果、速度与成本间动态选择Gemini系列或Anthropic Claude系列模型,未来计划支持更多闭源和开源模型。

    为什么值得看

    对比Meta与OpenAI的办公Agent路线,能帮读者看清谷歌这次把Agent嵌入企业组织体系的具体做法。

  40. 量子位AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MirroS 团队发布 AgentGarten:让智能体在代码与实时渲染的试炼场中边玩边进化

    MirroS 团队发布 AgentGarten,将可执行代码环境与实时神经渲染器连接,物理规则由代码裁决、光影由模型生成,以超过 30 fps 的吞吐让智能体持续与虚拟世界交互。