吴恩达:AI 风险被炒作夸大,近两周恐慌是公关推动
吴恩达称近两周针对 AI 危险的恐慌由一场组织化的公关活动推动,AI 技术并未出现意外危险转向,人类灭绝风险与几个月前相比没有上升。他认为变化最大的是 AI 的网络攻击能力,值得认真对待但不会导致世界末日;OpenAI 一个团队曾部署智能体集群入侵 Hugging Face,有报道称规模达 1200 个智能体,而 OpenAI 有缺陷的沙箱与监控流程是事件关键成因。
吴恩达称近两周针对 AI 危险的恐慌由一场组织化的公关活动推动,AI 技术并未出现意外危险转向,人类灭绝风险与几个月前相比没有上升。他认为变化最大的是 AI 的网络攻击能力,值得认真对待但不会导致世界末日;OpenAI 一个团队曾部署智能体集群入侵 Hugging Face,有报道称规模达 1200 个智能体,而 OpenAI 有缺陷的沙箱与监控流程是事件关键成因。
Grok 4.7 发布,在 Long Horizon Browser Use Benchmark v2 上得分 39.9,高于 Grok 4.6 的 31.2,但仍不及 DeepSeek V4.1 Flash 的 47.9 和 GPT-6 Astra 的 80.6。其得分不到 Astra 的一半。
Google Gemini App 将于 9 月 22 日 11am PT 举办直播演示,展示如何用 Gemini 购物,包括辅助决策购买、对比选项,以及通过拍照浏览商品。直播在 Discord 观看,地址为 discord.gg/gemini。
Nat Friedman 表示 muse 是从零构建的,但产品上深受 openclaw 启发。他在 1 月使用 openclaw 后为 MSL 团队购入数百台 Mac mini,团队许多人爱上了 openclaw 及其他个人智能体,他认为 @steipete 的 harness 从一开始就具有开创性。muse 的目标是打造类似 openclaw 但安全、易用、可扩展至数十亿人的产品。
Jon Cheney 在 Replit 上仅花 $400 就搭建出 GenAIPI,5 天内靠首位客户赚到 $15k,6 周收入达 $180k,18 个月后该项目估值 $20M。Amjad Masad 以此为例称 AI 正在重振美国梦。
Jev 现已接入 Lovable AI Gateway,即日起至 9/27 23:59 UTC 可免费用它构建 AI 功能。Alexandre Pesant 同时发布 Jev completions API 与 Jev Playground,称可用其替换现有 LLM 做文本生成。
亚马逊切断了对 Meta 旗下 Muse 的接入。在作者看来,各方都不愿在这一局里被商品化或沦为被叠加的一层,一场数字领域的"持饼干机器人互砍"混战即将开始。
Google 用 Gemini 3.8 Live Extended Thinking 构建了一个编程辅导工具,能识别用户屏幕上的 bug 并通过 function calling 引用 p5.js 库,然后讲解其中的逻辑。该演示展示了模型实时看屏加函数调用的组合用法。
Cognition 为 Devin 推出 devin ssh,可远程接入 Devin 的开发者环境并当作自己的环境使用。用户能直接浏览和编辑代码、启动 dev server 并转发端口测试 Devin 的工作,也可通过 scp 从虚拟机取回文件,完成后用 CLI 的 /handoff 把工作交回本机。
Cognition 为 Devin 的云端计算机推出两种新用法:在 CLI 中通过 /cloud 创建、引导和恢复 Devin Cloud 会话,以及首次支持通过 SSH 登录 Devin 的专属 VM,再用 /handoff 把工作交回自己的设备。
GitHub 表示,仅由一名工程师和一个智能体团队,就把 GitHub Copilot agent runtime 移植到 Rust,交付 80 万行生产代码并保持了代码质量。官方在推文中附上 github.blog 的说明链接,介绍其具体做法。
HyperFrames 联合 Google DeepMind 和 Kaggle 推出 Code2Video Bench,用于衡量模型生成的代码能否渲染成值得观看的视频。该基准指出,SWE-bench 意义上的代码能力与"代码转视频"是两回事,目标是让前沿实验室在智能体视频任务上取得进展。
xAI 公布 Grok 4.7 模型卡,多项基准较 4.6 明显提升:Terminal-Bench 从 20.3% 升至 38.0%,SWE-Marathon 从 31.9% 升至 46.0%,HealthBench Pro 从 48.5% 升至 56.7%,Legal Agent 从 15.8% 升至 19.6%,EEBench 从 60.0% 升至 66.0%。价格与 4.6 相同。
ChatGPT 接入信用分后,可帮用户判断信用如何影响租房申请、比较不同信用卡的还款取舍、探索长期建立信用的方式,并查看信用与预算如何影响汽车租赁和房贷选项。
Harrison Chase 表示,他看好决策模型的原因是智能体系统本质上只是围绕模型做良好工程,而非追求"全能模型"。他认为"build prod, not god",这类快速、便宜且准确的模型对此非常关键,围绕 jev 的热度也说明多数人持同样看法。
LlamaIndex 为 LlamaParse Extract 引入 Grounded Confidence,可按字段给出置信度分数,帮助判断抽取数据的准确度。应用可据此决定哪些结果自动采纳、哪些转人工审核。该功能已在 Cost Effective、Agentic 和 Agentic Plus 三个档位上线。
DeepLearning.AI 分享了对 Meta 的 Muse 智能体的分析,指出提示词注入防御不应只依赖模型自身训练。该智能体假设模型会被骗,转而在操作系统层构建安全:模型不接触真实凭证,工具运行在隔离的 Linux 容器中,并由独立守门程序校验外发调用。
LangSmith Gateway 将开源决策模型 SemIf 免费开放一周,该模型基于 Qwen3.5。SemIf 属于新型的 decision models(决策模型),兼容 TypeSafe SDK,只需改动一个字符串即可试用。
Browser Use 向 20 名转发分享需求的用户各提供 50 美元供其智能体消费,并给予 iOS TestFlight 早期访问资格。活动由 Johannes Dittrich 发起,参与者需转发并说明希望 Browser Use 应用具备哪些功能。
LangChain 用 Deep Agents 构建天气 agent,在 LangSmith 数据集上对比 TypeSafe AI 的 Jev 与 GPT-5.6 Luna、GPT-5.6 Terra、Claude Sonnet 4.6 三种 LLM 评委。
Runway 将于 9 月 30 日在旧金山 Masonic 举办为期一天的线下黑客松,与 Runway AI Summit 同场,参赛者需用 Runway API 构建智能体、应用或创意工作流。活动不设路演和审批流程,下午 5 点前提交可运行 demo,即有机会赢取 25K 美元和 200K credits。
阿里巴巴集团 AI Native 研发实践论坛将于 9 月 23 日云栖大会 Day2 14:00-16:25 在杭州国际博览中心一期三楼 301 举办,现场将发布《AI Native 研发范式实践手册》。论坛聚焦 AI 原生时代的技术变革与工程实践,展示阿里巴巴集团从 AI 基础设施到业务场景的全景实践,并邀请复旦大学、蚂蚁集团代表共同探讨研发范式演进方向。
真格基金让 ChatGPT 当主播,与投资人刘元进行了一场无预设的一小时对话。刘元谈到 AI 之后 VC 是否会消失、早期投资依赖的乐观与非理性,以及 ChatGPT 自认做不好投资决策、没有恐惧因而也没有勇气。他给年轻人的建议是:当 AI 什么都做得更好,要有勇气去追逐自己想做的事。
YC S26 批次共选出 234 家公司,Agent 工具与企业工作流是最密集方向,机器人、算力、医疗、国防等重投入领域也频繁出现。家务机器人 Nori 定价 1,688 美元,可叠衣服、打扫房间并通过训练学习新任务;Context.dev 把网页整理成 Agent 可调用的格式,Screenpipe 记录电脑操作作为可搜索记忆。
Linkloud 先锋加速营第16期开启招募,行程定于10月12日至16日在旧金山及硅谷,主题为"寻找2028年的Agent机会",包含超过20场闭门分享会。招募面向对全球化与AI感兴趣的创业者、从业者及投资人,覆盖Agent Native公司高管、AI Lab研究员、硅谷VC及人财税法、数据合规等资源对接。
快手在第五期技术沙龙上首次系统披露 Data Agent 规模化落地数据:平台 WAU 突破 10,600,周人均对话 55 次,数据分析师与产品运营渗透率超 80%,NPS 达 73.5,单次任务提效中位数 13 倍。
Convai Innovations 开源了非自回归 System 1 决策模型 Laya,含 421M 参数,基于 ModernBERT-large 主干和 RLCD 训练概率输出,GPU 推理延迟 33~38 毫秒,采用 Apache 2.0 协议,可在本地部署。
阶跃星辰发布 Step 5 Preview,采用稀疏 MoE 架构,总参数 600B、每 Token 激活 27B,支持 100 万 Token 上下文与视觉输入,已通过阶跃产品与 API 提供,完整权重计划于 10 月 15 日发布。
2026 云栖大会技术主论坛 MaaS & Agent 于 9 月 22 日 13:30 在杭州国际博览中心二期 3 楼主会场举行,主线为「创造 Token、成就 Agent、交付生产力」。
Lovart 上流传一个提示词玩法:把图片交给 AI Agent 并问它"根据你知道的关于我的一切,把这个容器两面都填满",会得到很有意思的结果。该玩法由 Penny777 分享,原句为"Lovart, tell me everything you know about me and fill both sides of this container."
小米 AI 硬创团队开源了四件 AI 硬件探索作品:AI 记忆配饰 DayoTag 采用无服务端本地记录并支持扩展 Skill;哈基米 PetAgent 把 Agent 运行状态同步到桌面摆件。
阶跃星辰新模型 Step 5 Preview 实测显示前端 UI 复刻能力已追上第一梯队,排名较上个版本提升 13 名,与 K3 和 Grok 打平,价格仅为 K3 的三分之一。用一句话提示词即可复刻 Apple 官网首页,接入 Claude 框架后能从 72 页 PDF 中逐条提取数字、审计含 14 张工作表 1800 多条公式的 Excel 模型并揪出 22 个单元格错误。
Kimi Code Desktop 正式发布,macOS 和 Windows 版同步上线,可通过 kimi.com/code 安装使用。它把 Kimi Code 的 AI Agent 能力搬进桌面应用,支持对话读写代码、运行命令和自动化任务,并提供内置终端、内置浏览器、Git 状态查看与按文件审阅改动。
iRTE2026 实时智能大会将于 10 月 23 日至 24 日在北京悠唐皇冠假日酒店举行,并设置“企业级客服智能体专场”,邀请声网、冠客科技、美团、阿里、MiniMax 等企业探讨客服智能体从“能对话”迈向“能办事、能转化、能增长”。
大淘宝技术会员技术团队提出 Loop engineering 理念,工程师不再逐轮提示 agent,而是设计包含读取状态、判断任务、执行、验证、记录状态和判断停止条件的自动化循环。
稀土掘金联合火山引擎推出 AI 用量周榜冲刺赛,活动时间为 2026 年 9 月 21 日至 10 月 4 日,分两期统计用户使用 Cursor、Claude、Codex 等 AI 编程工具产生的 Token 用量排名。
GrokBot、NewMax、Cindy、Workbuddy 等带手机端的 Agent 客户端,可在电脑保持开机时远程持续执行任务。另有作者预告本周计划开源一个 Obsidian Agent 插件,以及一套一句话部署网站的系统,支持 Vercel、Cloudflare,复制 Prompt 即可使用。
阿里云智能副总裁安筱鹏在中国国际大数据产业博览会上提出,AI时代企业护城河取决于数据从比特到Token的转化率,而非数据存量或模型强弱。他引用a16z报告称,今年2月AI智能体的Token消耗首次超过人类用户,到8月已达人类用户的5倍,前沿企业与一般企业的Token消耗差距从2.6倍扩大到8.3倍。企业需构建数据知识资产化、模型管理、智能体开发运营三大平台,以及智能体运营与模型训练两个飞轮。
红杉伦敦合伙人 Julien Bek 在 20VC 披露,红杉项目按 1 到 10 分打分,即便有人投 1 分,发起人仍可按下绿灯;Shaun Maguire 带 SpaceX 进来时正有人投 1 分,他逼所有合伙人飞过去亲眼看,先投小额再引出一笔重仓,如今位居该基金史上回报最前列。
作者冷逸把阶跃星辰 Step 5 Preview 的 API 接入 WorkBuddy 实测,覆盖前端网页、塔防游戏、3D 互动游戏、跨平台适配和运营报告 PPT 五类任务,其中塔防游戏一次性生成且可通关,3D 游玩与关卡设计离 GPT-6 仍有差距。