让人类交出方向盘:特斯拉FSD十三年的冒险、争议与进化
特斯拉Cybercab今年9月在美国德州奥斯汀投入运营,车辆没有方向盘和脚踏板;截至9月22日,特斯拉在德州登记的Robotaxi车队总数增至476辆,其中67辆是Cybercab。
特斯拉Cybercab今年9月在美国德州奥斯汀投入运营,车辆没有方向盘和脚踏板;截至9月22日,特斯拉在德州登记的Robotaxi车队总数增至476辆,其中67辆是Cybercab。
Elena Verna 在演讲中提出 HI-IC(高影响力个人贡献者)概念:借助 AI,一个人可独立完成过去需要整个团队才能做的事。她在 Lovable 转做 IC 后薪资不变,可独立搭建定价页面、做原型、部署到生产并跑数据分析;其调查显示 51 位在职管理者中有 42 位想回到 IC 角色。她认为管理应是一条职业路径,而非一次晋升。
开源堡垒机 JumpServer 发布 v5.0.0,进入 V5 时代,核心变化是原生客户端可统一连接 SSH、RDP、Kubernetes、数据库和 Web 站点等资产。
一位市场人员将重复的活动运营工作做成了一个可自动运行的 GitHub Issue 表单,交给 GitHub Copilot 完成自动化。该做法发布在 GitHub 博客的 AI and ML 栏目,帖子获 150 次点赞、32 条评论。
Vercel 域名搜索现已无需认证,尤其适合 AI 智能体调用。用户可通过 Vercel CLI 按关键词搜索域名,并通过 API 批量检查最多 200 个域名。
Anthropic 的 Thariq Shihipar 详解 Claude Code 的未来方向:Claude Mods 让开发者自定义整个 Claude Code harness,Claude.md 可能最终消失,可变软件或将改变应用构建方式。
Anthropic 发布 Claude Sonnet 5.5,距 Opus 5.5 发布不到一周。在 Terminal-Bench 4.0 编程评测中,Sonnet 5.5 的 Max 档从上一代 Sonnet 5 的 10.3% 提升到 70.6%。
梳理了 Sonnet 5.5 在编程与知识工作评测上的具体提升幅度、推理档位差异和官方迁移建议,便于对照选型。
Perplexity 为 Agent API 新增 Profiles、Skills 和托管连接器。Profile 是一个保存好的智能体,把模型、指令、工具、连接器、运行设置配置在一个带版本号的 ID 下,项目管理员配置一次后,项目内每位开发者都能用自己的应用和项目 API key 调用。
9 月 28 日,Manus 面向海外用户发布 2.0 版本,并推出面向个人生活场景的智能助理 Cue,上线不到 12 小时已有用户用它打电话、做机器人游戏、多 Agent 协作规划迪拜旅行等。
月活百万的 AI 热点资讯网站 AIHOT 正式开源,同时上线重写后的 2.0 版本,代码仓库为 https://github.com/KKKKhazix/AIHOT。
OpenAI 的 GPT-6.1 Sol 现已在 Vercel AI Gateway 上线,相较 GPT-6 Sol 在编码、电脑操作和专业工作(如阅读复杂文档、执行多步工作流)上有所提升。
腾讯技术工程提出一套 Agent 自进化方法论,把评测、记忆、落地、控制四个环节作为同一闭环的四个齿轮,主张自进化的瓶颈不在单个技术点,而在环节之间的数据通路是否连通。
Manus 2.0 正式发布,换上自研 Cascade 框架,按需加载专业能力以降低 Token 消耗,并新增事件触发的自动化任务与可独立购买的云电脑。桌面端升级为 Manus Studio,加入视频编辑与 Alchemy 模式,游戏开发环境可发布为网站分享;同时推出面向个人生活的独立应用 Cue,每个 Agent 拥有自己的邮箱、电话号码、钱包和电脑。
Augment Code 宣布 Anthropic 的 Claude Sonnet 5.5 已在其 Cosmos 中可用。接下来几天,他们会把智能体循环中的旧版 Sonnet 模型替换为 Claude Sonnet 5.5,并跟踪它如何改变其软件工厂的产出。
一个不聊天、不写文章、只做判断与排序的模型 Jev 近期在 AI 圈刷屏,被讨论为「关节模型」——介于规则与泛化之间,主打更快、更便宜。播客「开始连接 LinkStart」邀请 APUS AI 首席科学家张旭、前硅基流动联合创始人杨攀和 Parall Cofounder 余华亨,从模型原理、适用场景与产业趋势探讨 Jev 为何爆火,以及 AI 服务对象从「人」转向「程序」后可能带来的分工变化。
Harrison Chase 提出 AI 智能体 harness 的三阶段演进路径:coding harness、personal harness,再到 org harness,并称仍在确定这一阶段的最终命名,公开征集建议。
Fireworks 发布首个路由模型 FireRouter with Opus,常规任务交给顶级开源模型,其余由 Claude Opus 处理,并支持缓存与任务感知路由。官方称在编码会话中达到 Opus 98.1% 的准确率,单次会话成本降低 57%。
Manus 2.0 发布,1.0 曾启发整个 Agent 时代的产品,在 2.0 阶段选择视频、游戏作为生产力的核心场景。个人 Agent 方面获得身份信息,包括邮箱、电话、支付,以及一个连接 Agent 的网络,同时引入微信的小程序逻辑,每个二维码都是一个 Agent。作者提到其海外主要竞争对手目前是 Muse,国内最适合做 Muse 的是腾讯,而 Manus 的股东就是腾讯。
Harrison Chase 认为每个智能体都需要沙箱,harness 应放在沙箱之外,把“大脑”和“手”分离。他提到 NVIDIA 开源了相关沙箱工具,并认同 Andrew Ng 的说法,即这属于 harness 的一部分而非外挂组件。
这段发布视频由 Manus Studio 生成,@Nin19536 做了部分人工润色。发布者称三个月前还不会相信 AI 智能体能做出这样的发布视频。
Character.AI 上线 ShortSqueak 和 PipSqueak 3 两款免费 Chat Styles,ShortSqueak 主打简短回复、快节奏斗嘴与短信式休闲角色扮演,PipSqueak 3 则强化角色扮演的智能与沉浸感并减少格式错误。两者均支持 Lorebooks,c.ai+ 会员还可使用 Style Control。
Manus 2.0 现已支持构建游戏,官方称操作极为简单。团队在推文中展示了数十款用 Manus 制作的可玩游戏、提示词与演示。
Manus 2.0 现在可以构建游戏,官方称操作非常简单。官方在推文串中展示了用 Manus 制作的数十款游戏、提示词和可玩演示。
LlamaIndex 探索了 Jev 及同类模型在文档解析任务上的早期方案,涉及方向检测、语言检测、路由等任务。文档解析需要大量即时决策。
Replit 将举办一场名为 Just Ask Replit 的直播,探讨知识工作的未来:实时数据、可视化与自动化都在 agent chat 内完成,无需搭建仪表盘,也无需排队等工程资源。直播时间为周二上午 9 点 PT,在 YouTube、LinkedIn 和 X 同步进行。
Claude 官方账号展示了一组对比:给 Sonnet 5 与 Sonnet 5.5 同一个提示词,分别用 JavaScript 生成不到一分钟讲完恐龙史的动画,由 @kevin_t_ngo 创作。该演示发布在 Twitter 上,获得 693 个点赞、23 次转发和约 28 万次浏览。
Cognition 转述 Anthropic 的数据:Sonnet 5.5 的 token 价格与 Sonnet 5 保持一致,但输出生成速度提升超过 30%,单任务成本最多降低 30%。同一价格下的速度与成本变化,对使用 Claude 驱动编码智能体的团队更直接。
Cursor 宣布 Sonnet 5.5 现已在 Cursor 中可用。官方称其表现强劲,在许多任务上与 Opus 相当。
吴恩达宣布其开源智能体框架 OpenWorker 将支持 NVIDIA 开源的智能体沙箱工具,基于 NVIDIA OpenShell 把每个智能体的命令放进沙箱内运行。
Anthropic 发布中杯 Sonnet 5.5 模型,作者称其在 Agentic Coding 测评中分数比自家大杯 Opus 5.5 更高,其他分数与 Opus 5.5 相差无几,而定价不到 Opus 5.5 的一半、只有 GPT-6-Astra 的四分之一。
Manus Studio 上线最新 Alchemy 视频创作模式,官方称很适合用来制作发布视频,并透露 Cue 的发布视频就是 Manus 自己做的。有用户用这几天写的 Skills 尝试为 Cue 制作宣传片。
Notion Agents 应用推出全新设计的侧边栏,由设计师 Laura Sandoval 设计,目前正在逐步推送。该侧边栏已随 iOS 版 Notion Agents 应用发布。
NVIDIA 与 100 多家行业伙伴推出 Open Agent Safety Platform,整合 OpenShell 与 Sentry,目标是构建安全智能体系统的信任层。黄仁勋称这不只是一款产品,而是一个开放生态的开端,安全与创新并不冲突,信任是 AI 经济的基础。
Perplexity 正在招募安全工程师,Kyle Polley 称团队正在构建并测试让 AI 智能体更安全可靠的系统,邀请擅长攻破系统、搭建防护栏的工程师加入,并可用前沿 AI 辅助攻防两端工作。
Anthropic 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,官方称其相较 Sonnet 5 提速超过 30%,多数工作成本最多降低 30%。在 Claude Code 中,用户完成任务量比 Sonnet 5 多约 30%,且完成同样工作所需 token 更少;演示中用工具调用扫落叶时比 Sonnet 5 快 24 秒、少用 6K token。
原文给出 Claude Sonnet 5.5 在 Claude Code 中的任务完成量、速度与 token 消耗变化,可据此判断升级收益。
Anthropic 的 Claude Sonnet 5.5 现已在 GitHub Copilot 中正式可用,面向构建功能、修复 bug 等范围明确的日常工作。GitHub 称早期测试中它在编码任务上与 Sonnet 5 表现相当,但使用的步骤、token 和工具调用明显更少,完成任务的速度也更快。用户可在 GitHub Copilot app、CLI 和 code 中试用。
HeyGen 称其找到 Jev 的最佳用法是放在 HeyGen MCP 前面:Jev 以毫秒级速度、极低成本判断哪些线索值得生成视频,再由 HeyGen 渲染通过筛选的线索。
AI SDK 已支持通过 Anthropic 和 Claude 接入,相关说明见 ai-sdk.dev 的 AI SDK 提供商文档。该消息由 AI SDK 官方账号发布,并同时 @AnthropicAI、@claudeai 与 @vercel。
Claude 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,相比 Sonnet 5 运行速度快 30% 以上,多数任务的成本最多降低 30%。AI SDK 表示可以在 AI SDK 中使用 Claude Sonnet 5.5。
Cognition 表示,模型独立性让 Devin 能针对每部分工作调用最合适的模型,并持续优化其外层 harness:单次调用批量处理更多工作、并行执行更多动作、充分利用缓存上下文。最新模型与 harness 改进带来了更好的性价比。