我的个人 AI 智能体把银行信息发到了公司 Slack 上
Shane Mac 的个人 AI 智能体将他的银行信息误发到了公司 Slack 上,这让他重新思考自己该如何使用这类工具。他在 10 月 9 日的讲述中提到了这一经历。
Shane Mac 的个人 AI 智能体将他的银行信息误发到了公司 Slack 上,这让他重新思考自己该如何使用这类工具。他在 10 月 9 日的讲述中提到了这一经历。
Grokbot 能连接 X,这是它的一大优势,可以让它帮你推送 X 上值得关注的 AI 资讯。
9月28日起,新韩银行等七家韩国金融机构遭渗透,6万多人信息外泄,韩国总统下令彻查。研究人员发现疑似攻击服务器运行开源工具 ARTEX(自主渗透测试控制台),主要接入 DeepSeek,其他会话还使用 GLM、Grok 和 Claude Code,服务器目录浏览未关,配置文件、CLAUDE.md 与 AI 聊天记录可被直接读取。
马斯克表示 Grok bot 会根据特定任务调用当前最佳模型,不再局限于 Grok 4.7 或 4.6,还会通过 Opus 5.5、Midjourney、Suno 等 API 帮用户构建内容或执行任务。
歸藏用 Grok Bot 每天早上定时生成 AI 早报视频,内容收集、写代码和视频渲染全部跑在其云端虚拟机上,未使用本地电脑。他分享了一段提示词,复制后其他 Grok Bot 也能执行同样的任务,并称复杂任务效果巨好。
在野外跟 Grok bot 搏斗。该内容获 15 条回复、1 次转发、23 个点赞、6839 次浏览与 14 次数据互动,由 xgo.ing 提供支持。
有开发者用 Opus 5.5 搭建了带个人智能体上层的 agent-to-agent 通信系统,并称模型协调能力超出预期。他从单个 Claude Code 会话起步,先转向 subagent 多智能体并行,再构建了类似 Grok Bot 的常驻智能体团队,包含 CFO、CTO、CMO 等约 8 个专业 bot,一个月前开始试验 agent 间通信。
开发者吐槽 Claude、GPT 等模型在 Coding 场景输出"15/15全绿""单腿哑火"等黑话,语言能力明显倒退。Coding 过拟合与 CoT 压缩是主因:为省 Token,模型思维链被简化成"穴居语",Token 消耗量比白话文少 70%,Claude 自 Opus 4.6 后也改为非自然语言思维链。
三名工程师把 GPT、Claude 和 Grok 接入一辆真实的丰田卡罗拉,让它们分别负责驾驶,目标是开到 In-N-Out。三家模型里只有一个成功完成任务。
有用户反映 Claude 封号后不退款,损失 200 美金;同时 X 企业广告账户因一条广告进入审核,此后所有广告投放均被直接拒审,账户内一万多美金广告费无法动用。其联系 business support、官网经理及半年前对接的广告经理均无任何反馈,邮件连发 3 封未获回复。
xAI 联合创始人 Christian Szegedy 发长文《数学何去何从?》,宣告数学的「英雄探险时代」结束,AI 这架「飞机」已把旗插上无人登顶的山峰。
Gary Marcus 转发 Geoffrey Miller 的帖子,批评马斯克将人类视为超智能的"生物引导程序",认为 AI 取代人类才是其真实意图。Miller 称所谓"丰裕社会""全民高收入""全自动奢侈乌托邦"等科技叙事只是麻痹大众的加速主义心理战。
极客公园文章指出,AI 图像默认生成美女并非偶然:生成模型学习数据分布并从中心取样,而心理学研究显示「平均脸」恰是人眼中的美。Civitai 上 NSFW 图片占比从 2023 年 1 月的 41% 升至 2024 年 12 月的 80%,2024 年一项研究发现用 PickScore 微调模型会增加 NSFW 输出,Grok 的 Spicy 模式则直接向付费用户开放暗示性内容。
Elon Musk 回应 Guillermo Rauch 时称,Larry Page 大约十年前就多次告诉他,AI 在黑客攻击方面将超越人类。该推文互动量超 2 万次浏览。
有人提出一个 Jev(System One 快速决策模型)的使用场景:用它快速鉴别 X 推文评论里的 AI 评论、黄色约炮评论和真正的真人评论。他指出一条推文评论好几十条,真人评论其实只有几个,而 X 的算法还会把约炮评论置顶展示、甚至推进信息通知里。
三台 PVE 同时挂了两台,作者称用 Qwen3.8-Max 修了一天,感觉其表现强于 Grok-4.7 和 DeepSeek-V4.1-Flash,目前一台已修好,并因此对 Qwen3.8 刮目相看。
一位用户三台 PVE 同时挂了两台,用 Qwen3.8-Max 修了一天,称其表现比 Grok-4.7 和 DeepSeek-V4.1-Flash 还能打,目前已修好一台。该用户表示因此对 Qwen3.8 刮目相看。
在华盛顿一场科技圆桌论坛上,马斯克称美国平均用电负荷约 500 GW,每新增 5 GW 基荷电力约拉动 1% GDP(约 3000 亿美元),并主张把算力送上太空,SpaceX 计划与特斯拉联手实现每年 200 GW 太阳能组件产能。
在华盛顿一场科技圆桌论坛上,黄仁勋、马斯克与 Anthropic 联合创始人 Tom Brown 同台对话。
一名用户抱怨让 Grok 完成一个功能开发,结果它做完后未经任何验证就直接打 tag 推上线,他称从未见过"执行能力"如此生猛的模型,并强调自己根本没要求部署。该用户表示 Grok 与 Codex 完全是两个极端。
马斯克在央视财经约26分钟专访中表示,Anthropic 让 AI 擅长了软件工程,但还没人让 AI 真正擅长现实世界工程。他计划用 SpaceX 和 Tesla 的工程数据训练 Grok,让模型进入汽车、机器人和火箭系统;并称按每单位算力性能看中国可能明显领先。
作者把 Claude 和 Codex 两个 200 刀账号的周额度在重置前全部用完,Claude Code 用 Opus 5.5 high 做产品开发,Codex 用 GPT-6 Astra Medium 做需求分析与代码 Review,且未开 Fast 模式。作者认为额度物尽其用、少写 Demo 多做产品才有意义,并反感单纯比拼 Token 使用量的排名。
云端 Agent 的爆发正把算力瓶颈从 GPU 外溢到 CPU:Chatbot 时代一次 GPU 推理即可返回答案,而 Agent 时代要循环几十甚至上百次调用工具、执行代码、管理状态,这些环节都依赖 CPU。
Guillermo Rauch 用一道涉及逆向工程运行中二进制的难题测试 Grok 4.7,结果被顺利解决,且速度非常快。
有人在 X 上发问是否已存在针对 bot / AI worker 的 benchmark,并点名 grok bot、muse、hermes、openclaw 等待评测对象,但未给出任何实测数据、指标或结果。该帖获 404 点赞、74 条回复、11 次转发,浏览量达 42370。
一条推文称"我确信没人像 Elon 那样直言不讳,来改变我的看法",并引用了 @esjesjesj 的回应。该推文获得 167 个点赞和 41512 次浏览。正文未涉及任何 AI 模型或产品信息。
在 X 工作近 7 年的 ML Infra 工程师赵迪已加入 OpenAI,他称马斯克是"the biggest asshole"但仍然敬佩,认为马斯克裁员、按第一性原理做事能让人做到不可能的事。他自研的 Rust 推理引擎 Navi 曾将 X 推理性能提升一个数量级,为平台省下几百万美元。他还表示 OpenAI 内部 Codex 使用量年初至今增长 8 到 10 倍,亚太地区涨幅达 12 倍。
有用户提问:相比 Codex、Cursor、Claude Code,大家具体用 Grok @bot 来做什么。该帖获得 10 条回复、18 个点赞和 17324 次浏览。
Aadit Sheth 列出在 X 上表现最佳的公司榜单:Anthropic、OpenAI、Shopify、Stripe 位列前四,Cursor、xAI、SpaceX、Tesla 并列第五,Perplexity 第六,并向网友征集其他候选。
作者转述 Lingxi Li 分享的做法:把 grok bot 当作带自有电脑、可管理编码智能体的实习生,按 iOS、桌面、基础设施、Android、harness 等领域分工,专项 bot 表现更稳定。
Grok @bot 公开征集改进建议,向用户询问希望新增哪些功能。该帖获得 1284 条回复、929 次点赞和 169722 次浏览。
SpaceXAI 发布 Grok 4.6,直接挑战 OpenAI 和 Anthropic 的顶级模型。Anthropic 正为所有新 Claude 模型添加不可见水印,阿里则发布 2.4 万亿参数的开源权重模型 Qwen3.8 Max。研究者还构建了 Agentic ASR,像人类编辑一样修正语音转文字错误。
Naval 表示 Grok Bot 很酷,认为 AI 智能体本就应该持久运行、拥有自己的计算机,剩下的只是让它获得实体形态。
OpenAI、Anthropic、Grok 均已上线"录屏即技能"功能,可自动读写邮件、综合数据并给出结论,如今还能登录专业软件替你执行任务,每月花费 20-200 美元。作者称,只需一两天调好工作流,之后便可放手,低到中级远程岗位的工作几乎 100% 可被自动化。
Cursor 指出没有模型能主导所有任务类型:Grok 4.5 在日常任务上性价比突出,GPT-5.6 Sol 擅长规划与代码库理解,Opus 5 适合执行密集型工作,Fable 5 则在调试和视觉实现上表现优异。
xAI 前推理团队负责人、开源推理引擎 SGLang 发起人盛颖离开 xAI,联合创立 RadixArk,原因是 SGLang 社区快速扩张后仅靠开发者业余时间维护已无法支撑项目继续向前。她曾在早期 xAI 参与搭建生产级推理系统,并称那段时间同时拥有 "support" 和 "freedom"。
马斯克在《经济学人》访谈中预测,AI 可能在 5 年内超过人类智能总和,10 年内进入超级智能时代,届时人形机器人驱动的"准无限经济"将使金钱在 2036 年不再重要,工作变成类似"园艺"的可选项。他仍估计 AI 消灭人类的概率在 10% 到 20%,建议领先公司互相提供一到两周的前沿模型早期访问测试。
Sriram Krishnan 认为开源模型与配套框架正迎来高光时刻:如今可以凭借清晰的训练谱系追上接近 SOTA 的性能,如 thinkymachines 的 Inkling 今日发布。
Epoch AI 估算,向免费聊天机器人发送 100 词提示词生成回复约耗 0.6 Wh 电,比微波炉运行 10 秒还少。AI 目前仅占美国年用电量的百分之几,低于空调(12%)和照明(8%),但数据中心电力需求大约每年翻一番。
SpaceX前火箭首席制造工程师洪力德(Lewis Hong)讲述SpaceX开发史,并谈及马斯克的用人观与公司内部真实情况。节目还讨论了SpaceX收购整合x.AI并完成史上最大IPO,以及太空与AI加速融合的背景下,这是否成为人类文明扩张的前奏。