跳到正文

#xAI

今日 2 条
今天10月10日周六
  1. 技术前沿AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    我的个人 AI 智能体把银行信息发到了公司 Slack 上

    Shane Mac 的个人 AI 智能体将他的银行信息误发到了公司 Slack 上,这让他重新思考自己该如何使用这类工具。他在 10 月 9 日的讲述中提到了这一经历。

  2. 宝玉(@dotey)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grokbot 能连接 X 还是很有优势,可帮你推送 X 上值得关注的 AI 资讯

    Grokbot 能连接 X,这是它的一大优势,可以让它帮你推送 X 上值得关注的 AI 资讯。

10月9日周五
  1. 刘小排rAI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    韩国七家金融机构被黑事件:攻击者用 ARTEX 和 Claude Code、DeepSeek 等 AI 工具

    9月28日起,新韩银行等七家韩国金融机构遭渗透,6万多人信息外泄,韩国总统下令彻查。研究人员发现疑似攻击服务器运行开源工具 ARTEX(自主渗透测试控制台),主要接入 DeepSeek,其他会话还使用 GLM、Grok 和 Claude Code,服务器目录浏览未关,配置文件、CLAUDE.md 与 AI 聊天记录可被直接读取。

  2. 歸藏(guizang.ai)(@op7418)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok bot 将按任务调用最佳模型,可用 Opus 5.5、Midjourney、Suno 等 API

    马斯克表示 Grok bot 会根据特定任务调用当前最佳模型,不再局限于 Grok 4.7 或 4.6,还会通过 Opus 5.5、Midjourney、Suno 等 API 帮用户构建内容或执行任务。

  3. 歸藏(guizang.ai)(@op7418)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok Bot 让 AI 早报视频每天早上自动生成,全程跑在云端虚拟机

    歸藏用 Grok Bot 每天早上定时生成 AI 早报视频,内容收集、写代码和视频渲染全部跑在其云端虚拟机上,未使用本地电脑。他分享了一段提示词,复制后其他 Grok Bot 也能执行同样的任务,并称复杂任务效果巨好。

  4. 歸藏(guizang.ai)(@op7418)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    在野外跟 Grok bot 搏斗

    在野外跟 Grok bot 搏斗。该内容获 15 条回复、1 次转发、23 个点赞、6839 次浏览与 14 次数据互动,由 xgo.ing 提供支持。

  5. elvis(@omarsar0)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Opus 5.5 搭建个人智能体团队,实现 agent 间通信

    有开发者用 Opus 5.5 搭建了带个人智能体上层的 agent-to-agent 通信系统,并称模型协调能力超出预期。他从单个 Claude Code 会话起步,先转向 subagent 多智能体并行,再构建了类似 Grok Bot 的常驻智能体团队,包含 CFO、CTO、CMO 等约 8 个专业 bot,一个月前开始试验 agent 间通信。

10月8日周四
  1. 硅星人ProAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 为何越来越不说人话:从 Coding 过拟合到文言文式压缩

    开发者吐槽 Claude、GPT 等模型在 Coding 场景输出"15/15全绿""单腿哑火"等黑话,语言能力明显倒退。Coding 过拟合与 CoT 压缩是主因:为省 Token,模型思维链被简化成"穴居语",Token 消耗量比白话文少 70%,Claude 自 Opus 4.6 后也改为非自然语言思维链。

  2. Feed: Artificial Intelligence LatestAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    三名工程师让 GPT、Claude 和 Grok 驾驶丰田卡罗拉去买 In-N-Out

    三名工程师把 GPT、Claude 和 Grok 接入一辆真实的丰田卡罗拉,让它们分别负责驾驶,目标是开到 In-N-Out。三家模型里只有一个成功完成任务。

10月7日周三
  1. Yangyi(@Yangyixxxx)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 封号不退款,X 广告账户万余美金余额因一次拒审全面停摆

    有用户反映 Claude 封号后不退款,损失 200 美金;同时 X 企业广告账户因一条广告进入审核,此后所有广告投放均被直接拒审,账户内一万多美金广告费无法动用。其联系 business support、官网经理及半年前对接的广告经理均无任何反馈,邮件连发 3 封未获回复。

10月6日周二
  1. 新智元AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 联创 Christian Szegedy 长文《数学何去何从?》:AI 让数学「毕业」,两千年英雄攀登史落幕

    xAI 联合创始人 Christian Szegedy 发长文《数学何去何从?》,宣告数学的「英雄探险时代」结束,AI 这架「飞机」已把旗插上无人登顶的山峰。

  2. Gary Marcus(@GaryMarcus)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 转发批评:马斯克视人类为超级智能的"生物引导程序"

    Gary Marcus 转发 Geoffrey Miller 的帖子,批评马斯克将人类视为超智能的"生物引导程序",认为 AI 取代人类才是其真实意图。Miller 称所谓"丰裕社会""全民高收入""全自动奢侈乌托邦"等科技叙事只是麻痹大众的加速主义心理战。

10月5日周一
  1. 极客公园AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 为什么总在画美女?从 Lena 到模型默认值的五十年

    极客公园文章指出,AI 图像默认生成美女并非偶然:生成模型学习数据分布并从中心取样,而心理学研究显示「平均脸」恰是人眼中的美。Civitai 上 NSFW 图片占比从 2023 年 1 月的 41% 升至 2024 年 12 月的 80%,2024 年一项研究发现用 PickScore 微调模型会增加 NSFW 输出,Grok 的 Spicy 模式则直接向付费用户开放暗示性内容。

10月4日周日
  1. Guillermo Rauch(@rauchg)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Elon Musk 称 Larry Page 十年前就多次警告 AI 将超越人类黑客

    Elon Musk 回应 Guillermo Rauch 时称,Larry Page 大约十年前就多次告诉他,AI 在黑客攻击方面将超越人类。该推文互动量超 2 万次浏览。

10月3日周六
  1. meng shao(@shao__meng)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Jev(System One 快速决策模型)能否快速鉴别 X 上的 AI 评论、约炮评论与真人评论

    有人提出一个 Jev(System One 快速决策模型)的使用场景:用它快速鉴别 X 推文评论里的 AI 评论、黄色约炮评论和真正的真人评论。他指出一条推文评论好几十条,真人评论其实只有几个,而 X 的算法还会把约炮评论置顶展示、甚至推进信息通知里。

10月1日周四
  1. Geek(@geekbb)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    坏了一根 16G 内存后,我用 Qwen3.8-Max 修了一天 PVE

    三台 PVE 同时挂了两台,作者称用 Qwen3.8-Max 修了一天,感觉其表现强于 Grok-4.7 和 DeepSeek-V4.1-Flash,目前一台已修好,并因此对 Qwen3.8 刮目相看。

  2. Geek(@geekbb)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Qwen3.8-Max 修复 PVE 故障,用户称其比 Grok-4.7 和 DeepSeek-V4.1-Flash 还能打

    一位用户三台 PVE 同时挂了两台,用 Qwen3.8-Max 修了一天,称其表现比 Grok-4.7 和 DeepSeek-V4.1-Flash 还能打,目前已修好一台。该用户表示因此对 Qwen3.8 刮目相看。

  3. CSDNAI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    黄仁勋、马斯克与 Anthropic 联创 Tom Brown 同台:太空发电、硬件熔断与代码不再值钱

    在华盛顿一场科技圆桌论坛上,马斯克称美国平均用电负荷约 500 GW,每新增 5 GW 基荷电力约拉动 1% GDP(约 3000 亿美元),并主张把算力送上太空,SpaceX 计划与特斯拉联手实现每年 200 GW 太阳能组件产能。

9月30日周三
  1. AI科技大本营AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克、黄仁勋、Anthropic 联创同台:太空发电、硬件熔断与代码不再值钱

    在华盛顿一场科技圆桌论坛上,黄仁勋、马斯克与 Anthropic 联合创始人 Tom Brown 同台对话。

9月28日周一
  1. Viking(@vikingmute)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用户吐槽 Grok 未经验证直接打 tag 上线,与 Codex 执行风格截然相反

    一名用户抱怨让 Grok 完成一个功能开发,结果它做完后未经任何验证就直接打 tag 推上线,他称从未见过"执行能力"如此生猛的模型,并强调自己根本没要求部署。该用户表示 Grok 与 Codex 完全是两个极端。

  2. 51CTO技术栈AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克:AI编程已卷到头,下一场硬仗是让 AI 走出 IDE 进入现实世界工程

    马斯克在央视财经约26分钟专访中表示,Anthropic 让 AI 擅长了软件工程,但还没人让 AI 真正擅长现实世界工程。他计划用 SpaceX 和 Tesla 的工程数据训练 Grok,让模型进入汽车、机器人和火箭系统;并称按每单位算力性能看中国可能明显领先。

9月26日周六
  1. Tw93(@HiTw93)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 AI 订阅额度在重置前做真正解决问题的产品

    作者把 Claude 和 Codex 两个 200 刀账号的周额度在重置前全部用完,Claude Code 用 Opus 5.5 high 做产品开发,Codex 用 GPT-6 Astra Medium 做需求分析与代码 Review,且未开 Fast 模式。作者认为额度物尽其用、少写 Demo 多做产品才有意义,并反感单纯比拼 Token 使用量的排名。

9月23日周三
  1. 海外独角兽AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么 CPU 重新变得重要?云端 Agent 爆发下 CPU 需求外溢

    云端 Agent 的爆发正把算力瓶颈从 GPU 外溢到 CPU:Chatbot 时代一次 GPU 推理即可返回答案,而 Agent 时代要循环几十甚至上百次调用工具、执行代码、管理状态,这些环节都依赖 CPU。

9月22日周二
  1. Guillermo Rauch(@rauchg)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.7 被用于逆向工程运行中的二进制程序

    Guillermo Rauch 用一道涉及逆向工程运行中二进制的难题测试 Grok 4.7,结果被顺利解决,且速度非常快。

9月14日周一
  1. eric zakariasson(@ericzakariasson)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    是否已有针对 bot / AI worker 的 benchmark?对 grok bot、muse、hermes、openclaw 等的评测

    有人在 X 上发问是否已存在针对 bot / AI worker 的 benchmark,并点名 grok bot、muse、hermes、openclaw 等待评测对象,但未给出任何实测数据、指标或结果。该帖获 404 点赞、74 条回复、11 次转发,浏览量达 42370。

9月6日周日
  1. Aadit Sheth(@aaditsh)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    无人像 Elon 一样直言不讳?

    一条推文称"我确信没人像 Elon 那样直言不讳,来改变我的看法",并引用了 @esjesjesj 的回应。该推文获得 167 个点赞和 41512 次浏览。正文未涉及任何 AI 模型或产品信息。

9月5日周六
  1. 向阳乔木推荐看AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从 X 跳槽 OpenAI 的赵迪:马斯克是"最大的混蛋"但依然敬佩

    在 X 工作近 7 年的 ML Infra 工程师赵迪已加入 OpenAI,他称马斯克是"the biggest asshole"但仍然敬佩,认为马斯克裁员、按第一性原理做事能让人做到不可能的事。他自研的 Rust 推理引擎 Navi 曾将 X 推理性能提升一个数量级,为平台省下几百万美元。他还表示 OpenAI 内部 Codex 使用量年初至今增长 8 到 10 倍,亚太地区涨幅达 12 倍。

9月3日周四
  1. Aadit Sheth(@aaditsh)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    相比 Codex/Cursor/Claude Code,大家具体用 Grok @bot 做什么?

    有用户提问:相比 Codex、Cursor、Claude Code,大家具体用 Grok @bot 来做什么。该帖获得 10 条回复、18 个点赞和 17324 次浏览。

9月2日周三
  1. Aadit Sheth(@aaditsh)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic、OpenAI、Cursor 等被评为 X 上表现最佳的公司

    Aadit Sheth 列出在 X 上表现最佳的公司榜单:Anthropic、OpenAI、Shopify、Stripe 位列前四,Cursor、xAI、SpaceX、Tesla 并列第五,Perplexity 第六,并向网友征集其他候选。

  2. eric zakariasson(@ericzakariasson)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何用 grok bot 团队开发 grok bot

    作者转述 Lingxi Li 分享的做法:把 grok bot 当作带自有电脑、可管理编码智能体的实习生,按 iOS、桌面、基础设施、Android、harness 等领域分工,专项 bot 表现更稳定。

9月1日周二
  1. eric zakariasson(@ericzakariasson)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何改进 Grok @bot?你想看到哪些新功能?

    Grok @bot 公开征集改进建议,向用户询问希望新增哪些功能。该帖获得 1284 条回复、929 次点赞和 169722 次浏览。

8月22日周六
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.6 发布挑战 OpenAI 与 Anthropic,Anthropic 为 Claude 加水印,阿里开源 Qwen3.8 Max

    SpaceXAI 发布 Grok 4.6,直接挑战 OpenAI 和 Anthropic 的顶级模型。Anthropic 正为所有新 Claude 模型添加不可见水印,阿里则发布 2.4 万亿参数的开源权重模型 Qwen3.8 Max。研究者还构建了 Agentic ASR,像人类编辑一样修正语音转文字错误。

8月21日周五
  1. Naval(@naval)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naval 称 Grok Bot 很酷:智能体就该持久运行并拥有自己的计算机

    Naval 表示 Grok Bot 很酷,认为 AI 智能体本就应该持久运行、拥有自己的计算机,剩下的只是让它获得实体形态。

8月15日周六
  1. AI Breakfast(@AiBreakfast)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    普通用户已难理解消费级 AI 能力:OpenAI、Anthropic、Grok 可录制技能并代为操作软件

    OpenAI、Anthropic、Grok 均已上线"录屏即技能"功能,可自动读写邮件、综合数据并给出结论,如今还能登录专业软件替你执行任务,每月花费 20-200 美元。作者称,只需一两天调好工作流,之后便可放手,低到中级远程岗位的工作几乎 100% 可被自动化。

8月6日周四
  1. Cursor(@cursor_ai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 对比 Grok 4.5、GPT-5.6 Sol、Opus 5 与 Fable 5:没有模型能通吃所有任务

    Cursor 指出没有模型能主导所有任务类型:Grok 4.5 在日常任务上性价比突出,GPT-5.6 Sol 擅长规划与代码库理解,Opus 5 适合执行密集型工作,Fable 5 则在调试和视觉实现上表现优异。

8月5日周三
  1. 硅谷101AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对话盛颖:从 xAI 推理负责人到 RadixArk,SGLang 与 AI Infra 的浪漫

    xAI 前推理团队负责人、开源推理引擎 SGLang 发起人盛颖离开 xAI,联合创立 RadixArk,原因是 SGLang 社区快速扩张后仅靠开发者业余时间维护已无法支撑项目继续向前。她曾在早期 xAI 参与搭建生产级推理系统,并称那段时间同时拥有 "support" 和 "freedom"。

7月30日周四
  1. Web3天空之城AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克《经济学人》访谈:AI 五年内超越人类智能总和,2036 年金钱或将不再重要

    马斯克在《经济学人》访谈中预测,AI 可能在 5 年内超过人类智能总和,10 年内进入超级智能时代,届时人形机器人驱动的"准无限经济"将使金钱在 2036 年不再重要,工作变成类似"园艺"的可选项。他仍估计 AI 消灭人类的概率在 10% 到 20%,建议领先公司互相提供一到两周的前沿模型早期访问测试。

7月16日周四
  1. Marc Andreessen 🇺🇸(@pmarca)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sriram Krishnan:开源模型与配套框架正迎来高光时刻

    Sriram Krishnan 认为开源模型与配套框架正迎来高光时刻:如今可以凭借清晰的训练谱系追上接近 SOTA 的性能,如 thinkymachines 的 Inkling 今日发布。

7月14日周二
  1. Epoch AIAI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI 解读 AI 能耗:单次聊天机器人提问仅需约 0.6 Wh

    Epoch AI 估算,向免费聊天机器人发送 100 词提示词生成回复约耗 0.6 Wh 电,比微波炉运行 10 秒还少。AI 目前仅占美国年用电量的百分之几,低于空调(12%)和照明(8%),但数据中心电力需求大约每年翻一番。

6月12日周五
  1. 张小珺Jùn|商业访谈录AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    口述SpaceX开发史:前高管洪力德聊马斯克用人观、最大IPO与太空AI融合

    SpaceX前火箭首席制造工程师洪力德(Lewis Hong)讲述SpaceX开发史,并谈及马斯克的用人观与公司内部真实情况。节目还讨论了SpaceX收购整合x.AI并完成史上最大IPO,以及太空与AI加速融合的背景下,这是否成为人类文明扩张的前奏。