第 9 份年度《State of AI》报告发布:涵盖 AI 构建 AI、世界模型、Physical AI、地缘政治与网络防御
第 9 份年度《State of AI》报告发布,涵盖 AI 如何构建更强的 AI、世界模型、Physical AI、地缘政治、网络防御,以及对未来 12 个月的预测。发布方为 AI Will(@FinanceYF5),具体发现以报告正文为准。
第 9 份年度《State of AI》报告发布,涵盖 AI 如何构建更强的 AI、世界模型、Physical AI、地缘政治、网络防御,以及对未来 12 个月的预测。发布方为 AI Will(@FinanceYF5),具体发现以报告正文为准。
Olivia Moore 在与 Town 和 Gamma 团队交流后,总结了 5 条打造消费级 AI 产品的重要经验。其中一条核心路径是:先让个人用户爱上产品,再由他们把产品带进公司,这可能是消费级 AI 最有效的增长方式。
试图在模型实验室擅长的领域正面击败它们往往是个错误,用更少资源复制相同路线不如选择能打开市场的独特切入点或专注服务某类客户。对 Town 而言,这个切入点就是多人协作。
Olivia Moore 与 TownAI 的 @jgreze、Gamma 的 Deeni Fathia 讨论了消费级 AI 业务的打法:消费者不太可能直接为 AI 付费,但可把消费端当作低成本企业获客漏斗。Gamma 目前用户已超 100M,并用约 3 个月重建并重新上线产品;对团队级采用的产品,按团队共享 token 是一种定价思路。
AI 创业公司当前最难招的岗位,是既长期泡在网上熟悉趋势、又有品味和内容创作能力,同时懂 AI 技术、还能高质量落地执行的人。这类人极为稀缺。
腾讯研究院联合 WorkBuddy、腾讯基金会、腾讯学堂、清华大学可持续社会价值研究院、益盒 Charity Box 发起「AI & Society 大哉问」系列第三期直播,10 月 9 日(周五)20:00 开播,主题为 AI 与教育普惠。
文章指出,2025 年 5 月 Anthropic 把向量搜索从 Claude Code 中移除,改用 grep,作者 Boris Cherny 称结果全面胜出且优势很大;此后 Cursor、Windsurf、Cline、Devin、Sourcegraph Amp 相继转向工具驱动的 agentic 检索。
2026年诺贝尔奖生理学或医学奖授予光遗传学三位奠基人,物理学奖由82岁哈尔岑独享、表彰其推动南极冰立方中微子天文台建成,化学奖颁给卡甘与硖合宪三的手性分子研究。开奖前德国媒体让ChatGPT、Gemini等9款主流AI模型预测获奖名单,结果在物理、化学、生理学或医学三个奖项上大多预测错误,微软Copilot甚至把奖项颁给已故科学家、ChatGPT预测了并不存在的诺贝尔数学奖。
阿里云智能集团副总裁安筱鹏在2026云栖大会汽车行业峰会上提出,AI正同步重构汽车产业的经济模型、产品形态与竞争规则,使行业呈现高固定成本、低边际成本特征。全球汽车产业利润池中传统业务占比将从2021年的90%降至2035年的44%,Robotaxi市场年复合增长率超88%,2035年规模达1300亿~4150亿美元。自动驾驶、智能座舱、AI生产力由此成为三大竞技场。
刘润在新书《高效能工作法》中提出,决定收入差距的不是效率而是效能——把7小时压缩到5小时是效率,判断这7小时该不该花才是效能。他给出效能公式:效能 = 时间 × 个人杠杆 × 团队杠杆,个人杠杆靠获得新能力、提炼规律、用好AI工具和职业化修炼,团队杠杆则需通过别人拿结果、把经验沉淀为PDCA流程与责权利对等的制度。
Pyromind 押注 RSI 产业化的早期形态出现在企业 Agent 上线后的持续学习,用 AutoRL 和 Reward Data Flywheel 把真实任务反馈转化为可训练、可评估的模型能力。
OpenAI发布700多份数学手稿后,人类数学协会发声明呼吁数学家停止与其合作,菲尔兹奖得主陶哲轩在个人博客转载了该声明,后被误传为领衔发起。争议焦点在于722篇论文中仅162篇主要结果经过计算机验证,OpenAI次日撤下3篇手稿、修订14篇,并在GitHub仓库README中承认部分未形式化结果可能存在问题。
Contra Labs 发布《Creative Intelligence Report 2026》,问卷覆盖15万名以上在职创意专业人士、数据依托200万以上创作者,显示超过70%的创意人每天都在用 AI,善用 AI 者单个项目规模平均增长40%以上。
今年AI人才招聘规模增长7.9倍,在招岗位中三四成已是AI相关岗位,预训练、后训练、推理优化等方向的稀缺基础模型人才刚毕业就能拿到数百万元乃至千万元年薪。企业真正缺的不是懂模型的人,而是能判断AI该介入哪个业务卡点、把AI嵌入真实产品流程并验证业务价值的产品经理,理解大模型、RAG、智能体的能力边界正是这类能力的基础。
10 月 8 日发布的《State of AI Report 2026》指出,OpenAI 与 Anthropic 今年 5 月组建企业部署服务公司,前线工程师进入客户现场把模型接入业务系统并持续维护。
于红离开深耕 15 年的 VC 行业、创办线上 SEL 教育产品兔咚咚后,用“林迪效应”回答 AI 时代该学什么:存在越久的能力越不会过时,语文重要性最高,英语只需学到日常可用的 60-80 分,编程对多数普通孩子不必大量投入。她把 SEL 梳理为 6 大维度、12 大能力,核心第一步是接纳情绪,孩子上课后发脾气时间变短、频率降低,对情绪的识别与理解明显提升。
Netflix 可观测性团队介绍其本体驱动的端到端知识图谱实践,用以将可观测性从被动监控转为主动洞察引擎。Netflix 峰值达 6500 万并发流、日均超 20 亿请求、每秒超 3800 万条实时日志事件,团队希望自动发现问题、按用户影响排序并自动定位根因。
有用户在社交平台吐槽 GPT6.1sol,称其是当期最垃圾的模型,该帖获得 93 条评论、179 次点赞和 7.7 万次浏览。原文未给出具体评测数据或对比依据。
据外媒报道,Anthropic 瞄准 11 月中旬上市,路演最快可能从 11 月 9 日当周启动;9 月曝光的招股书显示去年收入 45.9 亿美元、净亏损 420 亿美元,已承诺的算力和基础设施支出累计达 5180 亿美元。
Business Insider 资深记者 Katie Notopoulos 撰文称,她对 AI 智能体的期待不是充当行政助理,而是像妻子一样打理生活。文章为个人观点的评论,未涉及具体模型或产品。
Amazon 表示其意外走红的「About You」用户画像页面并未使用外部数据,仅基于用户在本平台的购物与浏览行为生成。这些页面因对顾客的调侃式描述而病毒式传播,Amazon 同时给出了用户自行编辑或关闭该画像的方法。
Meshy.ai 创始人、CEO 胡渊鸣在公司 ARR 突破1亿美元后,写下48条创业反思,分"温度与原则""时间与 Founder Mode""AI 与人""团队与管理""战略与执行"五个板块。他提出管理者不能"惩罚责任心",创始人不应向下属索取情绪价值;并称公司几乎无限 Token,但面试仍要求手写代码。
Ray Dalio 表示,AI 投资热潮正与政府大规模借贷一起加剧对资本的争夺,股市的容错空间正在收窄。
经历前一交易日科技股领跌的抛售后,美股股指期货上涨,油价走低与 AI 板块情绪回暖共同提振市场。
AI安全高度依赖模型的「拒绝」能力,但这一机制既不可靠也可能被滥用。文章梳理了拒绝行为的训练方式与高维激活空间原理,并指出分类器叠加的「瑞士奶酪模型」存在漏洞,过度拒绝已导致正常提问被误拦;同时OpenAI与阿联酋等国家的合作、Anthropic与Google等模型对威权政府相关提问的差异化拒绝,都显示拒绝正在成为审查工具。
菲尔兹奖得主陶哲轩牵头人类数学协会(AHM)发布联合声明,全面抵制OpenAI,敦促数学家停止与其合作。起因是OpenAI发布700多份机器生成的数学证明文件,动用内部模型测试约8000个开放数学问题,命中率约5%。声明指责其无视数学与人工智能咨询小组(AGMAI)的红线警告,缺乏同行评审与人类可读逻辑;图灵奖得主杨立昆则持相反态度,认为形式证明自动化将开启数学新时代。
有用户吐槽 ChatGPT 在复杂需求上表现很差:原地打转、主观能动性不足,需不断催促才继续干活,产出多为半成品,还常推翻自己最早方案导致补丁代码堆积。该用户称其表达不像人话、需反复解释,加上 computer use 后 token 消耗飞快,正考虑取消订阅。
一条讨论 AI 电影是否算得上艺术的推文引发关注,获得 151 次点赞、14 次转发和 8.4 万余次浏览,并附带一段视频。原文未给出具体结论或涉及的 AI 视频模型名称。
Charles Curran 在 X 上发布一段 AI 生成影片,并反问"如果你认为 AI 电影不能成为艺术,那就解释一下这个"。该帖附带视频,获 1 次点赞、469 次浏览,未展示具体使用的模型或工具。
Similarweb 数据显示,Muse 上线不到一个月,全球 DAU 持续攀升,并于 10 月 5 日达到 218.2 万的新高。
LangSmith evals 中的 Jev 评判模型把 trajectory labeling 拆成多个独立问题,难度和正确性各得一个带类型的答案,且在一次 pass 中对每条 trace 完成。
白宫上周签署《开启超级智能时代》行政令,要求联邦政府非法定文件、网站与报告一律用超级智能(SI)取代人工智能(AI)。马斯克表态将把SpaceXAI更名为SpaceXSI,OpenAI则公开拒绝改名,奥特曼称公司名与全球认知都长在AI上。行政令还要求白宫科学顾问在60天内起草新的联邦定义,并成立超级智能工作组。
Replit 按用户支出排名位列消费级 AI 应用前 10,但按流量排名却排在倒数 5 名。这说明流量与收入讲的是两个完全不同的故事:很多普通用户不会频繁使用的产品,AI 重度用户却愿意持续付费。
a16z 指出,Replit 按用户支出位列消费者 AI 应用前十,但按流量排在倒数前五,流量与收入呈现出两套不同的故事。AI 重度用户的付费集中在轻度用户不活跃的地方。a16z 同时发布了由 @omooretweets 在 Cosign 整理的 Top 50 Consumer AI Apps by Revenue 完整榜单。
Claude Opus 5.5 列出了自己能够取代人类的 20 种工作。该内容由 X 平台账号 AI Will 发布,帖文显示获得 1115 次浏览。
Claude Opus 5.5 列出了 20 种将被 AI 取代的人类工作。该内容源自 Min Choi 在 X 上发布的推文,并引用了 Claude Opus 5.5 的输出。
70 位 AI 从业者对全球主要实验室划分梯队,只有 Anthropic 和 OpenAI 获得 Frontier 共识,即至少 75% 受访者将二者选入同一档。
一项覆盖 70 人的 AI 实验室分级调查公布结果,受访者包括 AI 数据公司的工程师、研究人员与创始人、实验室从业者及其他创业公司的创始人和工程师。为避免利益冲突,实验室从业者对自家实验室的投票未计入,发起人本人也未参与投票。榜单按"超过半数(51%–74%)""更倾向(最高票但不足半数)""部分(20%+)"三档划分,完整结果发布于 frontierlist.com/lab-tiers。
Chris Barber 询问 70 位 AI 数据公司工程师、研究员、创始人和实验室人员,将各 AI 实验室按代际分层。Anthropic 和 OpenAI 获共识评为前沿(frontier),Google DeepMind 与 xAI 获共识评为 n-1。
a16z 最新一期消费级 AI 应用 Top 100 报告显示,AI 支出最高的 1% 用户如今花得比后 50% 用户加起来还多,人均每月花费 903 美元,而用户消费中位数仅 25 美元。