跳到正文

#Anthropic

今日 0 条
9月23日周三
  1. Alex Albert(@alexalbert__)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5 用 Blender 从单条提示词构建完整 3D 世界

    Claude Opus 5.5 在 Blender 中的 3D 建模与视觉能力提升,使其能凭单条提示词构建完整世界。演示中生成了 1906 年旧金山 Market 街地震前的历史街景。

  2. Alex Albert(@alexalbert__)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Cowork 与聊天合并为统一 Claude

    Anthropic 的 Claude Cowork 和聊天将合并为一个统一的 Claude,用户既可以快速提问,也可以把一份报告交给 Claude 处理,即使合上笔记本它也会继续推进。遇到不清楚的地方 Claude 会主动询问,最终决定权仍归用户,该功能将在未来几周内向 Pro 和 Max 用户逐步推出。Alex Albert 提醒用户确认已更新到该版本,尚未更新的也即将全面推送。

  3. Alex Albert(@alexalbert__)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5 可在 Claude.ai 中用单条提示词驱动 Blender 制作黏土动画

    Opus 5.5 现在能在 Claude.ai 中用单条提示词驱动 Blender 制作黏土动画。发布者 Alex Albert 展示了这一效果,相关推文获得 2639 次点赞和 26.6 万次浏览。

  4. Windsurf(@windsurf_ai)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Opus 5.5 现已登陆 Devin Desktop 和 Devin CLI

    Claude Opus 5.5 现可在 Devin Desktop 和 Devin CLI 中使用。在 FrontierCode 1.1 上,Opus 5.5 以远低于 Fable 5 的成本拿下第一。

  5. Cognition(@cognition_labs)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5 在 FrontierCode 1.1 以 65.3% 登顶 Extended 榜

    Opus 5.5 在 Cognition 的 FrontierCode 1.1 基准上取得 Extended 65.3% 的成绩,超越 Fable 5 登顶,且成本仅为后者的一小部分。该基准针对真实工程任务,评估代码的可合并性与质量。

  6. Cognition(@cognition_labs)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Opus 5.5 上线 Devin,在 FrontierCode 1.1 登顶

    Claude Opus 5.5 现已在 Devin 中可用。在 FrontierCode 1.1 上,Opus 5.5 从 Fable 5 手中拿下第一,且成本仅为其一小部分。

  7. GitHub(@github)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Opus 5.5 在 GitHub Copilot 正式可用

    Anthropic 的 Claude Opus 5.5 已在 GitHub Copilot 中正式可用。GitHub 称早期测试显示它在效率上表现突出,任务解决能力与 Claude Opus 5 相当,但所用步骤和 token 明显更少,在多步任务中还能快速从错误中恢复。

  8. AI SDK(@aisdk)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 新增 Anthropic Claude 支持

    AI SDK 新增对 Anthropic Claude 的支持,相关提供方文档已在 ai-sdk.dev 上线。该条信息由 AI SDK 账号发布,并同时提及 Anthropic、Claude 与 Vercel。

  9. AI SDK(@aisdk)AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 接入 Claude Opus 5.5,运行成本较 Opus 5 低 40%

    Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,在大多数任务上达到 Claude Fable 5.1 的水平。其运行成本比 Opus 5 低 40%。AI SDK 表示已可用 AI SDK 调用 Claude Opus 5.5。

  10. Cursor(@cursor_ai)AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Opus 5.5 上线 Cursor,CursorBench 达 57.8%(Max)

    Cursor 宣布 Claude Opus 5.5 已在其平台上线,该模型以 57.8%(Max)成为 CursorBench 上的新榜首。Cursor 同时表示,其每任务成本比 Opus 5 低 40%。

  11. Alex Albert(@alexalbert__)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 预告 Claude Sonnet 5.5 与 Haiku 5.5 将于数周内发布

    Mike Krieger 表示 Anthropic 将在未来几周内推出 Claude Sonnet 5.5 和 Haiku 5.5,这两款模型将带来与近期发布相近的性能、效率和安全性改进。他同时称今天只是开始,后续还有更多内容。

  12. Mike Krieger(@mikeyk)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 将在未来数周推出 Claude Sonnet 5.5 和 Haiku 5.5

    Anthropic 将在未来数周推出 Claude Sonnet 5.5 和 Haiku 5.5。这两款模型将带来性能、效率与安全方面的多项相同改进。

  13. Mike Krieger(@mikeyk)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 称 Opus 5.5 经过广泛对齐测试与外部评估

    Anthropic 的 Opus 5.5 经过了广泛的对齐测试,并接受 METR 等外部机构评估,同时针对网络与生物等高风险领域引入了防护措施。

  14. Mike Krieger(@mikeyk)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Opus 5.5,成本比 Opus 5 降 40%

    Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,官方称其在编码和知识工作方面领先,写作能力也较强。该模型多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。Mike Krieger 转发了这一发布并邀请用户试用。

  15. Lovable(@lovable_dev)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 改用 Opus 5.5 构建,步骤最多减少 48%

    Lovable 宣布即日起其构建流程改用 Opus 5.5,质量与 Opus 5 持平。官方称在 0 到 1 构建与迭代修码上质量不变,在已有代码库上步骤最多减少 48%;自检测试得分高出 4-6%,达成同样结果所需步骤最多减少 57%。

  16. Perplexity(@perplexity_ai)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Computer 将 Claude Opus 5.5 设为 Standard effort 级别

    Claude Opus 5.5 现已在 Perplexity Computer 中作为 Standard effort 级别提供。在 WANDR benchmark 上,它以每任务 4.13 美元得分 0.610,略优于 Claude Fable 5.1,且每任务成本低 67.6%。

  17. v0(@v0)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    v0 已支持使用 Claude Opus 5.5

    v0 宣布用户现可在 v0 中使用 Claude Opus 5.5,并给出试用入口 v0.app/?opus55。所引用的 Anthropic 内容称,Claude Opus 5.5 是 Claude 5.5 系列的首个模型,多数任务上表现与 Claude Fable 5.1 持平,运行成本比 Opus 5 低 40%。

  18. Guillermo Rauch(@rauchg)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Guillermo Rauch 称赞 Anthropic 的发布品味:Claude Opus 5.5 与 Next.js 展现设计前沿

    Vercel CEO Guillermo Rauch 称赞 Anthropic 的发布审美,认为 AI 让网页不再有借口不推进设计边界,并以 anthropic.com/claude-opus-5-5 页面为例称这是 Next.js 的最佳体现。他提到自己看好"headless"网页的原因正是每个页面都能呈现任意独特形态。

  19. mem0(@mem0ai)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DolphinBench 公布 Hermes 与 Claude Code 两套测试框架下 GPT-5.6-Luna、MiniMax M3、Claude Sonnet 5 的官方结果

    DolphinBench 公布了两套测试框架(Hermes、Claude Code)与三个智能体模型(GPT-5.6-Luna、MiniMax M3、Claude Sonnet 5)的官方测试结果,实时榜单已在 dolphinbench.ai/leaderboard/ 上线。

  20. Alex Albert(@alexalbert__)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Alex Albert 体验 Claude Opus 5.5:更快更省,多数任务达到 Fable 5.1 水平

    Claude 发布 Claude Opus 5.5,这是新 Claude 5.5 系列的首个模型,多数任务表现达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。Alex Albert 表示使用 Opus 5.5 的体验很好,认为它聪明、写作清晰、速度快且成本低得多。

  21. cat(@_catwu)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Opus 5.5 成为 Claude Code 与 Claude 应用默认模型

    Claude Opus 5.5 现已成为 Claude Code 和 Claude 应用(含 Cowork)的默认模型,面向 Pro、Max 和 Team 套餐开放。

  22. Anthropic(@AnthropicAI)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Opus 5.5

    Anthropic 宣布 Claude Opus 5.5 今日上线,是其全新 Claude 5.5 家族的首款模型。官方称它在大多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%。

  23. Anthropic NewsAI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 用 Claude 发现类 CRISPR 的新型酶系统 ART

    Anthropic 成立生命科学实验室,让 Claude 智能体在 DNA 数据库中自主搜索,发现了一种与重复序列关联的新型逆转录酶系统 ART,相关预印本已发布。

9月22日周二
  1. 海外独角兽AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    和一线研究员的闭门讨论:蒸馏变难后,下一步的重点是什么?

    拾象整理了一场与来自多家模型厂商的 AI Researchers 的线下闭门交流,讨论 Astra 的 Computer Use、RSI、模型蒸馏和训练数据等方向,保留其中的共识与分歧。

  2. METRAI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 发布 Claude Opus 5.5 部署前评估摘要

    METR 发布对 Claude Opus 5.5 的部署前评估摘要,认为该模型对 AI 研发的加速略高于 Fable 5.1,但不太可能完全自动化 AI 研发。

  3. Vercel NewsAI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Opus 5.5 上线 Vercel AI Gateway

    Anthropic 的 Claude Opus 5.5 已在 Vercel AI Gateway 上线,模型标识为 anthropic/claude-opus-5.5,支持 1M token 上下文窗口和最多 128K 输出 token,面向智能体编码、长时智能体任务和专业知识工作。

    为什么值得看

    Claude Opus 5.5 上线 Vercel AI Gateway,同时列出两项会导致 400 报错的 API 不兼容变更,便于现有调用方迁移。

  4. Anton Osika – eu/acc(@antonosika)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anton Osika:我们的 harness 专为构建 Web 应用微调,按需路由至 OAI 或 Anthropic

    Anton Osika 表示其团队的 harness 已针对构建 Web 应用做微调,会依据用户请求内容在 OAI 与 Anthropic 之间路由,并自动拉取全部调试数据。他邀请开发者试用该工具。

9月21日周一
  1. 大淘宝技术AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    大淘宝技术:Loop engineering 如何把 agent 放进工程循环

    大淘宝技术会员技术团队提出 Loop engineering 理念,工程师不再逐轮提示 agent,而是设计包含读取状态、判断任务、执行、验证、记录状态和判断停止条件的自动化循环。

  2. 硅谷科技评论AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    红杉如何让一个人对抗投委会:哪怕只得 1 分也能投

    红杉伦敦合伙人 Julien Bek 在 20VC 披露,红杉项目按 1 到 10 分打分,即便有人投 1 分,发起人仍可按下绿灯;Shaun Maguire 带 SpaceX 进来时正有人投 1 分,他逼所有合伙人飞过去亲眼看,先投小额再引出一笔重仓,如今位居该基金史上回报最前列。

  3. 夕小瑶科技说AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 被曝跳过 Claude Opus 5.2 直奔 Opus 5.5,API 价格或降 20%

    爆料称 Anthropic 正在测试代号 claude-wafer-eap 的 Claude Opus 5.5,跳过 5.2 版本,计划本周内发布,已有用户用它在 Claude Code 中生成 Waymo 自动驾驶汽车 3D 模型。

  4. Akshay Kothari(@akothari)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 被问及:担心 AI 失控为何还让其控制机器人生物实验室

    Akshay Kothari 转发 Ryan Petersen 的质疑:若 Anthropic 担心失控 AI 危及所有人,为何还让 AI 控制一间机器人生物实验室,并表示希望 Anthropic 的人出面回应。原文未提供更多细节。

9月20日周日
  1. 沃垠AIAI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里Qoder Cloud Agents上线,比OpenAI的Agents API早四个月

    阿里今年5月上线Qoder Cloud Agents,基于Qoder家族统一智能引擎打造,称其为国内首个云端Agent构建及托管平台,已服务金融、企业软件、零售、电商等领域数百家大型企业,月均调用量达千万级。

  2. 腾讯混元AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯混元联合清华北大提出 WebCraftBench:让智能体实测 AI 生成的网页

    腾讯混元联合清华、北大提出网页生成评测基准 WebCraftBench,把软件测试方法引入评测:用智能体真实操作网页,结合代码覆盖率与美观度、易用性、需求符合度三维打分。基准含 369 条真实需求、5,088 条验收标准,覆盖 17 个前沿模型生成的 6,273 个应用,在 197 组人类偏好对比中一致率达 85.3%。

9月19日周六
  1. Interconnects AI — Nathan LambertAI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nathan Lambert:我为何仍不认同真正的 RSI

    Interconnects AI 作者 Nathan Lambert 表示仍不认同"真正的递归自我改进(RSI)",认为当前 AI 安全焦虑更多来自成千上万智能体并行工作与旧金山前沿实验室文化,而非尚未公开的突破。

  2. Anthropic(@AnthropicAI)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 与 Accenture 合作开展前沿 AI 独立评估

    Anthropic 宣布与 Accenture 合作,对前沿 AI 进行独立评估,这是其近期承诺在 Anthropic 内部嵌入评估人员的一部分。双方预计未来五年各投入至少 10 亿美元用于建设该领域能力。

  3. Simon Willison(@simonw)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code mods 系统曝光:用 AGENTS.md 自定义 Claude Code harness

    Anthropic 正在开发 Claude Code mods 系统,作为自定义 Claude Code harness 的方式,AGENTS.md 支持即基于该系统构建,目前是内置 mod,用户后续也能自行构建自定义的项目指令版本。

  4. Simon Willison(@simonw)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code 2.1.277 起支持 AGENTS.md

    Claude Code 从 2.1.277 版本起支持 AGENTS.md:当文件夹中没有 CLAUDE.md 时,Claude 会自动查找并使用 AGENTS.md,该行为可在 /config 中切换。

9月18日周五
  1. 机器之心SOTA模型AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    豆包2.1 Pro 0915版支持多模态编程,Anthropic开源生物模型推理工具集,ChatGPT for Word上线

    豆包2.1 Pro 0915版进入火山方舟模型列表,支持百万 Token 上下文与多模态编程,并强化长程 Agent 协作与异步子任务验收。Anthropic 开源含 36 套工具的生物模型推理优化工具集,报告平均提速约 4 倍,其中 FlashPairformer 专用内核加速结构预测,仓库为研究参考发布、不计划持续维护。

  2. 硅谷101AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    敢把钱包交给AI吗?Agent交易爆发前夜的信任基建

    蚂蚁集团CEO韩歆毅、万事达卡首席产品官Jorn Lambert等人在2026外滩大会圆桌讨论"当Agent成为交易主体",聚焦智能体支付中的授权、身份与责任问题。韩歆毅透露自己已用AI Agent下单买零食,并预测智能体经济将在未来6—12个月爆发,但坦承目前后台数据尚未显现迹象,行业面临"先有鸡还是先有蛋"困境。万事达卡提出"可验证意图"机制,韩歆毅则提出KYA(了解你的智能体)概念。

  3. 阮一峰的网络日志AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    科技爱好者周刊(第 413 期):再见了,React Native

    Shopify 宣布放弃 React Native,改用 Swift 和 Kotlin 开发移动客户端,回到原生语言路线;六年前它曾高调从原生转向 React Native。周刊还提到联合国投票决定废除墨卡托投影,建议改用 Equal Earth Projection 绘制世界地图;成都市计划推出"词元券",对企事业单位消耗的 Token 补贴不超过 30% 的消费金额。