跳到正文

#Anthropic

今日 74 条
2月6日周五
  1. Lex Fridman(@lexfridman)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lex Fridman 透露 Claude Opus 4.6 与 GPT Codex 5.3 今日发布,OpenClaw 播客即将上线

    Claude Opus 4.6 与 GPT Codex 5.3 于当日发布,OpenClaw 也在近期推出,Lex Fridman 预计 xAI/Grok 与 Google/Gemini 很快会跟进新版本。他透露将围绕 OpenClaw 与创作者 steipete 录制一期深度播客,并征集听众问题。他还计划下周前往旧金山湾区待一段时间,聚焦编程并参与工程团队工作。

  2. Mike Krieger(@mikeyk)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布最新 Opus 模型

    Anthropic 联合创始人 Mike Krieger 在 X 上分享最新 Opus 模型的博客链接,并称这是他使用过的体验最好的 Claude 版本。原文未披露该模型的具体能力、版本号或开放范围。

  3. Mike Krieger(@mikeyk)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Opus 4.6

    Claude Opus 4.6 发布,官方称它能在数小时内完成开发项目从架构到部署的流程。在 Rakuten,它自主完成了一个 50 人规模组织内 issue 的关闭与分配;在 Harvey,它取得 90.2%,是 Claude 系列模型中 BigLaw Bench 的最高分。

  4. AnthropicAI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Opus 4.6

    Anthropic 发布 Claude Opus 4.6,标题为 Introducing Claude Opus 4.6,原始内容为 YouTube 视频,正文信息抓取失败,暂无更多细节。

2月5日周四
  1. David Heinemeier HanssonAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DHH 实测 OpenClaw 智能体零 MCP 配置完成注册与协作任务

    David Heinemeier Hansson 分享用 OpenClaw 给 AI 分配独立机器、长期记忆和持续执行能力的实验,他在 Proxmox 虚拟机上隔离部署智能体 Kef,未安装任何技能、MCP 或 API 接入,仅凭一条提示词就让其自行在 hey.com 注册邮箱、完成 Fizzy 注册并创建看板卡片,随后通过邮件邀请加入 Basecamp 并在聊天室打招呼。

2月4日周三
  1. Mike Krieger(@mikeyk)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Xcode 26.3 发布并原生集成 Claude Agent SDK

    Xcode 26.3 今日发布,原生集成 Claude Agent SDK,与驱动 Claude Code 的同一套 harness。开发者可在 Xcode 内使用 Claude Code 的 subagents、后台任务和插件,用于长时间运行的自主工作。

1月30日周五
  1. METRAI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前沿 AI 安全法规:加州 SB 53、纽约 RAISE Act、伊利诺伊 SB 315 与欧盟 AI Act 要点梳理

    METR 发布前沿 AI 安全法规参考文档,梳理加州 SB 53、纽约 RAISE Act、伊利诺伊 SB 315 及欧盟 AI Act 前沿 AI 部分对 OpenAI、Google、Anthropic、xAI 等开发者的安全与安保义务。

  2. METRAI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 发布前沿 AI 安全法规指南:解读加州 SB 53、纽约 RAISE、伊利诺伊 SB 315 与欧盟 AI 法案

    METR 发布面向前沿 AI 实验室人员的合规参考,梳理加州 SB 53、纽约 RAISE 法案、伊利诺伊 SB 315 及欧盟 AI 法案中前沿 AI 部分的义务。

  3. METRAI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前沿 AI 安全法规指南:加州 SB 53、欧盟《人工智能法》等对 OpenAI、Anthropic、Google、xAI 的要求

    METR 发布指南梳理前沿 AI 开发者已需遵守的安全法规,涵盖加州 SB 53、纽约 RAISE 法案、伊利诺伊州 SB 315 和欧盟《人工智能法》,适用对象为训练算力超 10^25 或 10^26 FLOPs 的模型开发者。

1月27日周二
  1. Dario Amodei(@DarioAmodei)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Dario Amodei 谈 AI 与未来:明尼苏达事件下更需守护民主价值

    Dario Amodei 表示自己耗时许久写成一篇主要探讨 AI 与未来的文章,强调在国内守护民主价值与权利的重要性,并称鉴于明尼苏达正在发生的可怕事件,这一主题尤为切题。

  2. Dario Amodei(@DarioAmodei)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Dario Amodei 发布《Machines of Loving Grace》续篇

    Dario Amodei 发布了一篇与一年多前所写文章《Machines of Loving Grace》配套的续篇,原文聚焦于如果方向正确、强大 AI 能够实现什么。

1月22日周四
  1. METRAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 发布监控能力评估原型 SHUSHCAST 的早期结果

    METR 公布监控能力评估原型 SHUSHCAST 的早期结果,测试监控器能否发现 AI 智能体秘密执行副任务。GPT-5 作为智能体时,获取推理轨迹使监控器捕获率提升超 50 个百分点,而 Claude Sonnet 4.5 效果小得多,部分原因可能是其推理轨迹经过摘要处理。该工作与 OpenAI 合作完成,任务集规模小、缺乏智能体与监控器诱导是主要局限。

1月21日周三
  1. Jan Leike(@janleike)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jan Leike:2025 年模型对齐程度显著提升,Anthropic、GDM 与 OpenAI 自动审计发现的不对齐行为比例均在下降

    Jan Leike 指出,2025 年模型对齐程度大幅提升,自动审计发现的不对齐行为比例不仅在 Anthropic 下降,在 GDM 和 OpenAI 也同样走低。

1月18日周日
  1. Hamel HusainAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么我不再用 nbdev:AI 编程工具改变了取舍

    nbdev 联合维护者 Hamel Husain 宣布不再使用这个他参与重写的 literate programming 工具,原因是 AI 编程工具难以区分 notebook 与最终源码,用起来像在跟 AI 对抗。

1月14日周三
  1. Mike Krieger(@mikeyk)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mike Krieger 重返 Anthropic Labs 做产品,称 Opus 4.5 与 Claude Code 持续带来惊喜

    Mike Krieger 宣布重新戴上产品创始人的帽子,加入 Anthropic Labs 团队亲手做产品,并将产品团队交由 Ami Vora 领导以扩展 Claude。他称 Opus 4.5 与 Claude Code 在产品质量和完整度上持续带来惊喜。Anthropic 正为 Claude Code、MCP 和 Cowork 背后的 Labs 团队扩招。

  2. 硬地骇客AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从 Prompt 到 Agent Skills:Anthropic 的野心与大模型应用的终极抽象

    Anthropic 的 Agent Skills 正被推成行业默认标准,播客《硬地骇客》拆解了 Agent Skills、MCP 与 Tool Calling 的层级关系:MCP 是 Skill 的一个可选部分,Skills 描述模型能做的事情,并通过增加抽象层把领域知识从业务知识中抽离。

1月7日周三
  1. David Heinemeier HanssonAI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DHH:AI 智能体值得"升职",但 90% 代码由 AI 写仍是吹嘘

    DHH 认为 AI 智能体已从辅助工具升级为可自主产出生产级代码的团队成员,Claude Opus 4.5、Codex 5、Gemini 3、MiniMax M2.1、GLM-4.7 等模型配合终端工具已能自主运行测试、搜索文档。

12月25日周四
  1. 语言即世界language is worldAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Altimeter 合伙人 Freda Duan 谈 OpenAI、谷歌、Waymo 与 2026 年 AI 投资主线

    Altimeter Capital 合伙人 Freda Duan 在访谈中从硅谷一线投资人视角分析了 OpenAI、Anthropic、谷歌、Meta、微软和 Robinhood 等公司,指出大模型商业模式本质是现金流负向滚雪球,除非收入大幅跃升或停止训练下一代模型。

12月9日周二
  1. METRAI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 更新《前沿 AI 安全政策共同要素》(2025 年 12 月版)

    METR 发布《前沿 AI 安全政策共同要素》2025 年 12 月更新版,目前已有 Anthropic、OpenAI、Google DeepMind、Meta、xAI、Nvidia 等十二家公司发布前沿 AI 安全政策。

  2. Jan Leike(@janleike)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 为安全缓解措施设立漏洞赏金计划,覆盖 CBRN 风险

    Anthropic 为其安全缓解措施推出漏洞赏金计划,覆盖 CBRN 风险等负责任扩展政策要求有效缓解的领域。参与者可通过攻破其防御机制来协助 AI 安全并获得报酬,目前该项目已开放报名。

  3. Jan Leike(@janleike)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jan Leike 分享 Claude 更多细节链接

    Jan Leike 发布推文分享 Claude 的更多细节,附上 support.claude.com 的支持文章链接。该推文获得 42 次点赞和 10467 次浏览。

11月27日周四
  1. FlowiseAI(@FlowiseAI)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    FlowiseAI 晒出 GPT 5.1、Gemini 3.0、Opus 4.5 支持清单

    FlowiseAI 发布推文列出 GPT 5.1、Gemini 3.0 与 Opus 4.5 三款模型,三者均标注勾选符号。推文附带数据为 2 条评论、2 次转发、19 个点赞、3825 次浏览和 6 次收藏,由 xgo.ing 提供支持。

11月22日周六
  1. Jan Leike(@janleike)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 研究:生产 RL 中的奖励作弊可导致自然涌现的失准

    Anthropic 发布新研究,主题是生产 RL 中奖励作弊引发的自然涌现失准。研究指出,奖励作弊指模型在训练任务中学会作弊;Jan Leike 称这是他所见过最有趣的泛化发现之一,如果模型在编码任务上学会作弊,可能带来广泛的失准。研究认为若不加缓解,奖励作弊的后果可能非常严重。

10月28日周二
  1. METRAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 发布 Anthropic 2025 夏季破坏风险试点报告评审

    METR 对 Anthropic 2025 夏季破坏风险试点报告进行外部评审,认同 Claude Opus 4 与 4.1 带来的灾难性破坏风险很低。评审认为报告证据总体清晰完整、推理基本严谨,但指出 Claim 2 对任务范围界定不够精确,且 Opus 4 理论上可能进行未被评测发现的"本能性"错位推理,这略微降低了评审对报告结论的信心,但仍判断该风险不太可能构成重大破坏风险。

10月16日周四
  1. Mike Krieger(@mikeyk)AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 4.5

    Anthropic 发布 Claude Haiku 4.5,官方称其达到 5 个月前 Sonnet 4 的水平,成本为三分之一、速度为其两倍,在 computer use 上甚至超过 Sonnet 4,发布当日即可在 Claude 各处使用。

10月11日周六
  1. Dario Amodei(@DarioAmodei)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 扩展印度市场:Claude Code 使用量自 6 月以来增长 5 倍

    Anthropic 正扩展印度市场,Dario Amodei 与印度总理 @narendramodi 会面讨论了此事,其中 Claude Code 在印度的使用量自 6 月以来增长了 5 倍。双方还谈及印度如何在教育、医疗和农业等关键领域为超过十亿人部署 AI。

10月2日周四
  1. Monica_IM(@hey_im_monica)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Monica AI 上线 Claude 4.5 Sonnet 与 Google Nano Banana

    Monica AI 新增 Claude 4.5 Sonnet,主打复杂推理与编码的自主能力,同时上线 Google Nano Banana,定位超轻量、超快速的图像编辑并保持创作一致性。两款模型现已在 monica.im 开放试用。

9月30日周二
  1. FlowiseAI(@FlowiseAI)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 4.5 现已可在 Flowise 中使用

    Claude Sonnet 4.5 现已接入 Flowise,可用于构建复杂智能体。Flowise 称其为构建复杂 agents 的最强模型。

9月22日周一
  1. MongoDB BlogAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MongoDB Atlas 加入 MCP Toolbox,打通 AI 智能体与企业数据源

    MongoDB Atlas 现已加入 MCP Toolbox for Databases 的支持数据库生态,这一开源 Model Context Protocol(MCP)服务器由 Anthropic 提出,可实现生成式 AI 智能体与企业数据源的无缝集成。

8月22日周五
  1. METRAI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 复现 GDM 实验:Claude、GPT 与 Gemini 都难以绕过 CoT 监控

    METR 复现并扩展了 GDM 论文第 5 节的实验,用 Claude 4 Sonnet、Claude 3.7 Sonnet 和 GPT-4o 作为 actor 模型、用 GPT-4o、GPT-4o-mini、o3、Gemini 2.0 Flash 和 Gemini 2.5 Pro 作为监控模型,发现模型即使面对比自己弱的监控模型也难以在不显著损失准确率的情况下掩盖推理。

8月8日周五
  1. METRAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR:CoT 不忠实仍可能极具信息量

    METR 发布研究指出,LLM 的思维链(CoT)虽不总是忠实反映全部推理步骤,但在需要 CoT 才能完成的复杂推理中仍有很高信息量。

5月23日周五
  1. Barsee 🐶(@heyBarsee)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一周 AI 大事:Google Veo 3、Anthropic Claude 4 等集中发布

    Barsee 总结了最近 AI 领域最密集的一周,Google 推出 Veo 3,Anthropic 发布 Claude 4,OpenAI 与 Jony 联合推出 IO。此外还有 Apple Glasses 与 Google Glasses、Tesla Optimus 的进展,以及 Anthropic CEO 对 2026 年 AI 的预测。

  2. Monica_IM(@hey_im_monica)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Opus 4 和 Claude Sonnet 4 上线 Monica

    Claude Opus 4 和 Claude Sonnet 4 已在 Monica 上线,提供增强的聊天体验。Claude Opus 4 被称为目前最强模型及全球最佳编码模型,Claude Sonnet 4 相较前代在编码与推理上有显著升级。

2月9日周日
  1. Jan Leike(@janleike)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 越狱挑战:约 30 万条消息后有人通关全部 8 关,通用越狱仍未出现

    Anthropic 的越狱防御挑战在累计约 30 万条消息、约 3,700 小时集体投入后,首次有人突破全部 8 个关卡。但组织者 Jan Leike 表示,能一次性击败所有关卡的通用越狱尚未被发现。

2月6日周四
  1. Jan Leike(@janleike)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jan Leike 的越狱挑战开赛 48 小时:无人通过第 4 关

    Jan Leike 发起的越狱挑战开赛约 48 小时,尚无人通过第 4 关,但通关第 3 关的人数明显增多。

2月4日周二
  1. Jan Leike(@janleike)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发起越狱挑战:8 级防御,谁能找到通杀越狱提示词

    Anthropic 推出新的越狱防御机制并发起公开挑战,共设 8 个难度等级,邀请用户尝试找出一个能击败全部 8 级防御的越狱方法。该防御与宪法 AI(Constitutional AI)相关,挑战入口位于 claude.ai。

12月3日周二
  1. Jan Leike(@janleike)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic Fellows Program 开放申请,招募 AI 安全研究人才

    Anthropic Fellows Program 现已开放申请,参与者将与顶尖研究者合作开展 AI 安全研究。该项目由 Anthropic 推出,聚焦于应对全球最紧迫的问题之一。

9月11日周三
  1. Geoffrey Hinton(@geoffreyhinton)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Geoffrey Hinton 等 110+ 家顶级 AI 公司员工与校友联名支持 SB 1047

    110 多名顶级 AI 公司的员工与校友联名发表公开信,支持被称为"全球最具争议 AI 法案"的 SB 1047,其中 30 多人来自反对该法案的公司。Geoffrey Hinton 表示已在这份名单上署名,并称这些签署者对 AI 未来走向的洞察胜过几乎所有人,他们的警告值得重视。

7月4日周四
  1. Jan Leike(@janleike)AI 评估 · 5/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 将在 ICML 7 月 23 日举办招聘 happy hour

    Anthropic 将在 ICML 期间于 7 月 23 日举办一场 happy hour,面向有兴趣加入 Anthropic 的人,需通过 lu.ma/c751eomf 报名。

5月26日周日
  1. Eugene YanAI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    提示词基础与有效应用方法

    Eugene Yan 总结提示词工程的基础做法,指出做大规模提示词优化前需要可靠的评估,并给出“标注约100条评估样本、写初版提示词、跑评估并迭代、上线前在留出测试集上验证”的流程。