跳到正文

全部动态

今日 123 条
12月17日周三
  1. Groq Inc(@GroqInc)AI 评估 · 1/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Groq 分享 Brex 应用案例详情

    Groq 在 X 上分享了一条指向 Brex 官方博客的链接,主题为 Brex 的相关实践记录。原文未披露该案例的具体内容、涉及模型或性能数据。

12月12日周五
  1. Binyuan Hui(@huybery)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TIME 2025 年度人物「AI 架构师」:Binyuan Hui 发帖调侃"小小的白日梦"

    TIME 将"AI 架构师"(Architects of AI)评为 2025 年度人物,称 2025 年人工智能的全部潜力全面显现、已无回头路。Binyuan Hui 引用该消息并发帖"a little daydream"调侃。

12月9日周二
  1. METRAI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 更新《前沿 AI 安全政策共同要素》(2025 年 12 月版)

    METR 发布《前沿 AI 安全政策共同要素》2025 年 12 月更新版,目前已有 Anthropic、OpenAI、Google DeepMind、Meta、xAI、Nvidia 等十二家公司发布前沿 AI 安全政策。

  2. Jan Leike(@janleike)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 为安全缓解措施设立漏洞赏金计划,覆盖 CBRN 风险

    Anthropic 为其安全缓解措施推出漏洞赏金计划,覆盖 CBRN 风险等负责任扩展政策要求有效缓解的领域。参与者可通过攻破其防御机制来协助 AI 安全并获得报酬,目前该项目已开放报名。

12月6日周六
  1. Binyuan Hui(@huybery)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NeurIPS 2025 智能体时代的代码深度学习(DL4C)workshop 即将开场

    NeurIPS 2025 的 Deep Learning for Code in the Agentic Era(DL4C)workshop 在 Hall G-H 于 09:00–17:00 举行,距开场还有十小时。

11月19日周三
  1. Groq Inc(@GroqInc)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Groq 招聘新任设计负责人

    Groq 正在招聘一名新的设计负责人(head of design)。该招聘信息由其官方账号发布,未披露岗位具体要求或其他细节。

11月14日周五
  1. Aman Sanger(@amanrsanger)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 完成 23 亿美元 D 轮融资,年化收入超 10 亿美元

    Cursor 宣布完成 23 亿美元 D 轮融资,投资方包括 Accel、Andreessen Horowitz、Coatue、Thrive、Nvidia 和 Google。Cursor 还表示年化收入已超过 10 亿美元,其产出的代码量超过世界上任何其他智能体;作者本人称正在全力开发 composer-2。

11月7日周五
  1. Adam D'Angelo(@adamdangelo)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Quora 宣布扩展使命:增长全球集体智能

    Quora 宣布扩展其使命为"增长全球集体智能",并发布完整博客文章说明这一新方向。该消息由 Adam D'Angelo 对外公布。

11月3日周一
  1. Sualeh Asif(@sualehasif996)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks AI 完成 2.5 亿美元 C 轮融资,估值达 40 亿美元

    Fireworks AI 完成 2.5 亿美元 C 轮融资,由 Lightspeed 和 Index Ventures 联合领投,红杉资本和 Evantic Capital 参投,估值升至 40 亿美元;此前 Benchmark 和红杉领投的轮次累计融资 3.27 亿美元。

10月28日周二
  1. Taranjeet(@taranjeetio)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    mem0ai 融资 2400 万美元,为 AI 打造通用记忆层

    mem0ai 完成 2400 万美元融资,用于构建 AI 通用记忆层,已有数千个团队在生产环境使用,累计 1400 万次下载、41K GitHub stars。

  2. METRAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 发布 Anthropic 2025 夏季破坏风险试点报告评审

    METR 对 Anthropic 2025 夏季破坏风险试点报告进行外部评审,认同 Claude Opus 4 与 4.1 带来的灾难性破坏风险很低。评审认为报告证据总体清晰完整、推理基本严谨,但指出 Claim 2 对任务范围界定不够精确,且 Opus 4 理论上可能进行未被评测发现的"本能性"错位推理,这略微降低了评审对报告结论的信心,但仍判断该风险不太可能构成重大破坏风险。

10月23日周四
  1. METRAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 发布 gpt-oss 方法学审查总结:17 项建议中 OpenAI 采纳 9 项

    METR 审查了 OpenAI 发布 gpt-oss-120b 前开展的对抗性微调实验方法学,共提出 17 项建议(其中 6 项为高优先级),OpenAI 在 gpt-oss 模型卡中表示采纳 9 项,METR 认为 6 项高优先级建议中 5 项已落实、1 项(明确高风险模型判定标准)仅部分解决。

10月17日周五
  1. Ian Goodfellow(@goodfellow_ian)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 与 Commonwealth Fusion Systems 合作,用 AI 加速核聚变研发

    Google DeepMind 宣布与核聚变公司 Commonwealth Fusion Systems(CFS)达成研究合作,用 AI 帮助加速清洁、安全、无限的聚变能源开发。Ian Goodfellow 表示,他与同事在 AI 用于核聚变方面的更多工作现已公开。

10月11日周六
  1. Dario Amodei(@DarioAmodei)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 扩展印度市场:Claude Code 使用量自 6 月以来增长 5 倍

    Anthropic 正扩展印度市场,Dario Amodei 与印度总理 @narendramodi 会面讨论了此事,其中 Claude Code 在印度的使用量自 6 月以来增长了 5 倍。双方还谈及印度如何在教育、医疗和农业等关键领域为超过十亿人部署 AI。

10月3日周五
  1. MongoDB BlogAI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MongoDB 推出 AI 驱动的应用现代化平台 AMP,Wells Fargo、CSX 等客户实践入选

    MongoDB 推出 AI 驱动的应用现代化平台 AMP(Application Modernization Platform),结合 AI 工具与方法论,帮助企业从遗留单体架构迁移到微服务架构。

10月2日周四
  1. Ian Goodfellow(@goodfellow_ian)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Moonlake 正式上线:专注生成模拟环境与游戏,完成 2800 万美元种子轮融资

    Moonlake 正式公开上线,专注用推理模型生成实时模拟环境与游戏,已获 Threshold Ventures、AIX Ventures 和 NVentures 等投资的 2800 万美元种子轮融资。Ian Goodfellow 称模拟环境是生成式模型的重要应用方向,也是当前强化学习环境稀缺导致模型能力受限的瓶颈所在。

9月29日周一
  1. Modal BlogAI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Modal 完成 8700 万美元 B 轮融资,估值 11 亿美元

    AI 基础设施公司 Modal 完成超 8000 万美元 B 轮融资,由 Lux Capital 领投,老股东跟投,投后估值 11 亿美元,累计融资 1.11 亿美元。

9月24日周三
  1. MongoDB BlogAI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MongoDB 入选 Glassdoor 2025 最佳领导力公司

    MongoDB 入选 Glassdoor 2025 年度最佳领导力公司榜单,该榜单覆盖 50 家员工超 1000 人的企业,完全依据现任及前任员工的评价产生,无自荐或申请环节。

9月18日周四
  1. MongoDB BlogAI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MongoDB 公布 2025 全球合作伙伴大奖获奖名单

    MongoDB 公布 2025 全球合作伙伴大奖,Microsoft 获全球云合作伙伴年度大奖,AWS 获云 AI 国际合作伙伴年度大奖。AWS 与 Novo Nordisk 用 Amazon Bedrock 和 MongoDB Atlas 将原本 12 周的流程缩短至 10 分钟。

  2. MongoDB BlogAI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MongoDB 公布 2025 全球合作伙伴奖,Microsoft、AWS、Google Cloud、LangChain 等获奖

    MongoDB 公布 2025 年度全球合作伙伴奖,Microsoft 获年度全球云合作伙伴,AWS 获年度全球 AI 云合作伙伴,Google Cloud 获年度全球云 GTM 合作伙伴,Accenture 同时拿下全球系统集成商和全球公共部门两个奖项。

  3. MongoDB BlogAI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MongoDB 公布 2025 全球合作伙伴奖,Microsoft、AWS、Google Cloud、阿里巴巴等获奖

    MongoDB 公布 2025 年度全球合作伙伴奖,Microsoft 获年度全球云合作伙伴,AWS 获年度全球 AI 云合作伙伴,Google Cloud 获云市场拓展奖。阿里巴巴获云认证数据库即服务(DBaaS)合作伙伴奖,LangChain 获年度全球 AI 技术合作伙伴,Confluent 已与 MongoDB 有逾 550 个联合客户部署。

  4. MongoDB BlogAI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MongoDB 公布 2025 全球合作伙伴年度大奖

    MongoDB 公布 2025 全球合作伙伴年度大奖,Microsoft 获云领域年度全球合作伙伴,AWS 获云领域年度全球 AI 合作伙伴,Google Cloud 获云领域 GTM 年度全球合作伙伴,Accenture 获年度全球系统集成商,Accenture Federal Services 获年度全球公共部门合作伙伴,Confluent 获年度全球技术合作伙伴。

  5. MongoDB BlogAI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MongoDB 公布 2025 全球合作伙伴奖:Microsoft 与 AWS 获奖

    MongoDB 公布 2025 全球合作伙伴奖,Microsoft 获评 Global Cloud Partner of the Year,AWS 获评 Global AI Cloud Partner of the Year。

9月11日周四
  1. Lilian Weng(@lilianweng)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Thinking Machines Lab 推出研究博客 Connectionism,首篇文章聚焦 LLM 推理中的非确定性

    Thinking Machines Lab 上线研究博客 Connectionism,首篇文章题为《Defeating Nondeterminism in LLM Inference》。该博客将覆盖从内核数值到提示词工程等研究话题,名称致敬 1980 年代研究神经网络与生物大脑相似性的联结主义学派。

9月9日周二
  1. Arthur Mensch(@arthurmensch)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mistral AI 完成由 ASML 领投的 1.7B 欧元 C 轮融资

    Mistral AI 联合创始人 Arthur Mensch 确认公司完成 1.7B 欧元 C 轮融资,本轮由 ASML 领投。他表示公司与 ASML 建立合作进入下一阶段,将继续推进科学与技术领域的前沿 AI 能力,并预告后续将有新发布。

8月19日周二
  1. Lilian Weng(@lilianweng)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lilian Weng 欢迎 Kevin Lu 加入 Thinking Machines

    Lilian Weng 发文欢迎 Kevin Lu 加入 Thinking Machines 团队,并表示很高兴能再次共事。Kevin Lu 称自己近期加入 Thinking Machines,认为该团队拥有全球密度最高的研究人才,并称公司有宏伟的路线图,正在招人。

8月15日周五
  1. FlowiseAI(@FlowiseAI)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Flowise 加入 Workday,继续加码开源社区与平台创新

    Flowise 宣布加入 Workday,并强调自身不会消失,将借此加大投入。加入 Workday 后,Flowise 将获得更多资源用于创新、增强平台和扩大覆盖范围,同时继续支持其核心开源社区。

  2. FlowiseAI(@FlowiseAI)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Flowise 被 Workday 收购

    Flowise 宣布已被 Workday 收购。Flowise 表示,加入 Workday 后其让每个人都能构建强大 AI 智能体的愿景将更加强大。

7月16日周三
  1. Lilian Weng(@lilianweng)AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Thinking Machines Lab 融资 20 亿美元并启动招聘

    Lilian Weng 转发 Mira Murati 声明,Thinking Machines Lab 已获 a16z 领投的 20 亿美元融资,NVIDIA、Accel、ServiceNow、CISCO、AMD、Jane Street 等参投。

6月8日周日
  1. Geoffrey Hinton(@geoffreyhinton)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Geoffrey Hinton 否认与 Amazon 书籍《Modern AI Revolution》有关,称其为骗局

    Geoffrey Hinton 公开表示,Amazon 上署名他为作者的《Modern AI Revolution》一书是骗局,与他毫无关系,他希望 Amazon 将其下架。

  2. Geoffrey Hinton(@geoffreyhinton)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Geoffrey Hinton 祝贺 Yoshua Bengio 发起 LawZero,推进安全设计 AI 研究应对自我保存与欺骗行为

    Geoffrey Hinton 祝贺 Yoshua Bengio 发起 LawZero,这是一项推进"安全设计"(safe-by-design)AI 的研究工作。Hinton 指出,该研究尤其针对前沿系统开始显露自我保存与欺骗行为迹象的情况。

5月1日周四
  1. Sualeh Asif(@sualehasif996)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    turbopuffer 无服务器向量搜索与 aurora limitless 处理超 1M txn/s

    有开发者公开致谢 turbopuffer 提供的真正无服务器向量搜索,并透露其团队已用 aurora limitless 处理元数据,目前承载超过 1M txn/s。两条信息均指向 AWS 生态下的无服务器基础设施组合。

4月29日周二
  1. Geoffrey Hinton(@geoffreyhinton)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hinton 签署联名信,要求加州与特拉华州总检察长阻止 OpenAI 重组

    Geoffrey Hinton 签署了一封致加州总检察长 Rob Bonta 和特拉华州总检察长的联名信,要求叫停 OpenAI 的重组,称希望阻止其彻底掏空"确保通用人工智能造福全人类"这一使命。该帖获 7588 次点赞、869 次转发。

4月15日周二
  1. Lilian Weng(@lilianweng)AI 评估 · 5/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lilian Weng 将在 ICLR2025 聊 Thinking Machines

    Lilian Weng 表示将出席 #ICLR2025,并期待与大家聊 Thinking Machines 及其近况。Thinking Machines 将在 4 月 25 日(周五)于新加坡举办 happy hour 活动,可吃喝并了解更多信息。

4月6日周日
  1. Lilian Weng(@lilianweng)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lilian Weng 预告下一篇博客:与新公司精神相关

    Lilian Weng 预告正在撰写下一篇博客,称内容与"我们的新公司"精神相关。推文未透露博客主题、公司名称或发布时间等具体信息。

2月27日周四
  1. DeepSeek(@deepseek_ai)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 开源周第 4 天:发布 DualPipe 与 EPLB 并行策略工具

    DeepSeek 开源周第 4 天发布优化并行策略,包括用于 V3/R1 训练中计算与通信重叠的双向流水线并行算法 DualPipe,以及面向 V3/R1 的专家并行负载均衡器 EPLB,并开源了分析 V3/R1 计算通信重叠的代码仓库。

2月21日周五
  1. DeepSeek(@deepseek_ai)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 预告开源周:下周开源 5 个代码库

    DeepSeek 宣布将于下周启动 OpenSourceWeek,陆续开源 5 个代码库。这些模块已在 DeepSeek 线上服务中完成文档化、部署并经过生产环境实战验证,将每日解锁发布。

2月14日周五
  1. Jan Leike(@janleike)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    越狱挑战结果公布:5 天 30 万条消息后系统被攻破,1 人找到通用越狱方法

    越狱挑战 5 天内收到超 30 万条消息、累计约 3,700 小时,系统最终被攻破,4 名用户通过全部关卡,其中 1 人找到通用越狱方法,共向获胜者支付 5.5 万美元。

2月6日周四
  1. Jan Leike(@janleike)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jan Leike 的越狱挑战开赛 48 小时:无人通过第 4 关

    Jan Leike 发起的越狱挑战开赛约 48 小时,尚无人通过第 4 关,但通关第 3 关的人数明显增多。

12月3日周二
  1. Jan Leike(@janleike)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic Fellows Program 开放申请,招募 AI 安全研究人才

    Anthropic Fellows Program 现已开放申请,参与者将与顶尖研究者合作开展 AI 安全研究。该项目由 Anthropic 推出,聚焦于应对全球最紧迫的问题之一。