OpenAI 分享数百次成功部署经验:如何让 AI 真正投入工作
OpenAI 基于数百次成功部署经验,总结了让 AI 真正投入工作的方法。内容面向企业落地场景,但正文未披露具体模型、版本或部署数据。
OpenAI 基于数百次成功部署经验,总结了让 AI 真正投入工作的方法。内容面向企业落地场景,但正文未披露具体模型、版本或部署数据。
OpenAI 发布 GPT-4o 微调网络研讨会。研讨会主题为 GPT-4o 的微调。
OpenAI 发布视频,展示了员工使用 ChatGPT Enterprise 高效分析数据、挖掘洞察的实际案例。内容聚焦企业内部的数据驱动工作方式,未披露新功能或版本信息。
Hamel Husain 介绍用对抗验证检测 AI 数据漂移:给两组数据集分别打 0/1 标签,训练二分类器,AUC 达到 0.60 以上即说明存在漂移,再用特征重要性定位根因。他还发布 CLI 工具 ft_drift,可检测两个多轮对话 jsonl 文件之间 prompt 模板和 token 层面的漂移。
OpenAI 宣布已与 Sam Altman 达成原则性协议,他将回归担任 CEO,并组建由 Bret Taylor(主席)、Larry Summers 和 Adam D'Angelo 组成的新初始董事会。OpenAI 表示正在协作敲定具体细节。
OpenAI 高层动荡的关键节点,读者可据此了解 Sam Altman 回归与初期董事会构成。
Lilian Weng 表示其团队正与 Superalignment 团队并行,从实践层面推进 AI 对齐,构建让 AI 能够安全部署的系统,并正在招募研究工程师与科学家加入。
OpenAI 提出新目标,要在未来 4 年内解决超智能对齐问题,并承诺把迄今为止 20% 的算力投入这一方向。Jan Leike 邀请研究者共同探讨如何最有效地使用这些算力来解决该问题。
OpenAI 提出自动化可解释性新方法:让 GPT-4 解释 LLM 中单个神经元的激活模式,并对这些解释进行评分。相关研究已发布于 OpenAI 官网。
开发者用 Raspberry Pico 加 e-ink 屏幕做了 raspberry-llm,通过调用第三方 LLM API 读取 WSJ 和 HackerNews RSS 内容并生成文本,最初用来做押韵时钟。
作者用 gpt-3.5-turbo 和 gpt-4 配合 LangChain、Pinecone 与 Discord 搭建了一套个人助理,实现 /summarize、/sql-agent、/search、/board 等工具,用于摘要、查询与提供建议。
为测试 LLM 的训练数据与表现,Eugene Yan 让 gpt-4、claude-v1.2、cohere-xlarge 等模型为自己写传记,结果 gpt3.5/4 整体表现最好,大意正确但细节多有错误。他指出不同模型在记忆与复述程度上差异明显,且这些模型无法联网,输出完全基于训练数据。
OpenAI 的 Lilian Weng 与 Greg Brockman 发布文章,介绍训练大型神经网络的技术,并称其可能比想象中更容易。两人同时表示 OpenAI 正在招聘。
Geoffrey Hinton 表示,将 GPT-3 的惊人表现外推到未来,生命、宇宙及一切的答案约为 4.398 万亿参数。该说法呼应《银河系漫游指南》中「42」的梗,以参数量作为终极答案的类比。
域随机化(DR)通过在仿真器中随机化视觉外观与物理动力学参数(如质量、摩擦、阻尼、关节限位、动作延迟),让策略在多样环境中训练,从而迁移到真实世界。相比需要真实数据的域适应,DR 几乎不需要真实样本;OpenAI Robotics 用视觉与动力学 DR 让机械手完成连续旋转物体的 50 次连续随机目标朝向任务。文章还把 DR 的随机化参数学习视为一种双层优化问题。