Codex GPT 6 Astra 一次性在 FPGA 上完整复刻街机游戏 Discs of Tron
Thomas Sohmers 用 Codex GPT 6 Astra 一次性把街机游戏 Discs of Tron 完整实现在 OpenAI DevDay 版 ModRetro Chromatic 的可重编程 FPGA 逻辑上。该项目为 100% one shot 完成,运行于 Chromatic 掌机。
Thomas Sohmers 用 Codex GPT 6 Astra 一次性把街机游戏 Discs of Tron 完整实现在 OpenAI DevDay 版 ModRetro Chromatic 的可重编程 FPGA 逻辑上。该项目为 100% one shot 完成,运行于 Chromatic 掌机。
OpenAI 展示如何为 ChatGPT 构建交互更丰富的插件:插件扩展支持从侧边栏启动插件、支持 @ 提及,以及添加文件查看器。官方以一段 walkthrough 演示了具体做法。
OpenAI 公布了参与 plugin extensions 建设的合作方,包括 Adobe、Canva、Figma、Shopify、Instacart、Atlassian、tldraw 和 MagicPathAI。这些公司正在基于该扩展能力开发集成。
HeyGen 向创始人征集正在打造的项目,只需在回复中留下网站并说明需求,形式可以是创始人介绍、产品演示或一直推迟的发布视频。HeyGen 将挑选部分项目,用 HeyGen MCP 制作视频并发布在其账号上。
Prime-Sentinel Command(PSC)是一个用 Python 面向对象实现的 master-agent 架构,由中央编排器 PrimeProgram 协调多个自主边缘诊断节点 SentinelProgram,后者采集 CPU 负载、内存占用与网络状态并返回结构化遥测数据。
Varun Jindal 提出在模型之外为编码智能体搭建一套 harness,包含宪法、自主边界、分层上下文、持久记忆、多视角评审面板和编辑后钩子六个部件。
Stack Overflow 博客发布六层 LLM 生产系统成熟度模型的第一层「确定性层」,主张智能体应是从上下文到提案的纯函数,无权直接改变业务状态,由经过充分测试的 substrate 在审批后执行提案。
Stack Overflow 博客发布了一份生产级 LLM 与智能体实战指南,提出从 Notebook 演示到生产级构建的六级成熟度模型,涵盖确定性、评测、置信度、安全治理与运维等层次。文中给出可勾选的自检清单,例如智能体只能提出建议而非直接改动业务状态、提示词或模型变更导致质量回退时应使 CI 失败、敏感数据在边界处脱敏并采用只追加审计账本。作者建议团队先找到自己最弱的一层,再按顺序逐级补齐。
Datadog 是面向云应用的可观测性与安全平台,可对基础设施、分布式系统以及 AI 智能体行为进行实时监控。该平台此次聚焦如何查看 AI 智能体的内部运行状态。
Oracle 的 Richmond Alake 将于 10 月 13 日在 AI Engineer New York 发表演讲,主题是智能体如何理解业务上下文、权限与记忆——即智能体能写出查询,却未必知道分析师被允许看到什么。Oracle AI Database 是本次活动的 Platinum 赞助商。
AI Engineer New York 定于 10 月 12 日至 14 日在纽约时代广场喜来登酒店举行,面向金融领域 AI 开发者,参会需购买会议门票。Luma RSVP 不包含入场资格,工作坊为额外付费项目。
Exa 的 Ryan Ahern 将于 10 月 12 日在 AI Engineer New York 主讲回测主题,核心问题是:漂亮的回测结果是否源于 AI 智能体偷看了未来信息。该环节演示用 Exa Snapshot 搜索"昨天的网络",Exa 是本次大会的 Platinum 赞助商。
WorkOS 的 Isabelle Williams 将在 AI Engineer New York 分享 AI 智能体身份与权限撤销问题:智能体发现 API、完成注册,却代表他人行动,该拥有谁的权限?该议题于 10 月 13 日进行,WorkOS 是本次活动 Platinum 赞助商。
马斯克表示,Grok Bot 今后会针对具体任务选用最合适的后端模型,不再局限于 Grok 4.7 或 4.6,也会调用 Claude Opus 5.5、Midjourney、Suno 以及其他领先 API,以求给出最好的结果。转述该消息的博主认为,Grok Bot 将借此具备构建内容和执行任务的能力。
有用户称在 Opus 5.5 订阅中可使用 Midjourney 创建图片、Suno 生成音乐,但据其了解,这些功能很多都没有实装,Midjourney 和 Suno 尚未上线。部分任务已开始由 Opus 5.5 驱动,但用户不能主动选择。
马斯克表示 Grok bot 会根据特定任务调用当前最佳模型,不再局限于 Grok 4.7 或 4.6,还会通过 Opus 5.5、Midjourney、Suno 等 API 帮用户构建内容或执行任务。
Grok bot 现在支持搜索、阅读甚至监控指定的推特内容,例如可设置在 tibo 重置 Codex 额度时收到通知。这些功能免费,且不通过以前的 xapi 实现。
Anthropic 宣布为 Max 和 Team 套餐用户按月发放 Claude Platform API 额度:Max 5x 为 100 美元,Max 20x 为 200 美元,Team 最高 500 美元且可共享池化。该额度可用于任何模型,包括 Haiku 5.5,既能在自己代码中使用,也能在支持输入 API 的第三方工具中使用,完整条款见 support.claude.com。
作者对比了 Anthropic Haiku 5.5 与几个中国竞品模型的价格和评测分数,认为它是在针对中国的甜点级模型。价格上它比 DeepSeek-V4.1 flash 和智谱 GLM 5.3 flash 都便宜;在 Terminal Bench 4.0 上,作者的测试显示它比 GLM 5.3 flash 高一分,也与其他模型持平或更高。
OpenAI 的 Codex 启动 Day 3 活动,向所有付费账户发放一张可留存的重置卡。官方同时宣布 Codex 与 ChatGPT Work 活跃用户数创新高,达到 40M。推文预告接下来将公布的重头戏是 Chat 中的 GPT-6。
Opus 5.5 制作的奇门遁甲排盘教学网站已上线,作者在原来自娱版本上做了优化,加入题目和讲解,更像一个学习网站。
针对外界质疑,该开发者回应称自己同样是新手,各路高手若有其他见解可以自行实现,并承诺后续会把代码开源出来。
针对有人质疑"这有啥恶心的",作者认为立场决定判断:站在国产厂商一边,Anthropic 的做法当然令人反感。他同时提醒,不应因为 Anthropic 近期模型变强,就忘记它此前做过的事,转而替它说话。
有用户发推 @bot,询问能否为自己的机器人申请 guziang@grokbot.com 邮箱地址。该推文获得 7 个点赞、4 条回复和 12910 次浏览。
用户发现账号无响应的原因是绑定的并非自己这个推特账号。该推文获 3083 次浏览,未提及具体产品或模型。
歸藏(guizang.ai)称,当时为抢 99 美元的额度用另一个账号购买了 Gork Bot,结果现在用自己的 Twitter 账号 @它,它不回。他同时提到 Grok bot 最近可搜索、阅读甚至监控指定推特内容,例如让它在 tibo 重置 Codex 额度时通知你,且这些功能免费、不通过以前的 xapi 实现。
有提醒称,遇到诱导领取类活动需谨慎,可能是钓鱼执法,帖文附带的互动数据显示该提醒获得少量转发与关注。
Anthropic Haiku 5.5 的定价被指专门狙击中国甜点级模型,价格比 DeepSeek-V4.1 flash 和智谱 GLM 5.3 flash 都便宜。在 Terminal Bench 4.0 上,其 AA 测试分数比 GLM 5.3 flash 高一分,并高于另外两个竞品。作者因吐槽该定价"恶心"而遭到批评。
用一条提示词让 Grok bot 每天早上定时产出 AI 早报视频,内容收集、写代码和视频渲染全部在 Grok 云端虚拟机上完成,不占用本地电脑。作者称实测效果不错,并公开了提示词,复制后其他人的 Grok bot 也能执行同样任务。
歸藏让 Grok bot 每天早上定时产出一条 AI 早报视频,内容收集、写代码和视频渲染全程都在其云端虚拟机上完成,未动用本地电脑。他分享的提示词可直接复制,让其他 Grok bot 也能执行同样的任务,Muse、Dots 等带云端电脑的 Agent 同样适用。
现在可以直接 @ 你的 bot,把它加入到每日任务中。原文未披露所涉平台、bot 名称及具体任务类型,仅说明这一 @ 调用方式可用于日常任务配置。
歸藏用 Grok Bot 每天早上定时生成 AI 早报视频,内容收集、写代码和视频渲染全部跑在其云端虚拟机上,未使用本地电脑。他分享了一段提示词,复制后其他 Grok Bot 也能执行同样的任务,并称复杂任务效果巨好。
一种"邪修"用法:在 Agent 的云电脑里装上 Pi 或 DeepSeek Harness 这类编程 Agent,把其他 Code plan 用不完的额度配置进去,再让 Grok Bot 调用这些 token 写代码、渲染视频,避免闲置额度浪费。
歸藏(guizang.ai)分享一种用法:在 Agent 的云电脑里安装 Pi 或 DeepSeek Harness 这类编程 Agent,把其他 Code plan 用不完的额度配置进去,再让 Grok Bot 调用这些 token 写代码、渲染视频。他称这样闲置额度就不会浪费。
歸藏用 Grok bot 每天早上定时生成 AI 早报视频,内容收集、写代码和视频渲染全部跑在 Grok 的云端虚拟机上,未使用本地电脑。他分享了可直接复制的提示词,让其他人的 Grok bot 也能执行同样任务。
原文仅有一句:"当然也可以打开两个狗头军师帮我参谋",未提供模型、产品、参数或功能等具体信息,无法据此写出更长的摘要。
作者称自己多个账号被封且未获退款,因此对这家公司不会有好话。该帖互动数据为 6 条回复、0 次转发、27 个点赞、4539 次浏览。
针对"模型强就该用、但公司说不得"的争论,作者提出质疑:这些人应该也没 A÷ 股份。
一则与 Grok bot 在野外搏斗的分享,帖文互动数据为 15 条回复、1 次转发、23 个点赞、7112 次浏览,由 xgo.ing 提供支持。
Yann LeCun 指出,一份 1991 年的技术报告构想模糊,既无理论也无实验,更没有代码,作者此后从未重访或推进该工作。报告仅含一张手绘架构图、一个形如 f(x)=0 的公式,并声称只要恰当实例化 f 和 x,其他所有技术都只是其特例。