OpenAI Codex 疯狂 28 天计划 Day 2:小更新后大概率迎来额度重置
OpenAI 疯狂 28 天计划进入 Day 2,Codex 只发了些小更新,但额度大概率会迎来重置。
OpenAI 疯狂 28 天计划进入 Day 2,Codex 只发了些小更新,但额度大概率会迎来重置。
Browser Use 上线 cloud 使用指南文档,地址为 docs.browser-use.com/cloud/guides/p。该文档面向 Browser Use 云端功能的使用说明,具体内容未在原文中展开。
Browser Use 推出 Profile Sync,一条命令即可将 Chrome 登录信息复制到云端,使每个云浏览器启动时都已处于登录状态。该功能免去了在提示词中填写密码或 2FA 验证码的步骤。
Simon Willison 发布了一款 LLM 插件,用于向 OpenAI 新的 Jev-clone 决策模型发送提示词,该模型基于 GPT-6 Luna。
xAI 的 Grok 4.7 已在 Microsoft Foundry 上线。原帖附有视频,并给出 Twitter 查看链接,互动数据为 117 条回复、227 次转发、2009 次点赞、377018 次浏览。
Vercel AI Gateway 现已提供 OpenAI Decisions API,端点位于 /v1/decisions,请求和响应格式与 OpenAI 一致,现有 OpenAI SDK 集成只需修改 base URL、凭证和模型 ID 即可切换。
Cursor 推出 iOS 应用,用户下载后可将手机与电脑配对使用。企业版用户需请管理员开启该功能,详情见官方 changelog。
Cursor 表示其智能体运行在用户自己的电脑上,因此即使手机失去信号,任务也不会中断。该帖未披露具体模型版本或参数信息。
Cursor 宣布用户现在可以通过手机控制电脑上的智能体,在 Cursor iOS 应用中进行查看进度、回复消息或启动新任务。原文未给出更多功能细节。
Higgsfield 推出 AI 网红工作室,脸型、身材、服装均可自定义,角色做好后可套用 Motion Presets 动作预设,让 AI 网红跳舞、表演、展示产品并快速生成短视频。
OpenAI Decisions API 现已面向所有开发者开放公开测试,可让应用近乎实时地选择模型、工具或动作,经 Responses API 做出的决策比 GPT-6 Luna 快最多 10 倍。作者 elvis 表示将借此对该 API 以及 Perplexity 的 Decisions API 做更细致的对比,并称会很快公布结果。
Vercel AI Gateway 上线 beta 功能,当主模型置信度低于设定阈值时,会自动在备用模型上重新运行该决策,即把不确定的判断"升级"处理。作者认为这一简单功能对规模化 AI 决策将极具影响力。
prompt-motion.com 汇集了大量从 X 上收集的 Opus 5.5 动画视频案例,多数附带可直接运行的 Prompt 和原 X 链接。
Ollama 模型库新增 Google DeepMind 模型页面,地址为 ollama.com/library/embedd。该页面由 Ollama 官方账号在 X 上发布推广,帖文互动量为 6 次点赞、2 次转发、0 条回复,浏览量 3694 次。
Replit 现已能掌握用户所有项目的上下文,用户上传一个自定义指令技能后,Replit 会在创建新项目版本前标记出工作区内高度相近的项目。该技能用于避免人和智能体重复劳动造成的项目泛滥,相关细节在推文线程中给出。
LMArena 推出 Multi-Image Edit Arena,并在 arena.ai/leaderboard 上线对应榜单,用于比较多图编辑能力。原文未披露参与模型、评分指标或具体排名的更多细节。
Claude 官方分享了一段 Dan Shipper 与 Willie Williams 的完整对话,主题是两人如何把产品做出来。完整视频已在 YouTube 上线,可点击链接观看。
The Every 团队将尽可能多的工作交给智能体处理,并基于 Claude Managed Agents 搭建了一个全员在 Slack 中使用的公司智能体,以便在新模型发布时共享技能。该智能体在内部流行后,团队将其开放给自家订阅者使用。
OpenAI 的 Decisions API 现已进入公开测试,开发者可通过 developers.openai.com 的 API 文档指南接入试用。原文未披露该 API 的具体功能、参数或定价信息。
OpenAI 的 Decisions API 被开发者用于将请求路由到合适的模型、工具或智能体,并把大规模输入转化为标签、排名和评分。它还可分析图像、比较视觉内容、识别关键视频帧,根据截图选择按钮或表单操作,标记有风险的工具调用,以及对大型数据集分类以发现趋势。
一款由 GPT-6 Luna 驱动的模型支持文本和图像输入,可输出三类结果:Predicates 评估陈述为真的概率,Choices 从预设选项中带置信度选择,Scores 将输入映射到数值区间。
OpenAI 的 Decisions API 已面向所有开发者开放公测,可让应用近实时选择正确的模型、工具或动作。该 API 通过 Responses API 调用,决策速度最高比 GPT-6 Luna 快 10 倍。
v0 iOS app 支持接入 ChatGPT 订阅,用户连接账号后即可用 ChatGPT 的 tokens 进行构建。该功能面向 ChatGPT Plus 或 Pro 订阅用户开放。
ChatGPT 推出 Meetings 插件,可在会议中自动记录,并把个性化摘要和后续步骤保存到 ChatGPT Space,内容基于 ChatGPT 对你的了解以及你们共同完成的工作。
LMArena 推出 Multi-Image Edit Arena,专门评测多图编辑能力并已上线排行榜页面(arena.ai/leaderboard/im…),帖子附带的互动数据显示 0 条回复、0 次转发、2 次点赞和 941 次浏览。
Fireworks 在 Nexus 中上线 Savings 功能,可按用户和模型查看 Fireworks 开放模型与 FireRouter 为团队节省的成本,并支持追踪缓存命中率。Nexus 入口已通过 bit.ly 链接开放。
Next.js 16.4 发布,官方首次将 Cache Components 推荐为所有 Next.js 应用的最佳选择,且 create-next-app 创建的新应用默认启用该模型,它将在 Next.js 17 成为默认。
OpenAI 为 Codex 加入语音输入,用户可直接与 Codex 对话,不必全程使用键盘。一位用户表示自己过去整天守在桌前,如今在阳光房里用语音就能发送演示文稿。
Gemini Live 的 Guided Vision 已在支持 Gemini Live 的地区和语言的 Android 9 及以上设备上线,用户需将 Gemini app 与 Android 系统软件更新至最新版本。该功能是 Gemini 与无障碍社区密切协作开发的成果,官方博客提供了日常使用场景的详细说明。
Google Gemini App 上线 Guided Vision 功能,面向需要快速视觉帮助的日常场景,支持阅读细小复杂文字、寻找和定位物品、描述物品并匹配细节、探索身边环境。该功能也为老年人、识字困难者或在弱光下阅读小字的人群提供实用视觉辅助。
Gemini Live 在开启 Guided Vision 后,Gemini 会充当对话伙伴:当摄像头抬得过高、贴得太近或偏向一侧时,它会用自然语言提示你向右慢慢平移、向下倾斜或后退,以获得清晰画面来回答问题。
Google 在 Gemini Live 中推出 Guided Vision,面向盲人和低视力社区提供对话式实时视觉辅助。用户可共享摄像头画面,获得动态音频描述和自然的口头重新构图提示,以探索周围环境。该功能与盲人和低视力社区共同打造。
LangChain 发布了一段 90 秒视频,用于解释 Deep Agents。正文除视频外未披露具体功能、参数或可用性信息。
Gemini 图像模型在 OpenRouter 上线,支持最多 14 张参考图像,并可通过 Google Search 进行接地。该模型可生成 1:4、4:1、1:8、8:1 比例的干净全景图,输出分辨率支持 2K 和 4K。定价为每张图 1K $0.0336、2K $0.0504、4K $0.1134。
用 Google Gemma 就能在浏览器中完成嵌入,无需服务端,示例已发布在 Hugging Face Space 的 webml-community 页面。该演示直接在浏览器内运行,使用者可对任意内容生成嵌入向量。
Pika 现已上线 Nano Banana 2.1,可通过 create.pika.art/apps/nano-bana… 访问使用。官方账号发布了这一体验入口,并附上对应链接。
Pika 宣布其 API Club 已支持调用 Google 模型,开发者可通过 dev.pika.art/models/google/ 接入构建应用。
Nano Banana 2.1 已在 Pika 上线,带来更好的视觉质量、更快的速度,并内置 Gemini 的真实世界智能。原文未披露具体参数、benchmark 分数或价格信息。
Hugging Face 推出可在浏览器中直接体验的 WebML Space(huggingface.co/spaces/webml-c…),无需本地部署即可试用。原文未披露具体模型、参数规模或性能数据。
OpenAI 付费层级的组织将自动迁移至新的套餐层级,用户无需进行任何操作。有关资格条件与速率限制的更多详情,可查看 platform.openai.com/settings/organ 页面。