跳到正文

全部动态

今日 0 条
10月7日周三
  1. AINLPAI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Codex 疯狂 28 天计划 Day 2:小更新后大概率迎来额度重置

    OpenAI 疯狂 28 天计划进入 Day 2,Codex 只发了些小更新,但额度大概率会迎来重置。

  2. Browser Use(@browser_use)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 发布云端部署指南文档

    Browser Use 上线 cloud 使用指南文档,地址为 docs.browser-use.com/cloud/guides/p。该文档面向 Browser Use 云端功能的使用说明,具体内容未在原文中展开。

  3. Browser Use(@browser_use)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 推出 Profile Sync:一条命令把 Chrome 登录状态同步到云端

    Browser Use 推出 Profile Sync,一条命令即可将 Chrome 登录信息复制到云端,使每个云浏览器启动时都已处于登录状态。该功能免去了在提示词中填写密码或 2FA 验证码的步骤。

  4. Simon Willison(@simonw)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Simon Willison 发布 LLM 插件,向 OpenAI 新的 Jev-clone 决策模型发送提示词

    Simon Willison 发布了一款 LLM 插件,用于向 OpenAI 新的 Jev-clone 决策模型发送提示词,该模型基于 GPT-6 Luna。

  5. xAI(@xai)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.7 上线 Microsoft Foundry

    xAI 的 Grok 4.7 已在 Microsoft Foundry 上线。原帖附有视频,并给出 Twitter 查看链接,互动数据为 117 条回复、227 次转发、2009 次点赞、377018 次浏览。

  6. Vercel NewsAI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Decisions API 上线 Vercel AI Gateway

    Vercel AI Gateway 现已提供 OpenAI Decisions API,端点位于 /v1/decisions,请求和响应格式与 OpenAI 一致,现有 OpenAI SDK 集成只需修改 base URL、凭证和模型 ID 即可切换。

  7. Cursor(@cursor_ai)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 发布 iOS 应用,可与电脑配对使用

    Cursor 推出 iOS 应用,用户下载后可将手机与电脑配对使用。企业版用户需请管理员开启该功能,详情见官方 changelog。

  8. Cursor(@cursor_ai)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 智能体在你的电脑上运行,手机断网也能继续工作

    Cursor 表示其智能体运行在用户自己的电脑上,因此即使手机失去信号,任务也不会中断。该帖未披露具体模型版本或参数信息。

  9. Cursor(@cursor_ai)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor iOS 应用支持手机远程控制电脑上的智能体

    Cursor 宣布用户现在可以通过手机控制电脑上的智能体,在 Cursor iOS 应用中进行查看进度、回复消息或启动新任务。原文未给出更多功能细节。

  10. 小互(@imxiaohu)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Higgsfield 推出 AI 网红工作室,可定制角色并套用 Motion Presets 生成短视频

    Higgsfield 推出 AI 网红工作室,脸型、身材、服装均可自定义,角色做好后可套用 Motion Presets 动作预设,让 AI 网红跳舞、表演、展示产品并快速生成短视频。

  11. elvis(@omarsar0)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Decisions API 进入公开测试,作者将对比评估

    OpenAI Decisions API 现已面向所有开发者开放公开测试,可让应用近乎实时地选择模型、工具或动作,经 Responses API 做出的决策比 GPT-6 Luna 快最多 10 倍。作者 elvis 表示将借此对该 API 以及 Perplexity 的 Decisions API 做更细致的对比,并称会很快公布结果。

  12. Guillermo Rauch(@rauchg)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel AI Gateway 推出置信度阈值功能:不确定决策可升级至备用模型

    Vercel AI Gateway 上线 beta 功能,当主模型置信度低于设定阈值时,会自动在备用模型上重新运行该决策,即把不确定的判断"升级"处理。作者认为这一简单功能对规模化 AI 决策将极具影响力。

  13. 宝玉(@dotey)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    收集 Opus 5.5 动画视频案例的网站 prompt-motion.com,多数附可运行 Prompt

    prompt-motion.com 汇集了大量从 X 上收集的 Opus 5.5 动画视频案例,多数附带可直接运行的 Prompt 和原 X 链接。

  14. ollama(@ollama)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 模型页上线 Ollama 模型库

    Ollama 模型库新增 Google DeepMind 模型页面,地址为 ollama.com/library/embedd。该页面由 Ollama 官方账号在 X 上发布推广,帖文互动量为 6 次点赞、2 次转发、0 条回复,浏览量 3694 次。

  15. Replit ⠕(@Replit)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 上线技能:新建项目前自动排查重复项目

    Replit 现已能掌握用户所有项目的上下文,用户上传一个自定义指令技能后,Replit 会在创建新项目版本前标记出工作区内高度相近的项目。该技能用于避免人和智能体重复劳动造成的项目泛滥,相关细节在推文线程中给出。

  16. lmarena.ai(@lmarena_ai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LMArena 上线 Multi-Image Edit Arena 多图编辑排行榜

    LMArena 推出 Multi-Image Edit Arena,并在 arena.ai/leaderboard 上线对应榜单,用于比较多图编辑能力。原文未披露参与模型、评分指标或具体排名的更多细节。

  17. Claude(@claudeai)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 对话 Dan Shipper 与 Willie Williams:谈他们如何打造该产品

    Claude 官方分享了一段 Dan Shipper 与 Willie Williams 的完整对话,主题是两人如何把产品做出来。完整视频已在 YouTube 上线,可点击链接观看。

  18. Claude(@claudeai)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    The Every 团队用 Claude Managed Agents 打造公司级 Slack 智能体并开放给订阅者

    The Every 团队将尽可能多的工作交给智能体处理,并基于 Claude Managed Agents 搭建了一个全员在 Slack 中使用的公司智能体,以便在新模型发布时共享技能。该智能体在内部流行后,团队将其开放给自家订阅者使用。

  19. OpenAI Developers(@OpenAIDevs)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 开放 Decisions API 公测

    OpenAI 的 Decisions API 现已进入公开测试,开发者可通过 developers.openai.com 的 API 文档指南接入试用。原文未披露该 API 的具体功能、参数或定价信息。

  20. OpenAI Developers(@OpenAIDevs)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Decisions API 的六类开发者用法:模型路由、数据标注与图像分析

    OpenAI 的 Decisions API 被开发者用于将请求路由到合适的模型、工具或智能体,并把大规模输入转化为标签、排名和评分。它还可分析图像、比较视觉内容、识别关键视频帧,根据截图选择按钮或表单操作,标记有风险的工具调用,以及对大型数据集分类以发现趋势。

  21. OpenAI Developers(@OpenAIDevs)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Luna 驱动的多模态模型:支持文本图像输入与三类输出

    一款由 GPT-6 Luna 驱动的模型支持文本和图像输入,可输出三类结果:Predicates 评估陈述为真的概率,Choices 从预设选项中带置信度选择,Scores 将输入映射到数值区间。

  22. OpenAI Developers(@OpenAIDevs)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 向所有开发者开放 Decisions API 公测,决策速度最高比 GPT-6 Luna 快 10 倍

    OpenAI 的 Decisions API 已面向所有开发者开放公测,可让应用近实时选择正确的模型、工具或动作。该 API 通过 Responses API 调用,决策速度最高比 GPT-6 Luna 快 10 倍。

  23. v0(@v0)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    v0 iOS app 现可使用 ChatGPT 订阅

    v0 iOS app 支持接入 ChatGPT 订阅,用户连接账号后即可用 ChatGPT 的 tokens 进行构建。该功能面向 ChatGPT Plus 或 Pro 订阅用户开放。

  24. ChatGPT(@ChatGPTapp)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 上线 Meetings 插件,自动记录会议并生成摘要

    ChatGPT 推出 Meetings 插件,可在会议中自动记录,并把个性化摘要和后续步骤保存到 ChatGPT Space,内容基于 ChatGPT 对你的了解以及你们共同完成的工作。

  25. lmarena.ai(@lmarena_ai)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LMArena 上线 Multi-Image Edit Arena 多图编辑排行榜

    LMArena 推出 Multi-Image Edit Arena,专门评测多图编辑能力并已上线排行榜页面(arena.ai/leaderboard/im…),帖子附带的互动数据显示 0 条回复、0 次转发、2 次点赞和 941 次浏览。

  26. Fireworks AI(@FireworksAI_HQ)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks Nexus 新增 Savings 功能,可查看开放模型与 FireRouter 节省成本

    Fireworks 在 Nexus 中上线 Savings 功能,可按用户和模型查看 Fireworks 开放模型与 FireRouter 为团队节省的成本,并支持追踪缓存命中率。Nexus 入口已通过 bit.ly 链接开放。

  27. Next.js BlogAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Next.js 16.4 发布:Cache Components 获推荐为所有应用首选

    Next.js 16.4 发布,官方首次将 Cache Components 推荐为所有 Next.js 应用的最佳选择,且 create-next-app 创建的新应用默认启用该模型,它将在 Next.js 17 成为默认。

  28. OpenAI Developers(@OpenAIDevs)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 Codex 加入语音对话功能

    OpenAI 为 Codex 加入语音输入,用户可直接与 Codex 对话,不必全程使用键盘。一位用户表示自己过去整天守在桌前,如今在阳光房里用语音就能发送演示文稿。

  29. Google Gemini App(@GeminiApp)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini Live 的 Guided Vision 登陆 Android 9 及以上设备

    Gemini Live 的 Guided Vision 已在支持 Gemini Live 的地区和语言的 Android 9 及以上设备上线,用户需将 Gemini app 与 Android 系统软件更新至最新版本。该功能是 Gemini 与无障碍社区密切协作开发的成果,官方博客提供了日常使用场景的详细说明。

  30. Google Gemini App(@GeminiApp)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Gemini App 推出 Guided Vision:为日常视觉任务提供实时辅助

    Google Gemini App 上线 Guided Vision 功能,面向需要快速视觉帮助的日常场景,支持阅读细小复杂文字、寻找和定位物品、描述物品并匹配细节、探索身边环境。该功能也为老年人、识字困难者或在弱光下阅读小字的人群提供实用视觉辅助。

  31. Google Gemini App(@GeminiApp)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini Live 开启 Guided Vision 后可用语音提示引导你调整摄像头取景

    Gemini Live 在开启 Guided Vision 后,Gemini 会充当对话伙伴:当摄像头抬得过高、贴得太近或偏向一侧时,它会用自然语言提示你向右慢慢平移、向下倾斜或后退,以获得清晰画面来回答问题。

  32. Google Gemini App(@GeminiApp)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 在 Gemini Live 推出 Guided Vision 实时视觉辅助功能

    Google 在 Gemini Live 中推出 Guided Vision,面向盲人和低视力社区提供对话式实时视觉辅助。用户可共享摄像头画面,获得动态音频描述和自然的口头重新构图提示,以探索周围环境。该功能与盲人和低视力社区共同打造。

  33. LangChain(@LangChainAI)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 用 90 秒讲清 Deep Agents

    LangChain 发布了一段 90 秒视频,用于解释 Deep Agents。正文除视频外未披露具体功能、参数或可用性信息。

  34. OpenRouter(@OpenRouterAI)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 图像模型上线 OpenRouter:支持 14 张参考图、Google Search 接地与 2K/4K 全景图

    Gemini 图像模型在 OpenRouter 上线,支持最多 14 张参考图像,并可通过 Google Search 进行接地。该模型可生成 1:4、4:1、1:8、8:1 比例的干净全景图,输出分辨率支持 2K 和 4K。定价为每张图 1K $0.0336、2K $0.0504、4K $0.1134。

  35. Philipp Schmid(@_philschmid)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Google Gemma 在浏览器里嵌入任意内容

    用 Google Gemma 就能在浏览器中完成嵌入,无需服务端,示例已发布在 Hugging Face Space 的 webml-community 页面。该演示直接在浏览器内运行,使用者可对任意内容生成嵌入向量。

  36. Pika(@pika_labs)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    在 Pika 上体验 Nano Banana 2.1

    Pika 现已上线 Nano Banana 2.1,可通过 create.pika.art/apps/nano-bana… 访问使用。官方账号发布了这一体验入口,并附上对应链接。

  37. Pika(@pika_labs)AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Pika 开放 Google 模型 API,可通过 Pika API Club 调用

    Pika 宣布其 API Club 已支持调用 Google 模型,开发者可通过 dev.pika.art/models/google/ 接入构建应用。

  38. Pika(@pika_labs)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nano Banana 2.1 上线 Pika,内置 Gemini 的真实世界智能

    Nano Banana 2.1 已在 Pika 上线,带来更好的视觉质量、更快的速度,并内置 Gemini 的真实世界智能。原文未披露具体参数、benchmark 分数或价格信息。

  39. Philipp Schmid(@_philschmid)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 上线 WebML 浏览器端体验 Space

    Hugging Face 推出可在浏览器中直接体验的 WebML Space(huggingface.co/spaces/webml-c…),无需本地部署即可试用。原文未披露具体模型、参数规模或性能数据。

  40. OpenAI Developers(@OpenAIDevs)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 付费组织将自动迁移至新套餐层级

    OpenAI 付费层级的组织将自动迁移至新的套餐层级,用户无需进行任何操作。有关资格条件与速率限制的更多详情,可查看 platform.openai.com/settings/organ 页面。