OpenAI API 付费使用层级从五档简化为三档,最高档门槛降至 500 美元
OpenAI 将 API 付费使用层级从五档合并为 Build、Launch、Grow 三档,新最高档 Grow 的达标门槛为累计 API 付款 500 美元,此前的最高档需要 1000 美元。调整后开发者更容易获得更高的 API rate limits。
OpenAI 将 API 付费使用层级从五档合并为 Build、Launch、Grow 三档,新最高档 Grow 的达标门槛为累计 API 付款 500 美元,此前的最高档需要 1000 美元。调整后开发者更容易获得更高的 API rate limits。
这条帖子只给出一个链接:agentid.com,并附一句「try it here」。帖子里没有任何模型名、版本号、参数或功能说明,因此无法判断该服务的具体能力与可用性。
NVIDIA 推出 DGX Spark Live,主题为混合 AI 的智能路由。原文未披露具体模型、参数与可用性细节。
Multiply Labs 完成 7500 万美元 B 轮融资,其机器人用于生产基因疗法、mRNA 治疗等复杂药物。这些机器人已在 AstraZeneca 和 Legend Biotech 的设施内运行。部分基因疗法手工生产单剂成本可超 100 万美元,且速度慢、易受污染。
elvis 在推文中称赞 @shaped 和 @parsewaveai 的工作成果,未披露具体产品或技术细节。该帖获得 7 个点赞、1 次转发和 1309 次浏览,由 xgo.ing 提供支持。
a16z 发布 OpenAI 的 Greg Brockman 访谈,他称能帮攻击者发现安全漏洞的 AI 对防守方其实是伪装的好事:一旦攻击者能找出漏洞就可能被滥用,但防守方可以据此打补丁,并掌握系统布防的主动权。
Parsewave 审查了 Zapier AutomationBench 全部 600 个公开任务,用智能体写出逼真的错误答案来诱导验证器,人工复核确认 206 个真实 bug,并全部修复,发布 AutomationBench Verified。
Nano Banana 2.1 已发布,面向图像生成与编辑用户,带来更高质量的图像和对前代模型的诸多 bug 修复,并采用更低的价格。该模型已在 API、AI Studio 和 Gemini app 中提供使用。
论文 OmniReasoning 提出突破音视频联合推理极限的方法,论文页面已发布在 Hugging Face。该推文获得 65 个点赞、11 条回复和 8 次转发。
Lovable 现已加入 Claude 的 Startup Stack,Claude Startups 会员可获得 Lovable Business 套餐 4 个月费用减免。Claude Startups 计划正向更多创始人扩展,会员还可获得一年的 Claude Team、API 额度、创业所需工具的专属优惠,以及与 Anthropic 应用 AI 团队的 office hours。
论文 ALoDLM(Adaptively Looped Diffusion Language Models)发布,提出面向扩散语言模型的自适应循环方法,论文页面已上线 Hugging Face。原文未披露参数量、benchmark 分数与开源情况等细节。
Mistral Large 4 面对未知二进制文件可端到端完成恶意软件逆向:本次任务中它判定样本为 Cobalt Strike,提取 IoC 与恶意软件配置,并生成报告和用于捕获后续攻击的 YARA 规则。这项原本可能耗时一天的工作,Mistral Large 4 用 12 分钟完成。
Mistral AI 表示 Mistral Large 4 是全球最强的网络安全 AI 模型之一。该说法由 Mistral AI 官方账号发布,未披露具体评测分数或技术细节。
Mistral AI 发布 Mistral Large 4,并以其在 CTF 挑战中的表现展示推理能力。官方称在包含工具调用、解题时间均来自真实运行记录的 CTF speedrun 中,该模型解出 19 道题中的 18 道。
AgentMail 发布 AgentID,让每个 AI 智能体拥有专属验证收件箱用于登录,并关联真实人类所有者,应用可借此识别智能体背后的真人。该功能被形容为面向 AI 智能体的"Sign in with Google",已集成提示词并在回复截图后可获 3 个月任意 AgentMail 套餐免费使用权。
SemiAnalysis 的 Oliver Kennon 指出,算力指数和 GPU 合约定价忽略了运营方这一变量,并非所有 GPU 的部署方式都相同。他将在 10 月 14 日 AI Engineer New York 上讨论算力指数遗漏了什么、GPU 合约应该以什么为结算依据。
Google 与 Northwestern、Jacaranda Health 合作,在肯尼亚内罗毕和芝加哥各纳入 1000 名孕妇,用机器学习模型分析未经超声培训的卫生员按预设路径完成的"盲扫"超声视频,估测妊娠龄和胎位,准确度与受训超声医师相当。卫生员仅需 8 小时即可学会操作,且全部处理在设备端完成,无需供电或 Wi-Fi,可在资源匮乏地区提供产前关键信息。
Parsave 对 Zapier AutomationBench 全部 600 个公开任务逐一审计验证器,智能体标记出 323 个可疑验证器,人工复核确认 206 个真实 bug,并已全部修复,发布 AutomationBench Verified。
Firecrawl 宣布加入 Claude Startups 计划。该计划正向更多创始人扩展,成员可获得一年 Claude Team、API 额度、创业工具专属优惠,以及与 Anthropic 应用 AI 团队的 office hours。
Mistral 发布 Mistral Large 4(Le Chonk),1T 参数、原生多模态、49B 激活参数,官方称其是欧美聚合基准上最好的开放权重模型,在视觉 grounding 上超过闭源前沿模型。
Google 发布新一代图像生成和编辑模型 Nano Banana 2.1,从今天起陆续上线 Gemini App、Google 搜索 AI 模式、AI Studio、Flow、Stitch、Google Ads 和 Gemini 企业平台。
Gumloop 的 Agent Browsers 已在 Gumloop 上线,让智能体访问没有 MCP 或 API 的工作。该工具在没有连接器时会在自有云沙盒中打开浏览器,登录并下载导出文件,把任务步骤保存为 recipe 后每周自动重复执行。支持安全凭证存储与 1Password 集成、会话回放、隐蔽代理会话,且完全模型无关。
包括 Apple、AWS、Microsoft 和 Google 在内的 21 家主要软件公司,过去四年每月报告的严重漏洞从未突破 100 个,而自今年春季以来这一数字已跃升至每月 600 个以上。
Replicate 已在平台上提供 Google 的 nano-banana 模型,用户可通过 replicate.com/google/nano-ba… 直接试用。原文未披露该模型的参数规模、上下文长度或 benchmark 数据。
Replicate 上线 Google DeepMind 图像模型 Nano Banana 2.1,该模型在价格与性能之间寻求平衡。它在视觉设计、基于 mask 的编辑和主体一致性上有所提升,以生成更自然的图像。
personal agent 产品 Hark Pro 已在 web、iOS 和 Android 上线,据称由 Opus 5.5 和 Sonnet 5.5 驱动。早期申请用户可获赠一个月 Pro 会员,其左侧卡片支持 AI 自定义,整体设计与动效细节获好评。
Perplexity 在 Hugging Face Decision Index(决策模型基准)上排名第一。该模型采用开放权重,所有人均可访问。
Claude 现在可以识别粘贴的 Google 文件链接,也能按需新建文档、表格或幻灯片,并直接在聊天窗口旁打开,供用户与 Claude 共同编辑。文件访问权限沿用 Google 的共享设置,该功能已在所有付费套餐中开启 beta 测试。
Claude 现可在 Google Docs、Sheets 和 Slides 内工作,这些文件也能在 Claude 中打开。在 Google Workspace 里,Claude 以侧边栏形式出现在文件旁,读取当前打开的内容并就地编辑,用户可逐条批准每次修改后再落地。
Nathan Fielder 与 Elizabeth Holmes 的纪录片门票即将开售,放映时间为下周四,地点在旧金山 Alamo。该消息由 Lenny Rachitsky 发布。
Gary Marcus 转评一条推文,追问"谁有决定权",并抛出疑问:一个"好用的工具"是否值得冒 10% 灾难风险。原文未给出更多细节。
作者推荐开源项目 Overmind,认为应通过挖掘 agent traces 中的知识来掌控自己的智能栈。Overmind 能从代码和 traces 构建上下文图、整理训练与评估数据集、评估提示词和模型,并训练出用户自己拥有的更小专用模型。项目地址为 github.com/overmind-core/。
Claude 面向新加入 Claude Team 的企业提供最高 7000 美元的产品与额度支持,其中包括免费用一年的 Claude Team,以及通过审核后即刻到账的 1000 美元 API 额度。
AI Gateway 现可在主模型答案触发自定义置信度条件时,把决策请求升级给回退模型。置信度条件支持 Choice 和 Score 类问题,Boolean 类问题则按概率区间升级;在 providerOptions.gateway.models 中添加一个条件对象即可启用,未配置的请求保持原有行为。一次触发的回退会运行第二次决策,因此两个阶段都会计费。
LlamaIndex 发布报名链接,邀请用户通过 Partiful 页面申请活动名额。
SF Tech Week 期间的黑领结活动 Agent Economy Gala 将于周五在 Redwood Room 举办,聚集 120+ 智能体创始人和 50 位投资人,并有现场爵士乐演出。活动采用邀请制,LlamaIndex 与 SpaceX、Daytonaio、lemma_、Tiny_Fish、thelinqapp、Obvious 等合作,可通过链接申请邀请。
Gary Marcus 以“一个‘好用的工具’是否值得冒 10% 灾难风险”发问,回应 Mark C. Massey 关于 Claude 的评论。Massey 称自己用 Claude 做出过一些有趣的东西,认为它是个好工具,但并非不可或缺,如果消失生活也会回归正常。
Lenny Rachitsky 在社交平台分享了妻子创作的儿童书,仅以"(my wife's genius children's book)"一句带过,未透露书名、内容或出版信息。该帖互动寥寥,获得 1 个点赞、2387 次浏览。
Jennifer Rhima 发现一本儿童绘本 Charts for Babies 在亚马逊 Prime Day 打折,仅售 6 美元,适合自用或送礼。
xAI 公开了完整的 cookbook 仓库,地址为 github.com/xai-org/xai-co…。该仓库配合相关教程使用,提供可直接上手的代码示例。