跳到正文

#Agent

今日 0 条
9月29日周二
  1. 硅谷101AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    让人类交出方向盘:特斯拉FSD十三年的冒险、争议与进化

    特斯拉Cybercab今年9月在美国德州奥斯汀投入运营,车辆没有方向盘和脚踏板;截至9月22日,特斯拉在德州登记的Robotaxi车队总数增至476辆,其中67辆是Cybercab。

  2. 深思圈AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Elena Verna:AI 时代 HI-IC 崛起,管理应是一种选择而非晋升

    Elena Verna 在演讲中提出 HI-IC(高影响力个人贡献者)概念:借助 AI,一个人可独立完成过去需要整个团队才能做的事。她在 Lovable 转做 IC 后薪资不变,可独立搭建定价页面、做原型、部署到生产并跑数据分析;其调查显示 51 位在职管理者中有 42 位想回到 IC 角色。她认为管理应是一条职业路径,而非一次晋升。

  3. 逛逛GitHubAI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    JumpServer 发布 v5.0.0:开源堡垒机正式进入 V5 时代

    开源堡垒机 JumpServer 发布 v5.0.0,进入 V5 时代,核心变化是原生客户端可统一连接 SSH、RDP、Kubernetes、数据库和 Web 站点等资产。

  4. GitHub(@github)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一位市场人用 GitHub Copilot 把重复性活动运营变成自动运行的 GitHub Issue 表单

    一位市场人员将重复的活动运营工作做成了一个可自动运行的 GitHub Issue 表单,交给 GitHub Copilot 完成自动化。该做法发布在 GitHub 博客的 AI and ML 栏目,帖子获 150 次点赞、32 条评论。

  5. Guillermo Rauch(@rauchg)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel 域名搜索不再需要认证,支持 CLI 关键词搜索与 API 批量查询最多 200 个域名

    Vercel 域名搜索现已无需认证,尤其适合 AI 智能体调用。用户可通过 Vercel CLI 按关键词搜索域名,并通过 API 批量检查最多 200 个域名。

  6. Latent.Space(@latentspacepod)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code 的未来:Mods、可变软件、前沿节奏与多智能体,Anthropic 的 Thariq Shihipar 详解

    Anthropic 的 Thariq Shihipar 详解 Claude Code 的未来方向:Claude Mods 让开发者自定义整个 Claude Code harness,Claude.md 可能最终消失,可变软件或将改变应用构建方式。

  7. 夕小瑶科技说AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5,编程能力逼近 Opus 5.5

    Anthropic 发布 Claude Sonnet 5.5,距 Opus 5.5 发布不到一周。在 Terminal-Bench 4.0 编程评测中,Sonnet 5.5 的 Max 档从上一代 Sonnet 5 的 10.3% 提升到 70.6%。

    为什么值得看

    梳理了 Sonnet 5.5 在编程与知识工作评测上的具体提升幅度、推理档位差异和官方迁移建议,便于对照选型。

  8. Aravind Srinivas(@AravSrinivas)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Agent API 新增 Profiles、Skills 和托管连接器

    Perplexity 为 Agent API 新增 Profiles、Skills 和托管连接器。Profile 是一个保存好的智能体,把模型、指令、工具、连接器、运行设置配置在一个带版本号的 ID 下,项目管理员配置一次后,项目内每位开发者都能用自己的应用和项目 API key 调用。

  9. 真格基金AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 发布 2.0 版本并推出生活场景智能助理 Cue

    9 月 28 日,Manus 面向海外用户发布 2.0 版本,并推出面向个人生活场景的智能助理 Cue,上线不到 12 小时已有用户用它打电话、做机器人游戏、多 Agent 协作规划迪拜旅行等。

  10. 数字生命卡兹克AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AIHOT 2.0 上线并开源,作者公开采集与精选流程

    月活百万的 AI 热点资讯网站 AIHOT 正式开源,同时上线重写后的 2.0 版本,代码仓库为 https://github.com/KKKKhazix/AIHOT。

  11. Vercel NewsAI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI GPT-6.1 Sol 上线 Vercel AI Gateway

    OpenAI 的 GPT-6.1 Sol 现已在 Vercel AI Gateway 上线,相较 GPT-6 Sol 在编码、电脑操作和专业工作(如阅读复杂文档、执行多步工作流)上有所提升。

  12. dbaplus社群AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯技术工程详解 Agent 自进化飞轮:评测、记忆、落地、控制四齿怎么搭

    腾讯技术工程提出一套 Agent 自进化方法论,把评测、记忆、落地、控制四个环节作为同一闭环的四个齿轮,主张自进化的瓶颈不在单个技术点,而在环节之间的数据通路是否连通。

  13. 十字路口CrossingAI 评估 · 75/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 2.0 发布并推出个人助理 Cue,回顾 63 次重大更新

    Manus 2.0 正式发布,换上自研 Cascade 框架,按需加载专业能力以降低 Token 消耗,并新增事件触发的自动化任务与可独立购买的云电脑。桌面端升级为 Manus Studio,加入视频编辑与 Alchemy 模式,游戏开发环境可发布为网站分享;同时推出面向个人生活的独立应用 Cue,每个 Agent 拥有自己的邮箱、电话号码、钱包和电脑。

  14. Augment Code(@augmentcode)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Augment Code 的 Cosmos 接入 Claude Sonnet 5.5

    Augment Code 宣布 Anthropic 的 Claude Sonnet 5.5 已在其 Cosmos 中可用。接下来几天,他们会把智能体循环中的旧版 Sonnet 模型替换为 Claude Sonnet 5.5,并跟踪它如何改变其软件工厂的产出。

  15. 开始连接LinkStartAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 爆火:AI 的下一步,可能不是把模型做得更大

    一个不聊天、不写文章、只做判断与排序的模型 Jev 近期在 AI 圈刷屏,被讨论为「关节模型」——介于规则与泛化之间,主打更快、更便宜。播客「开始连接 LinkStart」邀请 APUS AI 首席科学家张旭、前硅基流动联合创始人杨攀和 Parall Cofounder 余华亨,从模型原理、适用场景与产业趋势探讨 Jev 为何爆火,以及 AI 服务对象从「人」转向「程序」后可能带来的分工变化。

  16. Harrison Chase(@hwchase17)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Harrison Chase 提出 harness 演进路径:coding harness → personal harness → org harness

    Harrison Chase 提出 AI 智能体 harness 的三阶段演进路径:coding harness、personal harness,再到 org harness,并称仍在确定这一阶段的最终命名,公开征集建议。

  17. Fireworks AI(@FireworksAI_HQ)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks 发布首个路由模型 FireRouter with Opus

    Fireworks 发布首个路由模型 FireRouter with Opus,常规任务交给顶级开源模型,其余由 Claude Opus 处理,并支持缓存与任务感知路由。官方称在编码会话中达到 Opus 98.1% 的准确率,单次会话成本降低 57%。

  18. orange.ai(@oran_ge)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 2.0 发布:转向视频与游戏场景,为个人 Agent 配身份信息与连接网络

    Manus 2.0 发布,1.0 曾启发整个 Agent 时代的产品,在 2.0 阶段选择视频、游戏作为生产力的核心场景。个人 Agent 方面获得身份信息,包括邮箱、电话、支付,以及一个连接 Agent 的网络,同时引入微信的小程序逻辑,每个二维码都是一个 Agent。作者提到其海外主要竞争对手目前是 Muse,国内最适合做 Muse 的是腾讯,而 Manus 的股东就是腾讯。

  19. Harrison Chase(@hwchase17)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Harrison Chase:每个智能体都需要沙箱,harness 应置于沙箱之外

    Harrison Chase 认为每个智能体都需要沙箱,harness 应放在沙箱之外,把“大脑”和“手”分离。他提到 NVIDIA 开源了相关沙箱工具,并认同 Andrew Ng 的说法,即这属于 harness 的一部分而非外挂组件。

  20. hidecloud(@hidecloud)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus Studio 制作的发布视频,@Nin19536 加入人工润色

    这段发布视频由 Manus Studio 生成,@Nin19536 做了部分人工润色。发布者称三个月前还不会相信 AI 智能体能做出这样的发布视频。

  21. Character.AI(@character_ai)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Character.AI 推出 ShortSqueak 与 PipSqueak 3 两款免费 Chat Styles

    Character.AI 上线 ShortSqueak 和 PipSqueak 3 两款免费 Chat Styles,ShortSqueak 主打简短回复、快节奏斗嘴与短信式休闲角色扮演,PipSqueak 3 则强化角色扮演的智能与沉浸感并减少格式错误。两者均支持 Lorebooks,c.ai+ 会员还可使用 Style Control。

  22. hidecloud(@hidecloud)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 2.0 发布:现在可以构建游戏

    Manus 2.0 现已支持构建游戏,官方称操作极为简单。团队在推文中展示了数十款用 Manus 制作的可玩游戏、提示词与演示。

  23. ManusAI(@ManusAI_HQ)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 2.0 上线游戏生成功能

    Manus 2.0 现在可以构建游戏,官方称操作非常简单。官方在推文串中展示了用 Manus 制作的数十款游戏、提示词和可玩演示。

  24. LlamaIndex 🦙(@llama_index)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 探讨 Jev 及同类模型在文档解析早期方案中的应用

    LlamaIndex 探索了 Jev 及同类模型在文档解析任务上的早期方案,涉及方向检测、语言检测、路由等任务。文档解析需要大量即时决策。

  25. Replit ⠕(@Replit)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 直播探讨知识工作的未来:在 agent chat 中提问即可获得图表、pipeline 或自动化

    Replit 将举办一场名为 Just Ask Replit 的直播,探讨知识工作的未来:实时数据、可视化与自动化都在 agent chat 内完成,无需搭建仪表盘,也无需排队等工程资源。直播时间为周二上午 9 点 PT,在 YouTube、LinkedIn 和 X 同步进行。

  26. Claude(@claudeai)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5 与 Sonnet 5.5 用同一提示词生成 JavaScript 恐龙史动画对比

    Claude 官方账号展示了一组对比:给 Sonnet 5 与 Sonnet 5.5 同一个提示词,分别用 JavaScript 生成不到一分钟讲完恐龙史的动画,由 @kevin_t_ngo 创作。该演示发布在 Twitter 上,获得 693 个点赞、23 次转发和约 28 万次浏览。

  27. Cognition(@cognition_labs)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 转述 Anthropic 称 Sonnet 5.5 生成速度提升超 30%、单任务成本最多降低 30%

    Cognition 转述 Anthropic 的数据:Sonnet 5.5 的 token 价格与 Sonnet 5 保持一致,但输出生成速度提升超过 30%,单任务成本最多降低 30%。同一价格下的速度与成本变化,对使用 Claude 驱动编码智能体的团队更直接。

  28. Cursor(@cursor_ai)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 上线 Sonnet 5.5

    Cursor 宣布 Sonnet 5.5 现已在 Cursor 中可用。官方称其表现强劲,在许多任务上与 Opus 相当。

  29. Andrew Ng(@AndrewYNg)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达:OpenWorker 将基于 NVIDIA OpenShell 为每个智能体命令加沙箱

    吴恩达宣布其开源智能体框架 OpenWorker 将支持 NVIDIA 开源的智能体沙箱工具,基于 NVIDIA OpenShell 把每个智能体的命令放进沙箱内运行。

  30. 刘小排rAI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 中杯 Sonnet 5.5 测评超过 GPT-6-Astra

    Anthropic 发布中杯 Sonnet 5.5 模型,作者称其在 Agentic Coding 测评中分数比自家大杯 Opus 5.5 更高,其他分数与 Opus 5.5 相差无几,而定价不到 Opus 5.5 的一半、只有 GPT-6-Astra 的四分之一。

  31. hidecloud(@hidecloud)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus Studio 推出 Alchemy 视频创作模式,适合制作发布视频

    Manus Studio 上线最新 Alchemy 视频创作模式,官方称很适合用来制作发布视频,并透露 Cue 的发布视频就是 Manus 自己做的。有用户用这几天写的 Skills 尝试为 Cue 制作宣传片。

  32. Notion(@NotionHQ)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion Agents 应用新侧边栏上线

    Notion Agents 应用推出全新设计的侧边栏,由设计师 Laura Sandoval 设计,目前正在逐步推送。该侧边栏已随 iOS 版 Notion Agents 应用发布。

  33. Arthur Mensch(@arthurmensch)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    黄仁勋:只有开放生态才能保障 AI 安全,NVIDIA 联合 100 多家伙伴推出 Open Agent Safety Platform

    NVIDIA 与 100 多家行业伙伴推出 Open Agent Safety Platform,整合 OpenShell 与 Sentry,目标是构建安全智能体系统的信任层。黄仁勋称这不只是一款产品,而是一个开放生态的开端,安全与创新并不冲突,信任是 AI 经济的基础。

  34. Aravind Srinivas(@AravSrinivas)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 安全团队招募:用前沿 AI 攻防 AI 智能体系统

    Perplexity 正在招募安全工程师,Kyle Polley 称团队正在构建并测试让 AI 智能体更安全可靠的系统,邀请擅长攻破系统、搭建防护栏的工程师加入,并可用前沿 AI 辅助攻防两端工作。

  35. cat(@_catwu)AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 发布:Claude Code 中任务完成量提升约 30%

    Anthropic 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,官方称其相较 Sonnet 5 提速超过 30%,多数工作成本最多降低 30%。在 Claude Code 中,用户完成任务量比 Sonnet 5 多约 30%,且完成同样工作所需 token 更少;演示中用工具调用扫落叶时比 Sonnet 5 快 24 秒、少用 6K token。

    为什么值得看

    原文给出 Claude Sonnet 5.5 在 Claude Code 中的任务完成量、速度与 token 消耗变化,可据此判断升级收益。

  36. GitHub(@github)AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 在 GitHub Copilot 正式可用

    Anthropic 的 Claude Sonnet 5.5 现已在 GitHub Copilot 中正式可用,面向构建功能、修复 bug 等范围明确的日常工作。GitHub 称早期测试中它在编码任务上与 Sonnet 5 表现相当,但使用的步骤、token 和工具调用明显更少,完成任务的速度也更快。用户可在 GitHub Copilot app、CLI 和 code 中试用。

  37. HeyGen(@HeyGen_Official)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HeyGen:把 Jev 放在 HeyGen MCP 前面,毫秒级决定哪些线索值得做视频

    HeyGen 称其找到 Jev 的最佳用法是放在 HeyGen MCP 前面:Jev 以毫秒级速度、极低成本判断哪些线索值得生成视频,再由 HeyGen 渲染通过筛选的线索。

  38. AI SDK(@aisdk)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 新增 Anthropic Claude 提供商支持

    AI SDK 已支持通过 Anthropic 和 Claude 接入,相关说明见 ai-sdk.dev 的 AI SDK 提供商文档。该消息由 AI SDK 官方账号发布,并同时 @AnthropicAI、@claudeai 与 @vercel。

  39. AI SDK(@aisdk)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 支持接入 Claude Sonnet 5.5

    Claude 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,相比 Sonnet 5 运行速度快 30% 以上,多数任务的成本最多降低 30%。AI SDK 表示可以在 AI SDK 中使用 Claude Sonnet 5.5。

  40. Cognition(@cognition_labs)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 谈 Devin 的模型独立性:为每类任务调用最优模型

    Cognition 表示,模型独立性让 Devin 能针对每部分工作调用最合适的模型,并持续优化其外层 harness:单次调用批量处理更多工作、并行执行更多动作、充分利用缓存上下文。最新模型与 harness 改进带来了更好的性价比。