跳到正文

#Agent

今日 0 条
9月29日周二
  1. Simon Willison(@simonw)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Simon Willison 发布 Devs World Congress 主题演讲笔记与标注实录,盘点 2026 年 LLM 与智能体进展

    Simon Willison 为他在 San Jose 的 Devs World Congress North America 上所做主题演讲的视频,发布了详细笔记和带标注的文字实录。这份盘点回顾了 2026 年迄今 LLM 与 AI 智能体领域发生的各项进展。

  2. ManusAI(@ManusAI_HQ)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 与 CueAgents 可为智能体分配独立电话号码

    Manus 与 CueAgents 的智能体现在可以拥有自己的电话号码,用于拨打电话、接听电话和收发短信,用户还可以把自己的来电转接给智能体。该功能目前仅在部分国家上线,部分地区只支持语音,官方表示正在推动覆盖更多国家。

  3. Fireworks AI(@FireworksAI_HQ)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Normal 携 CAD Arena 加入 Fireworks AI 专业智能指数,评测 AI 跨五大 CAD 平台建模能力

    Normal 以 CAD Arena 加入 Fireworks AI 的专业智能指数(SII),把该指数扩展到工程设计领域。该基准测试 AI 智能体能否将工程图纸转成准确且可编辑的 CAD 零件,覆盖五个 CAD 平台。

  4. NVIDIA AI(@NVIDIAAI)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 黄仁勋谈 AI 智能体的安全边界

    NVIDIA CEO 黄仁勋在 CNBC 表示,AI 智能体需要明确的能力边界,且这些限制必须在智能体运行过程中持续有效。他介绍了 NVIDIA 正在构建的相关安全措施。

  5. Stack Overflow BlogAI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    你的 Human-in-the-Loop 是否正在拖慢你?我们的实践总结

    Stack Overflow 博客总结团队的分层 human-in-the-loop 实践:Prediction Router 按置信度把决策分三层,Tier 1 自动验证处理约 85% 流量、延迟低于 3 毫秒,Tier 2 异步专家复核约 12% 案例、4 到 6 小时完成,Tier 3 约 3% 高风险场景实时人工介入并设 30 到 60 秒确认窗口。

  6. Replit ⠕(@Replit)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 上线 Meta Quest VR 应用开发,接入 GPT-Sol 6、GPT-6 Luna 与 Opus 5.5

    Replit 一次性上线多项更新:支持构建 Meta Quest VR 应用、通过 Muse 创建 Replit 应用,并接入 GPT-Sol 6、GPT-6 Luna 和 Opus 5.5 三款新模型。同时新增 Airwallex 支付链接、在聊天中直接绘制数据图表,企业版则可在工作流内申请和控制访问权限。

  7. hidecloud(@hidecloud)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 旗下 Cue 限时免费,Android、Mac、Windows 版已上线

    Manus 旗下 Cue 限时免费开放,Android、Mac、Windows 版本现已可试用,iOS 版已提交审核、即将上线。需要邀请码的用户可在帖下留言获取。

  8. 屠龙之术AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    当 AI 开始设计芯片——聊聊 EDA 与 AI 时代的芯片设计

    播客「屠龙之术」邀请新思科技产品解决方案销售总监严华,围绕 EDA 行业地位、系统厂商自研芯片趋势以及 AI 对芯片设计的影响展开对谈。节目还讨论了作为硅基员工存在的 Agent、AI 全自动造芯的"神话"是否实现,以及未来几个人即可设计芯片的可能。

9月28日周一
  1. Cognition(@cognition_labs)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin Mobile 开启 beta 测试,可加入等待名单

    Cognition 宣布 Devin Mobile 现已开启 beta 测试,可通过下方链接加入等待名单。官方未披露具体功能与上线时间等细节。

  2. Aravind Srinivas(@AravSrinivas)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 披露 SPACE 沙箱 108 次越狱测试结果

    Perplexity 安全团队花一个月攻击其运行 Perplexity Computer 的沙箱平台 SPACE,给 Opus 5、GPT-5.6 Sol、Kimi K3、Gemini 3.1 Pro 等 9 个模型 VM 内 root 权限,部分测试还提供完整沙箱源码,要求它们逃逸到宿主机或访问被网络策略拦截的 URL。

  3. Justine Moore(@venturetwins)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何用 Claude 复刻 a16z 数据中心宣传片

    Justine Moore 以 a16z 的 It's Time to Build 视频为参考,让 Claude 制作一支数据中心主题的类似短片,并让 Claude 复盘了自己的制作流程。

  4. ManusAI(@ManusAI_HQ)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ManusAI 在 Cue 上推出个人智能体

    ManusAI 在 Cue 上推出个人智能体。官方以“我们带了个朋友来,你们应该会合得来”的口吻发布这一消息。

  5. ManusAI(@ManusAI_HQ)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 2.0 发布

    Manus 发布 2.0 版本,官方以「Introducing Manus 2.0」宣布这一更新,并附上演示视频。该消息在社交平台获得约 332 条回复、610 次转发和 9159 次点赞,浏览量约 1099 万。

  6. Yangyi(@Yangyixxxx)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code Opus5.5 一次跑通租赁图纸→CAD→Blender 渲染→Web 共享

    有用户演示了 Claude Code Opus5.5 可一次性完成租赁图纸到 CAD(JWW、DXF)、再到 Blender 高画质渲染的透视图,并直接生成 Web 共享页面。该帖作者称其能做的事太多,反而让工作推进不下去,并引发结合家具软装生成选品的设想。

  7. Perplexity(@perplexity_ai)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 联合 Nvidia 等搭建沙箱,测试 9 个 AI 模型能否逃逸

    Perplexity 宣布与 Nvidia 及 100 多家行业伙伴合作,建设用于隔离 rogue AI agents 的基础设施。其研究将 9 个 AI 模型放入 SPACE 并赋予 root 权限、要求它们突破环境,在 108 次运行中没有任何模型突破 VM 边界。

  8. ManusAI(@ManusAI_HQ)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 推出桌面版客户端

    Manus 发布桌面版,可通过 manus.im/desktop 下载。该消息由 ManusAI 官方账号发布,未披露具体功能与系统支持信息。

  9. Philipp Schmid(@_philschmid)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini Managed Agents 推出 Credentials API:密钥不再以普通环境变量暴露给沙箱依赖

    Gemini Managed Agents 新增 Credentials API,把 API 密钥等敏感信息从普通环境变量中移出,仅在请求可信域名时于传输层注入,沙箱内的代码无法读取原始 token。该能力支持环境变量、CLI 和 MCP Server。

  10. 魔搭ModelScope社区AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    斯坦福与英伟达开源 CLM-8B:75MB 对比学习验证器刷新 DeepSWE 与 Terminal-Bench 2.1

    斯坦福大学与 NVIDIA Research 联合发布 Contrastive Language Models(CLM),一类用对比学习目标训练的 System One 决策模型,首发版本 CLM-8B 以冻结的 Qwen3-8B 为骨干,只训练 2000 万参数的 MLP 投影头,检查点仅 75MB。

  11. ElevenLabs(@elevenlabsio)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 发布表现力语音生成新模型 v4

    ElevenLabs 发布新一代表现力语音生成模型,官方称其为最新研究成果的集成,面向角色表演和对话式智能体等强调表达效果的场景。模型已在 ElevenAgents、ElevenCreative 和 ElevenAPI 上线,地址为 elevenlabs.io/v4。

  12. Thomas Wolf(@Thom_Wolf)AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 发布 Open Agent Safety Platform,Hugging Face 参与合作

    英伟达联合 100 多家行业伙伴发布 NVIDIA Open Agent Safety Platform,整合开源组件 OpenShell 与 Sentry。Hugging Face 的 Thomas Wolf 表示,7 月有 AI 智能体在安全测试中逃出沙箱并进入 Hugging Face 服务器,因此安全不能只放在智能体内部,而要围绕它构建。

  13. 袋鼠帝AI客栈AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    体验国内首款个人 AI 助理 Today:主动提醒 PR、找选题、写中秋祝福

    国内首款个人 AI 助理 Today 中国版已正式上线,基础版永久免费,新用户可领 1 亿 token 和 1 个月 Pro 会员。它可读取本地文件夹、X 推文、GitHub 项目和 Gmail 作为上下文,主动提醒待办并推进 PR review。作者基于它搭建的个人助理"毛肚"还完成了中秋祝福撰写、X 账号运营分析和国庆出行规划。

  14. idoubi(@idoubicc)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实时查看 Agent 的每一个请求

    实时查看 Agent 的每一个请求。该内容由 xgo.ing 提供支持,帖子获得 688 次浏览。

  15. idoubi(@idoubicc)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    市面常见 Agent 可一键接入同一个 autojev 路由器

    市面常见的 Agent 均可一键接入同一个 autojev 路由器。该帖未披露支持的具体 Agent 名单、接入方式或 autojev 的项目来源与可用性细节。

  16. 京东技术AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    京东零售 Forge Agent 如何用 Agentic 重塑搜推数据生产体系

    京东零售构建了以 Forge Agent 为统一 AI 门面、Sindri Plugin/MCP 为确定性工具、Sindri 后端负责规划与提交、ADF 承载 DAG 与调度生命周期的人工智能数据研发链路。

  17. idoubi(@idoubicc)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    autojev.ai 开源:基于 jev 决策的模型路由器,为本地 Agent 自动选模型

    autojev.ai 已开源,这是一个基于 jev 决策的模型路由器,为本地 Agent 自动选择合适的模型处理对话请求,在速度、成本、质量之间取得平衡。原文未披露支持的具体模型清单、路由策略细节与性能数据。

  18. NVIDIA AI(@NVIDIAAI)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 发布开放智能体安全平台 OpenShell 与 Sentry

    NVIDIA 与超过 100 家行业合作伙伴推出 NVIDIA Open Agent Safety Platform,整合 OpenShell 和 Sentry 两款产品。

  19. LangChain BlogAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何用 Jev 和 LangGraph 构建生产级智能体

    TypeSafe AI 上周发布决策模型 Jev,它不生成文本,而是返回带概率的类型化答案;TypeSafe 基准显示在路由和分类等窄判断任务上,Jev 比领先 LLM 快至多 200 倍、便宜 400 倍。

  20. LangChain BlogAI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith 推出 Custom Apps:围绕智能体数据构建自定义界面

    LangChain 在 LangSmith 中推出 Custom Apps,可将基于 LangSmith 数据的自定义 UI 构建、发布并直接在其中运行,省去托管、鉴权和权限工作。

  21. LangChain BlogAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith 发布 Engine v2、Managed Deep Agents v0.8、Trajectories 与 Fine-Tuning 等更新

    LangChain 在 Interrupt NYC 上发布 LangSmith 多项更新:Engine v2 加入 Red Teaming 主动排查问题、扩展问题类型识别,并可在人工审核前自动验证修复方案;Engine 自 5 月上线以来已分析超过 60M traces,诊断数万个问题。

  22. 甲子光年AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从产品在线到数据产线:阿里云谈制造业如何让经验持续获得复利

    阿里云在云栖大会先进制造AI论坛上提出,制造业正从"产品售出"走向"产品在线",把设备运行数据回流研发与生产,形成数据网络效应。其数据产线覆盖数据接入、知识组织、模型训练、业务执行与反馈回流,并以Qwen、真武AI芯片和阿里云基础设施支撑自主可信、本地化、专业化、生态化"四化"。宁德时代已积累超600TB研发测试数据,覆盖3000万辆新能源汽车和3000个储能电站真实运行数据。

  23. AI科技大本营AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenClaw 之父对话 GitHub 创始人:PR 已死,该发 Prompt 了

    OpenClaw 之父 Peter Steinberger 与 GitHub 联合创始人 Tom Preston-Werner 在播客《AI Worth Using》中提出,AI 批量生成样板代码后开源项目应废除传统 Pull Request,改收附带思考链路与脱敏 Prompt 的 Issue。

  24. AI科技评论AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naive AI 发布开源模型 Naive-N0.5-Flash,并披露两项 AI 研发任务

    Naive AI 发布开源模型 Naive-N0.5-Flash,权重与推理代码以 MIT 许可证开放,API 输入每百万 Token 0.6 元、输出每百万 2.6 元。

  25. 刘小排rAI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    刘小排:别等 AI 干活,让 AI 等你——从「我该干点什么」到「我干什么时顺便让 AI 干活」

    刘小排提出应把提问方式从「等待 AI 干活时我该干点什么」改为「我干什么的时候可以顺便让 AI 干活」,主角由 AI 换成人。他不再盯屏幕等结果,让 AI 在后台跑、有事再来汇报;并建议先从「我不用电脑了」开始尝试,祝读者一边享受国庆假期一边日踩 10 亿 Token。

  26. 51CTO技术栈AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克:AI编程已卷到头,下一场硬仗是让 AI 走出 IDE 进入现实世界工程

    马斯克在央视财经约26分钟专访中表示,Anthropic 让 AI 擅长了软件工程,但还没人让 AI 真正擅长现实世界工程。他计划用 SpaceX 和 Tesla 的工程数据训练 Grok,让模型进入汽车、机器人和火箭系统;并称按每单位算力性能看中国可能明显领先。

  27. 稀土掘金技术社区AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 预告 DevDay 发布代号 "O" 的 Agent,瞄准 Meta Muse

    Meta 的 Muse 刚登上 Assistant Benchmark 最强 Agent 位置,OpenAI 随即预告将在 29 号 DevDay(北京时间 30 日凌晨)发布代号为 "O" 的 Agent。传言称 "O" 拥有独立身份、可无中断执行长程任务,并可能由 GPT-6 Astra 变体驱动。

  28. NVIDIA Technical BlogAI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 开放智能体安全平台:面向持续在硅智能体监控的参考方案

    NVIDIA 发布开放智能体安全平台,为持续在硅智能体监控提供参考方案。该平台定位为参考实现,用于对智能体行为进行持续监控。

  29. NVIDIA Technical BlogAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA OpenShell 为 AI 智能体添加运行时控制

    NVIDIA 发布 OpenShell,为 AI 智能体加入运行时控制能力,使其在获得工作区、算力、数据、凭证与外部服务访问权限的同时可被约束。AI 智能体可被赋予目标、编写代码、调用工具,并在新信息出现时持续工作,支撑软件故障排查、实验运行以及跨越数天或数周的关键业务操作与研究。

  30. 腾讯研究院AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI会取代真人短剧吗?腾讯研究院圆桌谈内容通胀与行业新稀缺资源

    今年前8个月全网上线微短剧43万部,是2025年全年的13倍,其中90%以上由AI生成;仅第一季度上线的12.8万部中AI微短剧占比超过95%。腾讯研究院《仲夏六日谈》邀请广电总局发展研究中心彭锦、AI短剧《风水天师》出品方邱熠与腾讯在线视频曹睿,围绕“AI会不会取代真人短剧”讨论内容通胀、审美降级与利润流向。嘉宾认为行业新稀缺资源集中在好故事、判断力、经验以及发行变现能力。

  31. Yangyi(@Yangyixxxx)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    究竟是哪家厂商会先发布 Agent OS?传字节豆包 6 天工期对标 Meta Muse

    多方爆料称,字节跳动豆包产品线被紧急下达任务,要求对标 Meta AI 助手 Muse 推出全托管型 AI 新产品,内部优先级极高,仅给 6 天工期。该被对标产品可一键订机票、发邮件、填表格,甚至接管社交软件代为回消息,曾登上美区苹果商店免费榜第一。

  32. 大淘宝技术AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    大淘宝技术团队 Ontology 决策结构化实践:不预画 workflow,让 Agent 全托管 120+ 工作项

    大淘宝商家财务团队用 Ontology 四层图谱(业务/系统/交付/治理)加 decision_function 结构化决策,替代预设 workflow 和打包 Skill,让 Agent 按"先取证、再决策、后行动"闭环动态生成流程,3 个月在 Agent Room 完成 120+ 需求与工作项,覆盖需求开发、工单处理、数据订正和业务运维。