跳到正文

全部动态

今日 0 条
10月1日周四
  1. 跨国串门儿计划AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    比尔·阿克曼:投资前先想清楚十年后还愿意持有吗

    Pershing Square 创始人兼 CEO 比尔·阿克曼在播客中警告,AI 带来的颠覆风险让投资者更难判断企业护城河能否守住,市场终可能出现崩盘让很多人赔掉一大笔钱。他以 Netflix 推出广告模式打破原有投资逻辑为例,说明出现与逻辑相悖的新信息时应加仓或离场,并建议普通人尽早开始长期投资、可用指数基金。

  2. AI产品黄叔(@PMbackttfuture)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    dot 打电话体验可替代 chat 通话,用户讨论 grokbot 多 bot 迁移

    有用户实测给 dot 打电话,认为可以完美替代此前在 chat 里打电话的需求。社群有朋友提出可把 grokbot 迁移过来,但该用户感觉两者不一样,并认为多 bot 形态更容易接受,例如 grokbot 里有视频号提取 bot、视频号批量提取 bot、邮箱 bot、微信 bot 等多个专用 bot。

  3. CSDNAI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    黄仁勋、马斯克与 Anthropic 联创 Tom Brown 同台:太空发电、硬件熔断与代码不再值钱

    在华盛顿一场科技圆桌论坛上,马斯克称美国平均用电负荷约 500 GW,每新增 5 GW 基荷电力约拉动 1% GDP(约 3000 亿美元),并主张把算力送上太空,SpaceX 计划与特斯拉联手实现每年 200 GW 太阳能组件产能。

  4. Justine Moore(@venturetwins)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Opus 5.5、Gemini 2.5 Flash、SAM 3.1 与 Ideogram 4.5 搭出一支工程团队的活

    有人用 Opus 5.5、Gemini 2.5 Flash、SAM 3.1 和 Ideogram 4.5 组成一套技术栈,分别负责界面、照片分类、图像分割和编辑,全部通过一个 fal API key 跑通,并称过去这需要一整支工程团队才能完成。

  5. Guillermo Rauch(@rauchg)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel AI Gateway:拒绝"免费 token"推广,做全球 AI token 流向的可信数据源

    Vercel AI Gateway 称其是全球 AI token 流向最大的可信数据源,因为它掌握真实客户在规模化平台上的真实用量,且零加价,平台已有 40 万+付费客户和数千家企业。

  6. 晚点LatePostAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    晚点 AI 季报:Meta Muse 与 OpenAI Dots 引爆个人助理,GPT-6 Astra 展现物理 AI 潜力

    OpenAI 在 DevDay 发布个人助手 Dots,Meta 的 Muse 则于 9 月 8 日上线并在 16 天内突破 340 万下载,引爆个人助理热潮。OpenAI 的 GPT-6 Astra 在 OSWorld 2.0 上从 65% 升至 72%,任务耗时缩短 47%。OpenAI 的 ARR 在 1 个半月内从超 400 亿美元涨至近 700 亿美元,涨幅约 70%。

  7. 深思圈AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Instinct 创始人 Noah Shinn:Personal Agent 正在重写互联网

    Instinct 是一个没有 App 的 AI 个人助理,通过短信、电话、邮件替用户订机票、管订阅、规划行程,创始人 Noah Shinn 称产品每天增长约 10%,平台年交易额已超十亿美元。它采用免费模式,在用户完成交易时从商家侧收取 take rate,其中 50% 交易额来自旅行;用户入驻满三周后有 40% 会主动分享信用卡信息,留存率随之跳到 80%。

  8. Varun Mohan(@_mohansolo)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Varun Mohan:Gemini 4 Argon 在 AA Coding Agent Index 上表现不错

    Varun Mohan 表示,现实世界使用更重要,但很高兴看到 Gemini 4 Argon 在 AA Coding Agent Index 上使用 Antigravity harness 表现不错,并称还有更多内容。

  9. Sahil Lavingia(@shl)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    不用 AI 写代码就像做菜不放盐

    Sahil Lavingia 发帖称"不用 AI 写代码就像做菜不放盐",该帖获得 625 个点赞、134 条回复和 31 次转发,浏览量达 34962。

  10. Richard Socher(@RichardSocher)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Richard Socher 新书成为全国畅销书,谈 AI 与科学进步对文明的意义

    Richard Socher 的新书成为全国畅销书,他在推文中表示,想理解 AI 与科学进步对文明的上行空间以及未来走向,这本书值得一读。该书由 PublicAffairs 出版。

  11. orange.ai(@oran_ge)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    两年前感到虚无的大聪明,如今成了我见过最充实的人

    两年前大聪明说自己感到一种虚无感,这两年却成了我见过最充实的人。战胜虚无的第一步是勇敢地面对它,如今越来越多人也开始感到虚无,我请大聪明分享过来人的经验。

  12. orange.ai(@oran_ge)AI 评估 · 5/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    orange.ai 分享 x.com 文章链接

    orange.ai(@oran_ge)在 X 上发布了一条指向 x.com 文章的链接,附带互动数据:3 条回复、7 次转发、54 次点赞、33051 次浏览。

  13. 有机大橘子AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    播客对谈:RSI 时代人类的命运与意义,从战锤、群星聊到湿件与俺寻思之力

    播客「有机大橘子」与赛博禅心主理人大聪明对谈 RSI 时代人类的命运与意义,提出人类始终有力量与意义两条腿,而当生产力集中在超级智能手中,围绕 AI 的人的意义却是缺失的,人越久待 AI 越易感到虚无。对谈借战锤、群星、四国演义、俺寻思之力与蒸发的尺子五个故事展开,称评价 AI 时代好坏的尺子已经蒸发。给普通人的建议是认清自己是普通人,以及快乐生活、保持健康,并把贬值快的换成贬值慢的。

  14. 十字路口CrossingAI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Richard Sutton《苦涩的教训》:AI 研究为何应当相信 Scaling Law

    Richard Sutton 在《苦涩的教训》中指出,回顾 70 年 AI 研究,长期最有效的往往是能持续利用更多算力的通用方法,而非人类精心设计的领域知识。国际象棋、围棋、语音识别与计算机视觉的历史都显示,研究者起初想用人类理解减少搜索,真正的突破却来自拥抱搜索和学习。他因此认为,搜索和学习是当前最能随算力扩展的两类方法,而试图把人类对心智的理解直接写进系统,长期会停滞甚至阻碍突破。

  15. Runway(@runwayml)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway Research 团队深度问答:实时模型、生成式界面与机器人下一步

    Runway Research 团队在一场深度问答中讨论了实时模型、生成式界面以及机器人技术的下一步方向。

  16. Demis Hassabis(@demishassabis)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Demis Hassabis 为团队成果发声:详情见博客

    Demis Hassabis 发文表示为团队长期投入的工作感到自豪,并附上博客链接供了解详情。原文未披露具体模型、产品或技术细节。

  17. Lenny Rachitsky(@lennysan)AI 评估 · 5/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lenny Rachitsky 分享 @rmstein 完整演讲视频

    Lenny Rachitsky 在 X 上发布了 @rmstein 的完整演讲,附带 YouTube 视频链接。帖子获得 17 个点赞、2 次转发和 6800 次浏览。

  18. Latent.Space(@latentspacepod)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 与 trq212 讨论提示词工程、MCP 与智能体原生架构

    一则以笔记形式讨论提示词工程:提示词取决于心智模型是否匹配、以及是否具备足够领域词汇,而非把指令写得更长;领域词汇来自实际做过该工作。作者指出 MCP 只是无头 API、Artifact 是短生命周期 UI,二者可跨 MCP 组合,并把这套"brain / hands / surface"读作智能体原生的经典软件架构版本:未来开发从写前端转向写 MCP server,由智能体组合 UI。

  19. Latent.Space(@latentspacepod)AI 评估 · 5/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Latent.Space 的 AI newsletter 获用户好评

    有用户推荐 Latent.Space 的 newsletter,称其长期寻找真正能为 AI 话题带来价值的内容,而这一份"非常非常好"。该推文由 Aleix Prat 发布,互动数据为 4 次点赞、1626 次查看。

  20. Lenny Rachitsky(@lennysan)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lenny Rachitsky 喊话 Google:不是要 diss,是想激励其行动

    Lenny Rachitsky 发帖表示自己并非要 diss Google,而是希望激励其采取行动。该帖互动数据为 6 条回复、30 次点赞、3970 次浏览,由 xgo.ing 提供支持。

  21. 大模型智能AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 神秘 RL 后训练算法被指只是 STE 近似:解析 Score Centering 与 vLLM/Megatron 训推不一致问题

    针对 arXiv 论文《Score Centering Stabilizes Off Policy Reinforcement Learning》被传为 OpenAI 后训练 RL 算法,有分析指出该 score centering 算法本质上是 STE(straight through estimation)的近似实现,其梯度与 STE 方案完全一致。

9月30日周三
  1. Lenny Rachitsky(@lennysan)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 助手争相挖掘 Google 数据,Google 却缺席?

    Lenny Rachitsky 发问:还有比你的 Google 数据更有价值的数据集吗?他指出每个 AI 助手都在"吞食"这些数据并做出奇妙的事,而 Google 在这一领域却不见踪影。该帖获得 119 条回复、16 次转发和 592 个点赞,浏览量达 116059。

  2. Aadit Sheth(@aaditsh)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 将重写整个旅游行业:机票酒店都将由 AI 代订

    AI 将重写整个旅游行业,机票、酒店和旅行体验都将由 AI 完成预订,未来用户不必再自己办理航班值机。这一过程会通过 Instinct、Chat、Claude 等聊天工具完成,并越来越多地发生在 iMessage 或 WhatsApp 里。

  3. AI Engineer(@aiDotEngineer)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI Engineer New York:Towards AI 联合创始人兼 CTO 基准测试 148 个模型复刻个人文风

    Towards AI 联合创始人兼 CTO 将在 AI Engineer New York 分享:因不满 AI 生成的流水线内容,他基准测试了 148 个模型,寻找能模仿自己文风的模型,并发现衡量"品味"必须依赖人工评分。活动时间为 10 月 12 日至 14 日。

  4. Paul Graham(@paulg)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Paul Graham:错误有限且不重犯,就能逼近完美

    Paul Graham 提出,若某个领域的可能错误是有限的,且你从不重犯同一个错误,就有机会最终逼近完美。他引用玻尔的话说明,专家就是在极窄领域里犯遍了所有能犯的错误的人。

  5. Martin Fowler(@martinfowler)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Martin Fowler:幻灯片何时该用——Sumeet Gayathri Moghe 谈演示文稿的视觉辅助原则

    Sumeet Gayathri Moghe 提出,幻灯片只有在作为视觉通道补充演讲者而非取代演讲者时才有价值,并据此总结出一套演示设计原则。相关内容发布于 martinfowler.com。

  6. 晚点LatePostAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从编程到个人助理:更强大的 AI,更透明的你

    晚点LatePost 梳理了 AI 编程工具与个人助理带来的数据隐私风险:智谱 ZCode 因代码库索引功能默认打包上传项目数据致歉并删除数据、补偿 Token,xAI 的 Grok Build 也曾上传约 5.48GB 项目文件且未脱敏。

  7. idoubi(@idoubicc)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Your SaaS 应该有一个 agent skill

    Jonathan Wilke 提出,SaaS 产品应该配备一个 agent skill,而非只提供 MCP server。该观点以引用推文形式发布,未披露具体实现方式或支持的产品。

  8. Founder ParkAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Instinct 创始人对谈:没有 App 的 Personal Agent 如何做到年化 10 亿美元交易额

    Instinct 创始人 Noah Shinn 在 Patrick O'Shaughnessy 播客上首次以长访谈形式介绍这款没有 App 的个人助理,用户通过短信、电话和邮件与它交互,它也能主动打电话提醒急事。

  9. 网易科技AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    三位00后创业者坦白局:技术、组织、死亡谷,和第一单白酒

    在2026网易未来大会上,灵初智能陈源培、OriginFlow秦深涛、万格智元王冠博三位00后创业者对话,谈具身智能落地瓶颈从算法转向算法工程化,创业公司真正的"死亡谷"在50到150人之间,端侧AI可用4G内存推理35B模型、10G内存推理80B模型。

  10. orange.ai(@oran_ge)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    花 1 美金 token 做的小软件,比很多专业骑行软件还好用

    有人花 1 美金 token 做了一个骑行小软件,自称比很多专业骑行软件都做得好,现在每次骑车都会用它。作者借国庆假期建议大家多多运动、少看 AI。

  11. 跨国串门儿计划AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    扎克伯格的优势:不领先,也不肯停下来

    Colossus 撰稿人 Jeremy Stern 为扎克伯格撰写人物特写,采访了 36 位相关人士。文章讲述 Llama 4 发布后扎克伯格重组 AI 团队、成立 Meta Superintelligence Labs 并大幅增加投入,以及 Meta 押注 AI 眼镜、试图用广告收入和数据中心把 AI 推给数十亿现有用户的路径。

  12. orange.ai(@oran_ge)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 报告批评开源模型安全,被指借机推销闭源模型

    在 OpenAI 宣布企业套餐加入 GLM 5.3 等开源模型后,Anthropic 发布报告批评开源模型安全问题。报告称 GLM 5.3 是网络安全能力最强的开源模型、落后美国前沿模型约 4 个月,且是测试中唯一具备漏洞利用能力的模型,但可通过 abliteration 移除拒绝行为,单次成本约 4400 美元。

  13. AI科技大本营AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克、黄仁勋、Anthropic 联创同台:太空发电、硬件熔断与代码不再值钱

    在华盛顿一场科技圆桌论坛上,黄仁勋、马斯克与 Anthropic 联合创始人 Tom Brown 同台对话。

  14. 深网腾讯新闻AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前京东智驾老兵刘东的星源智:只做具身智能“大脑”,已合作70%以上头部机器人公司

    星源智创始人刘东(前京东智能驾驶负责人)选择只做具身智能“大脑”不做本体,产品包括具身“大脑”模型与端侧算力平台,成立两个月后即开始交付,目前已与70%以上的头部机器人公司建立合作,预计今年实现数亿元收入。

  15. Z PotentialsAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    外滩大会AI2C论坛全纪实:从入口到交易,AI正在重写消费的每一个环节

    2026外滩大会·AI2C论坛在上海举行,12位创业者与投资人围绕AI如何从消费入口走向交易展开讨论。影眸科技Hyper3D现场演示Rodin 2.5,4秒生成基础3D模型、80秒生成千万级面数高精度资产,并已为劳氏3万多个SKU重建3D资产、将单件建模成本从100美金压到1美金以下。下半场焦点转向Agent代理搜索与支付,FluxA提出支付需感知用户意图、进入Agent执行上下文。

  16. 深思圈AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z 深度对话:personal agent 的正确打开方式是什么

    a16z General Partner Anish Acharya 与 Assistant Benchmark 创始人 David Pawlan 在播客中讨论 personal AI agent:David 追踪到 122 个同类产品并亲自测试 26 个,他认为 proactivity(主动性)才是真正的护城河,而非功能多少或底层模型。

  17. Jerry Liu(@jerryjliu0)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jerry Liu:希望 dots 是独立应用,而不是 ChatGPT 里的一个功能

    Jerry Liu 表示希望 dots 成为独立应用而非 ChatGPT 的一部分,认为它目前更像 GPTs 那样的产品功能,而不是一次令人兴奋的新发布。

  18. andrew chen(@andrewchen)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    开放权重 AI 应走向客户可控的护栏,而非黑盒规则

    开放权重 AI 的发展方向应是客户可控的护栏,而非黑盒规则。该观点认为,让客户掌控护栏优于不透明的黑盒机制,是开放权重模型需要演进的方向。

  19. Suhail(@Suhail)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Suhail:希望 AI 任何地方的进步都带来好日子而非被颠覆

    Suhail 表示,他这次非常在意一件事:无论 AI 的进步来自哪里,都应让多数日子变成好日子,而不是难熬的日子,也就是自己不被颠覆。他把今天视作对这一判断的一次不错的检验,并认为结果仍然成立。