跳到正文

#产品更新

今日 0 条
10月6日周二
  1. Harrison Chase(@hwchase17)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 为 Devin 推出 Dreaming 记忆机制并开源 Agent Memory Repo 标准

    Cognition 为 Devin 推出 Dreaming:跨会话构建反映用户工作方式的记忆图谱,并在夜间自我改进记忆,清除过期记录、发现潜在信息。同时推出了名为 Agent Memory Repo 的开源标准。Harrison Chase 表示,记忆需要离线清理循环而不只是更好的检索,否则过期记录会不断堆积,并认为记忆应当开放,但推断出的记忆在智能体使用前如何验证仍是待解问题。

10月5日周一
  1. InfoQ 中文AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Codex 负责人 Tibo:未来 28 天每天交付一项用户可感知改进,否则重置额度

    OpenAI 的 ChatGPT 和 Codex 负责人 Tibo Sottiaux 承诺,未来 28 天每天推出一项对大多数 Codex 和 Work 用户明显有用的改进,否则进行一次完整的额度重置。

10月4日周日
  1. Lenny Rachitsky(@lennysan)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sriram Krishnan:个人智能体时代产品经理回归

    Sriram Krishnan 认为,个人智能体的设计与 UX 让产品管理重新变得关键。Instinct、dot、muse、grok bot 都在大量投入产品工作,把 UX 与底层模型能力及其服务访问打通,用户往往不关心底层模型,而在意 muse 活动通知、Instinct 的点赞 emoji 这类细节。

9月29日周二
  1. Jerry Liu(@jerryjliu0)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    PageIndex 提出无需向量库的 RAG 方案,称在 FinanceBench 达 98.7%

    研究团队提出名为 PageIndex 的 RAG 新方法,跳过向量数据库、数据嵌入、分块和相似度检索,改为构建树索引让 LLM 像人读书一样推理文档。引用称其在 FinanceBench 上取得 98.7%,超过榜单上所有向量 RAG,且免费开源。Jerry Liu 转发并感叹如果这套方法流行,自己四年前就做得太早了。

9月28日周一
  1. AI科技评论AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naive AI 发布开源模型 Naive-N0.5-Flash,并披露两项 AI 研发任务

    Naive AI 发布开源模型 Naive-N0.5-Flash,权重与推理代码以 MIT 许可证开放,API 输入每百万 Token 0.6 元、输出每百万 2.6 元。

9月26日周六
  1. GitHub(@github)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub Copilot 的 canvases:聊天并非永远正确的 UI

    GitHub 官方账号抛出讨论:聊天是否永远是合适的 UI?@burkeholland 认为不是,至少在 GitHub Copilot 应用中有了 canvases 之后并非如此。该观点以文章形式发布,帖文互动量为 56 条回复、20 次转发、234 次点赞。

9月23日周三
  1. Genspark(@genspark_ai)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark COO 谈 AI 普惠:无需开 F1 也能用好智能引擎

    Genspark COO @sang_wen 在 All-In on AI Summit 上表示,AI 不应只属于专家,每个人都应从中受益。Genspark 据此打造了易于使用的 AI workspace。

  2. Guillermo Rauch(@rauchg)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Guillermo Rauch 称赞 Anthropic 的发布品味:Claude Opus 5.5 与 Next.js 展现设计前沿

    Vercel CEO Guillermo Rauch 称赞 Anthropic 的发布审美,认为 AI 让网页不再有借口不推进设计边界,并以 anthropic.com/claude-opus-5-5 页面为例称这是 Next.js 的最佳体现。他提到自己看好"headless"网页的原因正是每个页面都能呈现任意独特形态。

9月22日周二
  1. 深思圈AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z合伙人Josh Elman:10亿美元消费级AI App背后的产品逻辑

    a16z合伙人Josh Elman在访谈中提出,AI消费级产品的关键是让用户"停止做某件事",并以intriguing→adoption→spread→retention衡量增长。

9月17日周四
  1. Anton Osika – eu/acc(@antonosika)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 内部应用 4 个月内从 11 个增至 80 多个,17 个部门自建软件

    Lovable 各部门自建软件,内部应用从 4 月的 11 个增至 8 月的 80 多个,覆盖 17 个部门。其中 People 团队独自构建约 30 个应用,分析应用被全公司 80% 的人使用、处理 60% 的内部数据查询,社区团队用自建应用每月举办 345 场活动。

9月14日周一
  1. 随机小分队AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gamma CPO:100 人团队太臃肿,产品开始做减法

    Gamma 联合创始人兼 CPO Jon Noronha 在 First Round Capital 播客中复盘:这款超 1 亿注册用户的 AI 产品正拆掉 2023 年为弱模型搭的"护栏",不再由系统锁定字体与样式,转而让模型直接生成 HTML 和 CSS。团队约 100 人时已觉得太慢,主张服务上亿用户的系统只准备用六到十二个月,最终作品必须耐久,生产作品的方法可以易朽。

9月7日周一
  1. 十字路口CrossingAI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    快看漫画陈安妮谈 AI Native 新产品 Livo:一个实时活着的 AI 世界

    快看漫画创始人兼 CEO 陈安妮在播客对谈中披露,她正从零打造 AI Native 产品 Livo,定位"一个实时活着的 AI 世界",其中 AI 角色拥有自己的故事和梦想,用户言行会触发蝴蝶效应,核心功能名为"命运"。她同时回顾了创业 12 年的现金流断裂、2 亿美元融资与身体疼痛,并提出用"游戏精神"面对 AI 时代的内容行业变化。

8月20日周四
  1. 海外独角兽AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek Harness 发布:一套可热重载、可由 coding agent 自行修改的 Agent Harness

    DeepSeek Harness(DSH)发布了一套可热重载的 harness,设计成适合 coding agent 自己修改和进化的形态,以本地 Web UI 为主要入口,并提供标准、PTC/Code、极简、创造四个模式。

    为什么值得看

    梳理 DeepSeek Harness 的插件化三层结构与 Creator 模式,读者可对照 Anthropic 路线理解两种 harness 设计取舍。

8月18日周二
  1. Anton Osika – eu/acc(@antonosika)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 创始人 Anton Osika:做产品要走出去和用户聊,别坐在桌前空想

    Lovable 创始人 Anton Osika 表示,做生意的关键是做出让人们觉得价值高于付出的产品,而这没法坐在桌前想出来,必须和潜在用户交流以弄清该解决哪些问题、产品下一步往哪走。他举例说几天前在桑拿船上大部分时间都在问船主最大的痛点是什么、Lovable 能怎么帮上忙,并称与客户交谈的方式虽在演变,仍是他最喜欢的工作环节之一。

7月28日周二
  1. Smashing MagazineAI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MacPaw 如何为 AI 助手 Eney 设计角色形象

    MacPaw 推出主动式 AI 助手 Eney,放弃 Claude、ChatGPT 式的对话框形态,改用带表情与手势的圆形角色形象与用户交互。Eney 刻意减少屏幕动作,以眼睛作为主要情感连接点,并选用粉色而非 AI 产品常见的蓝色以形成区分。MacPaw 强调其设计全程由人类设计师决策,AI 只是加快流程的工具。

7月20日周一
  1. 十字路口CrossingAI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    生数科技张金涛聊 Vidu S1:推理加速与实时交互视频

    十字路口播客对话生数科技张金涛,聊月初发布的实时交互视频模型 Vidu S1:上传一张照片即可变成能实时视频通话的 AI 角色,生成速度超过播放速度并支持无限时长,实现 540P、25–42 FPS,可在消费级显卡上运行。

6月24日周三
  1. Andrej Karpathy(@karpathy)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 推出 Claude Tag,Claude 以团队成员身份加入 Slack

    Anthropic 推出 Claude Tag,让 Claude 以团队成员身份加入 Slack,可访问所选频道和工具、被 @ 后接受任务委派。Andrej Karpathy 认为这是 LLM 交互界面的第三次重大重构,前两次分别是网页版和被下载到电脑上的应用,这一次是自带工具与组织级上下文、持续存在且异步运行的实体,与人类团队并行工作。

5月16日周六
  1. 42章经AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    当软件容易被创作,新时代的产品长什么样?| 对谈 Albert

    连续创业者 Albert 在两个月内带团队试做了几十个新产品,均未达其发布标准,直到推出 merging.live,核心是为新的 maker 群体提供「回响」。他认为 Opus 4.6 之后模型厂商正加速挤压创业空间,但智能并非最高层的价值,因此不能围绕普遍性做产品。

7月5日周五
  1. OnBoard!AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OnBoard! 听友会实录:Monica.im、Answer AI、Logto 创始人谈出海如何打造百万用户产品

    Monica.im 创始人肖弘、Answer AI 创始人周立与 Logto 产品市场负责人李铭在 OnBoard! 听友会上分享出海实战经验,三家公司分别面向知识工作者、北美七至十二年级及大学生、全球开发者。