跳到正文

全部动态

今日 0 条
10月8日周四
  1. 李继刚(@lijigang_com)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Prompt:过去一百年里,对人类进步「影响最大」的十篇论文是哪些?

    李继刚(@lijigang_com)发出一条 Prompt,询问过去一百年里对人类进步「影响最大」的十篇论文是哪些。该条内容获得 296 次点赞、27 次转发、39 条回复,浏览量 148871。

  2. 硬氪AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    硬氪首发丨AI眼镜品牌NIMO完成数亿元天使轮融资,估值15亿元

    AI眼镜品牌NIMO所属公司比特幻境完成数亿元人民币天使轮融资,最新估值15亿元,投资方包括博华资本、戈壁创投、元禾璞华和尚势资本。NIMO首款产品于今年4月出货,月度销售达数千台,已合作约150家线下门店,并与雅视光学达成深度合作。产品重约29克,采用0.06英寸MicroLED微显示芯片和0.03cc自研超微型光机。

  3. 极客公园AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NOOKLAB 推出 AI 墨水屏 Moonphase Flip,红杉、线性参投

    NOOKLAB 推出首款产品 Moonphase Flip,一块可磁吸在手机背面的 AI 墨水屏,支持全天无感录音、实时转写和 AI 自动提取 todo 与日程,仅在日程、任务、AI 交互三个 Tab 呈现,续航两三天。

  4. Justine Moore(@venturetwins)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok Bot 上线 X 搜索监控功能,可扫描平台上的负面言论

    Grok Bot 现已能搜索、读取并监控 X 上的内容。用户实测让它扫描针对自己的负面言论,结果覆盖面之广超出预期,其中大部分内容此前未曾见过。

  5. 纪源资本AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    米正科技张相成:把摩卡壶的灵魂装进9bar微型意式机PURA

    米正科技创始人张相成推出微型意式咖啡机PURA,采用"下进水、上出液"的专利水路与加压萃取系统,粉饼端萃取压力稳定在6–9bar,并已申请"世界最小专业意式咖啡机"吉尼斯纪录和SCA专业认证。

  6. 歸藏的AI工具箱AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Haiku 5.5 对比中国模型:价格更低,Max 和 Team 用户获赠 API 额度

    Anthropic 的 Haiku 5.5 定价低于 DeepSeek-V4.1 flash 和智谱 GLM 5.3 flash,在 Terminal Bench 4.0 上比 GLM 5.3 flash 高一分,与其他两个中国竞品相当或更高。Anthropic 还向每个 Max 和 Team 用户赠送对应额度的 API 金额,该 API 可在任何支持输入 API 的产品中使用。

  7. 有机大橘子AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Personal Agent 大战:OpenAI Dots、Meta Muse、Instinct 各自走到了哪一步

    OpenAI 在 DevDay 发布的 Dots 回到 ChatGPT 式聊天形态,但存在记忆不共享、语音聊天要响两声才接、云电脑完全不开放等缺口;Meta 的 Muse 则提供 SDK 和适配 ESP32 的 AgentReady 通用固件,可直刷设备。

  8. 钛媒体AGIAI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6全球上线、Claude Haiku 5.5降价,假期AI圈动态汇总

    OpenAI宣布搭载智能界面(Intelligent UI)的GPT-6面向全球ChatGPT用户推出,Plus、Pro、Business和Enterprise用户先行,Free和Go用户次日起可用;其作答改为边想边答,联网搜索问题平均比上一代提前44%开始作答。

  9. 钛媒体AGIAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    成为 AI 原生超级组织:2026 ITValue 数字价值年会闭门会谈模型、数据与组织记忆

    2026 ITValue Summit 数字价值年会“如何成为一个 AI 原生的超级组织”闭门会在三亚举行,StartLux 郭权玮、百望股份王强宇、品胜丛泽龙分别从智能基础设施、企业数据与模型、硬件研发实践切入。

  10. 多维资本AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    北卓医疗完成近亿元Pre-A轮融资,加速无创脑机商业化落地

    北卓医疗宣布完成近亿元Pre-A轮融资,由元明资本与中关村资本联合领投,多维资本担任财务顾问,资金将用于核心技术迭代、临床管线推进与医疗器械注册申报。

  11. 有新NewinAI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软和 a16z 投了一家 AI 催收公司 Stuut,B 轮融资 5250 万美元

    纽约创业公司 Stuut 完成 5250 万美元 B 轮融资,由 Insight Partners 领投,Andreessen Horowitz、微软旗下 M12 和 Activant 参投。Stuut 从应收账款催收切入,用 AI 接管从订单到回款的跟进、争议处理与 ERP 核销,目前已有超过 150 家企业使用,累计经平台流转资金超过 30 亿美元。

  12. 国际大厂AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软发布 AI 硬件与 Windows 11 更新,强化本地智能体工作流

    微软在时隔两年的首场线下活动中发布 Surface Laptop Ultra 与 5999 美元的 Surface RTX Spark Dev Box,并公布 Windows 11 的多项更新。

  13. 掘金本周最热AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 写的小程序「厨菜记」上线 19 天开通流量主,累计 601 访客、收入几块钱

    全程由 AI 编写的小程序「厨菜记」9 月 18 日上线,19 天后累计独立访客 601、日均新增 30 人,是作者乐观预测上限的三倍,并已开通流量主。作者将预测失误归因于内容传播呈脉冲式,以及家庭内 2 到 4 人的裂变乘数。流量主开通两天累计收入几块钱,他只保留菜谱列表底部一个 Banner。

  14. 线性资本AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    本溯智能BASAL完成种子轮融资,五源资本领投、线性资本参投

    本溯智能BASAL完成由五源资本领投、常春藤资本、线性资本、华山资本参与的种子轮融资,公司由清华AIR首届博士生李健雄带领八名具身智能研究者创立于2026年7月。

  15. Viking(@vikingmute)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    《You're Already a Meat Proxy》一文引热议:人类工程师的价值在于品味与判断力

    一篇题为《You're Already a Meat Proxy》的文章引发讨论,作者提出人类工程师真正的价值在于高阶的品味与判断力(Taste and Judgment)。文章给出两种个人选择:若只想求薪水与生活平衡,就坦诚地用 AI 高效完成本职工作;若想在职业上获得主导权,则应放下亲自敲代码的执念,把 AI 当作杠杆去解决真正重要的问题。

  16. Paul Graham(@paulg)AI 评估 · 0/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Paul Graham:你的使用限制就是我的机会

    Paul Graham 发帖称"你的使用限制就是我的机会",该帖获得 2745 点赞、116 转发与超 50 万次浏览。帖文未指明具体产品或公司,仅表达对使用限制所带来机会的判断。

  17. Paul Graham(@paulg)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Paul Graham:禁用 AI 智能体的业务,正是创业公司做竞品的机会

    Paul Graham 认为,任何禁止 AI 智能体的业务都为创业公司留下做竞品的机会。他给出两条推理:需要禁用说明用户想用,否则禁令毫无意义;而这正意味着市场存在对允许使用智能体的替代品的需求。

  18. freeCodeCamp.orgAI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何在 CPU 上从零构建并训练 2500 万参数 LLM

    freeCodeCamp.org 发布一小时视频教程,演示在笔记本或普通 CPU 上从零构建、预训练并微调一个 2500 万参数语言模型。课程涵盖混合线性/稀疏注意力、MoE、绑定嵌入权重和多模态图像 patch 输入等现代架构,并搭建轻量 RL 循环让模型写代码、跑单元测试、拿奖励,任务成功率从 0% 提升到通过多数评测。教程还讲解如何形成可检验假设、调节温度与奖励结构并检查统计显著性。

  19. 硬氪AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    卫澜深海 9 个月内完成 5 轮融资,深创投、元禾原点押注水下具身智能机器人

    海洋具身智能公司卫澜深海在 9 个月内完成 5 轮融资,轮次推进至天使++++轮,核心股东包括深创投、元禾原点,资金用于训练水下具身智能模型、建设水下具身智能训练中心及深化海洋油气能源场景应用。

  20. orange.ai(@oran_ge)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    orange.ai 分享 X 长文链接

    orange.ai(@oran_ge)发布了一条指向 x.com 文章页面的链接,互动数据为 10 条回复、10 次转发、73 个点赞和 30241 次浏览。原文未提供文章标题或内容摘要,仅显示由 xgo.ing 提供技术支持。

  21. AI前线AI 评估 · 88/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI将GPT-6引入ChatGPT日常对话,并推出Intelligent UI

    OpenAI于10月7日宣布GPT-6进入ChatGPT日常对话,并推出Intelligent UI智能交互界面,向全球超过12亿周活跃用户开放。Plus、Pro、Business、Enterprise自10月7日起陆续获得GPT-6 Sol,Free和Go用户从10月8日起陆续获得GPT-6 Luna,企业工作区可用性还取决于管理员权限设置。

    为什么值得看

    梳理了GPT-6在ChatGPT全员开放的分批安排,以及Intelligent UI如何把回答变成可交互界面。

  22. Clip设计夹AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Eazo 测评:一句话生成完整可用 App,Wild Design 一次给出 6 种设计方案

    Eazo 是一个把一句模糊需求生成完整可用应用的 Coding Agent,支持一句话生成前端、后端、数据库、登录系统和全球收款,底层由 OpenAI、Claude 加自研模型混合编排。

  23. Justin Welsh(@thejustinwelsh)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Justin Welsh 发布免费 30 页一人创业指南

    Justin Welsh 发布了一份免费的 30 页 solopreneurship 指南,讲述他如何在不毁掉生活的前提下把一人小生意做到 1500 万美元利润。

  24. AI产品榜AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Muse 首月 455 万 MAU,腾讯 WorkBuddy 用了 3 个月:帮你偷懒的比帮你赚钱的跑得更快|AI产品榜·应用榜 2026.09

    Meta 个人生活助理 Muse 首月 MAU 达 455 万,登顶 AI产品榜 9 月全球增速榜;腾讯 WorkBuddy 达到同量级用了 3 个月,9 月国内增速 +10.77%。Muse 上线十来天即被亚马逊以"未经授权的 AI 智能体"为由封禁,文章将生活助理与办公助理的入口之争列为两条赛道。9 月国内增速第一为百度搭子(+17.79%),出海增速第一为 manus(+116.51%)。

  25. AINLPAI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 疯狂 28 天计划 Day 3:Codex 向付费用户赠送重置卡

    OpenAI 疯狂 28 天计划进入 Day 3,Codex 活跃用户达到 4000 万,并为每个付费用户赠送一张重置卡。

  26. 赛博禅心AI 评估 · 87/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 上线 Intelligent UI,让每个回答都能交互

    OpenAI 在 ChatGPT 中上线 Intelligent UI 能力,让回答以可交互方式展示,同时把 GPT-6 推给 ChatGPT 所有用户;付费订阅用户今天已可用,免费和 Go 用户明天上线。官方示例包括烤羊腿人数计数器、意大利婚礼七天穿搭卡片与行李清单,以及中心极限定理、三门问题等可拖动滑块或直接演示的教学内容,还能拍摄小票生成分账器这类小工具。

    为什么值得看

    原文用八个可交互示例说明 ChatGPT 回答从纯文本变为可操作界面,读者可据此判断日常用法会怎么变。

  27. 源码资本AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    码荟志9月刊:AI基础设施产业化进程提速

    源码资本《码荟志》9月刊聚焦 AI 基础设施产业化进程提速。该期以翻页形式呈现,具体内容未在正文中展开。

  28. 硬氪AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    星火传明完成A轮融资,推进红外卫星批产与太空私有云SaaS

    商业红外遥感企业星火传明完成A轮融资,资金将用于高分辨率红外载荷与星地激光通信地面站产线建设及批产、在轨星座组网和星上AI算法迭代。公司已有T0、T1、T2三颗红外遥感卫星在轨,T2中波分辨率达5米并验证端到端时延控制在1分钟以内,正研制3米中波载荷,规划年产100套红外载荷与50套激光地面站产线。公司还规划太空私有云SaaS,将卫星在轨算力按时间和区域切片供客户自主调用。

  29. 高鹄资本AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    苏度科技完成超10亿元新一轮融资,上海国投联合领投,加速具身智能规模化验证

    国内通用具身智能企业苏度科技完成超10亿元人民币新一轮融资,由上海国投旗下国投先导、国投孚腾与国泰海通联合领投,小米等老股东继续跟投,高鹄资本担任独家财务顾问。本轮资金将用于推进全栈技术攻坚与真实产业场景的规模化验证,推动具身智能系统进入多个行业标杆客户的产线与工位。

  30. Fun AI EverydayAI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Dreambuds:一副带"睡眠系统"的耳机

    波士顿创业公司 SOND 推出睡眠耳机 Dreambuds,每只仅 2.1 克,整晚持续读取心率、HRV、呼吸、睡姿、打鼾、体温等 12 项信号,据此动态调整耳内播放的助眠内容。

  31. Genspark(@genspark_ai)AI 评估 · 0/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 亮相 a16z Techweek

    Genspark 在 X 上发布了一条与 a16z Techweek 相关的动态,附有视频并 @ 了 a16z 和 Techweek。该帖互动数据为 8 个赞、2087 次浏览,转发与评论均为 0。

  32. Replit ⠕(@Replit)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 现身 SF Tech Week Creator Clubhouse,与 ElevenLabs、GammaApp 探讨 AI 如何改变创作者经济

    Replit 在 #sftechweek 的 Creator Clubhouse 活动现场,与 Techweek、passionfrootme、ElevenLabs、GammaApp 一同讨论创作者经济以及 AI 如何改变这一行业。

  33. 国际大厂AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 公开 722 份数学稿件;Chrome 155 支持 JPEG XL;Google 发布 EmbeddingGemma 2

    OpenAI 公开内部前沿模型产出的 722 份数学稿件、归为 372 个结果族,部分附 Lean 形式化证明,仓库说明验证状态不一、未形式化结果可能有问题。Google 发布 Apache 2.0 许可的 EmbeddingGemma 2,总参数 7.4 亿、文本部分 2.7 亿,可映射文本、图像、音频和视频到同一向量空间。

  34. 国际大厂AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mistral Large 4 开启 API 公开预览,1 万亿参数权重计划月底发布

    Mistral 发布原生多模态 MoE 模型 Mistral Large 4(昵称“Le Chonk”)公开预览,总参数 1 万亿、激活约 490 亿,可通过 Mistral Studio API 试用,权重计划月底发布。

  35. 极客公园AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    极客早知道:ChatGPT 推出 Intelligent UI,谷歌上线 AI 游戏平台 Playground

    OpenAI 在 10 月 7 日将 GPT-6 推向更广泛的 ChatGPT 用户,并同步推出 Intelligent UI,可按问题自动组合文字、图表、按钮和表单,生成可直接操作的界面,功能先从 Plus、Pro、Business 和 Enterprise 用户开放。

  36. 多知AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    三家语音优先教育AI公司接连融资,AI开始"开口教学"?

    荷兰Eevi、美国Aristotle与印度YoLearn.ai接连完成Pre-seed至种子轮融资,均把"语音优先"放于产品核心。波士顿大学一项随机实验显示,语音模式下学生对话密度约为文字模式的1.8倍、提问次数约2.4倍,但五周内两种模式的学习掌握程度无显著差异,且语音成本约为文字的2.8倍。

  37. Tw93(@HiTw93)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kaku:面向 AI 编程的开源 Mac 终端,新增会话恢复与官方 Homebrew 支持

    开源 Mac 终端 Kaku 定位面向 AI 编程,近期更新加入会话恢复与官方 Homebrew 支持,并修复图片相关的输入卡死问题,同时让标签页在远程桌面下更易用。

  38. 数字生命卡兹克AI 评估 · 83/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI开源722份数学手稿,引发数学界震动

    OpenAI在GitHub发布openai/math仓库,公开722份数学手稿、归为372组成果,覆盖数论、代数几何、组合数学等方向,全部来自一个未公开的内部模型。作者称这些成果平均每个花费约3小时ChatGPT Pro级思考算力,其中包含将准黎曼猜想推进到7/8、复数域矩阵乘法指数降到2.25等说法,同时记录了25位菲尔兹奖得主联名信等数学界的质疑与争议。

    为什么值得看

    梳理OpenAI一次性公开722份数学手稿所引发的学界反应与争议,并讨论AI科研中评审环节的瓶颈。

  39. 地缘政治AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    中国加速建设数据中心以争夺AI优势

    英国《金融时报》报道,中国正以极快速度推进算力基础设施建设,内蒙古是其中重点布局区域。报道将这一动作放在中国争夺AI优势的背景下描述。

  40. Browser Use(@browser_use)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Haiku 5.5 在 Browser Use Bench v2.1 上与 Luna 表现持平,但价格贵 2.8 倍

    Haiku 5.5 在 Browser Use Bench v2.1 上跑出与 Luna 相同的性能,但价格是后者的 2.8 倍。超过 100k 上下文后 Haiku 价格再涨 5 倍,缓存 token 也计入其中。BU Bench 2.1 多为超长时程任务,会频繁触及这一价格档位。