跳到正文

#多模态

今日 1 条
今天10月10日周六
  1. AI炼金术AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    和 ColaOS 橘子聊个人 Agent 这半年:时代追上了他,他却打了转向灯

    ColaOS 创始人橘子复盘个人 Agent 半年变化:DeepSeek Flash、Haiku 5.5 等便宜模型让单用户月成本从 Opus 4.6 时代的几百美金降到约十美金,Muse、Dot、Instinct 免费且完成度接近 90 分,云上 Agent 成共识。他放弃卷办公,转做「996 之外」的个人项目,今年目标盈亏平衡。

10月9日周五
  1. 有机大橘子AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5 之后:游戏、软件、硬件的门槛都在消失,一切终将开源?

    Opus 5.5 发布并被指代码能力再次飞跃,深度和广度已超越 99% 的程序员,完成同样任务所需生成的代码输出反而更少。有开发者用它直接反编译二进制、几十分钟做出可玩游戏 demo,也有人靠 AI 重写代码绕开 GPL 传染;Muse 为 ESP32 提供 Agent Ready 通用固件,模型推理成本最近一周大幅下降,Strata 可把推理速度提升数倍。

  2. 十字路口CrossingAI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对谈 KK、山音:一线 AI 创作者如何用 AI 拍电影

    上戏毕业的山音与广告公司职员 KK 用两年时间成为 AI 导演,作品登上国内外电影节。他们最常使用的 AI 视频产品是 CapCut Video Studio,同一部片子会混用 Seedance、MiniMax 等多个模型。两人在播客中讨论了 AI 视频产品在底层模型趋同后的壁垒,以及"AI 无限,人生有限"的创作者困境。

10月8日周四
  1. InfoQ 中文AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    10 秒视频很惊艳,为什么 AI 做一部短剧还是这么难?

    在 InfoQ《极客有约》X QCon 直播中,快手鲜嘉麒与爱奇艺路香菊、阿里巴巴邹娟、生数科技郑重讨论 AIGC 内容生产为何难落地:竞争单位已从一个 clip 变成完整生产链路,用户追问人物一致性、商品变形、按时交付与成本可控。真实成本是生成、重试、审核、人工编辑等之和除以合格成片数。

  2. AI科技评论AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    墨尔本的屏幕、芝加哥的数据、杭州的大模型:医疗 AI 的万亿价值从何而来

    医疗 AI 的万亿价值可能落在三类资产上:Pro Medicus 的影像工作流软件、Tempus AI 的诊断与患者数据、德适科技的医疗影像大模型。三家公司 2026 年 10 月 6 日市值分别约为人民币 780 亿元、875 亿元和 220 亿元。

  3. Z FinanceAI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    深度|对话框不是 Personal Agent 的终局:Eazo 让图形界面属于每个人

    Eazo 提出对话框并非 Personal Agent 终局:复杂意图先用自然语言表达,需求稳定后沉淀为可点击、可保存、可分享的 Personal Software。

10月7日周三
  1. Jerry Liu(@jerryjliu0)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 谈 agentic OCR:传统 OCR 已死,智能体式解析登场

    LlamaIndex 开源负责人 Logan Markewich 发文提出"agentic OCR",把文档解析改成循环流程:布局感知阅读顺序、将难处理元素智能路由到合适模型、多轮校验与自我纠正、对图表和复杂表格做多模态解析。传统 OCR 只做一次处理就直接返回文本,表格被压平、图表丢失、多栏布局错乱且无人校验。该方案认为前沿模型在处理成本与延迟上过度设计,却仍在长尾复杂边缘案例上吃力。

10月6日周二
  1. Simon Willison(@simonw)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5 能写出像样的游戏配乐了?

    Simon Willison 让 Opus 5.5「写一些电脑游戏音乐」,结果远超预期,他因此发问模型是从什么时候开始能创作出像样的音乐。这条帖子获得 133 条回复、310 个点赞和 38064 次浏览。

  2. SuperTechFansAI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    RemoveMacAI 开源工具可关闭 macOS 27 Apple Intelligence 并回收模型空间

    开源工具 RemoveMacAI 面向 Apple Silicon Mac,通过系统配置描述文件关闭 macOS 27 的 Apple Intelligence 并调用苹果资源管理服务删除已下载的基础模型、图像生成等模型文件,作者称无需关闭 SIP,已测试 macOS 27.0。具体回收空间取决于设备上已有的模型,删除后统计可能延迟更新,且关闭开关并不必然释放空间。

10月5日周一
  1. Import AI — Jack ClarkAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Import AI 475:群体扩展、Google DeepMind 为生物内容加水印与 AI 科学经济

    Import AI 475 期关注群(swarm)扩展:Toby Ord 认为 4 智能体群完成同等任务需约 2 倍 token,但因并行可将耗时减半,群扩展存在类似"踩脚"参数的收益递减。

  2. CSDNAI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Research 负责人 Yossi Matias:AI 正在终结岗位头衔,初级员工要一出道就硬抗判断力

    Google Research 副总裁 Yossi Matias 在官方播客《The Google Research Podcast》首期访谈中表示,AI 正在终结"岗位头衔",以往需要熬 15 年才积累的判断力,如今初级员工一出道就得硬扛。

10月4日周日
  1. 宝玉(@dotey)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fable 5.5 生成人类 40000 年艺术史动画

    Fable 5.5 整理并生成了人类 40000 年艺术史动画,原作者感叹难以理解抽象的向量矩阵如何输出这些精美动画。其称即便最厉害的动画团队,也不是一两个月能完成的。

10月2日周五
  1. Google DeepMind(@GoogleDeepMind)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 播客:AI 内容真假难辨,如何用 SynthID 水印验证来源

    Google DeepMind 在播客中探讨内容溯源问题:当 AI 生成内容逼真到难以分辨,如何验证内容由人类、机器还是自然产生。节目介绍了不可感知水印技术,重点讲解 SynthID 用于图像和视频,以及面向生物设计的 SynthID Bio。

10月1日周四
  1. Justine Moore(@venturetwins)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Opus 5.5、Gemini 2.5 Flash、SAM 3.1 与 Ideogram 4.5 搭出一支工程团队的活

    有人用 Opus 5.5、Gemini 2.5 Flash、SAM 3.1 和 Ideogram 4.5 组成一套技术栈,分别负责界面、照片分类、图像分割和编辑,全部通过一个 fal API key 跑通,并称过去这需要一整支工程团队才能完成。

9月30日周三
  1. 网易科技AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    三位00后创业者坦白局:技术、组织、死亡谷,和第一单白酒

    在2026网易未来大会上,灵初智能陈源培、OriginFlow秦深涛、万格智元王冠博三位00后创业者对话,谈具身智能落地瓶颈从算法转向算法工程化,创业公司真正的"死亡谷"在50到150人之间,端侧AI可用4G内存推理35B模型、10G内存推理80B模型。

  2. Z PotentialsAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    外滩大会AI2C论坛全纪实:从入口到交易,AI正在重写消费的每一个环节

    2026外滩大会·AI2C论坛在上海举行,12位创业者与投资人围绕AI如何从消费入口走向交易展开讨论。影眸科技Hyper3D现场演示Rodin 2.5,4秒生成基础3D模型、80秒生成千万级面数高精度资产,并已为劳氏3万多个SKU重建3D资产、将单件建模成本从100美金压到1美金以下。下半场焦点转向Agent代理搜索与支付,FluxA提出支付需感知用户意图、进入Agent执行上下文。

9月29日周二
  1. Suhail(@Suhail)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Computer 用 Opus 5.5 花约 2000 美元额度做出浏览器端开放世界游戏

    Perplexity 的 Aravind Srinivas 演示了 Computer(Standard Mode 搭配 Opus 5.5)端到端设计并构建一款浏览器端开放世界游戏,过程中自行租用 GPU、运行 headless Blender、做程序化设计、联网下载素材并设计音频,成本约 2000 美元额度。

  2. 有机大橘子AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5:从大语言模型,到世界模型?

    Anthropic 的 Opus 5.5 靠纯代码生成品牌宣传片、像素动画,还能操控电脑画图,与 GPT-6 的 Sol 和 Luna 同周发布后,热度持续一周不退。

  3. LlamaIndex 🦙(@llama_index)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex:最新前沿 VLM 仍搞不定表单解析,LlamaParse 用专用方案降本处理 W-2/1040

    LlamaIndex 指出,最新前沿 VLM 在表单解析上仍会失误,因为表单不是页面上的文本,而是由分组字段构成的层级结构。其最新博客分析了 VLM 在真实 W-2、1040、W-9 和扫描版 W-4 上的失败点,并给出用 LlamaParse 以更低成本处理这些表单的定制 cookbook。

9月28日周一
  1. Yangyi(@Yangyixxxx)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code Opus5.5 一次跑通租赁图纸→CAD→Blender 渲染→Web 共享

    有用户演示了 Claude Code Opus5.5 可一次性完成租赁图纸到 CAD(JWW、DXF)、再到 Blender 高画质渲染的透视图,并直接生成 Web 共享页面。该帖作者称其能做的事太多,反而让工作推进不下去,并引发结合家具软装生成选品的设想。

9月27日周日
  1. Simon Willison(@simonw)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Simon Willison 用 Claude Opus 5.5 为 Kākāpō 繁殖季演讲制作像素动画

    Simon Willison 在昨天的演讲中提及今年破纪录的 Kākāpō 繁殖季,并用 Claude Opus 5.5 生成了一段像素风动画作为收尾幻灯片。他称 Claude Opus 5.5 在像素艺术动画上表现出意料之外的强能力。

9月25日周五
  1. orange.ai(@oran_ge)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    给 Opus 5.5 一个参考视频和新主题,就能复刻解说视频

    用 Opus 5.5 做解说视频,只要把参考视频和新主题交给它,就能复刻一条或模仿参考视频的风格。DreW 用 Claude Opus 5.5 做出了这样一条视频,作者直呼「太逆天了,视频模型瑟瑟发抖」。

  2. 花叔AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    花叔独立做模型后训练,计划开源多模态模型

    花叔正在独立进行模型后训练,目标是训出一个具备多模态能力、且在基本文本分类能力上超越 Jev 的开源模型,算是对小米 Mimo-V2.6 公开训练过程的模仿。他预计次日完成全部训练和开源,届时会在 Hugging Face 和 GitHub 上开源模型,并称无论成败都是有趣的尝试。

9月24日周四
  1. Philipp Schmid(@_philschmid)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.8 Flash:多模态理解就用 Gemini

    有人推荐多模态理解直接用 Gemini 3.8 Flash,未给出具体参数、基准分数或价格信息。该内容来自一条社交平台帖子,获得 204 个点赞和约 2 万次浏览。

  2. AI Engineer(@aiDotEngineer)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sarvam 文档模型处理 13 万亿 token 文本,上线四个月数字化 3500 万页

    前沿模型所学习的网页抓取数据中,印度语言内容占比远低于 1%;Sarvam 的文档模型在见到第一张图像前已读取 13 万亿 token 文本,上线四个月即数字化 3500 万页。Perceptron AI 用模型自主决定读取哪些 token,以应对一小时视频约百万视觉 token 中仅约 2% 有真值标注的问题。Meta 则在其三智能体审核流程中过滤大部分视频,压缩相似帧并对热门视频缓存判定结果。

9月23日周三
  1. Sam Altman(@sama)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI API 目标:在每个价位和每种模态上提供最佳模型

    OpenAI 称要让 OpenAI API 在每个价位点都提供最佳模型,并在文本、代码、图像、视频等每种模态上做到最好,希望用户基于此提出好想法并构建产品。该表述未给出具体的模型名称、版本号或发布时间。

9月22日周二
  1. 阿里研究院AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴泳铭云栖演讲:未来机器思考总量将达人类的1000倍以上

    阿里巴巴集团CEO吴泳铭在2026杭州云栖大会上判断,未来机器供给的思考总量将达人类思考总量的1000倍以上,机器将承担99.9%的思考工作。他宣布平头哥发布新一代AI芯片真武V900,性能达M890的3倍,单一集群可扩展至50万卡;Qwen团队正探索递归式自我改进(RSI),计划训练5-10T参数规模的新模型。阿里云目标到2032年全球数据中心规模超20GW。

9月21日周一
  1. AI科技大本营AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Research 负责人 Yossi Matias:AI 正终结岗位头衔,初级员工要一出道就硬抗判断力

    Google Research 副总裁 Yossi Matias 在官方播客《The Google Research Podcast》首期访谈中表示,AI 正在终结"岗位头衔",以往需要熬 15 年才练出的判断力,如今初级员工一出道就得硬抗。

9月20日周日
  1. Yann LeCun(@ylecun)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:自回归 LLM 本身不会通向人类级 AI

    Yann LeCun 重申"自回归 LLM 本身不会通向人类级 AI"依然成立,理由包括当前推理依赖非自回归搜索、自我改进仅在数学和代码等可自动评分的领域有效、多模态助手多用独立训练的编码器。

9月18日周五
  1. Founder ParkAI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实时交互模型:一个还没形成共识的赛道,怎么就成了热门?

    交互模型正成为一个尚未收敛的热门赛道,Loopit、Reverie AI、SigmaZ AI 等团队各以「交互世界模型」「交互模型」「下一代 AI Interface」等不同称呼切入,Runway 也推出实时角色 Characters、可交互世界 GWM Worlds 和生成交互界面的 Solaris。

9月15日周二
  1. Yann LeCun(@ylecun)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:LLM 本身并非通向人类级 AI 的路径

    Yann LeCun 表示,基于 LLM 的 AI 工具虽然非常有用、人人都在用,但它们本身并不是通向人类级 AI 的路径。他指出,能够理解真实世界的架构并非 LLM,让当前 LLM 系统得以解读图像、视频等真实世界信号的架构组件也不属于 LLM。他同时提到有一场 1 小时的演讲,用结果和证据支撑上述结论。

9月14日周一
  1. Yann LeCun(@ylecun)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:活在 bits 与 tokens 离散世界的 AI 从业者,未必理解真实世界有多混乱

    Yann LeCun 在 X 上回应 @ericxing 时表示,活在 bits 与 tokens 离散世界里的 AI 从业者,并不总能理解真实世界有多混乱。该帖获得 893 次点赞、82 次转发,浏览量 36227 次。

9月8日周二
  1. 屠龙之术AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    2026 AI江湖夜话:谁在上桌、下桌、掀桌,钱又流向了哪?|对话「屠龙之术」庄明浩

    「有点Yi思」第14期邀请「屠龙之术」主理人庄明浩与蚂蚁战投「AGI及支付宝」负责人王盟,复盘2026年AI圈每两月一轮的座次洗牌:Coding、多模态、Agent、价格四张新桌分桌而立。讨论提到美国头部Coding ARR已破10亿美金、Seedance 2.0后情绪面翻转,以及有效成本等于token成本加试错成本与人工纠正。

9月4日周五
  1. andrew chen(@andrewchen)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Astra 一周内在 Unreal Engine 构建曼哈顿世界

    GPT-6 Astra 用一周时间在 Unreal Engine 中构建出一座曼哈顿城市场景,并能逐条街道精细打磨每个细节。这条演示由 Matt Shumer 发布,被评论者称为「GTA7 is gonna be sick」。

9月3日周四
  1. 十字路口CrossingAI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对卷卷的3小时访谈:从抖音到AI 3D、成为制造业OS的野心,以及基础模型不会吞噬一切

    数美万物创始人任利锋(卷卷)在近3小时访谈中回顾了从0到1孵化抖音的经历,并介绍公司最新发布的 Hi3D 3.0 2048³ 模型。他将数美万物的目标从 Maker OS 推向「制造业 OS」,认为基础模型不会吞噬一切——进入实体制造后仍需能产出「生产级」3D 资产的模型,以及拆件、加连接结构、适配材料设备等后续环节。

9月2日周三
  1. Fei-Fei Li(@drfeifei)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    李飞飞:带空间上下文的相机条件世界模型可广泛用于机器人 real2sim

    李飞飞回应 Jim Fan 关于 World Labs 的讨论时表示,带空间上下文的相机条件世界模型(camera conditioned world model)有大量横向用途,包括用于机器人领域的 real2sim。

8月25日周二
  1. Rowan Cheung(@rowancheung)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sundar Pichai 预测三年后内容可任意模态互转:今天的 AI 还很原始

    Sundar Pichai 受访预测,三年后任何内容都能从任意模态转换为任意模态,回看今天的技术会像看翻盖手机一样原始——YouTube 片段可变博客,newsletter 无需录制即成播客,消费者选择格式,创作者只提供想法、品牌与个性。他认为这会终结"堆量"策略,胜出的创作者将聚焦质量;YouTube 新政策针对的是低质内容而非 AI,内容够好就没人关心它怎么做的。

  2. Ian Goodfellow(@goodfellow_ian)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    BBC World Service 新纪录片《深度伪造的崛起:AI 如何改变色情、政治与现实》

    BBC World Service 推出新纪录片《The Rise of Deepfakes: How AI Changed Porn, Politics, and Reality》,探讨 AI 深度伪造技术对色情、政治与现实认知的影响。该片已在 YouTube 上线,由 Ian Goodfellow 分享。

8月22日周六
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.6 发布挑战 OpenAI 与 Anthropic,Anthropic 为 Claude 加水印,阿里开源 Qwen3.8 Max

    SpaceXAI 发布 Grok 4.6,直接挑战 OpenAI 和 Anthropic 的顶级模型。Anthropic 正为所有新 Claude 模型添加不可见水印,阿里则发布 2.4 万亿参数的开源权重模型 Qwen3.8 Max。研究者还构建了 Agentic ASR,像人类编辑一样修正语音转文字错误。

8月20日周四
  1. Naval(@naval)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naval:未来所有 UI 都是聊天与手势输入、聊天与视频输出

    Naval 预测,最终所有 UI 都会变成"聊天和手势输入、聊天和视频输出"。该帖获 6975 次点赞、320 次转发和 55.18 万次浏览。