跳到正文

全部动态

今日 0 条
10月8日周四
  1. Midjourney(@midjourney)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Midjourney Office Hours 10/7 办公时间活动

    Midjourney 于 10/7 举办 Office Hours 活动,通过 X Spaces 进行,相关链接已在推文中公布。该条推文获得 3 条回复、2 次转发、16 个点赞,浏览量达 14114 次。

  2. OpenAI(@OpenAI)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 公布 ChatGPT for Teens 进展并预览 College Planner

    OpenAI 分享了面向 18 岁以下用户的 ChatGPT for Teens 进展,该体验会自动应用于被识别为未成年的账号,且防护默认开启。OpenAI 同时预览了 College Planner,将把美国高中生申请四年制大学的申请要求、截止日期、任务和助学金步骤集中在一起,并表示将持续构建这些工具、评估其与防护机制的实际表现。

  3. Runway(@runwayml)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 上线 MCP 服务,可通过 runway.com/mcp 接入

    Runway 推出 MCP 服务,用户可通过 runway.com/mcp 开始使用。该入口由 Runway 官方发布,正文未披露具体功能与模型版本。

  4. Runway(@runwayml)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 直接接入 ChatGPT Astra,可在同一聊天窗口完成 brief 与反馈

    Runway 现已直接集成进 ChatGPT Astra,用户可在同一个聊天窗口内完成下达 brief、让其执行并给出反馈的全流程。官方提示可通过下方链接开始使用。

  5. Harrison Chase(@hwchase17)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    deepagents 支持加载技能时动态加载工具,兼容 OpenAI/Anthropic 模型且不破坏 prompt cache

    deepagents 现在支持在加载技能(skill)时动态加载工具,用于应对某些技能需要特定工具、但这些工具并非始终需要可用的场景。该机制与 OpenAI/Anthropic 模型配合时不会破坏 prompt cache。

  6. AWS Machine Learning BlogAI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amazon Quick 与 Amazon Bedrock 如何用实时 ACL 重塑 RAG 访问控制

    Amazon Quick 与 Amazon Bedrock Knowledge Bases 采用实时 ACL 校验,在查询时直接向 Google Drive 等权威来源核实权限,作为预检索过滤之外的第二层防护。该两阶段架构先用索引中缓存的 ACL 做语义检索,再实时验证候选文档,未授权的文档不会传入 LLM。AWS 称权限一旦被撤销,AI 响应可在数秒内而非数小时内反映变化。

  7. TechcrunchAI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 的 AI 智能体 Muse 上线 iPad

    Meta 的 AI 智能体 Muse 现已登陆 iPad,距离其移动端首次亮相仅一个月。Meta 正快速扩展这款助手的覆盖范围和集成能力。

  8. HeyGen(@HeyGen_Official)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 搭配 HeyGen MCP:一条提示词为每位宾客生成专属万圣节视频邀请

    ChatGPT 通过 HeyGen MCP 接入,只需一条提示词就能为万圣节派对生成宾客名单上每个人的专属视频邀请,视频中的你是吸血鬼形象,活动由 @partiful 创建。官方账号 @HeyGenMCP 会持续分享日常用例与工作流。

  9. Greg Brockman(@gdb)AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 在 ChatGPT 推出 Intelligent UI,结合 GPT-6 提供交互式回答

    OpenAI 在 ChatGPT 中推出新能力 Intelligent UI,结合 GPT-6 现已向所有用户逐步上线。该能力用完全交互式的用户界面快速作答,让日常问题更直观、复杂话题更易理解,并可即时调用交互式工具。

    为什么值得看

    OpenAI 在 ChatGPT 中上线 Intelligent UI,读者可了解它与 GPT-6 结合后的交互形态变化。

  10. 国际大厂AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kindle 更新 5.20.1:Reader 读者期待已久的功能上线

    Amazon 推送 Kindle 软件更新 5.20.1,为第三代 Kindle Scribe 电子笔记本以及 2024 年起发布的所有 Kindle 设备带来多项新功能。该更新包含读者长期呼吁的特性。

  11. Cursor(@cursor_ai)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Haiku 5.5 上线 Cursor,短请求成本比 Claude Haiku 4.5 低 10 倍

    Claude Haiku 5.5 现已在 Cursor 中可用,在较短请求上成本比 Claude Haiku 4.5 低 10 倍。用户可在 Cursor 的 Settings > Models 中开启该模型。

  12. Anton Osika – eu/acc(@antonosika)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    与 Lovable 聊天现已免费

    Lovable 的聊天功能现已免费开放,用户可直接与 @lovable 对话,不再需要付费。该消息由 Anton Osika 发布,附带演示视频,但未披露具体的免费范围或使用限制。

  13. LangChain BlogAI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Managed Deep Agents v0.9 发布:支持自我调度、按运行配置与 Slack 表情回应

    LangChain 发布 Managed Deep Agents v0.9,公开测试版新增三项能力:Schedules SDK 让智能体在对话中自行创建提醒、跟进和周期性任务。

  14. 国际大厂AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amazon 上线“About You”页面,展示它对你的一切推断

    Amazon 的“About You”页面今年 5 月上线后目前处于 beta,依据用户活动数据生成 Product Preferences、Interests & Hobbies、Home & Family 等类别的个人推断,用于个性化购物体验。该页面支持从其他 AI 聊天机器人导入个人数据来生成购物画像,但用户无法直接退出该功能,只能手动增删信息。

  15. OpenAI(@OpenAI)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 用可视化让抽象概念变得直观易懂

    OpenAI 展示了一种用可视化让抽象概念变得直观易懂的方式,帮助用户加深对话题的理解。推文附带的视频需浏览器支持 video 标签才能播放。

  16. OpenAI(@OpenAI)AI 评估 · 1/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 推出交互式回答,可自定义回复

    OpenAI 上线交互式回答功能,用户可在回复中直接操作选项来定制模型输出。该功能由 OpenAI 官方账号发布演示,原文未披露支持的模型版本与开放范围。

  17. OpenAI(@OpenAI)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 可在对话中直接创建互动工具,如游戏和预算计算器

    OpenAI 支持在对话中直接创建可用的互动工具,例如游戏或互动预算规划计算器,用户无需离开对话界面即可使用。该功能由 @OpenAI 发布,配文附带演示视频。

  18. AI SDK(@aisdk)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 新增 Claude 支持,Anthropic 模型接入 Vercel 生态

    AI SDK 现已支持 Anthropic 的 Claude 模型,可通过 Vercel 平台接入使用,详情见 ai-sdk.dev 的 provider 文档。该消息由 AI SDK 官方账号发布,并同步 @claudeai、@AnthropicAI 与 @vercel。

  19. 国际大厂AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软为 Copilot 开放本地文件访问与跨系统操作能力

    微软在 Windows and Surface 活动上宣布升级 Copilot,使其可访问 PC 本地文件并跨操作系统执行操作,属于其称为 Hybrid Intelligence 的本地与云端模型混合方案。

  20. TechcrunchAI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 ChatGPT 推出新界面,加入交互式可视化

    OpenAI 正在为 ChatGPT 推出一款新用户界面,将为 ChatGPT 带来交互式可视化内容。

  21. Feed: Artificial Intelligence LatestAI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为所有用户更新 ChatGPT,推出更视觉化的 Intelligent UI

    OpenAI 面向所有用户更新 ChatGPT,加入名为 Intelligent UI 的界面,让聊天机器人在输出中直接生成交互式元素,整体呈现更偏视觉化。该报道指出这次更新的展示成分多于实际说明。

  22. Lovable(@lovable_dev)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 上线 Chat:支持语音、了解你的应用与已连接工具且免费

    Lovable 推出 Chat 功能,用户可就任何话题与其对话,并支持语音输入。该功能对用户的 Lovable 应用及已连接工具具备深度上下文理解,且免费开放。

  23. Lovable(@lovable_dev)AI 评估 · 1/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 推出「发现下一个构建灵感」入口

    Lovable 发布「Discover your next idea to build」入口,指向 link.lovable.dev/dJRS5E5,供用户寻找下一个可构建的项目灵感。

  24. 国际大厂AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软 Surface Laptop Ultra 内置磁吸式 USB-C 充电

    微软为 Surface Laptop Ultra 推出 Magnetic Connect 磁吸充电方案,充电线可磁吸吸附到机身右侧的 USB-C 接口,该接口仍可正常用于视频、数据和其它 USB-C 连接。

  25. 国际大厂AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软 Surface RTX Spark Dev Box 开启预售,售价 5,999 美元

    微软 Surface RTX Spark Dev Box 已开启预售,售价 5,999 美元,预计 11 月发货。该设备搭载 Nvidia Arm 架构 RTX Spark 平台和 128GB 统一内存。

  26. 国际大厂AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软 Windows 与 Surface 发布会:Windows 智能体功能与 Surface Laptop Ultra 亮相

    微软在 Windows 与 Surface 发布会上公布 Windows 的智能体 AI 功能,并展示搭载 NVIDIA RTX Spark SOC 的 Surface Laptop Ultra。

  27. 国际大厂AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软 Surface Laptop Ultra 发布:搭 NVIDIA RTX Spark,24GB 内存与 1 petaflop FP4 算力,起售价 $2,599

    微软公布首款“builder class PC”Surface Laptop Ultra,搭载 NVIDIA RTX Spark 芯片,最高 20 核 CPU、128GB 统一内存,可提供 1 petaflop FP4 AI 算力,即日起以 $2,599 起预售。

  28. 国际大厂AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软把 Windows 搜索改造成聊天机器人式入口

    微软在秋季 Surface 活动上宣布,从今年秋季起 Windows 任务栏的搜索菜单将改造成聊天机器人式界面,用户可通过输入简短命令完成数千种操作,如开关深色模式和免打扰,也能不打开 Copilot 应用直接与其对话。

  29. The GitHub BlogAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub:AI 智能体贡献三分之一 PR,密钥防泄露必须跟上代码生成速度

    GitHub 披露,如今每 3 个 PR 就有 1 个涉及 AI 智能体,一年前这一比例不足 1/10。

  30. eric zakariasson(@ericzakariasson)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 发布 grok @bot 0.68.1:可协作生成幻灯片并导出 PowerPoint 或 Google Slides

    xAI 的 grok @bot 升级至 0.68.1,Bot 可与你共同制作幻灯片,并直接交付为 PowerPoint 或 Google Slides。新版本还支持从草稿卡片直接发送格式化邮件,1:1 聊天中你的消息会显示该 Bot 的颜色,computer use 速度提升并支持 1920x1200 屏幕。

  31. NVIDIA AI(@NVIDIAAI)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 将 SynthID Detector 开放给所有人

    Google DeepMind 宣布 SynthID Detector 现已面向所有人开放,可用来检测线上内容是否由 GoogleAI 或 OpenAI、NVIDIA、Kakao 等合作方的工具生成,Apple 也将加入。

  32. Recraft(@recraftai)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Recraft 在 X 上 @NanoBanana 并分享 go.recraft.ai 链接

    Recraft(@recraftai)在 X 上发布推文 @NanoBanana,并附带一条 go.recraft.ai 短链接。该推文获得 0 次回复、0 次转发、2 次点赞和 244 次浏览。

  33. Recraft(@recraftai)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google NanoBanana 2.1 上线 Recraft Studio,文字拼写能力大幅提升

    Google NanoBanana 2.1 已接入 Recraft Studio,拼写能力明显改善,海报、标签和信息图中的文字能按输入原样呈现。用户现可在 Recraft Studio 中试用该模型。

  34. Fish Audio(@FishAudio)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fish Audio 推出 drama-3-preview 模型,开发者可通过 API 调用

    Fish Audio 发布 drama-3-preview 模型,开发者可在 docs.fish.audio 的 API 文档中将 model 设为 drama-3-preview,并在 fish.audio/app/api-keys 获取 API key。网页用户可在 fish.audio/app/text-to-spe 选择 Fish Audio Drama 3(Preview)模型使用。

  35. 技术前沿AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 推出新 AI 工具,识别暗中导流儿童性虐待内容的广告

    Meta 宣布在 2026 年上半年对 Facebook 和 Instagram 上 3320 万条儿童性剥削内容采取行动,其中超过 97% 由系统在用户举报前发现;印度同期为 530 万条,超 98% 为主动检测。

  36. DatabricksAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Databricks Apps 正式 GA:以用户身份代理授权构建权限感知应用

    Databricks Apps 正式 GA,支持 on-behalf-of-user 授权,让开发者能在 Databricks 平台上构建并部署权限感知的数据与 AI 应用。该授权机制使应用以用户身份访问数据,从而遵循用户自身的权限范围。

  37. mem0(@mem0ai)AI 评估 · 0/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    mem0 分享 X 长文:链接指向 x.com 文章

    mem0 在 X 上发布了一条帖子,正文仅含一个指向 x.com 文章(x.com/i/article/2107…)的短链接,未附任何说明文字。该帖获得 27 条回复、56 次转发、508 个点赞和 46475 次浏览,数据由 xgo.ing 提供。 (说明:原文正文除短链接和互动数据外不含任何可提取的模型、产品、版本或参数信息,故摘要仅陈述可核验事实,未做任何扩写。)

  38. hidecloud(@hidecloud)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    CueAgents 路演前两小时拿到新贴纸,让 ManusAI 把它做成动画

    CueAgents 在路演前两小时拿到全新贴纸,随后请 ManusAI 将其做成动画效果。相关推文由 alan chan 引用发布,称 Cue 拥有自己的身份和专属贴纸。

  39. The Cloudflare BlogAI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 打造基于证据的多 AI 智能体安全运营框架

    Cloudflare 推出内置多 AI 智能体安全运营框架 Managed Defense,先由确定性代码完成侦察、再由协调 AI 智能体并行调度流量分析、客户上下文。

  40. Perplexity(@perplexity_ai)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 检索器在 MADQA 上以 92.4% 登顶

    在 MADQA 基准上(500 道题、800 份 PDF),该检索器取得 92.4% 的成绩,为所有检索器中的最高结果。来源为 Perplexity。