跳到正文

全部动态

今日 0 条
9月24日周四
  1. Google Gemini App(@GeminiApp)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 接入 Peloton:可搜索预约课程并生成多日训练计划

    Gemini 现可对接 Peloton,支持搜索并预约课程,还能创建多日训练计划。用户只需对 Gemini 说“Find a 30-minute advanced strength class focusing on core with Peloton”这类指令即可完成操作。

  2. Google Gemini App(@GeminiApp)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 新增接入 Adobe、Squarespace、Peloton 等 13 款应用

    Gemini 现可连接 Adobe、Squarespace、Peloton 等 13 款新应用,用户无需在多个标签页之间切换,即可直接在 Gemini 内拓展业务、设计素材和规划训练。

  3. Firecrawl(@firecrawl_dev)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 3.6 秒完成 5000 次决策,数据来自 Firecrawl Alexandria

    Firecrawl 推出 Jev 与 Alexandria,前者用后者数据在 3.6 秒内完成 5000 次决策。Alexandria 汇总了财富 1000 强公司的数据,并接入 100+ 数据源,目前已向 Jev 及其他用户开放。

9月23日周三
  1. Cursor(@cursor_ai)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 通过优化提示词与缓存将 token 成本降低 7%

    Cursor 宣布其 token 成本降低 7%,智能体质量没有下降。节省来自更紧凑的提示词、选择性工具加载、更好的缓存以及压缩文件读取。

  2. Cursor(@cursor_ai)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 如何改进其 agent harness

    Cursor 公布了对自家 agent harness 的改进方案,说明如何提升其 AI 智能体的运行表现。原文未披露具体模型版本、参数规模或 benchmark 数据,仅指向官方博客的详细说明。

  3. 刘小排rAI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实测豆包工作:拍短剧、养号与搭AI新品雷达

    作者给豆包工作派了三件跨度较大的活:拍短剧、养自媒体号、搭AI新品雷达。拍短剧方面,它先列人物、分镜和衔接供确认,再切目标模式检查人物一致性和字幕配音并交出成片。

  4. Philipp Schmid(@_philschmid)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布 Gemini 3.1 提示词指南与迁移文档

    Google 发布 Gemini 3.1 的提示词指南与从 3.1 迁移的文档,并同步更新官方博客,相关链接指向 blog.google 与 ai.google.dev 的 Gemini API 文档页。

  5. Google DeepMind(@GoogleDeepMind)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini API 音频生成支持逐句微调语气与停顿,并加入 SynthID 水印

    Gemini API 现已支持逐句微调音频生成,可调整节奏、情绪以及笑声、停顿等提示。所有生成的音频都带 SynthID 水印,可被可靠识别为 AI 生成内容。开发者可通过 Google AI Studio 使用 Gemini API 开始构建。

  6. Julien Chaumond(@julien_c)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 发布 huggingface/lerobot JS 包:浏览器直读 LeRobot 数据集

    Hugging Face 推出新 JS 包 huggingface/lerobot,可在浏览器中直接读取 Hub 上的 LeRobot 数据集,无需下载。官方给出的示例是用约 600 行 JS 在该包之上实现一个自定义查看器 UI,并建议把编码智能体指向它来快速构建。

  7. NVIDIA AI(@NVIDIAAI)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 在 Hugging Face 上线实时演示与博客

    NVIDIA 在 Hugging Face 上线了一个可直接试用的实时演示,并配有一篇介绍其工作原理与上手方式的博客。演示位于 huggingface.co/spaces/nvidia/,博客发布在 huggingface.co/blog/nvidia/。

  8. idoubi(@idoubicc)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Douchat 接入本地十几个 Agent:多人多 Agent 群聊,jev 模型负责调度

    Douchat 可自动识别电脑上的本地 Agent,把 codex、claude code、grok build、hermes 等建为联系人并共享给他人使用。其核心功能是多人 + 多 Agent 对话,可为每个联系人指定不同模型,并用 jev 模型做群聊调度分配任务,云端模型按量充值 credits,使用自有模型和本地 Agent 完全免费。

  9. LovartAI(@lovart_ai)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovart MCP 接入 Codex:一条命令即可运行

    Lovart 公布在 Codex 中运行其 MCP 的方式,复制粘贴 `codex mcp add lovart` 命令,并附带 URL 与 `--oauth-client-id codex-lovart` 参数即可完成接入。

  10. LovartAI(@lovart_ai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovart MCP 上线 Codex,支持品牌素材批量生成创意

    Lovart 的 MCP 现已在 Codex 上线,用户可导入品牌并批量生产创意素材,还能询问哪些素材实际表现更好。该功能由 Jev 提供支持,发布方为 LovartAI。

  11. 印记中文AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI周刊 #101:TypeSafe AI 发布 Jev,Qwen-Image-2.1 与 Qwen3.8 Omni Flash 亮相

    TypeSafe AI 公开 System One Model 与 Jev,用 RLCD 训练,单查询 70–500ms 直接输出结构化类型值与校准概率,输入 $0.042/MTok、输出免费。

  12. Recraft(@recraftai)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Recraft 上线新模型体验入口并公布 API 速度基准

    Recraft 开放了新功能的试用入口,并附上对比结果与 API 速度基准,该基准测量于 2026 年 9 月 21 日。用户可直接体验,或先查看对比数据了解表现。

  13. ElevenLabs(@elevenlabsio)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs Scribe v2 Medical 上线 ElevenAPI,每小时 0.22 美元起

    ElevenLabs 的 Scribe v2 Medical 已通过 ElevenAPI 开放使用,价格为每小时 0.22 美元起,并随用量规模增加而降低。该模型定位医疗场景的语音转写。

  14. ElevenLabs(@elevenlabsio)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs Scribe v2 Medical 面向企业客户支持 HIPAA 合规

    ElevenLabs 的 Scribe v2 Medical 现已面向签署 BAA 并启用 Zero Retention Mode 的企业客户满足 HIPAA 合规要求。该模式确保音频与转写文本在每次请求完成的瞬间即被删除。

  15. Runway(@runwayml)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 开放峰会报名,summit.runwayml.com 可注册了解详情

    Runway 开放峰会报名,注册与详情入口为 summit.runwayml.com。该推文未披露峰会的具体时间、议程或参与嘉宾信息。

  16. Patrick Loeber(@patloeber)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google AI Studio 上线 Gemini 智能体学习课程

    Google AI Studio 推出面向 Gemini 智能体的学习页面 aistudio.google.com/learn/gemini-a,用于讲解相关开发内容。该链接由 Patrick Loeber 在社交平台分享,帖文互动量较低(11 次点赞、1018 次浏览)。

  17. Qwen(@Alibaba_Qwen)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mobile Creative Agent 性能表现

    Mobile Creative Agent 的性能表现公布,帖子获得 46 次点赞、15637 次浏览,并带有 5 条回复与 1 次转发。该内容由 xgo.ing 提供支持。

  18. Qwen(@Alibaba_Qwen)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mobile Planner Agent 性能表现

    Mobile Planner Agent 的性能数据公布:7 条评论、1 次转发、93 个点赞、39752 次浏览、16 次数据统计。该信息由 xgo.ing 提供支持。

  19. Qwen(@Alibaba_Qwen)AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里发布 Qwen Intelligence,推出三个移动端 SOTA 智能体并开放评测基准

    Qwen 推出 Qwen Intelligence,首发三个 SOTA 智能体:Mobile Planner Agent 负责任务规划与编排,在 MobilePA-Bench。

    为什么值得看

    阿里发布 Qwen Intelligence 及三个移动端智能体,并开放覆盖规划、跨应用执行与安全的评测基准。

  20. 沃垠AIAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    千问办公发布Agent硬件QwenNote A2,实测语音直连智能体

    千问办公发布Agent硬件品牌QwenNote,首款产品QwenNote A2售价1199元,自带4G网卡和GPS,无需连手机即可使用。作者实测长按AI键发语音即可调用Agent做总结、写PPT和网页,背后接入云栖大会发布的Qwen-Audio-3.1-Realtime,并已与钉钉打通。

  21. LovartAI(@lovart_ai)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Lovart 生成一整套超可爱涂鸦风星座插画

    用 Lovart 生成了一整套超可爱涂鸦风星座插画,先放出其中 4 张。作者在帖中邀请网友留言自己的星座,会直接在评论区回复对应的那一张。

  22. 字节跳动技术团队AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenViking × LLM-Wiki:让团队文档不再"各说各话"

    OpenViking 上线 Compile 功能,可基于自定义或预置的 LLM-Wiki skill,把本地文件、GitHub 仓库、飞书文档等导入的原始资料编译成相互链接、带出处的团队 Wiki。

  23. 百度AIAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    百度文库网盘「库库AI」全球AI办公月活超4000万,海外版Kooko用户破1000万

    百度文库网盘在百度AI Day上宣布,通用智能体「库库AI」全球AI办公月活超4000万,海外一站式AI办公平台Oreate AI焕新为海外版「Kooko」,一年内海外用户突破1000万。库库AI已连接百度学术、百度文库及百度网盘用户授权数据,并接入金融、学术、法律等行业专业数据库,支持数据溯源回查,汇聚超700万在线知识库、18亿公域报告资料和7.5亿学术期刊论文。

  24. Recraft(@recraftai)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Recraft 分享四组提示词:玻璃鱼、几何发型人像等视觉生成示例

    Recraft 发布四组图像生成提示词示例,涵盖悬浮于深色石块上方的透明玻璃鱼、几何轮廓长发的时尚人像、盛放深色反光金属贝壳的透明玻璃碗,以及装有超大镀铬苹果的透明玻璃手袋。四组提示词均强调光滑造型、金属质感与强烈反光效果。

  25. idoubi(@idoubicc)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    sumus.im 发布:团队协作版 Grok Bot,支持 Codex 或 Claude Code 作为队友加入

    sumus.im 发布,定位为团队协作版 Grok Bot,为使用者、朋友和 AI 队友提供共享空间。AI 队友拥有自己的电脑,可协同工作并在用户登出后继续运行,Codex 或 Claude Code 也能通过 BYOA 方式作为队友加入。产品可免费试用。

  26. LovartAI(@lovart_ai)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovart 创作者角色生成:Serio_ai 分享韩文提示词并上线网页版

    Serio_ai 分享了一套生成 Lovart 创作者风格角色的提示词,由于长文本无法直接上传,改以网页应用形式发布在 bot-icon-studio.serio-ai.chatgpt.site。用户可在该站点点击复制按钮,将提示词粘贴到图像生成 AI 中使用。

  27. 刘小排rAI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实测豆包工作:从做短剧到搭AI新品雷达的三个案例

    作者刘小排用豆包工作完成三个跨度较大的任务:从一句创意出发制作一集AI短剧,抓取账号历史数据并不断修正自媒体选题策略,以及搭建一个收录67个产品的AI新品工作台。

  28. Hunyuan(@TXhunyuan)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯混元 Hy Image3.5 preview 上线 OnSolo,两周免费

    腾讯混元 Hy Image3.5 preview 已在 OnSolo 上线,提供两周免费使用。该预览版支持 5 张参考图与 2K 输出,可用于短剧角色设定、全动态游戏素材与关键帧生成。官方称角色能在各集之间保持一致,编辑为精修而非重新生成。

  29. idoubi(@idoubicc)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    douchat:多人 + 多 Agent 群聊,可自动识别本地 Agent 并共享给他人

    douchat 主打多人 + 多 Agent 对话,每个人可把自己的 Agent 拉进群协助他人,例如群友可艾特他人的 codex 帮忙设计海报。它能自动识别本地 codex、claude code、grok build、hermes 等 Agent 新建联系人并共享,支持为每个联系人指定不同模型,并用 jev 模型做群聊调度。

  30. Stack Overflow BlogAI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Slack 推出 Code Channels:让团队和 AI 智能体在群聊中协作写代码

    Slack 推出 Code Channels 功能,把“多人协作 AI”带入团队聊天,让开发者和编码智能体在同一频道内协同工作。Slack GM Rob Seaman 在 Stack Overflow 播客中表示,与编码智能体的多数交互会变成孤立的上下文,而开发者与智能体共处的群聊能把写代码和代码审查压缩成一个步骤。他还认为 Slack 频道可能比终端更适合作为开发环境。

  31. 阿里云开发者AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里千问AI平台面向Agent全面升级,发布Agent Studio与API优速模式

    在2026云栖大会MaaS&Agent技术主论坛上,阿里巴巴集团战略副总裁文征宣布千问AI平台全面升级,在模型服务基础上新增Agent服务与行业AI解决方案,并推出API优速模式、Agent Studio、千问AI座舱解决方案等能力。

  32. Genspark(@genspark_ai)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.7 上线 Genspark,覆盖 AI Chat、Code Agent 与 Claw

    SpaceXAI 的 Grok 4.7 已在 Genspark 上线,可用于 AI Chat、Code Agent 和 Claw,价格与速度与 Grok 4.6 保持一致。官方称其在困难任务上能工作更久、更仔细地检查结果,并配备迄今最强的安全防护。

  33. Genspark(@genspark_ai)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 接入 Claude Opus 5.5,覆盖 AI Chat、Code Agent 和 Claw

    Claude Opus 5.5 已在 Genspark 上线,覆盖 AI Chat、Code Agent 和 Claw 三个入口。据 Genspark 引用的 Anthropic 介绍,该模型是 Claude 5.5 家族首个模型,多数任务上达到 Claude Fable 5.1 的水平,运行成本比 Opus 5 低 40%,速度比 Opus 5 快 30%。

  34. Hunyuan(@TXhunyuan)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ComfyUI 支持 Hy Image3.5 preview

    Hy Image3.5 preview 已上线 ComfyUI,单模型同时支持文生图与图生图,最高 2K 分辨率,人评胜率较 Hy Image3.0 提升 30%。该模型支持多语言文字、符号与小字号渲染,覆盖电影、漫画、商业摄影和插画风格,并能在场景、服装和风格变化中保持人物身份与产品特征。

  35. 阿里研究院AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    2026云栖大会首日:Qwen4训练中,平头哥发布真武V900芯片,阿里云推出AgentCore

    2026云栖大会首日,阿里公布大模型系列进展:基于新一代架构的Qwen4已在训练中,未来Qwen4.5、Qwen5等版本将扩展至5-10T参数;Qwen3.8-Max在人类零参与下自主迭代超1个月、完成33轮有效迭代,并在平头哥新款GPU上自主优化Qwen3.8-Flash推理框架,单实例推理吞吐量提升96%。

  36. cat(@_catwu)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何试用 Opus 5.5 与 Slack 中的 Claude Tag

    Boris Cherny 用 Opus 5.5 对 Claude Agent SDK 做形式化验证,几段简短提示词就产出 16 个 PR,修复多个 bug 和竞态条件,TLA+ 同样适用,他还常把 Lean 与 TLA+ 结合排查数据流、并发与状态管理问题。他表示自己并不熟悉这两门语言,但 Claude 都很擅长,认为这种方式能发现人眼难以察觉的 bug。

  37. Tw93(@HiTw93)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Tw93 更新 Mac 软件实测清单:已覆盖 611 款应用,新增可在 mole.fit 查看

    Tw93 将其 Mac 软件实测清单产品化并沉淀为脚本,当前实测软件数量已达 611 个。新增条目后续可在 mole.fit/tested-apps 官网查看,用户可核对自己电脑所装软件是否在列,不在清单中的可反馈提交,作者会继续测试验证补齐规则。