跳到正文

#编码

今日 29 条
8月17日周一
  1. Qunar技术沙龙AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    去哪儿网:AI Coding 驱动 15 万行核心系统重构实践

    去哪儿旅行国内机票团队用 AI Coding 完成约 15 万行高并发核心系统重构,总工时从约 100PD 降至 30PD,搜索主流程 P50 / P90 耗时均下降约 70%,机器资源成本节省约 45%,且无 QA 介入顺利上线无故障。

8月16日周日
  1. 枫言枫语AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vol. 171 假如我们有无限 Token

    枫言枫语最新一期播客讨论两位主播沉迷 AI 编程后人类反而成为开发循环瓶颈的现状,提到 Tibo 频繁给 Codex reset、Anthropic 给 Fable 5 解禁,两家 frontier model 的 $200 plan 都嫌 token 不够用。

8月15日周六
  1. Windsurf(@windsurf_ai)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Windsurf 宣布 SWE-1.7 与 GLM-5.2 面向 Pro、Max、Teams 用户免费一个月

    Windsurf 将 SWE-1.7 和 GLM-5.2 两款模型免费开放一个月,Pro、Max 和 Teams 用户可在 Devin Desktop 与 Devin CLI 中继续使用这两个模型。

  2. Interconnects AI — Nathan LambertAI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GLM-5.3 发布:中国实验室如何跟上前沿

    Z.ai 发布 GLM-5.3,目前仅在编码套餐中提供,之后将上线 API,两周后登陆 Hugging Face 开放权重。

    为什么值得看

    以 Z.ai 被称为仅靠后训练扩展的小参数模型为切口,拆解中国实验室贴近前沿的发布节奏与数据产业因素。

  3. Augment Code(@augmentcode)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Augment Code 重建 Auggie CLI 工具链,单任务成本降 53%

    Augment Code 从零重建 Auggie CLI 工具链,在 SWE-bench Pro 通过率不变的前提下,将单任务成本从 Claude Code 的 $2.70 降至 $1.27,降幅 53%。

8月14日周五
  1. 智谱AI 评估 · 85/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    智谱发布 GLM-5.3,编程能力提升并在网络安全任务中涌现新能力

    智谱发布 GLM-5.3,基座模型与 GLM-5.2 相同,提升全部来自后训练 Scaling,官方称其为编程能力最强的开源模型。内部体感评测较 GLM-5.2 提升 50%,Terminal-Bench 3.0 得分从 4.6 升至 28.3,DeepSWE v1.1 从 46.2 升至 66.9,Agents' Last Exam 从 23.8 升至 28.5。

    为什么值得看

    官方给出后训练Scaling带来的编程与安全能力实测对比,可据此判断开源模型在编程和安全任务上的位置。

  2. AI炼金术AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ouraca 联合创始人张栖铭 & 吴俊东:AI 进组干活后,我们脑子都要烧坏了

    Ouraca 两位联合创始人张栖铭与吴俊东复盘一年多创业踩坑:全员用 AI 后流程没变、只是旧流程被加速,真正耗时的开会对齐一分钟没省,AI 写的「先变小再播放」这类隐藏坏逻辑还让团队间歇性想退回古法编程。他们改按上下文而非职能分工、全员出原型、把公司长在 GitHub 上,会压缩到每天十分钟站会,并称一周能写十几万行代码。

  3. Windsurf(@windsurf_ai)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.7 Flash 上线 Devin Desktop 与 Devin CLI,8 月 27 日前五折

    Gemini 3.7 Flash 现已在 Devin Desktop 和 Devin CLI 上线,8 月 27 日前享 50% 折扣。在 FrontierCode 1.1 上,它达到 Claude Sonnet 5 级别的性能,成本不到后者一半,并具备 Flash 系列一贯的低延迟。

  4. Windsurf(@windsurf_ai)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Windsurf 推广 Devin Desktop 下载

    Windsurf 发布推文推广 Devin Desktop,附上 devin.ai/desktop 下载链接。该条内容互动量很低,仅获 6 个点赞、2964 次浏览。

  5. Poe(@poe_platform)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.7 Flash 上线 Poe,支持 100 万 token 上下文

    Google 的 Gemini 3.7 Flash 已在 Poe 上线,官方称其为 GoogleAI 最智能的主力模型,具备快速且强大的推理能力,面向编程与智能体场景。该模型支持 100 万 token 上下文窗口,可处理文本、图像、音频和视频。

  6. Google AI Developers(@googleaidevs)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.7 Flash 在 Antigravity 中用单份规格生成 5 个原生应用

    Gemini 3.7 Flash 在 @antigravity 中可依据一份架构规格,直接生成覆盖 Flutter、SwiftUI、Jetpack Compose、React Native 和 NativeScript 五个移动框架的原生生产级代码,无需样板代码。

  7. Varun Mohan(@_mohansolo)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.7 Flash 上线 Google Antigravity,API 成本减半

    Google Antigravity 宣布 Gemini 3.7 Flash 上线,称其为面向编码和智能体任务的最强主力模型,可下载或升级 Antigravity 试用。原推作者(Varun Mohan)转发时评价能力大幅提升且 API 成本减半。

  8. Google AI Developers(@googleaidevs)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布 Gemini 3.7 Flash,主打编码与智能体任务

    Google 发布 Gemini 3.7 Flash,称其为面向编码和智能体任务最智能的主力模型,带来更高的指令遵循、首轮代码准确率和智能体任务执行质量。

  9. Demis Hassabis(@demishassabis)AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.7 Flash 发布,软件工程与网页开发能力升级

    Google DeepMind 发布 Gemini 3.7 Flash,在软件工程、网页开发和知识工作方面带来较大升级。该版本的首发价格为原 Gemini 3.6 Flash 成本的一半。Demis Hassabis 表示这一版本在编码、知识工作和网页开发上更强。

  10. Google AI(@GoogleAI)AI 评估 · 77/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布 Gemini 3.7 Flash,面向编码与智能体并推出半价优惠

    Google 发布 Gemini 3.7 Flash,称其为面向编码和智能体的最智能主力模型,Gemini App 中的 Gemini Spark 已改用 3.7 Flash。

    为什么值得看

    Google 发布面向编码与智能体的 Gemini 3.7 Flash,给出多步规划改进与限时半价,读者可据此判断工作流成本变化。

  11. Google Gemini App(@GeminiApp)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini Spark 在 160 多个国家启用 Gemini 3.7 Flash

    Google 宣布 Gemini Spark 从今天起改用 Gemini 3.7 Flash,该服务面向 160 多个国家的 Google AI Pro 和 Ultra 订阅用户开放。官方称 Gemini 3.7 Flash 是面向编码和智能体任务的最强主力模型,详情见其博客。

  12. Sundar Pichai(@sundarpichai)AI 评估 · 75/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周

    Google 在 3.6 Flash 发布仅三周后推出 3.7 Flash,称其在编码和智能体任务上有显著提升,并在软件工程、知识工作和网页开发方面带来改进,首发价格为 3.6 Flash 原价的一半。该模型已在 Antigravity 中供 Google 内部工程师使用,同时通过 Gemini API 在 Google AI Studio、Gemini Enterprise 等渠道提供。

  13. Google DeepMind BlogAI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 发布 Gemini 3.7 Flash,面向编码与智能体,输入百万 token 0.75 美元

    Google DeepMind 发布 Gemini 3.7 Flash,距离 Gemini 3.6 Flash 仅三周,定位为面向编码和智能体的主力模型。

  14. Google DeepMind(@GoogleDeepMind)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 发布 3.7 Flash,在调试与问题解决等编码任务上升级

    Google DeepMind 发布 3.7 Flash,相比 3.6 Flash 在调试、问题解决等关键编码任务上有明显提升,并能用更少提示词设计更实用的网页布局和应用,在真实业务工作流中的推理与准确率也有改善。

8月13日周四
  1. AI炼金术AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ouraca 张栖铭 & 吴俊东:只要你还在开会,你们公司用了 AI 也快不起来

    Ouraca 联合创始人张栖铭和吴俊东复盘一年多的 AI 提效踩坑:每个节点都在用 AI,版本却没快多少,因为真正写代码的时间本来就不长,大头是开会、评审、对齐,这些一分钟都没省。

  2. Poe(@poe_platform)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.6 上线 Poe,面向长时间运行智能体与编码,上下文 500K token

    Poe 宣布 Grok 4.6 已在其平台上线,该模型由 SpaceXAI 推出,面向长时间运行的智能体、编码和知识工作,提供 500K token 上下文窗口,用户可通过 poe.com/Grok-4.6 试用。

8月12日周三
  1. Hamel HusainAI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hamel Husain 的 AI Product Engineering Notes 文章索引

    Hamel Husain 在个人站点汇总了其 AI 产品与评测(Evals)主题的长文清单,最新一篇为 9/30/26 的 Claude's new auto eval tool。

  2. v0(@v0)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    v0 推出新侧边栏:对话按项目分组,新增实时状态指示

    v0 上线新侧边栏,对话可按项目分组,并加入 streaming、waiting、ready 三种状态的实时指示。悬停卡片会显示网站预览、变更文件和 git 分支。

  3. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mustafa Suleyman 分享 MAI-Code 更多细节

    Mustafa Suleyman 在 X 上分享了 MAI-Code 的更多细节,并附上微软 AI 博客链接 microsoft.ai/news/mai-code-…。该帖未披露模型版本、参数规模或可用性信息。

  4. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mustafa Suleyman 发布新代码模型,效率提升 25%、成本降至四分之一并上线 GitHub Copilot

    Mustafa Suleyman 宣布最新代码模型上线 GitHub Copilot,相比 6 月发布的模型效率提升 25%、质量更高、成本仅为四分之一。他邀请用户在 GitHub Copilot 中试用该模型。

8月11日周二
  1. Martin Fowler(@martinfowler)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    让编程智能体自己做 TDD 有用吗?Birgitta Böckeler 的实验与思考

    Martin Fowler 提出疑问:让编程智能体自行执行 TDD 是否真的有效,还是属于"对人类有益、对智能体却无益甚至有害"的罕见情形。Birgitta Böckeler 对此开展实验并在 martinfowler.com 分享了她的思考。

  2. 智谱AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    智谱 ZCode 全面升级,上线 Goal、Subagents、Remote Control 与闲时任务

    智谱针对 GLM 深度优化的 Coding Harness ZCode 迎来重大升级,Goal、Subagents、Remote Control 与闲时任务四大功能正式上线。

8月7日周五
  1. 李继刚(@lijigang_com)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    李继刚:以前是 read-only 权限,现在是 write-only 代码

    李继刚用一句话概括 AI 编程现状的转变:以前是 read-only 权限,现在是 write-only 代码。该帖获得 5 条评论、4 次点赞和 6658 次浏览。

  2. 奇舞精选AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    奇舞周刊第594期:从零开始用 Zig+Python 构建 Coding Agent "Violin"

    作者用 Zig+Python 从零构建了 Coding Agent "Violin",架构借鉴 Pi 的三层分离与 EventBus 设计,核心是 Agent Loop(在"问模型"与"执行工具"间循环直至得到最终答案)。

  3. bolt.new(@boltdotnew)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt 网站排名不靠"好看":7 个可直接用提示词完成的 SEO 修复

    Bolt 官方账号提出 7 个可直接通过提示词在 Bolt 站点上完成的 SEO 修复,无需插件、无需猜测,站点排名不取决于外观是否好看。

8月6日周四
  1. Cursor(@cursor_ai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 详解其构建过程

    Cursor 发布博客披露其自身构建方式,官方在 X 上以「Here's how we built it」配文引流至 cursor.com/blog/how-curso…。正文仅给出博客链接与互动数据,未披露模型版本、参数或性能数字。

  2. Cursor(@cursor_ai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 对比 Grok 4.5、GPT-5.6 Sol、Opus 5 与 Fable 5:没有模型能通吃所有任务

    Cursor 指出没有模型能主导所有任务类型:Grok 4.5 在日常任务上性价比突出,GPT-5.6 Sol 擅长规划与代码库理解,Opus 5 适合执行密集型工作,Fable 5 则在调试和视觉实现上表现优异。

  3. Next.js BlogAI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Next.js 16.3 让 v0 实现即时导航:用 instant() 测试与 Skill 驱动智能体循环

    Vercel 在 Next.js 16.3 中引入即时导航能力,并将其应用于自家全栈编码平台 v0,使登录与未登录首页、会话详情页和设置下各子页面从阻塞变为即时。

8月5日周三
  1. Sahil Lavingia(@shl)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sahil Lavingia:18,000 行代码曾经算是很多代码

    Sahil Lavingia 发帖称,18,000 行代码曾经算是很多代码。该帖获得 35 条回复、2 次转发、100 次点赞和 14160 次浏览。

8月4日周二
  1. Yann LeCun(@ylecun)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:优秀代码生成系统并非纯 LLM,不只是自回归 token 预测

    Yann LeCun 回应质疑称,其言论针对的是纯 LLM 所做的自回归 token 预测,而优秀的代码生成系统并非纯 LLM,也不只是在做自回归 token 预测。

  2. Next.js BlogAI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Next.js 16.3 正式发布:开发内存降低 90%,构建提速 5.5 倍

    Next.js 16.3 正式发布,Turbopack 在 next dev 下最高减少 90% 内存占用,磁盘缓存默认启用于 next build,部分项目 CI 构建提速 5.5 倍,App Router 改用原生 Node.js 流后负载下请求处理量提升 22%。

8月3日周一
  1. Last Week in AIAI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI Podcast #253:Claude Opus 5、Gemini 3.6、Kimi K3 与 Hugging Face 被黑事件

    Anthropic 发布 Claude Opus 5,Google 推出 Gemini 3.6/3.5 Flash 等多款新模型,Black Forest Labs 发布可生成图像与 20 秒带音频视频的 FLUX 3。

  2. 奇舞精选AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 时代的学习方式:从愚昧山峰上不断跌落

    前端开发者 Tapir 借助 Codex 在 ESP32-S3 开发板 LILYGO T-Embed 上做出名为 CadenzaOS 的操作系统,随后尝试让 AI 用 kicad-happy 画 PCB,却在嘉立创 SMT 环节因大量报错崩溃。他退回做 PCB Art 艺术板跑通闭环,并新开项目 PCB Atelier,可像 PS 一样操作图层并导出嘉立创 EDA 工程直接下单。

  3. Binyuan Hui(@huybery)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Binyuan Hui 转述 Karpathy:用 LLM 造游戏或成综合能力测试方向

    Binyuan Hui 转发 Andrej Karpathy 的观点并评论,认为做游戏能同时检验 LLM 的推理、规划、编码、工具库使用和多模态理解等能力,但社区仍缺少做游戏的标准化基准。

  4. Rowan Cheung(@rowancheung)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    有人用 Claude 搭工作流替代每月 38 美元的 QuickBooks 订阅

    一位用户用 Claude 构建的工作流替代了每月 38 美元的 QuickBooks 订阅,该工作流可解析银行对账单、为每笔支出分类,并接入一个消费看板。该案例由 Michael Saif 分享。