跳到正文

#部署/工程

今日 0 条
9月18日周五
  1. Perplexity(@perplexity_ai)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 为 Computer 模型选择器推出 effort controls

    Perplexity 在 Computer 的模型选择器中上线 effort controls,通过 effort presets 组合编排模型与推理深度,控制 Computer 处理任务的深入程度与效率。该功能已在网页端可用,移动端和桌面端即将推出。

  2. Jina AI(@JinaAI_)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jina AI 发布 jina-ocr-v1:基于 DeepSeek-OCR 后训练,支持 25 种语言

    Jina AI 推出基于 DeepSeek-OCR 后训练的 jina-ocr-v1,多语言支持扩展至 25 种,并针对 NVIDIA L4 等低预算 GPU 优化。该模型在 OmniDocBench v1.6 上得分 91.14,olmOCR-Bench 上得分 83.4,页面吞吐量在所有竞品中最高。

9月17日周四
  1. AWS Architecture BlogAI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DHI Group 如何用黑客松将生成式 AI 工作负载从想法推向生产

    DHI Group 与 AWS 合作推出 Hackathon Acceleration Package(HAP),通过三天黑客松让 20 名参与者分 3 组构建原型,覆盖雇主分析、候选人匹配与 ClearanceJobs–AgileATS 集成三类用例。

  2. Weaviate • vector database(@weaviate_io)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Weaviate 1.39 新增 4-bit Rotational Quantization,8-bit RQ 导入提速 16%

    Weaviate 1.39 推出 4-bit Rotational Quantization(RQ),在压缩向量内存占用的同时保持较强召回,并提升导入与搜索性能。

  3. AI产品黄叔(@PMbackttfuture)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    基于 Claudian 改造:支持 antigravity cli,可用 OpenCodex 接入 Codex,并装入 Obsidian

    基于 Claudian 改造的版本新增了对 antigravity cli 的支持,并可通过 OpenCodex 接入 Codex,同时该 Claudian 插件已可安装到 Obsidian 中使用。原推未披露模型版本、参数或性能数据。

  4. 字节跳动技术团队AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    火山引擎日志服务 TLS AgentLoop 支持多模态调用观测

    火山引擎日志服务 TLS AgentLoop 新增多模态内容展示能力,开发者可在 Session、Trace 和 Span 中直接查看图片,并与提示词、模型输出、工具结果对照排查。

  5. 随机小分队AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Linkloud 第 44 期成都沙龙:Agent 如何从"能做"走向"能用"与"能卖"

    Linkloud 第 44 期沙龙将于 2026 年 9 月 19 日下午在成都举办,主题是 Agent 如何从"能做"走向"能用"与"能卖"。

  6. 百度AIAI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    文心开发者用百度搭子把"给猫算塔罗"做成小程序

    文心开发者丁康佳借百度搭子把一次情绪梳理体验做成可运行的小程序,灵感来自他用塔罗牌"测算"自家猫是否怀孕。百度搭子发布的Harness智能引擎在相关任务中任务完成率达99%以上,积分消耗降低30%,其内置安全沙箱在用户本地设备内隔离运行数据与操作。

  7. 百度AIAI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    2026 CCF-百度松果基金申报倒计时3天:9月20日截止,聚焦大模型七大方向

    2026年度CCF-百度松果基金申报将于9月20日23:59(北京时间)截止,该基金由CCF与百度于2020年共同发起,已累计支持170余项课题、产出超100项顶级成果。今年基金聚焦基础理论、分布式训练、推理部署、强化学习训练系统、模型结构与预训练、后训练与Agent、数据建设七大方向,计划支持8至13项,每项资助15万至25万元,课题周期为2026年10月至2027年10月。

  8. 腾讯云开发者AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯轻量云 DevFlow 实践:多 Agent 工作流里真正烧 Token 的是反复携带的长上下文

    腾讯云轻量云团队在多 Agent 开发工作流 DevFlow 中定位到,Token 消耗主要来自长上下文在多轮请求中被反复携带,而非代码本身;Developer 阶段上下文曾达到约 120K tokens。

  9. HelloGitHubAI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从一份 README 到 3 万星,RustFS 这一年都干了什么?

    RustFS 发布正式版,这个基于 Rust、兼容 S3 的对象存储系统开源首年已积累 3 万多 Star,全球安装实例超 270 万,70% 以上来自欧美。正式版新增 MinIO 丝滑切换,可直接读取 MinIO 数据盘完成迁移,并将 MinIO 商业版中约 80 万人民币/年的 S3 Table 功能免费开源,支持 Spark、Iceberg 读写表数据并已进入生产环境。

  10. AI SDK(@aisdk)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel AI SDK 文档更新,附 ai-sdk.dev 链接

    Vercel 在推文中指向 AI SDK 的文档页面 ai-sdk.dev/docs/ai-sdk-co…,并 @vercel 与 @vercel_dev 两个官方账号。该推文互动量为 0 条回复、1 次转发、9 个点赞、3174 次浏览,未披露具体功能或版本信息。

  11. AI SDK(@aisdk)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 新增 evaluate 方法,可调用 typesafeai 最新 Jev 模型

    AI SDK 新增 𝚎𝚟𝚊𝚕𝚞𝚊𝚝𝚎 方法,用户可借此调用 typesafeai 的最新 Jev 模型。该消息由 AI SDK 官方账号发布,未披露 Jev 的版本号、参数规模或可用方式。

  12. NVIDIA Technical BlogAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何用 AI 智能体为仿真准备 3D 场景

    智能体 AI 工作流可用于为物理 AI 系统准备并验证数字孪生:智能体检查 3D 场景、在 OpenUSD 中编写仿真相关数据、添加物理属性、渲染预检视图,并按仿真就绪(SimReady)要求校验结果。该流程演示了从 Blender 中的场景到交付给 NVIDIA 的仿真就绪 OpenUSD 的完整过程。

  13. Greg Brockman(@gdb)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Databricks 向约 3500 名工程师全量部署 Astra

    Databricks 向约 3500 名工程师全量部署 Astra。Patrick Wendell 称,Astra 在高层系统设计等复杂任务上明显优于此前的 Opus 5、Sol 5.6,工程师整体编码支出较基线增加约 60%;但在中低复杂度编码任务上提升不明显,团队通过 Unity Gateway 为 Astra 设专项子预算,引导工程师只在复杂任务上使用。

  14. Fireworks AI(@FireworksAI_HQ)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks AI 发布微调 Quickstart 文档

    Fireworks AI 上线微调 Quickstart 文档,地址为 docs.fireworks.ai/fine-tuning/tr…。该推文未披露更多模型、价格或参数细节。

  15. Fireworks AI(@FireworksAI_HQ)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GLM 5.3 上线 Fireworks AI Serverless Training API,Kimi K3、Qwen 3.8 27b 已在列

    GLM 5.3 现可在 Serverless Training API 上训练,与 Kimi K3、Qwen 3.8 27b 等模型并列;GLM 5.3 Flash 即将推出。官方称无需销售演示或私信沟通,可直接从文档或预制 recipe 上手(github.com/fw-ai/cookbook)。

  16. Paul Couvert(@itsPaulAi)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Unsloth 发布免费 Google Colab 资源,含 GitHub 仓库与文档

    Unsloth 在 X 上分享了全套免费资源,包含可直接在浏览器打开的 Google Colab 笔记本、GitHub 仓库和官方文档站链接。帖子未披露具体模型、参数量或性能数据,仅指向 unsloth.ai/docs/new/studi 页面。

  17. NVIDIA Technical BlogAI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA TensorRT Edge-LLM 在 Jetson AGX Thor 上以 6.4 倍速度完成 MLPerf Edge Agentic Benchmark

    NVIDIA 的 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升 6.4 倍。该基准针对 AI 智能体在车辆、机器人等边缘设备上的多步推理工作流,要求模型快速生成 token 并在不断增长的对话中持续推理。TensorRT Edge-LLM 面向此类边缘推理场景优化。

  18. xAI(@xai)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 的 Grok Voice 上线 fal,0.70 秒响应构建低延迟语音智能体

    xAI 的 Grok Voice 已在 fal 上线,这是一款响应仅需 0.70 秒、能在句子说完前完成工具调用的语音模型。它支持带词级时间戳的转录、覆盖 25+ 种语言的 30+ 种音色的文本转语音,并可用两分钟音频完成声音克隆。开发者可借此在 fal 上构建低延迟语音智能体,用于解决真实客户问题。

  19. DeepLearning.AI(@DeepLearningAI)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    长时运行 AI 智能体的上下文管理与信息丢失问题:新工具帮助优化记忆并降低 API 成本

    长时运行的 AI 智能体面临上下文限制与信息丢失问题,一款新工具正帮助开发者优化记忆管理并削减 API 成本。高效的信息检索被视为生产级 AI 的关键技能。完整分析刊于 The Batch。

  20. mem0(@mem0ai)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mem0 上线 Vercel Marketplace,为智能体提供跨会话记忆

    Mem0 现已上线 Vercel Marketplace,安装后可为 AI 智能体提供跨会话持久记忆。该集成会自动配置 Mem0 项目与 API key,费用计入 Vercel 账单,并提供免费套餐。开发者可通过 `vc i mem0` 命令安装。

  21. idoubi(@idoubicc)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Termany.sh 推出 Model Gateway 面板,为本地 AI 智能体提供统一模型路由层

    Termany.sh 推出 Model Gateway 面板,为本地 AI 智能体提供统一的模型路由层,可在数秒内切换模型与提供商,无需手动修改智能体配置文件。

  22. bolt.new(@boltdotnew)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt 上线可直接使用的网站模板,覆盖作品集、落地页、仪表盘与店铺

    Bolt 推出可直接使用的网站模板,覆盖作品集、落地页、仪表盘和店铺等场景,均可在 Bolt 中自定义。用户打开模板、改成自己的内容后即可发布上线。

  23. NVIDIA Technical BlogAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 用智能体 AI 将 CUDA Tile 运算从 Python 转译到 Rust

    NVIDIA 展示用智能体 AI 把 CUDA Tile 运算从 Python 转译到 Rust。目标系统 cuTile Rust(cutile-rs)是一个基于 tile 的 GPU kernel 编写框架,将 Rust 的所有权模型扩展到 tile 级 kernel,把可变输出拆分为互不相交的分片,并在 kernel 启动间保持主机端所有权契约;开发者也可在需要底层控制时局部退出该约束。

  24. cohere(@cohere)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere Model Vault 上线 NVIDIA 机密计算,开放限量 beta 早期访问

    Cohere 的 Model Vault 现已支持 NVIDIA 机密计算,并面向有限数量的 beta 客户开放早期访问,beta 名额有限。官方未披露具体模型、价格或性能数据,仅给出 cohere.com/solutions/mode… 的了解更多链接。

  25. cohere(@cohere)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere 机密计算:端到端加密推理与 GPU 硬件隔离

    Cohere 的机密计算通过三种方式防止数据被追踪或使用:端到端加密推理、借助 NVIDIA 机密计算将硬件强制隔离延伸至 GPU,以及可随时申请签名认证令牌并对照硬件厂商公钥独立验证。数据控制权归用户所有。

9月16日周三
  1. LangChain BlogAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 总结医疗与生命科学智能体规模化:Madrigal、Abridge、Vizient 的实践经验

    LangChain 梳理了 Madrigal Pharmaceuticals、Abridge 和 Vizient 三家机构构建医疗与生命科学智能体的做法:Madrigal 搭建企业级多智能体平台,Abridge 将医患对话转为临床文档并贯穿临床工作流,Vizient 用 GenAI 平台让医疗机构查询此前孤立的数据。

  2. mem0(@mem0ai)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    mem0 推出 Gateway:给 AI 智能体更多访问权限之后的一周会发生什么

    mem0 发布 Gateway,聚焦 AI 智能体获得更多访问权限之后的长期管理问题。原文未披露具体功能参数、价格或可用性细节。

  3. Milvus(@milvusio)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 支撑全球最大音乐流媒体之一:1 亿+曲目、数十亿向量、约 10ms P99 检索

    一家覆盖 100+ 国家、服务数亿听众的音乐流媒体平台用自托管 Milvus 搭建了音频与歌词的统一检索层,将 1 亿+曲目编码为数十亿向量,实现每秒数百次查询下约 10ms 的 P99 数据库检索延迟。该基础设施同时支撑歌曲识别、歌词搜索、推荐和版权匹配,支持播放短片段、哼唱旋律或输入模糊歌词等检索方式,并通过地域与版权过滤结合语义与全文搜索。

  4. The IntelliJ IDEA BlogAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    IntelliJ IDEA 2026.2 Logpoints 实战:gRPC 服务调试排错

    IntelliJ IDEA 2026.2 改进了 Logpoints,新增在任意两行可执行代码之间的 gutter 处点击即可输入日志表达式的方式,无需重建或重新部署即可修改日志。文章用一个 gRPC 客户端-服务器示例演示如何用 Logpoints 定位租户名未规范化导致折扣为 0 的 bug,并可在调试中直接验证修复效果。

  5. cohere(@cohere)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere 与 Aleph Alpha 联手打造安全可控的前沿 AI

    Cohere 宣布与 Aleph Alpha 合作,共同满足全球对既强大又安全的前沿 AI 日益增长的需求。Cohere 称,任何政府或企业都不应在 AI 能力与对自身技术的控制权之间做取舍。

  6. 真格基金AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    清华博士张托肯谈用 AI 三天设计芯片与 Agent 在芯片设计中的边界

    清华大学电子工程系博士、现苏黎世联邦理工学院博士后张托肯用 AI 在三天内从零设计了一颗 Attention 计算芯片并完成流片,过程记录在《三天从零到流片:AI 带我设计一颗 Attention 计算芯片》一文中。

  7. 此话当真AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对话张托肯:用 AI 三天设计一颗芯片后,一位清华博士决定「开卷」

    清华博士、苏黎世联邦理工博士后张托肯用 AI 三天完成从零到流片的 Attention 计算芯片设计,并借真格「Token Grant」算力支持推进「芯片开卷」计划。

  8. vivo互联网技术AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    告别"散装 AI":用 Skill 编排对存量代码做"微创手术"

    vivo IT 技术团队用 1 个编排器 dev-workflow 加多个单职责 Skill 组成 AI 协作流水线,把存量代码变更拆成增量流程 A 和存量流程 B,流程 B 依次执行影响面分析、处理原则提取、最小侵入分析、埋点与回归用例生成。

  9. 字节跳动技术团队AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenViking 如何为内容创作者打造跨 Agent 的长期记忆中枢

    OpenViking 是字节跳动 Viking AI 搜索推出的 Agent 记忆中枢,可接入 Trae、Codex 等不同 Agent,把创作资料、写作偏好和复盘经验统一组织成 Resource、Memory、Skill 三类,并存入 viking:// 地址实现分层召回,减少重复读取的 Token 开销。

  10. 得物技术AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    得物技术指标平台实践:从语义底座到 Text2SQL 与 AI Coding

    得物技术推动指标字典从0到1落地,用业务、数仓、产品三条线建立语义底座:存量报表逆向梳理、隐性指标先登记后转正,数仓消费收敛到域控宽表,并在提报环节拦截二义性。该语义层支撑 Text2SQL 与 AI Coding 两条消费主线,系统测评 SQL 准确率从 85%+ 提升到 95%+;OneData 建设全流程提效 40%+,核心模型开发阶段提效 70%+。

  11. 腾讯技术工程AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    看完我的AGENTS.md,你将看到我和不说人话且over-engineering的模型搏斗的这一生

    腾讯程序员 daisy 公开了一份用于约束 AI 编程模型的 AGENTS.md,把「本文件中的每一条规则都是强制性的」写进开头。规则禁止用 try-except 包 import、用 Git 回滚代码、读写 /tmp、主动使用视觉功能、以 mock 或 workaround 通过测试,也禁止「不是……而是……」句式和单字缩写。

  12. 袋鼠帝AI客栈AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    袋鼠帝开源《魔搭紫皮书》:8篇34章约40万字,教人从0部署、微调、评测开源模型

    AgentWork 开源社区发布《魔搭紫皮书》,共 8 篇 34 章、约 40 万字,面向想系统学习 AI 的读者。内容覆盖开源模型下载、无资源体验、用 ms-swift 做轻量微调、用 EvalScope 评测,以及 AI 健身教练、智能客服质检、语音助手、企业知识问答等场景,并含 Claude Code、Pi、DeepSeek Harness 的 Agent 篇。

  13. idoubi(@idoubicc)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    termany.sh 可查看每日 agent 使用情况

    termany.sh 支持查看每日 agent 使用情况,用户认为这一功能非常方便。