Unsloth 发布本地训练决策模型教程与开源仓库
Unsloth 发布本地训练教程与开源仓库,可将 Qwen3.8、Gemma 4 等 LLM 微调为输出选项概率的决策模型。Unsloth 报告,Qwen3.5 0.8B 在三个决策基准上的合计准确率从 20.7% 提升至 74.3%,并称仅需 4GB 显存。
Unsloth 发布本地训练教程与开源仓库,可将 Qwen3.8、Gemma 4 等 LLM 微调为输出选项概率的决策模型。Unsloth 报告,Qwen3.5 0.8B 在三个决策基准上的合计准确率从 20.7% 提升至 74.3%,并称仅需 4GB 显存。
张佳宣布《AI产品经理转型特训营-2026版》课纲开始更新,共14大模块、76章节、330+知识点、24小时课程时长,计划每周更新一轮、争取2个月内更完全部内容。新版融合2025版技能特训课、项目实训课、线下课、AI编程课与智能体课程内容,增加Agent、Skill的篇幅和颗粒度,并重构教学方式以适应零散时间学习。更新期间报名按2025版早鸟价2999元,更新完成后涨价至3999元。
阿里开源了内部使用两年的 AI 代码审查工具 Open Code Review,可识别逻辑错误、安全漏洞和性能问题并定位到具体代码位置,官方安装命令为 npm install -g @alibaba-group/open-code-review。
一场科技圈聚会上的举手表决显示,几乎无人愿意在 Anthropic 3 万亿美元估值下买入其股票,现场只有 3 人举手。Business Insider 认为,Anthropic 的 IPO 将检验这轮 AI 热度能否承受公开市场的审视。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,同日 Sonnet 5.5 缓存读取价格减半并推出订阅 API 额度。
汇总了 Haiku 5.5 的定价、第三方评测与 token 消耗代价,读者可据此判断小型模型在智能体工作流中的实际位置。
礼来CEO David Ricks在播客《Cheeky Pint》访谈中估计,人类目前可能只掌握10%-15%的生物学知识,需提升到50%以上AI才有望可靠预测复杂生物系统。礼来已启用配备1,016块英伟达Blackwell Ultra GPU的LillyPod超级计算机,并与英伟达共建AI创新实验室,未来五年投入最高10亿美元。他同时提到中国在全球药物研发管线中的份额已达约30%。
逛逛GitHub 汇总了三款最近爆火的个人 Agent 的开源平替项目。Rakazo 定位 Grok Bot 的开源替代,每个 Bot 拥有独立对话、记忆和例行任务,可接入模型并配置浏览器、终端、文件和图形桌面环境,支持多 Bot 分工与子 Agent。
Kent Beck 在 Prodacity 大会演讲中称,自己写的三本编程手艺书如今"基本可以扔进垃圾桶"。他批评大模型是"神灯里的精灵":几秒吐出成千上万行语法正确、看似合情合理的代码,却往往无法真正跑通,只会以极低资本开销制造出不可维护的"屎山"。他主张工程师在 AI 交差后踩死刹车,于特性间隙重构,并以"未来期权"视角权衡特性产出与系统可修改性。
2026 奇点智能技术大会将于 11 月 20—21 日在北京万达文华酒店举行,初版全日程已公布,设 18 个专题、近 70 场分享,汇聚 70+ 技术专家。议题覆盖从 Agentic Scaling 到 RSI、Agent、多模态与世界模型、Physical AI、AI Infra 与 AgenticOps 等方向,C++ 及系统软件技术大会同期同址举行。
谷歌于 10 月 6 日开源 EmbeddingGemma 2,这是其首个原生多模态开源嵌入模型,可把文字、代码、图片、视频、音频放进同一个 768 维空间并用一句话检索。
Qdrant 与 Pento 合作推出 miniCOIL EN-ES,一个英西双语稀疏神经检索器,让 "home" 与 "casa"、"bat" 与 "murciélago" 映射到稀疏向量的同一单元格,单个倒排索引即可同时服务英语和西班牙语查询与文档,无需翻译步骤。
面向 Physical AI 的 Reality-to-Sim 具身智能基础设施公司景立构(ScanArk)完成 Pre-天使轮融资,4个月内累计完成种子轮、种子+轮及 Pre-天使轮三轮融资,累计数千万元人民币,投资方包括小苗朗程、国海创新资本、头部具身机器人公司及知名产投机构等。
智能眼镜品牌NIMO所属公司比特幻境完成数亿元人民币天使轮融资,最新估值达15亿元。本轮投资方包括博华资本、戈壁创投、元禾璞华及尚势资本,资金将用于产品研发、渠道拓展及海外市场布局。NIMO首款产品砍掉拍摄、音频外放与彩色大屏,围绕0.06英寸Micro LED芯片实现单目单绿色显示,整机重29克,定价2499元(含配镜)。
Govee 在 IFA 2026 发布 Sky Ceiling Light、COB Strip Light 2 Pro 和 Permanent Outdoor Lights 2 Pro 三款新品,均搭载 AI Lighting Bot 2.0,用户可用文字、语音或图片生成灯光效果并进行多轮对话调整。
Cloudflare 在 Birthday Week 期间发布开源权重决策模型 Clef,包含 27B 多模态模型和面向延迟敏感场景的 9B 模型 Clef-Flash,输入为状态与带类型问题的 schema,输出每个候选项的概率,不生成自由文本。
Manus母公司蝴蝶效应宣布完成超过5亿美元新一轮融资,博裕投资、IDG资本领投,腾讯、红杉中国、真格基金继续参与,估值40亿美金,刷新中国AI应用估值纪录。9月28日Manus发布2.0版本,同时推出独立应用Cue,展示个人Agent方向,Cue中的Agent可通过自己的身份沟通、在用户设定预算内付款、在群聊中分工协作,目前处于早期访问阶段并以邀请码免费使用。
作者整理了一套面向 Codex 的提问模板卡,覆盖修 Bug、加改功能、优化代码、改已有功能、还原设计稿、修启动构建问题和对接接口 7 个场景。每个模板给出可直接复制替换的提示词,明确任务边界、处理要求与完成即停止等约束,并说明同一需求涉及多项工作时可使用通用组合模板。
面向Physical AI的Reality-to-Sim具身智能基础设施公司景立构(ScanArk)宣布完成Pre-天使轮融资,4个月内累计完成种子轮、种子+轮及Pre-天使轮三轮融资,累计数千万元人民币。
一名开发者已全额支付 Cloudflare 账单 US$10,811.41,称这是人生第二贵的教训。其减免工单只得到机器人循环回复,通过 X 及其他渠道联系官方人员也仅获"看看"的回应。他随后宣布将所有项目从 Cloudflare 迁出,改为 VPS 自部署,并卖出全部 Cloudflare 股票。
Vercel Sandbox 的 Sandbox.create() 现在会在快照恢复完成后才返回,沙箱创建完成即可直接运行命令和读写文件,首个操作不再需要等待快照恢复,启动错误也改为在 create() 阶段抛出。代价是创建耗时在 p50 增加约 50 ms,未缓存快照可能增加更多,但到首个操作的总耗时不变,该变更自动生效,无需升级 SDK 或调整配置。
ZooWork 创始人兼 CEO Ning Hu 在 Assembling 2026 AI 峰会炉边对谈中提出企业 AI 的 L1 到 L4 分级:L1 是人用 AI 提效,L4 是 AI 在岗位上执行并递归学习,目前多数企业仍停留在 L1。
UniPat AI 推出 PaperBenchX(PBX)评测,让 AI 在真实科学软件中复现已发表论文的关键实验。在覆盖 12 个科学方向的 93 道题中,70 道没有被任何配置完全复现,表现最好的 GPT-6 Astra 仅有 14% 的任务过关,国产模型基本在 7% 左右。评测发现建模和执行平均得分都在六成以上,但科学验证仅约 43%,多轮交互难以弥补这一差距。
开发者吐槽 Claude、GPT 等模型在 Coding 场景输出"15/15全绿""单腿哑火"等黑话,语言能力明显倒退。Coding 过拟合与 CoT 压缩是主因:为省 Token,模型思维链被简化成"穴居语",Token 消耗量比白话文少 70%,Claude 自 Opus 4.6 后也改为非自然语言思维链。
文章指出 Tips and Linkers 并不像表面上看起来那么安全,并将其置于全球经济背景下讨论。标题未点明具体主体,正文实际内容不足以支撑更细的结论,故不补写具体模型、公司或功能信息。
Manus 母公司蝴蝶效应宣布于近日完成超过 5 亿美元新一轮融资,由博裕投资、IDG 资本领投,腾讯、红杉中国、真格基金继续加持,未披露估值。这是 Manus 今年 9 月 1 日宣布恢复独立运营后的第一笔融资,也是国内 AI 应用领域迄今最大的一笔单笔融资。
Claude Code 团队公开向 @swyx 及用户征集改进意见,询问希望在 Claude Code 中改进哪些方面。该帖获 57 次点赞、7684 次浏览。
OpenAI 在 X 上宣布 GPT-6 开始向全球 ChatGPT 用户分批推送,付费用户先行,10 月 8 日起扩展到 Free 和 Go,免费版与 Go 使用 GPT-6 Luna,付费档日常 Chat 使用 GPT-6 Sol。
GPT-6 向免费用户开放并带来回答内可交互的智能 UI,读者可据此判断日常问答形态的变化。
10月6日,Anthropic 宣布 Claude 接入 Google Docs、Sheets 和 Slides,向 Pro、Max、Team 和 Enterprise 全部付费计划开放公开 Beta。
英国汽车市场竞争格局目前仍完全开放,但各类贸易壁垒正在逼近。
iOS 27 新增通知自动化,任何能发送通知的 App 都可作为快捷指令触发条件,并可按通知标题、副标题、正文三个字段组合筛选。作者用十个案例展示具体玩法,包括重要联系人连续消息换墙纸提醒、自定义图标后补回角标、按 App 颜色生成墙纸、联系人专属铃声、英文通知自动翻译以及用 AI 总结当天通知。文中也指出限制,通知自动化只能获取实际显示出来的内容,微信等长消息会被省略号截断。
架构师沈剑在《AI时代的架构设计100讲》第9讲指出,AI写代码会踩的四类缓存坑没变——耦合、雪崩、不一致、互相挤兑,但踩坑的从程序员变成了AI。他建议把四条红线写进spec禁止条款:禁止用缓存当服务间数据管道、禁止调用方缓存服务底层数据、禁止多服务共用缓存实例、未做容量预估与雪崩预案禁止上线。雪崩预案可用高可用缓存集群或缓存水平切分,并需通过缓存宕机演练验收。
旧金山市长 Daniel Lurie 在 SFPD 陪同下夜巡 SoMa、Tenderloin、Nob Hill、Hayes Valley 和 Mission,称 24th and Mission 等地有亮点,但芬太尼仍是城市危机。他已要求 SFPD、Muni、SFFD、Sheriff's Office、Rec and Park 等部门优先整治夜间街头状况。
《纽约时报》9月29日报道,Anthropic 过去一年邀请数十位宗教学者闭门讨论 Claude 内部状态与模型意识问题,联合创始人克里斯托弗·奥拉还于5月赴梵蒂冈出席活动。
Grok 在 X 上线新的 X scan 功能,支持 meme 搜索:给它一张图片或视频截图,就能找到该梗的出处、最热门的推文,甚至特定类型的帖子(例如"使用这张图的 AI 相关推文")。该功能被评价为"好得离谱"。
厘清智能近日完成天使轮及天使+轮数亿元融资,蚂蚁集团连续两轮加码并领投天使+轮,CMC资本、国汽投资、中金资本旗下基金等跟投。融资将用于物理世界数据管线、模型研发、物理仿真、能力评测、跨本体适配与部署系统。公司已推出T1系列数采手套和Ego数采设备,为模型厂商与AI研发团队提供多模态数据采集、加工标注与专项数据集建设服务。
OpenAI 宣布 GPT-6 面向全球推送,付费用户先行,10 月 8 日起免费用户也能使用,正式取代 GPT-5.6 Sol 和 Luna,并带来可自动生成图表、按钮、表单的 Intelligent UI。
企业法务运营负责人分享了将最新 AI 技术引入律师工作体系的实际经验,既谈到收益也谈到代价。这些一线反馈揭示了内部法务团队落地 AI 时面临的现实问题。
Anthropic 为 Max 和 Team 订阅用户按月赠送 Claude Platform API 额度:Max 5x 每月 $100,Max 20x 每月 $200,Team 按席位 $20 或 $100 合并共享,整队上限 $500/月。
中国科学院院士鄂维南在 PAIR Conference 2026 演讲中提出,AI for Science 的下半场是科研体系重构,将打破理论实验、学科之间、科研与产业三道边界。他称仅靠开源通用模型微调叠加科学能力做"科学基座模型"可能是伪命题,底层基座模型仍是最大挑战;同时提到 DPA-4 大原子模型、SpecXMaster 核磁谱解析平台等进展。
ElevenLabs 正式在新加坡落地,其东南亚新中心已开放,并已与 Funding Societies、Atome 等企业展开合作。Mati Staniszewski 表示自己本周都在当地,欢迎有意与其共建的人联系,公司同时在招聘相关岗位。