The Rundown AI 今日头条:OpenAI 数学论文破 700 篇、Mistral 发布 Le Chonk 开源模型
The Rundown AI 汇总今日 AI 要闻:OpenAI 相关数学研究论文已超 700 篇,Mistral 的 Le Chonk 加入西方开源模型浪潮,OpenAI 的 GPT-6 Astra 可帮用户比较网站,Brett Adcock 的 Hark 推出主动式 AI 助手。
The Rundown AI 汇总今日 AI 要闻:OpenAI 相关数学研究论文已超 700 篇,Mistral 的 Le Chonk 加入西方开源模型浪潮,OpenAI 的 GPT-6 Astra 可帮用户比较网站,Brett Adcock 的 Hark 推出主动式 AI 助手。
Min Choi 仅用一条提示词加上 OpenAI 一篇 722 页 AI 数学论文的 URL,就让 Opus 5.5 生成了一段 92 秒的动态图形讲解视频。该演示展示了模型在长文档理解与视频生成上的能力。
作者仅提供一个提示词和论文页面 URL,就让 Opus 5.5 把 OpenAI 的 722 篇 AI 数学论文浓缩成一段 92 秒的动态图形解说视频。它展示的是单一提示词加链接输入下,模型对大规模论文集合做压缩并生成动态解说内容的效果。
Claude 可被用于产品经理场景:只需向它提问"上周谁使用这个功能最多?整理一份使用量最高的前 10 名报告,然后联系他们,安排 15 分钟交流",即可自动找出产品重度用户并直接约访,这可能是获取真实用户反馈最快的方法。
一位产品经理分享 Claude 的用法:让 Claude 查出上周使用量最高的用户,生成用量 Top 10 的 artifact,再主动联系这些人并安排 15 分钟交流。她称这是获取用户反馈最快的方式。
X 为 Grok Bot 推出 X Scan 功能,用户给出一张图片或一帧视频,即可找到 Meme 的最初来源、传播最广的推文,以及特定类型的相关内容,例如所有使用这张图的 AI 主题推文。
Grok 的 X scan 功能支持输入一张图片或视频截图,即可找到表情包的出处、最热门的推文,甚至特定类型的帖子,比如“使用这张图的 AI 相关推文”。Justine Moore 称该功能“好得离谱”,并提到 X 现已上线表情包搜索。
Grok Bot 现已能自主搜索、阅读并持续监控 X,覆盖行业动态、品牌口碑、投诉预警以及竞品发布、趋势和爆款内容追踪。它 24 小时运行,每天早上自动生成简报,且已包含在现有付费套餐中,被称作最便宜的 X 研究分析师。
Grok Bot 成为可在 X 上自主搜索、读取和监控的调研工具,能追踪行业突发动态、品牌口碑、潜在投诉以及竞品发布、趋势和爆款帖。它全天候运行,每天早上直接生成简报,且包含在用户已付费的方案中。
Midjourney 宣布将面向有限社区测试 Midjourney MCP,目标是招募有创意和技术能力的用户拓展其模型能力边界。官方强调该 MCP 不用于 SaaS 产品,而是面向纯艺术与创意探索,申请通道已开放。
OpenAI「疯狂 28 天计划」Day 5 公布,用户现在可以直接在 iOS 和 Android 版 ChatGPT 应用中从手机创建 dots。
OpenRouter 为内部 5 人销售团队打造的 AI 销售智能体 Rasp,每月节省约 600 小时工时,当前推理使用 GLM 5.2、成本约 18 美元/天。
Google Cloud 在 Gemini at Work 活动上宣布发布 Gemini,定位为面向工作的单一通用智能体,可在同一个提示框中完成问答、知识工作和写代码。
宝玉介绍了一个用 Claude Dashboard 分析 X 账号数据的用法:从 X 账号数据页下载各 Tab 数据,作为附件上传到 claude.ai/artifacts 新建的 Dashboard,交给 Claude Dashboard 分析。参考提示词为「帮我分析一下我的推文数据,看看哪些推文更受欢迎,怎么优化」。
以修改 UI 为主的功能不必先写技术方案,可以直接从改原型开始;原型改好后用 Agent 内置浏览器的“标记”工具在要改的地方标注并写评论。原型完成后,可在同一会话里让它把原型修改同步到正式代码中。作者通常用 Fable 做设计、Opus 执行、再由 Fable 验收。
小互表示可以确定 Grok Bot 现在由 Opus 5.5 驱动,让 Grok Bot 学习 Claude Motion 与 Dashboards 指南后一击命中生成视频,并上传自己的形象完成配音。该指南涵盖 Claude Dashboards 实战与避坑、Claude Motion 核心工作流、视频提示词写法、官方单车案例 81 秒演示逻辑及新手交付前检查清单。
Eazo 是一款以 App 为中心的 Personal Agent,支持用自然语言开发 App 和小游戏,并带登录、调用 AI 以及接入 Stripe 全球收款。
向阳乔木推荐 AI 应用 Eazo,可通过对话把日常高频小需求直接生成 App,并给出邀请链接与 App Store 下载地址。他认为 GUI 依然重要,点击比说话更省事,用 AI 造工具、再用手操作,成本低且直观;Eazo 生成的 App 审美在线,其本人还用 Remix 做了一个像素风钓鱼应用。
Mole 正在开发 AI 清理与维护功能,覆盖主流 AICoding 工具和 CLI,可处理旧版本、worktree、老对话、不在用的工具及过期内容。目前对话清理默认检查「120 天之前」,也可选择「永不清理」,Mole 就哪种默认策略更好向用户征求意见。
原文仅给出"当前的效果和选项"这一表述,未说明具体产品、模型或功能,也未提供任何参数、benchmark 分数或可用性信息,仅附带 2 条评论、0 次转发、1 个点赞和 2373 次浏览的互动数据,由 xgo.ing 提供支持。
一份 X 上最值得关注的 DevRel 名单被整理出来,这些开发者关系从业者擅长制作有趣的 Demo,也能把复杂技术讲得简单易懂。
AI Will 发布了 X 平台上优秀 DevRel(开发者关系)的完整名单,地址为 topdevrels.vercel.app,并转引 aasha 的说法称这些人能做出酷炫 demo、把技术内容讲得通俗易懂。
Ryan 根据服务大型品牌、招聘数十个内容岗位的亲身经验,总结了成为世界级 Head of Content 的完整方法。他认为只会写爆款只能算 6/10,真正的 11/10 需要同时掌握品牌战略、内容分发、团队管理和系统建设四方面能力。
Ryan(@ryangrowthh)在 X 上发布了一条推文,内容为指向其 X 长文(Article)的阅读链接,并附上 x.com 的原文跳转地址。该推文互动数据为 1 条回复、0 次转发、1 次点赞、359 次浏览。
Ryan 根据服务大型品牌、招聘数十个内容岗位的经验,总结出成为世界级 Head of Content 的方法:只会写爆款只能算 6/10,真正需要同时掌握品牌战略、内容分发、团队管理和系统建设。
LangChain 推出 Managed Deep Agents 0.8,新增用户自有凭证、用户级记忆、HTTP channels、Slack 文件传输,以及由 Parallel 驱动的联网搜索预置工具。
LangChain 发布 LangSmith Fine-Tuning 和 smithtune,这是一个把 LangSmith 轨迹转成 Agent 专用微调模型的 CLI,覆盖数据集构建、基于 Fireworks 或 Baseten 的训练以及 LangSmith 评估。
Notion 正在原生重建其 iPad 应用。侧边栏、AI 和 Search 已完成原生化以提升速度,接下来移动端将上线原生编辑器,验证稳定后再在 iPad 上测试,随后探索 Apple Pencil 支持。
Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 在对话中指出,AlphaFold 的突破只是开始,蛋白质折叠远未解决,静态结构预测无法覆盖蛋白质动态与无序性。
股市重回历史高点,Robinhood 上这群爱冒险的普通美国交易者是推动力量之一。在这处被视作风险偏好者圣地的平台上,几乎每个人都有一段发财经历。
Devin 推出按需云环境,支持 macOS、Linux、Windows 和 Android,让硬件不再决定开发者能在哪里、构建什么。有用户表示自己用的是 Windows PC,也能借此无缝为 iOS 构建应用。
豆包工作 10 月 9 日宣布任务模式新增画布功能,支持无限画布查看整理素材与创作成果,并可在生成后逐步调整文字、配色与布局。同时上线豆包 2.1 Lite 模型,官方称其更省额度、更快交付,覆盖文档撰写、表格处理、PPT 制作等场景,并支持全新图片模型 Seedream 5.0 Flash。
Lee Robinson 在斯坦福 CS146S 课程第三周讲座中,以 Grok Bot 为例讲解「常驻式主动智能体」的工作原理,即常驻运行、主动观察环境、自主决定何时介入的 agent。讲座分六部分,涵盖从聊天式助手到常驻 agent 的演进、模型能力变化、内部架构拆解、执行框架(工具调用、循环控制、权限与安全边界)、上下文工程以及范式前瞻。
SpaceXAI 团队 @pjvann 发布 4 个可直接使用的 Grok Bot 模板,覆盖产品发布(LaunchBot)、安全威胁猎捕(Threat Hunter)、威胁情报(Threat Intelligence Lead)和 X API 开发(X API Engineer)四个场景。
ChatGPT 会话标题末尾偶发出现外语词或赌博色情小广告,作者结合抓包记录与 EMNLP 论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》推断,标题由轻量推理模型生成,常在该结束生成时收尾失败,继续按概率输出词元。
Claude Code Projects 向所有 Pro 和 Max 用户开放,小互给出 4 分钟入门指南:创建项目并填入目标和相关代码仓库,Claude 会把大目标拆成多个任务,每项任务建立独立线程并行执行,线程默认在云端运行,合上电脑也能继续,需要本地文件或工具时可改到电脑上运行。作者提示并行任务会更快消耗套餐额度,可以规定它如何工作、多久汇报、是否先给计划,线程之间共享项目记忆。
一条建议称,在完成优化后,可以再用 Opus 5.5 去 review 一下,然后让它学习一下。原文未说明具体优化对象与流程细节。
Vercel CEO Guillermo Rauch 公布平台流量数据:过去 30 天整个 Vercel 网络有 58.18% 流量来自机器人,2024 年 1 月这一比例为 32%。
Shane Mac 的个人 AI 智能体将他的银行信息误发到了公司 Slack 上,这让他重新思考自己该如何使用这类工具。他在 10 月 9 日的讲述中提到了这一经历。
Supabase 官网访问量已连续 12 个月高于 Vercel。过去一年构建层平台流量集体翻倍:Vercel 涨 2.6 倍、Supabase 涨 2.1 倍、Cloudflare 涨 2 倍、OpenRouter 涨 2.4 倍;与此同时,单一用途的 AI 网站访问量出现萎缩。