Grok 实时生成双人播客:粘贴链接或 PDF,脚本边写边播
Grok 推出播客功能:粘贴一个链接、文章或 PDF,两位主持人便能对谈讲解。每一行由 Grok 写完即转成语音,因此整集节目在脚本尚未完成时就开始播放。
Grok 推出播客功能:粘贴一个链接、文章或 PDF,两位主持人便能对谈讲解。每一行由 Grok 写完即转成语音,因此整集节目在脚本尚未完成时就开始播放。
xAI 在 GitHub 开源 X 情绪追踪器,用户选定话题后,Grok 每天执行一次 X 搜索,覆盖过去 10 天内容,剔除噪声并将每条帖子按 -1 到 +1 打分。仪表盘展示情绪正负分布、逐日变化趋势,以及每个分数对应的原始帖子。
Grok 能把截图直接写成 Tailwind 组件,再将渲染结果截图并与原图轮廓叠加后回传给 Grok,让它修正对不齐的地方。这一流程在本次运行中把还原度从 60% 提升到 77%,代码已开源于 github.com/xai-org/xai-co。
有人向 cookbook 新增了五款应用,全部基于新的 SpaceXAI TypeScript SDK 构建。这五款应用分别实现:premise 转短片、图片转视频广告、截图转 React 组件、𝕏 帖子转情绪看板、链接转播客,demo 与代码均已放出。
Bolt 现在支持按 GDPR 合规方式接入 Sentry:不存储网络地址,邮箱替换为内部 ID,仅在出错时记录会话。开发者仍能看到所有 bug,而用户保持匿名。
Gumloop 推出 Agent Browsers,让智能体能够触达没有 API 或 MCP 的工作流程。该功能支持安全凭证存储与 1Password 集成、会话回放以及隐身代理会话,且完全模型无关。
LangChain 在编码智能体的 harness 中内置模型路由器,成本降低 64% 且未牺牲质量。Sydney Runkle 的视频介绍了具体做法:理解任务、理解模型、在 harness 中构建路由器,并跟踪任务结果。
GPT-6 Astra 在 Lilypond Bach Benchmark 上取得迄今最佳结果,其四声部众赞歌没有声部进行错误,和声语汇复杂到包含那不勒斯六和弦,并且是首个在该 benchmark 上写出经过音的模型。测试使用 Extra High effort,提示词要求在 LilyPond 2.24 中按巴赫风格写 G 小调 3/4 拍四声部众赞歌并只返回代码块。
Stack Overflow 2026 年度开发者调查显示,AI 编程助手每日使用率呈压倒性态势,但开发者对其信任问题仍存。结构良好的文档被视为提供可验证上下文、缓解模型幻觉的关键,同时开发者正从主动社区发帖转向被动知识消费。
NVIDIA 的 Nemotron Labs 发布新一期内容,介绍如何借助 Artificial Analysis 评测开源模型,并附上直播回放链接。
图像生成定价公布:输出 2K 分辨率每张 0.050 美元,输出 4K 分辨率每张 0.076 美元。原文未说明具体模型或服务名称。
Gary Marcus 转发 @HarperSCarroll 于 4 月 19 日在不列颠哥伦比亚上空用 iPhone 16 Pro 拍摄的内容,该帖获 4 条回复、3 次转发、82 个赞、4844 次浏览和 11 次互动,由 xgo.ing 提供数据支持。
谷歌发布图像生成模型 Nano Banana 2.1,官方称其在视觉设计、基于蒙版的编辑、主体一致性和画面自然度上全面超越前代模型,并已在 Google AI Studio 上线。歸藏实测表示,该模型中文文字清晰度和错字问题大幅改善,中文字体设计与排版美学良好、画面干净,且支持生成 4K 图片,但价格偏贵。
Genspark 联合创始人兼 COO 桑文在 NYSE 访谈中表示,AI 正在改变企业工作流与日常决策,前沿模型与低阶模型各有其作用,模型多样性是关键,并强调可及性的重要。
Gary Marcus 表示自己此前的"黑暗预测"又如期应验,并附上《纽约时报》2026 年 10 月 6 日的一篇报道链接。他未在推文中展开具体所指的预测内容或事件细节。
Figure AI 创始人 Brett Adcock 的 Hark 推出 Hark Pro,一款主动式个人 AI 助手。其界面由曾发布 iPhone Air 的前 Apple 设计师主导,网页端和移动端免费使用,硬件产品将于 2027 年推出。
Anthropic 面向成立五年内或近两年获得融资的初创公司开放 Claude Startups 申请,可预约其 Applied AI 团队的线上办公时间,并在名额允许时参加 Founder House、黑客松和 meetup 等活动,申请入口为 claude.com/resources/arti…。
Anthropic 为开发者提供最高 7500 美元的 Claude 产品与额度支持,其中包含面向首次使用 Team 的企业赠送一年 Claude Team,以及通过审核后即刻到账的 1000 美元 API 额度。
Claude 推出 Startup Stack,整合 Linear、Lovable、ElevenLabs、Granola 和 Hex 等基于 Claude 构建的公司的优惠,提供价值最高 45,000 美元的折扣与额度,覆盖销售、设计、数据工程等工具。
Anthropic 的 Claude Startups 计划扩展至更多创始人,成员可获得一年 Claude Team、API 额度、创业工具专属优惠,以及与 Anthropic 应用 AI 团队的 office hours。
Kevin Mandia 称,Armadin 自今年 1 月以来在客户生产环境累计发现 90 多个零日漏洞,涉及大型软件公司,多数在 48 小时内通知对方 CISO。他表示团队用真实红队人员对模型做后训练,扫描时以黑盒方式从互联网侧切入、不依赖源码审查,因此能发现远程代码执行等问题;他还指出 AI 驱动的攻击会更多寻找定制应用中的逻辑漏洞而非代码漏洞,并持续穷举所有路径。
Microsoft Research 新一期播客中,Jennifer Neville 讲述自己辗转多轮才走入计算机科学的经历,以及如何用更实用的评估方法推动当今 AI 系统。她认为研究进展往往是一条曲折的路。
一项新论文提出 Harness-Aware Distillation,用同一教师模型分别在带与不带 harness 信息下作答,训练学生模型偏好带 harness 时选择的动作,并用过滤器剔除与 harness 记录矛盾的配对,全程不使用任务奖励或成功标签。
作者称 Jev 的一个有趣之处是其一致性(consistent property),这对为智能体工作流构建可靠的评审器很有用。目前作者正在做一个小型 benchmark,以更广泛地测试这一点,并与其他决策 API 进行比较,更多内容将很快公布。
开发者用 Codex 配合自建的磁盘空间统计 Skill,8 分 14 秒扫描完 C 盘并生成 Excel 报表,查出 C:\Users 占 117.94 GB。
Ampersand 是专为企业 AI 智能体打造的系统集成基础设施,让智能体能够在 Salesforce、SAP、NetSuite、Workday 等系统记录中执行操作。用户只需在一份配置中定义每个客户的对象与映射,Ampersand 负责处理认证、重试、回填和监控。它已支撑 11x、Orb 和 Square 的智能体行动能力。
a16z 的被投公司正在招募 AI 内容创作者和创作者项目管理人才,制作 AI 工具相关内容或有意管理创作者项目的人可通过指定链接报名。该招募面向这两类人群开放,具体岗位与公司名单未披露。
ElevenLabs 在官方博客发布新内容,附有 elevenlabs.io 链接供了解详情。该推文互动数据显示 9 次点赞、1747 次浏览。
ElevenLabs 发布 ElevenAgents Architect,让团队任何成员都能在 ElevenAgents 中通过对话管理 AI 智能体。该工具还可从 Claude、Claude Code、ChatGPT、Cursor 和 Grok Bot 直接调用。
ElevenLabs 发布 ElevenAgents Architect,这是一个内置于 ElevenAgents 的专家,只需对话或输入文字,就能帮助团队启动并改进 AI 智能体。
Nano Banana 2.1(gemini-nano-banana-2.1)已上线,价格从上一代 Pro 模型的每张 0.134 美元降至 0.034 美元。
Gamma 推出公司史上最大规模的产品重构 Gamma 5,重建后的平台可生成贴合用户自身品牌风格的演示文稿,覆盖文档、社交素材与图形,并支持调用各类前沿与图像模型。
Google DeepMind 发布 EmbeddingGemma 2,参数量 740M,在多项基准上具有竞争力,甚至超过部分参数量两倍以上的专用模型。开发者可用它为应用加入多模态搜索,例如用语音备忘录在视频中定位片段,也可与 Gemma 4 搭配实现私密的端侧 RAG。该模型以 Apache 2.0 许可发布,权重已在 Hugging Face 和 Kaggle 上线。
Google DeepMind 发布 EmbeddingGemma 2,称这是其首个原生多模态的端侧嵌入开源模型。该模型在文本之外统一了代码、图像、音频和视频,把它们映射到同一个共享空间。
LangChain 将举办名为 The Agentic Operating Model 的网络研讨会,聚焦企业规模化落地生产级 AI 时人与流程、技术如何协同演进。议题包括智能体开发与运维由谁负责、跨团队应标准化哪些内容、治理与控制应放在哪里、团队如何在不拖慢开发的前提下共享基础设施,以及如何持续评估和改进生产环境中的智能体。
Lenny Rachitsky 分享了完整对话视频,可通过 YouTube 链接观看,未披露对话主题、嘉宾或其他细节。
OpenAI 的 ChatGPT 与 Codex 负责人 @thsottiaux 分享 AI 时代技能趋势:上升的是出色的品味、打造有意义事物的热情,以及知道什么是"好";下降的是打字速度。
Replit 推出 Pro Series 新一期,主题为"打造病毒式增长引擎",并以直播形式发布。该内容在 X 上获得 33 次点赞、4 次转发与 6088 次浏览。
Replit 现在支持跨所有项目的上下文,用户在新对话中可让 Replit 查找现有项目、添加功能,或用一个项目作为另一个项目的参考。Replit 能读取项目文件并据此以后台任务方式启动修改,同时提供链接供用户查看改动并继续工作。
Datawhale 发布开源中文教程《Jev Cookbook》,面向 System One 决策模型,包含 11 章系统讲解与 18 篇可运行的 Jupyter Notebook,从 Choice、Score、Noul 三种核心原语讲起,覆盖 RAG 引用过滤、动态工具路由、风险拦截等接入场景。