跳到正文

全部动态

今日 0 条
10月9日周五
  1. bolt.new(@boltdotnew)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    bolt.new 分享 wavesurfer.js 播客片段播放器提示词

    bolt.new 分享了一段可直接使用的提示词,用于构建基于 wavesurfer.js 的播客片段播放器:波形可拖动定位、播放/暂停,以及沿波形点击章节标记,并使用示例音频文件。该提示词面向 AI 编程工具直接生成可用代码。

  2. bolt.new(@boltdotnew)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    bolt.new 一条提示词构建播客剪辑播放器

    在 bolt.new 中用一条提示词即可构建完整的播客剪辑播放器。该播放器支持可拖拽波形、可点击跳转的章节标记,并提供可视化编辑器用于后续重新调整样式。

  3. LlamaIndex 🦙(@llama_index)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 博客:Markdown 相关新内容

    LlamaIndex 发布博客文章,指向 llamaindex.ai/blog 上关于 Markdown 的内容,推文附有该博客链接。

  4. The GitHub BlogAI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub 漏洞赏金研究员 vaib25vicky 如何挑选要调查的功能

    GitHub 在网络安全意识月专访 VIP 漏洞赏金研究员 @vaib25vicky,其专注授权与访问控制方向,挑选目标的标准是功能足够复杂、难以理解,一旦发现可疑点就持续使用和探索该功能直至出现异常。

  5. Grafana LabsAI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grafana Labs 启动第五届年度可观测性调查

    Grafana Labs 已启动第五届年度可观测性调查,问卷涵盖是否信任智能体不经审查直接发布、仪表盘是否已被聊天窗口取代、可观测性工具数量是否过多等问题,并延续对成本、工具链、开源与成熟度的同比追踪。该调查提供巴西葡萄牙语、英语、日语和西班牙语版本,去年有超过 1,350 名从业者参与,结果将用于明年初发布的免费报告。

  6. Fish Audio(@FishAudio)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 AI 语音练习真实对话的语言应用,语音由 Drama 3 生成

    @whosamberella 做了一个用 AI 语音练习真实对话的语言应用,每个角色都有自己的个性,还内置面向初学者的发音卡片,角色甚至会因为你没听懂而变得不耐烦。所有语音均由 Drama 3 生成。

  7. elvis(@omarsar0)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    RSIGym:Evolvent AI 发布 AI 研究智能体训练环境,Opus 5 在 SWE-bench Verified 提升至 50.33%

    Evolvent AI 推出 RSIGym,把训练、推理、评测与沙箱打包成研究智能体可调用的服务,并开源代码、实验配置、研究轨迹和评测日志。以 Opus 5 作为研究者,改进后的系统在 SWE-bench Verified 上从 17.67% 升至 50.33%。

  8. The Rundown AI(@TheRundownAI)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    特朗普:白宫将使用"Artificial Intelligence"而非"Super Intelligence"者视为敌人

    美国总统特朗普在 Truth Social 发文称,白宫将任何使用"Artificial Intelligence"一词、而非"更准确的新术语 Super Intelligence"的人视为"敌人"。该帖获得 11 条回复、1 次转发、22 个赞和 7522 次浏览。

  9. 技术前沿AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    大型科技公司就 AI 智能体展开布局

    大型科技公司围绕 AI 智能体密集发布新服务,相关竞赛已进入高速阶段。多家公司相继推出各自方案,争夺这一新兴服务市场的主导权。

  10. LlamaIndex 🦙(@llama_index)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex:为什么 Markdown 是解析的默认输出格式

    LlamaIndex 解释了为何将 Markdown 作为解析的默认输出格式。解析器即便读对页面上每个词,也可能丢失数字所属的列,导致模型只能靠猜;Markdown 能保留标题、列表和表格结构,且在排查错误答案时仍可读。对于表头合并的表格,LlamaIndex 会改用 HTML。

  11. TechcrunchAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    曾入狱的创业者 Richard Bronson 推出 AI 平台 Commissary Club,瞄准出狱人群市场

    曾任 Stratton Oakmont 合伙人的 Richard Bronson 因证券违规在联邦监狱服刑,如今创办 Commissary Club,用 AI 帮助出狱者找工作、住房、社群乃至约会。

  12. myFT followingAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 年化收入较此前披露低 200 亿美元

    OpenAI 近期向投资者表示,9 月年化收入接近 500 亿美元,远低于此前广泛报道的 700 亿美元,两者相差约 200 亿美元。

  13. 国际大厂AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amazon 停产 Fire 平板,转向搭载原生 Android 的 Alexa Tablets

    Amazon 消费电子负责人 Panos Panay 向 Bloomberg 确认,Fire 平板品牌将被淘汰,取而代之的 Alexa Tablets 改用原生 Android 系统并完整支持 Play Store 及 Google 官方应用。Panay 称 Fire 平板线"没有给到用户想要的东西",Amazon 仍会为 Fire 平板提供安全更新,但不再有硬件更新。

  14. Aravind Srinivas(@AravSrinivas)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Decider V1.1 在 DecisionBench 排名第一,成本也最低

    Perplexity 的 Decider V1.1 在 DecisionBench 上排名第一,同时成本最低。在 949 个共享文本用例中,该模型达到 93.9% 准确率,中位延迟 534 ms,每千次决策成本 $0.016。

  15. andrew chen(@andrewchen)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kenan Saleh:一家公司 3 个月从 0 做到 6000 万美元,向 AI 实验室出售前沿数据

    Kenan Saleh 称其合作的一家公司 3 个月内营收从 0 增长到 6000 万美元,本月将达到 1 亿美元 run-rate。该公司向 AI 实验室和模型开发者出售前沿数据(frontier data),他认为数据正与算力和算法并列成为一等公民。

  16. AI Breakfast(@AiBreakfast)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Voice Arena 发布 Monsoon 语音数据集:覆盖 50 种语言、10 万小时,Bengali FLEURS 上 Whisper Medium 词错率从 85.27% 降至 7.65%

    Voice Arena 发布 Monsoon ASR 语料库,覆盖 50 种语言、10 万小时,其中以长尾语言为主,发布 7 天内已有 80+ 机构申请授权许可。

  17. Fireworks AI(@FireworksAI_HQ)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Zeta Global 发布 AthenaOS 与 Athena MCP,并联合 Fireworks AI 推出 Athena Inference Model (AIM)

    Zeta Global 发布企业智能操作系统 AthenaOS、把 Zeta 智能接入现有工具的 Athena MCP,并首次公布正在与 Fireworks AI 基于 NVIDIA Nemotron 开发的 Athena Inference Model (AIM)。

  18. LangChain(@LangChainAI)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 在 Slack 里做了个办公用品采购 Agent“Restock”

    LangChain 展示了一款名为 Restock 的办公用品采购智能体,可直接在 SlackHQ 中对话下单。它能在 Slack 里搜索真实商品、准备购买,并通过 Stripe 的 Link agent wallet 由人工逐单审批后完成支付。该应用基于 MPP 与 Managed Deep Agent 构建。

  19. Latent Space [Youtube]AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Synthesis Superintelligence:从半导体到超导体——Periodic Labs 的 Liam Fedus 与 Ekin Dogus Cubuk

    Periodic Labs 的 Liam Fedus 和 Ekin Dogus Cubuk 提出“synthesis superintelligence”,主张让模型在真实物理实验中做强化学习,而非只训练互联网数据。他们认为科学发现不同于数学与编程,物理实验才是最终基准,失败实验可能是最有价值的训练数据,目标是让每台实验仪器具备“140 IQ”并压缩数十年的试错。

  20. The Rundown AI(@TheRundownAI)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Claude Code 和 Codex 找出 NASA 漏掉的行星,NASA 计划 11 月用 TESS 复核

    Pavel Rabtsevich 称他用 Claude Code 和 Codex 在 NASA 数据中发现了一颗 NASA 自家软件多年未识别的行星。NASA 计划在 11 月 TESS 望远镜掠过该恒星时进行密切观测。

  21. 技术前沿AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Goodfire 推出“由内而外”的 AI 智能体监控器,成本仅为传统方案零头

    Goodfire 发布了一种“由内而外”的监控方案,直接读取 AI 模型工作时的内部激活信号,而非让第二个模型逐字审阅输出。在 Kimi K3 上测试约 1500 个会话,成本约 51 美元,而廉价模型逐步检查需 233 美元、顶级模型约 1 万美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送二审,同时运行四个探针给模型响应启动时间增加不到 2%。

  22. 歸藏(guizang.ai)(@op7418)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Astra 读取 Memory 后按喜好用 Blender 建模生成海报

    用户让 GPT-6 Astra 读取自己的 Memory,结合个人喜好,用 Blender 建模的几个模型做成了一张海报,模型细节、材质与光影表现都很好。该分享展示了 GPT-6 Astra 在 3D 方向上的能力。

  23. Vercel NewsAI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel 新增 skipMiddlewareRequestBody:不再向 Routing Middleware 转发请求体

    Vercel 推出 skipMiddlewareRequestBody 配置项,可跳过将客户端请求体发送给 Routing Middleware,从而降低 middleware 调用带来的 Fast Origin Transfer 用量,并改善首字节时间,对请求体较大的请求效果明显。

  24. 技术前沿AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Natura 推出 99 美元智能戒指 Interface,把 AI 智能体戴在手指上

    AI 与硬件初创公司 Natura 发布售价 99 美元的智能戒指 Interface,按下手指即可让 AI 智能体完成任务、记录想法,同时具备心率、HRV、睡眠和活动等健康追踪功能。

  25. Anthropic(@AnthropicAI)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 向 Genesis Mission 投入 1.5 亿美元,并向逾 15 家联邦机构开放 Claude

    Anthropic 承诺向 Genesis Mission 投入 1.5 亿美元,以深化对科学研究与技术发现的支持。该公司还将向超过 15 家联邦机构提供 Claude 及技术支持。

  26. LangChain(@LangChainAI)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 推出可在 Slack 下单、Stripe 审批付款的购物智能体

    LangChain 展示了一套购物智能体方案:用户在 Slack 中提出需求,智能体负责寻找真实商品并准备下单,每笔订单都需人工审批,最终在 Stripe 的 Link agent wallet 中完成付款。该方案基于 MPP + Managed Deep Agen 构建。

  27. OpenAI NewsAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Oracle 如何用 ChatGPT 与 Codex 将数天工作压缩到几分钟

    Oracle 在招聘、工程和运营环节用 ChatGPT Work 与 Codex 把专家知识转化为快速、可复用的工作流,将原本数天的工作压缩到几分钟。

  28. DeepLearning.AI(@DeepLearningAI)AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    本周 AI 动态:Gemini 4 Argon 追平 GPT-6 Astra,Mistral Large 4 开源权重将发布

    Google Gemini 4 Argon 在 Artificial Analysis Intelligence Index 上以 53 分追平 GPT-6 Astra,每任务成本约为后者 60%。Mistral Large 4 是 1T 参数开放权重模型,将于 10 月底发布,现为美中之外最智能的模型。Reflection AI 的开放权重 Beam 称推理算力比同类开放模型少 3-4 倍。

  29. 大模型智能AI 评估 · 81/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 向所有 ChatGPT 用户开放 GPT-6,并推出 Intelligent UI

    OpenAI 宣布面向全球所有 ChatGPT 用户(含免费和付费用户)推出 GPT-6,取代 ChatGPT 中的 GPT-5.6 Sol 和 GPT-5.6 Luna,但通过 Codex 和 ChatGPT Work 访问这两款模型的用户仍使用之前发布的版本。

    为什么值得看

    OpenAI 将 GPT-6 开放给免费用户并引入可自主生成交互界面的 Intelligent UI,读者可据此了解这一交互形态的变化。

10月8日周四
  1. Julien Chaumond(@julien_c)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ecosia 弃用 Mistral,转向开源模型(含中国模型)

    柏林搜索引擎 Ecosia 将放弃其法国 AI 合作伙伴 Mistral,转而押注开源模型,其中包括来自中国的模型。Ecosia CEO 向 POLITICO 透露了这一决定,该搜索引擎目前被政府服务部门使用。

  2. Firecrawl(@firecrawl_dev)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Firecrawl 发布 Universal Scrape:单一 API 为智能体抓取网页、PDF 与图像数据

    Firecrawl 发布 Universal Scrape,让智能体从网页、PDF 和图像获取上下文,并覆盖人物档案、金融数据、播客等内容。该功能由 Alexandria 驱动,可通过一个 API 访问网络数据、文件以及 200 多个数据提供方。

  3. 歸藏(guizang.ai)(@op7418)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    A÷小伎俩:Haiku 用 100k 阶梯定价打榜第一

    讨论指出,Haiku 的定价是阶梯策略,上下文达到 100k 后价格翻 5 倍,而 GPT 的分界线是 272k,因此看起来价格很低、实际使用成本高得多。该设计被质疑是面向 Benchmark 的特化优化,借此打榜到第一。

  4. Simon Willison(@simonw)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AWS 推出开源沙箱 Strands Box,用于构建 AI 智能体

    AWS 发布开源沙箱 Strands Box,面向构建 AI 智能体的开发者。该消息由 Marc Brooker 在 Strands 博客中宣布,相关细节见 strandsagents.com 博客文章。

  5. Fireworks AI(@FireworksAI_HQ)AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks AI 活动:swyx 谈为什么未来属于领域专用的一切

    Fireworks AI 将于 11 月 3 日在旧金山举办活动,Latent Space 与 AI Engineer 的 swyx 将分享为何未来是"领域专用的一切"。他提出,每一支严肃的 AI 团队最终都会自建数据、评估、模型,甚至芯片。

  6. clem 🤗(@ClementDelangue)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 上线 Reachy Mini 舞蹈自制 Space

    Hugging Face 上出现了一个可自制 Reachy Mini 舞蹈的 Space,作者是 pollen 相关账号,原帖附上了该 Space 的链接邀请大家自行尝试。帖子互动量不高,仅有 6 次点赞、1437 次浏览。

  7. The Keyword (blog.google)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Play Play Fest 10 月 13 日开启:抽奖、电竞联赛与每日优惠

    Google Play 将于 10 月 13–19 日举办 Play Fest,Play Points 会员可用积分兑换抽奖机会,奖品包括 1:1 Scale 2026 Replica Season Racing Helmet - Oscar Piastri、XREAL AURA Glasses 和 Samsung Galaxy Z Fold 8 Ultra 等。

  8. Yann LeCun(@ylecun)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun:科学奖属于科学家,成果要发在同行评审平台

    Yann LeCun 回应 Brian Roemmele 与 Elon Musk 时表示,科学奖是给科学家的,科学家会把成果发表在接受同行评审的平台上,以便被审视、验证和复现。

  9. cohere(@cohere)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere 举办网络研讨会,探讨 Embed 5、Parse 5 与检索新方法 RCP-nDCG

    Cohere 正在举办网络研讨会,讨论搜索与检索的未来,内容包括 Embed 5、Parse 5 以及其新的检索评估方法 RCP-nDCG。

  10. The Rundown AI(@TheRundownAI)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    数学界组织就 OpenAI 722 篇论文发布发声明,呼吁数学家停止与 OpenAI 合作

    人类数学协会就 OpenAI 发布的 722 篇论文发表声明称,数学家并未要求做这项工作,并呼吁数学家停止与 OpenAI 的合作。菲尔兹奖得主 Terence Tao 在其博客以客座文章形式转载该声明,X 上随后将其当作 Tao 本人的表态传播。OpenAI 已撤回其中 3 篇论文,另有 14 篇在发布后被修订;其发布说明 README 中曾提到,部分未形式化的结果可能存在问题,会尽快修复。

  11. Satya Nadella(@satyanadella)AI 评估 · 0/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Satya Nadella 发布 X 长文

    Satya Nadella 在 X 上发布一篇长文(链接为 x.com/i/article/2108…),该帖获 2692 次点赞、315 次转发、221 条回复,浏览量达 816466 次。