<?xml version="1.0" encoding="utf-8"?>
<feed xmlns="http://www.w3.org/2005/Atom">
  <title>51AllAI</title>
  
  <subtitle>探索 AI 的无限可能</subtitle>
  <link href="https://51allai.com/atom.xml" rel="self"/>
  
  <link href="https://51allai.com/"/>
  <updated>2026-09-21T14:15:40.000Z</updated>
  <id>https://51allai.com/</id>
  
  <author>
    <name>51AllAI</name>
    
  </author>
  
  <generator uri="https://hexo.io/">Hexo</generator>
  
  <entry>
    <title>Kimi Code 发布桌面客户端，macOS 与 Windows 同步上线</title>
    <link href="https://51allai.com/posts/2026/09/kimi-code-desktop/"/>
    <id>https://51allai.com/posts/2026/09/kimi-code-desktop/</id>
    <published>2026-09-21T14:15:40.000Z</published>
    <updated>2026-09-21T14:15:40.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>Kimi Code Desktop 已上线 macOS 和 Windows，Mac 同时提供 Apple Silicon 与 Intel 版本。它把 Kimi Code CLI 的 Agent 核心搬进图形界面，集中管理本地项目、代码改动、终端验证和网页预览。<br><img src="https://images.51allai.com/blog/kimi-code-desktop-cover_20260921_222833.png" alt="Kimi Code Desktop macOS 与 Windows 桌面编程客户端" fetchpriority="high" decoding="async"></p></blockquote><h2 id="本地项目、改动和验证集中在一个窗口"><a href="#本地项目、改动和验证集中在一个窗口" class="headerlink" title="本地项目、改动和验证集中在一个窗口"></a>本地项目、改动和验证集中在一个窗口</h2><p>Kimi Code Desktop 使用本地项目文件夹作为工作区。新建会话并选择工作区后，用户可以直接描述任务，也可以用 <code>@</code> 引用具体文件或目录。Agent 能够读取和修改代码、执行命令，并根据运行结果继续调整。</p><p>右侧改动面板会按文件和回合展示 diff，顶部同时显示当前分支、同步状态、改动文件数和 PR 状态。内置终端以当前工作区为运行目录，可以直接执行构建、测试和格式化命令。网页项目还能在右侧打开内置浏览器，页面标签与当前会话绑定，方便检查实际效果。</p><p>官方变更记录将 1.0.0 标记为 9 月 17 日发布，支持 macOS Apple Silicon、macOS Intel 和 Windows。9 月 19 日的 1.0.2 已经重做内置浏览器的操作反馈，并修复了页面截图、下载对话框和 subagent 审批提示等问题。</p><h2 id="Plan、Goal-和-Swarm-对应不同任务"><a href="#Plan、Goal-和-Swarm-对应不同任务" class="headerlink" title="Plan、Goal 和 Swarm 对应不同任务"></a>Plan、Goal 和 Swarm 对应不同任务</h2><p>桌面端提供普通任务、Plan、Goal 和 Swarm 四种工作方式。普通任务适合范围清晰、容易验证的修改；Plan 会先分析并提交计划，确认后才改文件；Goal 用于需要多轮执行和检查的长任务；Swarm 则把可拆分的工作分配给多个 subagent。</p><p>涉及命令、文件修改或计划时，客户端会以审批卡片展示具体范围。权限分为“始终询问”“必要时询问”和“完全自动”三档。首次打开不熟悉的仓库时，可以先用“始终询问”限定写文件和运行命令的范围。</p><h2 id="桌面端与-CLI-共用-Agent-核心"><a href="#桌面端与-CLI-共用-Agent-核心" class="headerlink" title="桌面端与 CLI 共用 Agent 核心"></a>桌面端与 CLI 共用 Agent 核心</h2><p>Kimi Code Desktop 不是另一套编程服务。它延续 Kimi Code CLI 的 Agent 核心，两者可以安装在同一台电脑上，并共享账号、模型、模型供应商和插件等部分本地设置。CLI 用户可以运行 <code>/desktop</code> 或 <code>kimi install-desktop</code>，在浏览器中打开桌面端下载页。</p><p>两种界面服务于不同习惯：桌面端把项目、会话、文件改动、终端和浏览器放到图形界面中；CLI 适合终端优先和脚本化工作流。它也不是 <a href="/posts/2026/06/moonshot-kimi-work-local-agent/">Kimi Work</a> 的改名版：Kimi Code Desktop 围绕代码工程和开发验证设计，Kimi Work 面向本地文件、网页和办公交付等知识工作。</p><h2 id="下载后选择账号或第三方模型"><a href="#下载后选择账号或第三方模型" class="headerlink" title="下载后选择账号或第三方模型"></a>下载后选择账号或第三方模型</h2><p>用户可以前往 <a href="https://www.kimi.com/code">Kimi Code 官方下载页面</a>，选择 Apple Silicon Mac、Intel Mac 或 Windows 安装包。首次启动时可以选择界面语言和主题，然后通过 Kimi OAuth 登录。中国内地账号使用 <code>kimi.com</code>，其他地区使用 <code>kimi.ai</code>。</p><p>登录后，客户端会列出当前账号可用的 Kimi 官方模型。新版 Kimi 会员中，Plus 及以上档位可使用 Kimi Code，Desktop、CLI、VS Code 和第三方工具的请求计入同一套额度。用户也可以在设置中填入 API Key、Base URL 和模型信息，接入其他模型供应商。</p>]]></content>
    
    
    <summary type="html">Kimi Code 发布 macOS 与 Windows 桌面客户端，把本地项目、代码改动、终端、浏览器和 Git 状态收进同一界面。本文梳理安装入口、任务与权限模式，以及它与 CLI、Kimi Work 的区别。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="coding-agent" scheme="https://51allai.com/tags/coding-agent/"/>
    
    <category term="desktop-agent" scheme="https://51allai.com/tags/desktop-agent/"/>
    
    <category term="moonshot" scheme="https://51allai.com/tags/moonshot/"/>
    
    <category term="kimi" scheme="https://51allai.com/tags/kimi/"/>
    
  </entry>
  
  <entry>
    <title>开发者开源 Jev 聊天助手，在微信旁分析消息并生成候选回复</title>
    <link href="https://51allai.com/posts/2026/09/jev-chat-assistant-wechat/"/>
    <id>https://51allai.com/posts/2026/09/jev-chat-assistant-wechat/</id>
    <published>2026-09-21T13:35:34.000Z</published>
    <updated>2026-09-21T13:35:34.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>开发者 Finderchangchang 于 9 月 21 日开源 Jev 聊天助手。Android 用户可让它读取微信当前会话，判断对方意图、危险等级与回复动作，再生成并排序 3 条候选回复。助手只把选中内容填入输入框，发送仍由用户完成。<br><img src="https://images.51allai.com/blog/jev-chat-assistant-wechat-cover_20260921_214328.png" alt="Jev 聊天助手微信消息分析与候选回复" fetchpriority="high" decoding="async"></p></blockquote><h2 id="它是悬浮在聊天界面上的回复辅助层"><a href="#它是悬浮在聊天界面上的回复辅助层" class="headerlink" title="它是悬浮在聊天界面上的回复辅助层"></a>它是悬浮在聊天界面上的回复辅助层</h2><p>Jev 聊天助手不是新的通讯软件。它在 Android 上通过无障碍服务读取当前聊天窗口，把消息整理成“我”与“对方”的对话，再用悬浮窗展示分析结果和候选回复。</p><p>当前代码为微信和飞书分别实现了采集适配器。微信适配器读取聊天气泡文字，再按气泡的水平位置判断发言方。仓库记录的实测环境是 Android 版微信 8.0.78。</p><p>飞书适配器已能识别聊天窗口、会话标题、气泡位置和输入框，但普通消息正文使用自绘控件，没有出现在无障碍节点中。所以飞书当前只能读到部分带 TextView 的卡片内容，普通消息的截图和本地 OCR 链路还没有接入。</p><h2 id="Jev-负责判断，生成模型负责写回复"><a href="#Jev-负责判断，生成模型负责写回复" class="headerlink" title="Jev 负责判断，生成模型负责写回复"></a>Jev 负责判断，生成模型负责写回复</h2><p>助手会取最近 10 条消息，连同用户设置的人际关系描述一起发给 Jev 1.13。Jev 不直接写文案，而是回答一组结构化问题：对方的意图、关系冲突危险、需求、最佳动作、是否需要具体回复，以及紧张状态是否结束。</p><p>另一次模型请求会生成 3 条不同策略的中文回复，每条最多 40 字。Jev 再对这 3 条回复排序，悬浮窗中的占比来自这一步。默认回复模型是 <code>deepseek/deepseek-chat-v3.1</code>，用户可在设置页更换。</p><h2 id="选中回复后只填入，不会点击发送"><a href="#选中回复后只填入，不会点击发送" class="headerlink" title="选中回复后只填入，不会点击发送"></a>选中回复后只填入，不会点击发送</h2><p>用户在悬浮窗点击“填入”后，程序会先尝试用 Android 的 <code>ACTION_SET_TEXT</code> 向当前输入框写入文本。如果写入失败，则复制到剪贴板并执行粘贴。代码没有点击发送按钮的步骤，用户可以在输入框里继续修改或直接删除。</p><p>这个设计保留了发送前的人工确认，但无障碍和悬浮窗仍是高权限。项目会监听窗口内容，再按前台 App 的包名选择微信或飞书适配器。安装前应先阅读源码，并只给自己信任的构建授权。</p><h2 id="对话内容会发往-OpenRouter"><a href="#对话内容会发往-OpenRouter" class="headerlink" title="对话内容会发往 OpenRouter"></a>对话内容会发往 OpenRouter</h2><p>这不是全本地工具。进入分析流程后，最近 10 条消息会通过 OpenRouter 分别发给 Jev 和用户选择的回复生成模型。对话白名单可以限制助手处理哪些会话；白名单为空时，所有能被适配器读取的会话都允许触发分析。</p><p>OpenRouter API Key 保存在 App 私有的 <code>SharedPreferences</code> 中，不会写入日志或仓库；当前实现没有使用 <code>EncryptedSharedPreferences</code>。这些数据边界比“密钥保存在本机”更值得关注，因为真正发往模型服务的是聊天文本。</p><h2 id="Android-11-及以上用户可从源码构建"><a href="#Android-11-及以上用户可从源码构建" class="headerlink" title="Android 11 及以上用户可从源码构建"></a>Android 11 及以上用户可从源码构建</h2><p>项目最低支持 Android 11（API 30），源码采用 Kotlin 和传统 View 实现，许可证为 MIT。构建需要 JDK 17、Android SDK Platform 35 和 Build Tools 35：</p><figure class="highlight bash"><table><tr><td class="gutter"><pre><span class="line">1</span><br></pre></td><td class="code"><pre><span class="line">./gradlew assembleDebug</span><br></pre></td></tr></table></figure><p>生成的调试 APK 位于 <code>app/build/outputs/apk/debug/app-debug.apk</code>。安装后需在设置页填写自己的 OpenRouter API Key，并开启无障碍、悬浮窗和前台保活所需权限。小米或 HyperOS 设备还需配置自启动和省电白名单，否则后台服务可能被冻结。</p>]]></content>
    
    
    <summary type="html">开发者开源 Jev 聊天助手，Android 用户可让它读取微信当前会话，判断对方意图并生成 3 条候选回复。本文说明运行流程、构建条件、数据去向与已知限制。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="ai-agents" scheme="https://51allai.com/tags/ai-agents/"/>
    
    <category term="open-source" scheme="https://51allai.com/tags/open-source/"/>
    
    <category term="mobile" scheme="https://51allai.com/tags/mobile/"/>
    
    <category term="jev-chat-assistant" scheme="https://51allai.com/tags/jev-chat-assistant/"/>
    
  </entry>
  
  <entry>
    <title>智谱开源 ZCode，桌面端、Web 与 Agent CLI 源码同步公开</title>
    <link href="https://51allai.com/posts/2026/09/zhipu-zcode-open-source/"/>
    <id>https://51allai.com/posts/2026/09/zhipu-zcode-open-source/</id>
    <published>2026-09-21T02:19:37.000Z</published>
    <updated>2026-09-21T02:19:37.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>智谱于 2026 年 9 月 21 日开源 ZCode。官方仓库公开桌面应用、Web、后端服务、共享 UI、Agent CLI 与运行时源码，第一方代码采用 Apache-2.0 许可证。开发者可以从源码检查本地执行、网络请求和权限处理逻辑。<br><img src="https://images.51allai.com/blog/zhipu-zcode-open-source-cover-v2_20260921_104550.png" alt="智谱 ZCode 桌面端、Web 与 Agent CLI 开源范围" fetchpriority="high" decoding="async"></p></blockquote><h2 id="公开的不只是桌面客户端"><a href="#公开的不只是桌面客户端" class="headerlink" title="公开的不只是桌面客户端"></a>公开的不只是桌面客户端</h2><p>ZCode 是一个 AI 编程工作台。这次公开的是一个多包仓库，覆盖 Electron 桌面应用、Web 客户端、HTTP 与 WebSocket 后端、共享 React 组件、Provider 适配层，以及 Agent CLI、终端界面和运行时。</p><table><thead><tr><th>入口</th><th>开源仓库中的用途</th><th>开发命令</th></tr></thead><tbody><tr><td>Desktop</td><td>Electron 桌面应用</td><td><code>pnpm dev:desktop</code></td></tr><tr><td>Web &#x2F; ZCode 命令行版</td><td>组合 Web、后端、终端界面和 Agent</td><td><code>pnpm dev:web</code></td></tr><tr><td>Agent CLI</td><td>在终端使用 <code>zcode</code>，同时为 Desktop 和 Web 提供运行时</td><td><code>pnpm --filter @zcode/cli dev</code></td></tr></tbody></table><p>这个范围让开发者能够追踪从界面交互、权限判断到工具调用的完整路径，也可以检查桌面端、Web 与 CLI 是否复用同一套 Agent 能力。</p><h2 id="源码可以本地构建"><a href="#源码可以本地构建" class="headerlink" title="源码可以本地构建"></a>源码可以本地构建</h2><p>仓库指定 Node.js 24.14.0 和 pnpm 10.33.2。克隆代码后，可在根目录执行：</p><figure class="highlight bash"><table><tr><td class="gutter"><pre><span class="line">1</span><br></pre></td><td class="code"><pre><span class="line">pnpm bootstrap</span><br></pre></td></tr></table></figure><p>该命令会安装 workspace 依赖、准备桌面端本地运行资源，再执行初始构建。桌面版还可以针对 macOS、Windows 和 Linux 选择打包目标；命令行版则可生成包含 TUI、Web、后端和 Agent 的独立运行包。</p><p>第一方代码使用 Apache-2.0 许可证。依赖包、原生二进制文件、字体、图标和其他第三方资源仍遵循各自条款，不能只根据根目录许可证判断所有内容的再分发范围。</p><h2 id="现在可以直接检查数据与执行边界"><a href="#现在可以直接检查数据与执行边界" class="headerlink" title="现在可以直接检查数据与执行边界"></a>现在可以直接检查数据与执行边界</h2><p>开源仓库的 <code>NOTICE.md</code> 把模型请求、工具执行、账号与 API 凭据、插件、MCP、附件、会话分享和远程环境的处理路径集中列出。其中几个边界会直接影响开发者如何审计和部署：</p><ul><li>共享 Agent 执行适配器不默认提供操作系统沙箱。文件、终端、Git 和外部进程能在当前系统账号的权限范围内运行。</li><li>模型与辅助模型请求可能携带提示词、历史、代码、diff、工具结果或附件，实际接收方由模型端点、网关转发与代理配置共同决定。</li><li>命中指定官方模型端点的请求会改发 ZCode 网关。客户端转发逻辑已公开，网关接收请求后的内部处理不在客户端源码可核验范围内。</li></ul><p>对个人项目，可以先检查实际使用的 Provider 端点、权限模式和插件配置。对公司代码库，还应在隔离环境中运行，限制账号、凭据和网络权限，再审查外发请求。</p><h2 id="v3-14-0-与开源仓库保持同一版本号"><a href="#v3-14-0-与开源仓库保持同一版本号" class="headerlink" title="v3.14.0 与开源仓库保持同一版本号"></a>v3.14.0 与开源仓库保持同一版本号</h2><p>ZCode v3.14.0 于 9 月 19 日发布，版本日志把“修复仓库百科异常上传的问题”列入修复项。9 月 21 日公开的仓库根 <code>package.json</code> 同样标记为 3.14.0，开发者可以围绕这个版本检查客户端实现。</p><p>开源代码本身不代表官方云服务已全部可自行复制。仓库声明明确写明，不承诺公开源码与构建产物包含官方产品的全部功能和活动政策。想了解官方模型入口的读者，可继续查看 <a href="/posts/2026/08/zhipu-glm-53-coding-plan/">GLM-5.3 与 ZCode 的使用方式</a>。</p>]]></content>
    
    
    <summary type="html">智谱开源 ZCode，公开 Electron 桌面端、Web、后端服务、共享 UI、Agent CLI 与运行时源码，采用 Apache-2.0 许可证。本文梳理可审计范围、本地构建入口与云端服务边界。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="security" scheme="https://51allai.com/tags/security/"/>
    
    <category term="coding-agent" scheme="https://51allai.com/tags/coding-agent/"/>
    
    <category term="open-source" scheme="https://51allai.com/tags/open-source/"/>
    
    <category term="desktop-agent" scheme="https://51allai.com/tags/desktop-agent/"/>
    
    <category term="zhipu" scheme="https://51allai.com/tags/zhipu/"/>
    
  </entry>
  
  <entry>
    <title>瑞幸咖啡上线 CLI，支持在终端查询门店并创建订单</title>
    <link href="https://51allai.com/posts/2026/09/luckin-coffee-cli/"/>
    <id>https://51allai.com/posts/2026/09/luckin-coffee-cli/</id>
    <published>2026-09-20T01:29:43.000Z</published>
    <updated>2026-09-20T01:29:43.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>瑞幸咖啡于 2026 年 6 月 3 日上线 AI 开放平台，同期提供面向开发者的官方 CLI。用户可在终端查询门店与商品、预览和创建订单；安装包覆盖 macOS、Linux 与 Windows 的 x86-64 和 ARM64 设备。<br><img src="https://images.51allai.com/blog/luckin-coffee-cli-cover_20260920_095302.png" alt="瑞幸咖啡 CLI 终端点单流程" fetchpriority="high" decoding="async"></p></blockquote><h2 id="瑞幸把点单能力做成命令行工具"><a href="#瑞幸把点单能力做成命令行工具" class="headerlink" title="瑞幸把点单能力做成命令行工具"></a>瑞幸把点单能力做成命令行工具</h2><p>瑞幸咖啡 CLI 是 AI 开放平台的三种接入方式之一。MCP 用标准协议把点单能力接入 AI 应用，Skill 为智能体提供现成任务步骤，CLI 则让用户和程序直接在终端调用这些功能。它不是新的咖啡商城，而是将门店、商品和订单操作变成可组合的命令。</p><p>官方软件包公开了 <code>luckin</code> 命令。除了用 <code>luckin -p &quot;&lt;需求&gt;&quot;</code> 输入自然语言，它还提供门店、菜单、商品和订单子命令，适合交互使用，也能交给 AI Agent 或脚本调用。</p><h2 id="官方安装包覆盖三大桌面系统"><a href="#官方安装包覆盖三大桌面系统" class="headerlink" title="官方安装包覆盖三大桌面系统"></a>官方安装包覆盖三大桌面系统</h2><p>macOS 和 Linux 使用同一条安装命令：</p><figure class="highlight bash"><table><tr><td class="gutter"><pre><span class="line">1</span><br></pre></td><td class="code"><pre><span class="line">curl -fsSL https://open.lkcoffee.com/install | bash</span><br></pre></td></tr></table></figure><p>Windows 用户需要在 PowerShell 执行：</p><figure class="highlight powershell"><table><tr><td class="gutter"><pre><span class="line">1</span><br></pre></td><td class="code"><pre><span class="line"><span class="built_in">irm</span> https://open.lkcoffee.com/window/install | <span class="built_in">iex</span></span><br></pre></td></tr></table></figure><p>安装脚本会判断操作系统和处理器架构，从官方版本清单下载对应压缩包，再用 SHA-256 值校验文件。截至 2026 年 9 月 20 日，清单中的最新版本为 <code>0.0.1</code>，提供 macOS、Linux 和 Windows 的 AMD64 与 ARM64 构建。</p><p>管道安装会立即执行远程脚本。想先检查内容的用户，可以先单独下载安装脚本，确认下载域名、校验步骤和安装路径后再执行。</p><h2 id="CLI-可查门店、商品和订单"><a href="#CLI-可查门店、商品和订单" class="headerlink" title="CLI 可查门店、商品和订单"></a>CLI 可查门店、商品和订单</h2><p>官方软件包中可确认的命令覆盖以下流程：</p><table><thead><tr><th>环节</th><th>命令范围</th><th>用途</th></tr></thead><tbody><tr><td>登录</td><td><code>luckin login</code>、<code>luckin logout</code></td><td>授权或退出瑞幸账号</td></tr><tr><td>门店</td><td><code>luckin store</code>、<code>luckin menu</code></td><td>按位置查询门店，读取指定门店菜单</td></tr><tr><td>商品</td><td><code>luckin product</code></td><td>查询门店内的商品与可选规格</td></tr><tr><td>订单</td><td><code>luckin order preview</code>、<code>create</code>、<code>detail</code>、<code>cancel</code></td><td>预览价格与优惠、创建订单、查询状态或取消订单</td></tr></tbody></table><p>门店查询使用经纬度，创建订单前还要组合门店 ID、商品 ID、SKU 和数量。不想手动拼参数时，可以使用自然语言入口，再在预览订单阶段检查门店、规格、数量和价格。</p><h2 id="创建订单后仍需用户完成支付"><a href="#创建订单后仍需用户完成支付" class="headerlink" title="创建订单后仍需用户完成支付"></a>创建订单后仍需用户完成支付</h2><p>CLI 把商品选择、优惠试算和订单创建放进终端，但不会绕过用户确认与支付。订单创建结果包含微信支付链接和二维码，用户支付后再查询制作状态与取餐码。</p><p>对开发者来说，这条路线的价值在于结构化输入和可编排性：同一套门店、商品和订单能力可以由人在终端调用，也可以进入 AI Agent 工作流。如果需要对照另一种“CLI + Skill”开放方式，可参考 <a href="/posts/2026/09/workbuddy-open-platform/">WorkBuddy 开放平台的命令行接入路线</a>。</p>]]></content>
    
    
    <summary type="html">瑞幸咖啡上线面向开发者的官方 CLI，可在终端查询门店和商品、预览并创建订单。本文整理 macOS、Linux 与 Windows 安装方式、可用命令和支付边界。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="ai-agents" scheme="https://51allai.com/tags/ai-agents/"/>
    
    <category term="luckin-coffee" scheme="https://51allai.com/tags/luckin-coffee/"/>
    
  </entry>
  
  <entry>
    <title>Cherry Studio 移动端开启公测，Android APK 与 iOS TestFlight 提供测试入口</title>
    <link href="https://51allai.com/posts/2026/09/cherry-studio-mobile-public-beta/"/>
    <id>https://51allai.com/posts/2026/09/cherry-studio-mobile-public-beta/</id>
    <published>2026-09-17T02:19:06.000Z</published>
    <updated>2026-09-17T02:19:06.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>Cherry Studio 于 2026 年 9 月 16 日发布移动端 v0.1.0-beta.1，Android 用户可下载 ARM64 APK，iPhone 和 iPad 用户可通过 TestFlight 公开邀请参与测试。新客户端覆盖多模型对话、智能体、插件与 MCP 工具，并公开 AGPL-3.0 源码。<br><img src="https://images.51allai.com/blog/cherry-studio-mobile-public-beta-cover-v2_20260917_102557.png" alt="Cherry Studio 移动端 Android 与 iOS 公测" fetchpriority="high" decoding="async"></p></blockquote><h2 id="Android-与-iOS-提供不同测试入口"><a href="#Android-与-iOS-提供不同测试入口" class="headerlink" title="Android 与 iOS 提供不同测试入口"></a>Android 与 iOS 提供不同测试入口</h2><p>v0.1.0-beta.1 已标记为预发布版本。Android 用户可在 <a href="https://github.com/CherryHQ/cherry-studio-app/releases/tag/v0.1.0-beta.1">GitHub 发布页</a> 下载名为 <code>cherry-studio-0.1.0-2026-09-16-android.apk</code> 的 ARM64 安装包，文件大小约 126 MB。同页提供 <code>SHA256SUMS</code>，可用于检查下载文件是否完整。</p><p>iPhone 和 iPad 用户需要先安装 Apple TestFlight，再打开 <a href="https://testflight.apple.com/join/Mdd3bqvT">Cherry Studio APP 公测邀请</a> 接受测试。加入后可在 TestFlight 内安装开发者提供的构建，并接收后续测试版更新。iOS 构建由独立的发布工作流处理，不会以 IPA 附件的方式出现在 Android APK 的 GitHub 发布页中。</p><h2 id="多模型对话和智能体进入手机"><a href="#多模型对话和智能体进入手机" class="headerlink" title="多模型对话和智能体进入手机"></a>多模型对话和智能体进入手机</h2><p>Cherry Studio Mobile 可连接多个 AI 服务商，管理模型，并在不同对话中选择合适的模型。对话支持 Markdown 格式的流式回复，也能添加文本和图片附件；具体能否处理图片，取决于当前选择的模型。</p><p>用户还可以创建独立智能体，为它设置指令、默认模型和可用工具。客户端支持插件与 MCP 服务器；MCP 是让 AI 连接外部工具和数据的通用协议。配置相应服务后，智能体可使用联网搜索和网页读取等能力，工具操作需要审批时会在客户端内展示。</p><p>移动端也提供图像生成、附件与生成文件管理，并可将选中的对话内容导出为 Markdown、HTML 或图片。</p><h2 id="与桌面端的配对不等于全量同步"><a href="#与桌面端的配对不等于全量同步" class="headerlink" title="与桌面端的配对不等于全量同步"></a>与桌面端的配对不等于全量同步</h2><p>手机端可与 Cherry Studio Desktop 配对，导入受支持的模型服务商配置和模型。当前配对范围不包含对话历史同步，也不能用手机远程控制桌面端智能体。如果用户的主要需求是在手机继续电脑上的现有对话，这个边界会直接影响当前的使用方式。</p><h2 id="公测前先准备模型服务"><a href="#公测前先准备模型服务" class="headerlink" title="公测前先准备模型服务"></a>公测前先准备模型服务</h2><p>Cherry Studio Mobile 是 AI 工作台，不是自带所有模型用量的聊天服务。用户选择的模型和外部服务可能需要账号或 API Key，调用费用由对应服务商决定。</p><p>项目源码已在 <a href="https://github.com/CherryHQ/cherry-studio-app">CherryHQ&#x2F;cherry-studio-app</a> 公开，采用 AGPL-3.0 许可证。开发者可以直接检查移动端的 Expo、React Native 实现，或通过 Issue 和代码贡献参与测试。</p>]]></content>
    
    
    <summary type="html">Cherry Studio 移动端开启 v0.1.0-beta.1 公测，Android 通过 ARM64 APK 安装，iOS 通过 TestFlight 参与。本文整理两端测试入口、多模型与智能体功能，以及与桌面端配对的已知边界。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="ai-agents" scheme="https://51allai.com/tags/ai-agents/"/>
    
    <category term="open-source" scheme="https://51allai.com/tags/open-source/"/>
    
    <category term="cherry-studio" scheme="https://51allai.com/tags/cherry-studio/"/>
    
  </entry>
  
  <entry>
    <title>Best Buy 上架 ChatGPT 数字礼品卡，提供 25 至 200 美元四档</title>
    <link href="https://51allai.com/posts/2026/09/best-buy-chatgpt-gift-cards/"/>
    <id>https://51allai.com/posts/2026/09/best-buy-chatgpt-gift-cards/</id>
    <published>2026-09-16T01:48:54.000Z</published>
    <updated>2026-09-16T01:48:54.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>Best Buy 已上架 OpenAI ChatGPT 数字礼品卡，提供 25、50、100 和 200 美元四档。购买需要 BestBuy.com 账户，兑换信息通过邮件和订单详情提供；卡片仅限美国兑换，不支持退货。<br><img src="https://images.51allai.com/blog/best-buy-chatgpt-gift-cards-cover_20260916_095142.png" alt="Best Buy ChatGPT 数字礼品卡四档面值" fetchpriority="high" decoding="async"></p></blockquote><h2 id="Best-Buy-提供四档数字礼品卡"><a href="#Best-Buy-提供四档数字礼品卡" class="headerlink" title="Best Buy 提供四档数字礼品卡"></a>Best Buy 提供四档数字礼品卡</h2><p>Best Buy 销售的 ChatGPT 礼品卡为数字格式，可选 25、50、100 和 200 美元四档。这不是可在 Best Buy 门店消费的商店礼品卡；兑换后，金额会进入对应 ChatGPT 账户的 OpenAI 钱包。</p><p>用户可直接在 <a href="https://www.bestbuy.com/product/openai-chatgpt-100-gift-card-digital/JJG34P787G/sku/6688133">Best Buy 的 ChatGPT 礼品卡商品页</a> 选择面值。Best Buy 将该商品标注为自营销售，商品页也明确列出数字格式和各档金额。</p><h2 id="下单需要-BestBuy-com-账户"><a href="#下单需要-BestBuy-com-账户" class="headerlink" title="下单需要 BestBuy.com 账户"></a>下单需要 BestBuy.com 账户</h2><p>购买时必须登录 BestBuy.com 账户。下单后，兑换信息会通过邮件发送，同时也可以在 Best Buy 订单详情中查看。如果要送给其他人，收到邮件后可使用其中的赠送选项。</p><p>这类数字礼品卡不支持退货。下单前应先确认面值、收件信息和兑换账户，不要把礼品卡 PIN 发到公开页面或提供给陌生人。</p><h2 id="礼品卡只能在美国兑换"><a href="#礼品卡只能在美国兑换" class="headerlink" title="礼品卡只能在美国兑换"></a>礼品卡只能在美国兑换</h2><p>ChatGPT 礼品卡当前仅限在美国购买和兑换，兑换时还需要位于美国并使用美元计费的 ChatGPT 账户。数字交付不会改变这些地区与币种条件。</p><p>兑换时需要在 <code>chatgpt.com/redeem</code> 登录收款账户并输入 PIN。整张卡的金额会一次性进入该账户，不能拆分给多个账户，兑换后也不能转移。</p><h2 id="买前检查订阅的计费渠道"><a href="#买前检查订阅的计费渠道" class="headerlink" title="买前检查订阅的计费渠道"></a>买前检查订阅的计费渠道</h2><p>礼品卡余额可用于 ChatGPT 网页端直接计费的符合条件订阅、升级、续费和积分购买。通过 Apple App Store 或 Google Play 计费的订阅不会使用这笔余额，API 预付费也不支持。</p><p>购买前可先查看 <a href="/posts/2026/09/openai-chatgpt-gift-cards/">ChatGPT 礼品卡的完整兑换与余额规则</a>。兑换礼品卡只会增加钱包余额，不会自动开通付费订阅。</p>]]></content>
    
    
    <summary type="html">Best Buy 已上架 OpenAI ChatGPT 数字礼品卡，提供 25、50、100 和 200 美元四档。本文说明购买账户、邮件交付、美国兑换限制，以及下单前需要核对的用途。</summary>
    
    
    
    <category term="行业观察" scheme="https://51allai.com/categories/%E8%A1%8C%E4%B8%9A%E8%A7%82%E5%AF%9F/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="pricing" scheme="https://51allai.com/tags/pricing/"/>
    
    <category term="openai" scheme="https://51allai.com/tags/openai/"/>
    
    <category term="chatgpt" scheme="https://51allai.com/tags/chatgpt/"/>
    
  </entry>
  
  <entry>
    <title>OpenAI 将于 10 月 14 日从 ChatGPT、Work 与 Codex 停用 GPT-5.5</title>
    <link href="https://51allai.com/posts/2026/09/openai-gpt-55-retirement/"/>
    <id>https://51allai.com/posts/2026/09/openai-gpt-55-retirement/</id>
    <published>2026-09-16T01:24:07.000Z</published>
    <updated>2026-09-16T01:24:07.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>OpenAI 将于 2026 年 10 月 14 日从 ChatGPT、ChatGPT Work 与 Codex 停用 GPT-5.5，覆盖所有套餐。Codex 用户可改用 GPT-5.6 Sol 或 GPT-6 Astra；实际可选模型取决于套餐、工作区权限与客户端版本。<br><img src="https://images.51allai.com/blog/openai-gpt-55-retirement-cover_20260916_092843.png" alt="GPT-5.5 停用与 ChatGPT、Work、Codex 迁移路线" fetchpriority="high" decoding="async"></p></blockquote><h2 id="GPT-5-5-将在三个产品入口停用"><a href="#GPT-5-5-将在三个产品入口停用" class="headerlink" title="GPT-5.5 将在三个产品入口停用"></a>GPT-5.5 将在三个产品入口停用</h2><p>GPT-5.5 的停用日期是 2026 年 10 月 14 日，范围包括普通 ChatGPT 对话、ChatGPT Work 和 Codex，适用于所有套餐。用户在截止日前仍依赖 GPT-5.5 处理固定工作流时，需要提前换到当前模型，并用常见任务检查输出格式、工具调用和用量。</p><p>这次变化与站内此前记录的 <a href="/posts/2026/04/openai-gpt-5.5-agentic/">GPT-5.5 发布</a> 属于不同阶段：前者说明模型上线，当前安排处理产品内的停用与迁移。</p><h2 id="Codex-用户可转向-Sol-或-Astra"><a href="#Codex-用户可转向-Sol-或-Astra" class="headerlink" title="Codex 用户可转向 Sol 或 Astra"></a>Codex 用户可转向 Sol 或 Astra</h2><p>Codex 用户可以把 GPT-5.5 会话迁移到 GPT-5.6 Sol 或 GPT-6 Astra。GPT-5.6 Sol 面向编码、研究和复杂工作；GPT-6 Astra 也可用于 Codex，但是否出现取决于套餐与工作区权限。</p><p>不同入口的现行模型分配并不完全相同：</p><table><thead><tr><th>使用入口</th><th>已确认的替代范围</th></tr></thead><tbody><tr><td>ChatGPT 普通对话</td><td>Free 与 Go 使用 GPT-5.6 Luna；符合条件的付费套餐使用 GPT-5.6 Sol</td></tr><tr><td>ChatGPT Work</td><td>Plus、Pro、Business 与 Enterprise 可用 GPT-5.6 Sol、Terra 和 Luna</td></tr><tr><td>Codex</td><td>Free 与 Go 可用 GPT-5.6 Terra；Plus、Pro、Business 与 Enterprise 可用 Sol、Terra 和 Luna</td></tr><tr><td>Work 与 Codex 中的 Astra</td><td>Plus 包含有限用量；Pro 与 Business 的可用量随套餐而变，Enterprise 还受工作区模型权限控制</td></tr></tbody></table><p>普通 ChatGPT 对话里的 <a href="/posts/2026/08/chatgpt-gpt-56-sol-luna-access/">GPT-5.6 Sol 与 Luna 套餐分配</a> 不能直接套用到 Work 和 Codex。迁移时应在实际使用的入口检查模型选择器，而不是只看 Chat 页面。</p><h2 id="更新客户端后再切换模型"><a href="#更新客户端后再切换模型" class="headerlink" title="更新客户端后再切换模型"></a>更新客户端后再切换模型</h2><p>Codex 使用 GPT-5.6 需要 ChatGPT 桌面应用 Codex 模式 26.707.30751 或更高版本，或者 Codex CLI 0.144.0 或更高版本。GPT-6 Astra 对 Codex CLI 的最低要求是 0.153.0；桌面端应通过“菜单 → 检查更新”安装最新版本。</p><p>看不到 Astra 时，先确认客户端版本，再检查套餐和工作区权限。<a href="/posts/2026/09/openai-gpt-6-astra/">GPT-6 Astra 的模型规格与使用边界</a> 与这次停用安排分开，选择替代模型时还要考虑任务类型和可用额度。</p><h2 id="迁移前保留一组固定测试"><a href="#迁移前保留一组固定测试" class="headerlink" title="迁移前保留一组固定测试"></a>迁移前保留一组固定测试</h2><p>模型切换会改变回答风格、推理过程和工具使用方式。长期运行的 Codex 或 Work 任务可以保留一组固定输入，至少覆盖常用指令、文件处理、工具调用和最终交付格式；切换模型后用同一组输入重跑，再更新默认模型或团队配置。</p><p>工作区管理员还可以在 Work 与 Codex 的模型设置中配置起始模型、推理强度和新对话行为。起始设置不会授予成员原本没有的模型权限，因此团队迁移需要同时检查角色权限。</p>]]></content>
    
    
    <summary type="html">OpenAI 将于 2026 年 10 月 14 日从 ChatGPT、ChatGPT Work 与 Codex 停用 GPT-5.5，覆盖所有套餐。本文说明 Codex 用户可迁移到 GPT-5.6 Sol 或 GPT-6 Astra，并梳理不同套餐的替代模型与客户端版本要求。</summary>
    
    
    
    <category term="行业观察" scheme="https://51allai.com/categories/%E8%A1%8C%E4%B8%9A%E8%A7%82%E5%AF%9F/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="openai" scheme="https://51allai.com/tags/openai/"/>
    
    <category term="chatgpt" scheme="https://51allai.com/tags/chatgpt/"/>
    
    <category term="codex" scheme="https://51allai.com/tags/codex/"/>
    
    <category term="gpt-5-5" scheme="https://51allai.com/tags/gpt-5-5/"/>
    
  </entry>
  
  <entry>
    <title>腾讯云发布 Octop 1.0，提供 PC 与飞牛 NAS 安装包</title>
    <link href="https://51allai.com/posts/2026/09/tencentcloud-octop-1-ga/"/>
    <id>https://51allai.com/posts/2026/09/tencentcloud-octop-1-ga/</id>
    <published>2026-09-15T01:37:54.000Z</published>
    <updated>2026-09-15T01:37:54.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>腾讯云发布 Octop 1.0 GA 版。用户可以在自己的电脑或服务器上运行这款多用户、多智能体助手，官方已提供 Windows、macOS、Linux 与飞牛 NAS 安装包，源代码采用 MIT 许可证。<br><img src="https://images.51allai.com/blog/tencentcloud-octop-1-ga-cover_20260915_094105.png" alt="腾讯云 Octop 1.0 自托管多用户 AI 助手" fetchpriority="high" decoding="async"></p></blockquote><h2 id="一台机器承载控制台、通信和定时任务"><a href="#一台机器承载控制台、通信和定时任务" class="headerlink" title="一台机器承载控制台、通信和定时任务"></a>一台机器承载控制台、通信和定时任务</h2><p>Octop 是一套自托管 AI 助手平台，不包含固定的大模型。用户配置自己的模型服务后，一个 Python 进程会同时提供 Web 控制台、命令行、HTTP&#x2F;WebSocket API、即时通信通道和定时任务。</p><p>默认配置使用 SQLite 保存用户、智能体、会话和审计信息，也可以切换到 PostgreSQL。每个智能体有独立工作区；每位用户可以分别设置模型提供商、通信通道和定时任务。对家庭或小团队来说，同一套服务可以建立多个账号，不必让所有人共用一段对话记录和一份工作目录。</p><p>飞书、钉钉、QQ、Discord 和企业微信可以作为消息入口。浏览器自动化、知识库、插件和远程桌面也放在同一控制台管理，部署者仍需要按实际任务为模型、搜索服务或外部连接器配置凭据。</p><h2 id="ACP-可接入编辑器，也能委派编程任务"><a href="#ACP-可接入编辑器，也能委派编程任务" class="headerlink" title="ACP 可接入编辑器，也能委派编程任务"></a>ACP 可接入编辑器，也能委派编程任务</h2><p>ACP（Agent Client Protocol）用于让编辑器、终端工具和智能体交换任务。Octop 支持两个方向：运行 <code>octop acp --agent main</code> 后，Zed、OpenCode 等客户端可以使用本机的 Octop 智能体；在控制台启用 <code>acp_runner</code> 后，Octop 又能把编程任务交给外部工具执行。</p><p>内置 Runner 覆盖 OpenCode、CodeBuddy、Claude Code、Codex、Kimi Code、Cursor CLI 和 Pi。外部编程工具仍需安装在运行 Octop 的主机上，并完成各自的登录或 API 配置。想了解另一种 ACP 开源实现，可以对照 <a href="/posts/2026/07/grok-build-open-source/">Grok Build 的终端智能体架构</a>。</p><h2 id="PC、服务器和飞牛-NAS-都有对应入口"><a href="#PC、服务器和飞牛-NAS-都有对应入口" class="headerlink" title="PC、服务器和飞牛 NAS 都有对应入口"></a>PC、服务器和飞牛 NAS 都有对应入口</h2><p>不想处理命令行环境的用户，可以直接下载桌面安装包。Windows 同时提供 x64 与 ARM64 版本，macOS 覆盖 Apple 芯片和 Intel，Linux 提供 x64 与 ARM64 压缩包。飞牛 NAS 用户可选 Docker 版或原生 FPK 包，通过应用中心安装。</p><p>项目代码、发行包与安装说明集中在 <a href="https://github.com/TencentCloud/Octop">TencentCloud&#x2F;Octop GitHub 仓库</a>。</p><p>已经管理 Python 环境的用户可以执行 <code>pip install octop</code>，然后用 <code>octop run</code> 启动服务。默认地址是 <code>http://127.0.0.1:8088</code>，首次设置向导会创建数据库、JWT 密钥和管理员账号。用于长期运行时，项目也提供 Docker Compose 与系统服务方式。</p><p>软件代码和安装包可免费下载。实际使用成本取决于部署机器、所选模型服务以及接入的外部工具；Octop 负责组织账号、智能体、工作区和工具调用，不替代这些服务本身。</p><h2 id="1-0-成为首个-GA-稳定版"><a href="#1-0-成为首个-GA-稳定版" class="headerlink" title="1.0 成为首个 GA 稳定版"></a>1.0 成为首个 GA 稳定版</h2><p>Octop 1.0 于 2026 年 9 月 14 日发布。GA 是 General Availability 的缩写，表示项目从 0.9 系列进入面向日常使用的稳定发布阶段。更新检查默认只查找稳定版，用户也可以自行选择是否接收预发布版本。</p><p>这一版本没有重新包装一批新功能，主要完成发布状态切换，并修复大体积备份列表扫描和中文语音探测错误提示。它与前一天发布的 0.9.35 保持连续升级关系，现有用户可以按稳定版通道更新。</p><p>Octop 的源代码采用 MIT 许可证，1.0.0 软件包已同步到 PyPI。项目要求 Python 3.12 或更高版本；官方安装脚本会用 uv 在 <code>~/.octop/</code> 内建立隔离环境，用户无需预先配置系统 Python。</p>]]></content>
    
    
    <summary type="html">腾讯云发布 Octop 1.0 GA 版，这款采用 MIT 许可证的自托管多用户 AI 助手提供 Windows、macOS、Linux 与飞牛 NAS 安装包，并支持 Web 控制台、即时通信、定时任务和 ACP 编程智能体接入。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="ai-agents" scheme="https://51allai.com/tags/ai-agents/"/>
    
    <category term="open-source" scheme="https://51allai.com/tags/open-source/"/>
    
    <category term="desktop-agent" scheme="https://51allai.com/tags/desktop-agent/"/>
    
    <category term="tencent" scheme="https://51allai.com/tags/tencent/"/>
    
    <category term="octop" scheme="https://51allai.com/tags/octop/"/>
    
  </entry>
  
  <entry>
    <title>小红书 AllSpark 开源 Iris，提供 35B 与 397B 搜索智能体模型</title>
    <link href="https://51allai.com/posts/2026/09/xiaohongshu-allspark-iris-search-agent/"/>
    <id>https://51allai.com/posts/2026/09/xiaohongshu-allspark-iris-search-agent/</id>
    <published>2026-09-14T11:37:24.000Z</published>
    <updated>2026-09-14T11:37:24.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>小红书 AllSpark 团队开源 Iris-mini 与 Iris-pro 两个搜索智能体模型，权重已可从 Hugging Face 下载。两个版本分别采用 35B&#x2F;3B 激活和 397B&#x2F;17B 激活的混合专家架构，均支持 256K Token 上下文，并配套开放评测框架。<br><img src="https://images.51allai.com/blog/xiaohongshu-allspark-iris-search-agent-cover_20260914_194506.png" alt="小红书 AllSpark Iris 搜索智能体开源模型封面" fetchpriority="high" decoding="async"></p></blockquote><h2 id="两个版本均支持-256K-上下文"><a href="#两个版本均支持-256K-上下文" class="headerlink" title="两个版本均支持 256K 上下文"></a>两个版本均支持 256K 上下文</h2><p>Iris 面向需要多轮检索、阅读网页并整合证据的搜索任务。它不是只返回关键词匹配结果，而是在一次任务中决定搜什么、读取哪些页面、是否继续检索，以及何时整理最终答案。</p><p>两个版本都建立在千问混合专家模型之上。混合专家模型不会在每次生成时调用全部参数，而是按输入激活其中一部分，因此总参数量和激活参数量需要分开看。</p><table><thead><tr><th>模型</th><th>基础模型</th><th>总参数 &#x2F; 激活参数</th><th>上下文</th><th>权重许可证</th></tr></thead><tbody><tr><td>Iris-mini</td><td>Qwen3.6-35B-A3B</td><td>35B &#x2F; 3B</td><td>256K Token</td><td>Apache 2.0</td></tr><tr><td>Iris-pro</td><td>Qwen3.5-397B-A17B</td><td>397B &#x2F; 17B</td><td>256K Token</td><td>Apache 2.0</td></tr></tbody></table><p>Iris-mini 每次激活 256 个专家中的 8 个；Iris-pro 每次激活 512 个专家中的 10 个。两套模型页都提供配置文件、聊天模板和 Safetensors 分片权重。小红书此前开源的 <a href="/posts/2026/08/xiaohongshu-dots3-note-preview/">dots3-note preview</a> 主要处理图文、视频和音频文档，Iris 的任务则是联网搜索与长链路信息查找。</p><h2 id="训练问题从网页链接反向构造"><a href="#训练问题从网页链接反向构造" class="headerlink" title="训练问题从网页链接反向构造"></a>训练问题从网页链接反向构造</h2><p>Iris 的训练数据从网页之间的超链接关系开始。系统先把一个种子页面及其链接页面整理成实体关系图，再沿着多个页面之间的关系生成需要多步查找的问题。问题中的直接名称会被改写为描述性线索，减少模型把原词复制到搜索框就得到答案的机会。</p><p>生成的问题还要通过两项筛选：参考模型在不给网页证据时无法直接回答，拿到对应证据后能够得到唯一答案。通过筛选的问题会被转成包含推理、工具调用和网页观察的完整轨迹，再按整条轨迹和单个步骤分别过滤。</p><p>训练过程交替使用监督微调和强化学习。监督微调让模型先学习筛选后的搜索过程；强化学习阶段让模型连接真实搜索工具执行任务，再把解开的难题和效率较高的轨迹送回下一轮监督训练。这套交替流程在论文中称为 SFT-RL climbing。</p><h2 id="评测框架同时控制工具和上下文"><a href="#评测框架同时控制工具和上下文" class="headerlink" title="评测框架同时控制工具和上下文"></a>评测框架同时控制工具和上下文</h2><p>GitHub 仓库中的 <code>Iris-Harness</code> 包含单智能体循环、网页搜索与抓取工具、上下文管理配置，以及 BrowseComp、BrowseComp-ZH、DeepSearchQA 和 HLE 四套评测入口。它可以连接提供 OpenAI 兼容接口的模型服务，不限定只能运行 Iris。</p><p>框架把上下文管理作为单独变量。<code>discard-all</code> 会在上下文超过阈值时清空已积累的工具历史，从原问题重新开始；<code>retry</code> 会在一次任务没有产出可解析答案时重新执行，并带上简短的排除信息。这样可以分别观察模型本身和外部上下文策略对结果的影响。</p><h2 id="开发者可下载权重并接入现有服务"><a href="#开发者可下载权重并接入现有服务" class="headerlink" title="开发者可下载权重并接入现有服务"></a>开发者可下载权重并接入现有服务</h2><p>Iris-mini 和 Iris-pro 的 Hugging Face 页面均为公开、无需申请访问的模型仓库。模型卡提供 SGLang 启动示例，并通过 OpenAI Function Calling 格式调用搜索工具；评测框架随后通过 OpenAI 兼容地址连接模型服务。</p><p>部署规模需要与模型体量匹配。Iris-mini 的示例采用 4 路张量并行，Iris-pro 的示例采用 8 路张量并行和 8 路专家并行，后者需要多节点或容量较大的单节点。开发者可以先从 Iris-mini 和评测框架入手，再按硬件条件调整并行参数与上下文长度。</p>]]></content>
    
    
    <summary type="html">小红书 AllSpark 开源 Iris-mini 与 Iris-pro 两个搜索智能体模型，提供 35B/3B 激活和 397B/17B 激活版本、256K 上下文、Apache 2.0 权重与配套评测框架。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="model-release" scheme="https://51allai.com/tags/model-release/"/>
    
    <category term="ai-agents" scheme="https://51allai.com/tags/ai-agents/"/>
    
    <category term="open-source" scheme="https://51allai.com/tags/open-source/"/>
    
    <category term="xiaohongshu" scheme="https://51allai.com/tags/xiaohongshu/"/>
    
    <category term="iris" scheme="https://51allai.com/tags/iris/"/>
    
  </entry>
  
  <entry>
    <title>OpenAI 建议精简 GPT-6 Astra Skills 与 AGENTS.md</title>
    <link href="https://51allai.com/posts/2026/09/gpt-6-astra-skills-agents-guide/"/>
    <id>https://51allai.com/posts/2026/09/gpt-6-astra-skills-agents-guide/</id>
    <published>2026-09-14T01:27:34.000Z</published>
    <updated>2026-09-14T01:27:34.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>OpenAI 建议 GPT-6 Astra 用户重新审计 Skills、<code>AGENTS.md</code> 和任务提示词：Skill 描述要缩短并收窄触发范围，多流程内容改为按需加载，仓库指令则按任务类型指向相关文档和测试。<br><img src="https://images.51allai.com/blog/openai-gpt-6-astra-skills-agents-cover_20260914_093809.png" alt="GPT-6 Astra Skills 与 AGENTS.md 指令精简示意" fetchpriority="high" decoding="async"></p></blockquote><h2 id="Skill-描述会竞争初始上下文"><a href="#Skill-描述会竞争初始上下文" class="headerlink" title="Skill 描述会竞争初始上下文"></a>Skill 描述会竞争初始上下文</h2><p>Codex 在决定是否调用 Skill 之前，会先看到每个 Skill 的名称和描述。初始 Skill 列表最多使用模型上下文窗口的 2%；无法确定窗口时，上限为 8000 个字符。Skill 太多时，描述会先被缩短，数量更大时还可能有 Skill 不出现在初始列表中。</p><p>描述的任务不是解释整套工作流，而是帮助模型决定“什么时候应该加载”。它应先写清关键用途和触发词，再收窄适用范围。“处理任何数据库工作”会让迁移 Skill 在查询、模型或持久化任务中误触发；“新增、修改或审核迁移时使用”则能直接界定范围。</p><h2 id="多流程-Skill-改成按需加载"><a href="#多流程-Skill-改成按需加载" class="headerlink" title="多流程 Skill 改成按需加载"></a>多流程 Skill 改成按需加载</h2><p>Skill 适合封装可重复的任务指令、参考资料和脚本。模型选中 Skill 后，才会读取完整的 <code>SKILL.md</code>。因此，同时包含多种工作流时，根文件只需保留选择路径和关键约束，把详细模板、案例和脚本说明放到支持文档中。模型在确定分支后再读对应内容。</p><p>过度细化的步骤也需要删减。只有输入、输出、安全边界或团队标准要求确定性时，才需要保留强制流程。通用任务不必为每个可能的分支预先写成长清单。</p><h2 id="AGENTS-md-负责路由，不是预加载所有文档"><a href="#AGENTS-md-负责路由，不是预加载所有文档" class="headerlink" title="AGENTS.md 负责路由，不是预加载所有文档"></a>AGENTS.md 负责路由，不是预加载所有文档</h2><p>Codex 启动时会把全局指令、项目根目录到当前目录之间的 <code>AGENTS.md</code> 组成一条指令链，更靠近当前目录的规则放在后面，可以覆盖前面的广泛规则。默认情况下，合并后的项目指令读取到 32 KiB 即停止追加。</p><p>与其要求每次编辑都通读架构、数据库和部署文档，不如给出条件化路由：改服务边界时读架构文档，改 Schema 时读数据库文档，准备部署时再读部署说明。这会保留项目约定，同时避免与当前任务无关的文档占用上下文。</p><p>GPT-6 Astra 的运行行为、委派和测试强度可以在<a href="/posts/2026/09/gpt-6-astra-prompting-guide/">现有提示指南</a>中单独配置。本次清理的重点是删掉过时的重复规则，而不是再加一层新指令。</p><h2 id="审批点和完成条件要重新校准"><a href="#审批点和完成条件要重新校准" class="headerlink" title="审批点和完成条件要重新校准"></a>审批点和完成条件要重新校准</h2><p>为了阻止早期模型越权操作，一些团队会把“每一步都询问”写进 Skill 或 <code>AGENTS.md</code>。GPT-6 Astra 可能会严格执行这类旧边界，在安全的本地分析、修改和测试之间频繁停下。更具体的写法是保留真正会改变目标或产生外部影响的确认点，并明确授权哪些本地流程可以连续完成。</p><p>完成条件也不能只写“做出第一版”。如果任务要求把结果跑起来、检查输出并修复失败，就应把这些动作一起写成终止条件，让指定验证成为交付的一部分。</p><h2 id="按这个顺序审计现有指令"><a href="#按这个顺序审计现有指令" class="headerlink" title="按这个顺序审计现有指令"></a>按这个顺序审计现有指令</h2><ol><li>统计已安装的 Skills，优先处理描述很长、范围重叠或容易误触发的项目。</li><li>为每个 Skill 留下一个聚焦任务，在描述前部写明关键用途和触发词。</li><li>把长案例、多分支步骤和仅在特定情况使用的资料移到支持文档，由根文件按需路由。</li><li>把 <code>AGENTS.md</code> 中的全量预读要求改成按任务类型读取，删掉已过时的项目地图和测试规则。</li><li>重新划定确认点，同时把实现、运行、检查和修复写入需要持续完成的任务边界。</li></ol>]]></content>
    
    
    <summary type="html">OpenAI 建议为 GPT-6 Astra 重新审计 Skills 与 AGENTS.md，缩短触发描述、按需加载支持文档，并删除过度测试和过时审批规则。本文给出可直接执行的清理顺序。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="ai-agents" scheme="https://51allai.com/tags/ai-agents/"/>
    
    <category term="openai" scheme="https://51allai.com/tags/openai/"/>
    
    <category term="codex" scheme="https://51allai.com/tags/codex/"/>
    
    <category term="astra" scheme="https://51allai.com/tags/astra/"/>
    
  </entry>
  
  <entry>
    <title>DeepSeek 保留 V4 Pro API，9 月 14 日后继续按原价提供</title>
    <link href="https://51allai.com/posts/2026/09/deepseek-v4-pro-api-continues/"/>
    <id>https://51allai.com/posts/2026/09/deepseek-v4-pro-api-continues/</id>
    <published>2026-09-13T01:38:45.000Z</published>
    <updated>2026-09-13T01:38:45.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>DeepSeek 调整 V4 Pro API 服务安排：2026 年 9 月 14 日后继续提供 <code>deepseek-v4-pro</code>，计费方式保持不变。当前模型仍为 DeepSeek-V4-Pro-0813，现有项目可以沿用原模型名和 API 地址。<br><img src="https://images.51allai.com/blog/deepseek-v4-pro-api-continues-cover_20260913_094539.png" alt="DeepSeek V4 Pro API 9 月 14 日后继续服务与原价计费" fetchpriority="high" decoding="async"></p></blockquote><h2 id="V4-Pro-不再按原计划于-9-月-14-日下线"><a href="#V4-Pro-不再按原计划于-9-月-14-日下线" class="headerlink" title="V4 Pro 不再按原计划于 9 月 14 日下线"></a>V4 Pro 不再按原计划于 9 月 14 日下线</h2><p>DeepSeek 将在 2026 年 9 月 14 日之后继续提供 V4 Pro API。当前模型与价格页仍列出 <code>deepseek-v4-pro</code>，对应版本为 <code>DeepSeek-V4-Pro-0813</code>。</p><p>此前的安排是：9 月 14 日 12:00 后，指向 V4 Pro 的请求将转交给 V4.1 Flash，并按 Flash 单价计费。现在的续供通知改变了这项安排。使用 V4 Pro 固定输出表现或工具调用行为的项目，不必因原定下线时间切换模型。</p><p>这次变化与 <a href="/posts/2026/09/deepseek-v41-flash-release-plan/">V4.1 Flash 发布前公布的临时路由方案</a> 直接相关。V4.1 Flash 仍通过 <code>deepseek-flash</code> 单独提供，两个模型名在当前价格页并列显示。</p><h2 id="V4-Pro-继续执行现行峰谷价格"><a href="#V4-Pro-继续执行现行峰谷价格" class="headerlink" title="V4 Pro 继续执行现行峰谷价格"></a>V4 Pro 继续执行现行峰谷价格</h2><p>V4 Pro 仍按每 100 万 Token 分项计费。Token 是模型读取输入和生成输出时使用的计量单位。</p><table><thead><tr><th>计费项目</th><th align="right">空闲时段</th><th align="right">高峰时段</th></tr></thead><tbody><tr><td>缓存命中输入</td><td align="right">0.15 元</td><td align="right">0.30 元</td></tr><tr><td>缓存未命中输入</td><td align="right">4.5 元</td><td align="right">9.0 元</td></tr><tr><td>输出</td><td align="right">13.5 元</td><td align="right">27.0 元</td></tr></tbody></table><p>高峰时段为北京时间周一至周五 9:00–12:00、14:00–18:00，其余时间执行空闲价格。一次调用若消耗 100 万个缓存未命中的输入 Token，并生成 100 万个输出 Token，空闲时段费用为 18 元，高峰时段为 36 元。</p><h2 id="现有项目可以保持调用配置"><a href="#现有项目可以保持调用配置" class="headerlink" title="现有项目可以保持调用配置"></a>现有项目可以保持调用配置</h2><p>OpenAI 兼容接口的基础地址仍是 <code>https://api.deepseek.com</code>，模型参数继续填写 <code>deepseek-v4-pro</code>。当前文档列出的上下文长度为 100 万 Token，最大输出为 38.4 万 Token，单账号并发上限为 500。</p><p>V4 Pro 继续支持 JSON Output、Tool Calls、Responses API 和 Anthropic API。已经接入这些接口的应用可以保持现有配置，并继续按 V4 Pro 的峰谷价核算预算。</p>]]></content>
    
    
    <summary type="html">DeepSeek 调整 V4 Pro 下线安排，9 月 14 日后继续提供 deepseek-v4-pro API，模型版本与计费方式保持不变。本文列出现行峰谷价格及对已有项目的影响。</summary>
    
    
    
    <category term="大模型" scheme="https://51allai.com/categories/%E5%A4%A7%E6%A8%A1%E5%9E%8B/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="pricing" scheme="https://51allai.com/tags/pricing/"/>
    
    <category term="deepseek" scheme="https://51allai.com/tags/deepseek/"/>
    
    <category term="deepseek-v4" scheme="https://51allai.com/tags/deepseek-v4/"/>
    
  </entry>
  
  <entry>
    <title>微软把 Grok 加入 Word、Excel 和 PowerPoint Copilot</title>
    <link href="https://51allai.com/posts/2026/09/microsoft-copilot-grok-office-apps/"/>
    <id>https://51allai.com/posts/2026/09/microsoft-copilot-grok-office-apps/</id>
    <published>2026-09-12T16:00:31.000Z</published>
    <updated>2026-09-12T16:00:31.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>微软于 2026 年 9 月 12 日宣布，Grok 模型正在推送到 Word、Excel 和 PowerPoint 中的 Copilot，首批面向 Microsoft Frontier 项目客户。演示画面显示，Grok 与 GPT、Claude 一起出现在 Copilot 模型选择器中。<br><img src="https://images.51allai.com/blog/microsoft-copilot-grok-office-apps-cover_20260913_000446.png" alt="Microsoft Copilot 在 Word Excel PowerPoint 加入 Grok 模型" fetchpriority="high" decoding="async"></p></blockquote><h2 id="Grok-进入-Copilot-模型选择器"><a href="#Grok-进入-Copilot-模型选择器" class="headerlink" title="Grok 进入 Copilot 模型选择器"></a>Grok 进入 Copilot 模型选择器</h2><p>这次更新把 Grok 放进 Microsoft 365 应用内的 Copilot。官方演示以 Excel 为例：用户打开 Copilot 侧边栏的模型选择器后，可以看到 Auto、GPT、Claude 和 Grok 四个选项。Auto 会自动选择模型，用户也可手动展开某个模型家族。</p><p>微软此前已把 <a href="/posts/2026/05/claude-office-integration-cross-app-context/">Claude 引入 Office 工作流</a>。Grok 加入后，Copilot 在同一个选择器中提供多个模型家族，用户不必离开正在编辑的文档、表格或演示文稿。</p><h2 id="首批用户需要进入-Frontier-预览计划"><a href="#首批用户需要进入-Frontier-预览计划" class="headerlink" title="首批用户需要进入 Frontier 预览计划"></a>首批用户需要进入 Frontier 预览计划</h2><p>Grok 的首轮推送面向 Microsoft Frontier 项目客户。Frontier 是 Microsoft 365 的可选早期体验计划，功能在正式全面上线前供组织评估。它按租户管理，需要 Microsoft Copilot 许可证。</p><p>管理员可以在 Microsoft 365 管理中心进入 <code>Copilot &gt; Settings &gt; View all &gt; Copilot Frontier</code>，再选择向所有用户或指定用户开放。用户还需被分配 Microsoft Copilot 许可证。此类预览功能由管理员控制，个人无法只在应用内自行打开。</p><h2 id="与独立-Grok-Office-加载项不同"><a href="#与独立-Grok-Office-加载项不同" class="headerlink" title="与独立 Grok Office 加载项不同"></a>与独立 Grok Office 加载项不同</h2><p>Microsoft Marketplace 中已有一款名为 Grok for Microsoft 365 的独立加载项。它为 X 和 SuperGrok 付费用户提供对话侧边栏，可以读取和修改 Word、Excel 与 PowerPoint 文档，并可将数据发送到互联网。</p><p>新推送的 Grok 则出现在 Microsoft Copilot 自身的模型选择器里，使用条件跟随 Copilot 许可证、组织租户配置和 Frontier 推送。如果已在使用独立加载项，不能据此判断 Copilot 里也已经出现 Grok；企业用户应由管理员检查 Frontier 和 Copilot 授权。</p>]]></content>
    
    
    <summary type="html">微软将 Grok 模型加入 Word、Excel 和 PowerPoint 中的 Copilot，首批面向 Microsoft Frontier 项目客户推送。本文说清新入口、开通条件，以及它与独立 Grok Office 加载项的区别。</summary>
    
    
    
    <category term="行业观察" scheme="https://51allai.com/categories/%E8%A1%8C%E4%B8%9A%E8%A7%82%E5%AF%9F/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="microsoft-365" scheme="https://51allai.com/tags/microsoft-365/"/>
    
    <category term="copilot" scheme="https://51allai.com/tags/copilot/"/>
    
    <category term="xai" scheme="https://51allai.com/tags/xai/"/>
    
    <category term="grok" scheme="https://51allai.com/tags/grok/"/>
    
  </entry>
  
  <entry>
    <title>豆包输入法推出 Windows 版，五个平台均已提供下载入口</title>
    <link href="https://51allai.com/posts/2026/09/doubao-ime-windows/"/>
    <id>https://51allai.com/posts/2026/09/doubao-ime-windows/</id>
    <published>2026-09-11T11:01:27.000Z</published>
    <updated>2026-09-11T11:01:27.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>豆包输入法 Windows 版于 2026 年 9 月 8 日开放下载，当前版本为 V0.9.0。它提供语音识别、大模型键盘输入、文字整理和跨端复制粘贴；官网现已列出 Windows、macOS、iOS、Android 与 HarmonyOS NEXT 五个平台的入口。<br><img src="https://images.51allai.com/blog/doubao-ime-windows-cover_20260911_190704.png" alt="豆包输入法 Windows 版与五个平台下载入口" fetchpriority="high" decoding="async"></p></blockquote><h2 id="Windows-版-V0-9-0-已开放下载"><a href="#Windows-版-V0-9-0-已开放下载" class="headerlink" title="Windows 版 V0.9.0 已开放下载"></a>Windows 版 V0.9.0 已开放下载</h2><p>豆包输入法现在可以直接安装到 Windows 电脑。Windows 下载版本为 V0.9.0，发布日期是 2026 年 9 月 8 日，安装包由豆包官方域名提供。</p><p>Windows 版上线后，豆包输入法官网已经同时列出 Windows、macOS、iOS、Android 和 HarmonyOS NEXT。手机与电脑用户可以从同一个产品页面选择对应平台，不必前往第三方下载站寻找安装包。</p><h2 id="语音输入支持方言、专业术语和中英混输"><a href="#语音输入支持方言、专业术语和中英混输" class="headerlink" title="语音输入支持方言、专业术语和中英混输"></a>语音输入支持方言、专业术语和中英混输</h2><p>语音输入可以识别方言、专业术语和中英文混合表达，也覆盖嘈杂环境和轻声说话场景，适合在聊天框、文档或其他可输入文字的位置口述内容。</p><p>键盘输入则加入智能联想、长句补全和随打随纠。这里的大模型能力用于结合当前句子的上下文调整候选内容，减少长句输入时反复拆词和回删的操作。</p><h2 id="长内容可以整理，复制内容可以跨端粘贴"><a href="#长内容可以整理，复制内容可以跨端粘贴" class="headerlink" title="长内容可以整理，复制内容可以跨端粘贴"></a>长内容可以整理，复制内容可以跨端粘贴</h2><p>“智能文字整理”面向较长的口述内容。用户说出零散句子后，可以使用整理功能补全表达、划分重点，再把结果写入当前输入位置。</p><p>“超级互传”用于跨设备复制粘贴。用户在一台设备上复制内容后，可以在另一台设备继续粘贴，减少通过聊天软件或文件传输工具中转文本的步骤。</p><h2 id="从官网下载-Windows-安装包"><a href="#从官网下载-Windows-安装包" class="headerlink" title="从官网下载 Windows 安装包"></a>从官网下载 Windows 安装包</h2><p>打开<a href="https://ime.doubao.com/pc">豆包输入法官网</a>，移动到“多端可用”区域，选择“Windows 版”并点击“立即下载”。下载页会从官方接口取得当前安装包，因此比保存第三方下载链接更适合后续更新。</p><p>安装完成后，先在常用的文档、浏览器和聊天软件里测试语音与键盘输入。需要在电脑和手机之间复制内容时，再使用同一产品提供的跨端互传功能。</p>]]></content>
    
    
    <summary type="html">豆包输入法推出 Windows 版 V0.9.0，官网现已列出五个平台的下载入口。本文梳理语音输入、键盘联想、文字整理与跨端互传等已确认功能，以及 Windows 版的官方下载方式。</summary>
    
    
    
    <category term="行业观察" scheme="https://51allai.com/categories/%E8%A1%8C%E4%B8%9A%E8%A7%82%E5%AF%9F/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="bytedance" scheme="https://51allai.com/tags/bytedance/"/>
    
    <category term="doubao" scheme="https://51allai.com/tags/doubao/"/>
    
    <category term="speech-recognition" scheme="https://51allai.com/tags/speech-recognition/"/>
    
    <category term="doubao-ime" scheme="https://51allai.com/tags/doubao-ime/"/>
    
  </entry>
  
  <entry>
    <title>OpenAI 暂停 ChatGPT Pro 200 美元套餐新订阅，现有用户续订不受影响</title>
    <link href="https://51allai.com/posts/2026/09/chatgpt-pro-200-subscription-pause/"/>
    <id>https://51allai.com/posts/2026/09/chatgpt-pro-200-subscription-pause/</id>
    <published>2026-09-11T01:22:51.000Z</published>
    <updated>2026-09-11T01:22:51.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>OpenAI 自 2026 年 9 月 10 日起暂停 ChatGPT Pro 200 美元套餐的新订阅与升级。现有 Pro 200 美元订阅仍会正常续费，Pro 100 美元套餐、其他套餐和 API 不在暂停范围内。<br><img src="https://images.51allai.com/blog/chatgpt-pro-200-subscription-pause-cover_20260911_092709.png" alt="ChatGPT Pro 200 美元套餐新订阅暂停与现有用户续订" fetchpriority="high" decoding="async"></p></blockquote><h2 id="新用户和套餐升级暂时无法购买-Pro-200-美元档"><a href="#新用户和套餐升级暂时无法购买-Pro-200-美元档" class="headerlink" title="新用户和套餐升级暂时无法购买 Pro 200 美元档"></a>新用户和套餐升级暂时无法购买 Pro 200 美元档</h2><p>此次暂停只针对 ChatGPT Pro 200 美元档，也就是 Pro 20x。Free、Go、Plus 和 Pro 100 美元用户都不能在暂停期间新购或升级到这一档。</p><p>Pro 100 美元档仍然可以从定价页面或 <code>Settings → My Plan</code> 升级。其他 ChatGPT 套餐和 OpenAI API 也继续可用。</p><p><img src="https://images.51allai.com/blog/%E6%88%AA%E5%B1%8F2026-09-11_09.27.26_20260911_092749.png" alt="ChatGPT Pro 200 美元套餐新订阅暂停与现有用户续订" loading="lazy" decoding="async"></p><h2 id="现有-Pro-200-美元订阅继续自动续费"><a href="#现有-Pro-200-美元订阅继续自动续费" class="headerlink" title="现有 Pro 200 美元订阅继续自动续费"></a>现有 Pro 200 美元订阅继续自动续费</h2><p>已经使用 Pro 200 美元档的账户不受新购暂停影响，订阅会按原有设置续费。用户如果已经安排取消或降级，在当前计费周期结束前仍保留 Pro 200 美元权益，也可以在账单设置中撤销变更。</p><p>取消或降级一旦生效，账户在暂停期间无法重新购买 Pro 200 美元档。续费付款失败后，如果用户没有在服务提示的时间内恢复付款并导致订阅取消，也会受到同样限制。</p><h2 id="Pro-100-美元与-200-美元档的差别主要在用量"><a href="#Pro-100-美元与-200-美元档的差别主要在用量" class="headerlink" title="Pro 100 美元与 200 美元档的差别主要在用量"></a>Pro 100 美元与 200 美元档的差别主要在用量</h2><p>两档 Pro 套餐包含相同的主要功能，差别是套餐用量：Pro 100 美元档提供 Plus 的 5 倍用量，Pro 200 美元档提供 Plus 的 20 倍用量。暂停期间，Pro 100 美元档是个人用户仍可新购的 Pro 选项。</p><p>GPT-6 Pro 由 GPT-6 Astra 驱动，在两档 Pro 套餐中都可用，但各档的模型用量不同。想了解模型本身而不是订阅变化，可参考 <a href="/posts/2026/09/openai-gpt-6-astra/">GPT-6 Astra 的模型规格、API 价格和上下文窗口</a>。</p><h2 id="取消或降级前先检查计费周期"><a href="#取消或降级前先检查计费周期" class="headerlink" title="取消或降级前先检查计费周期"></a>取消或降级前先检查计费周期</h2><p>现有 Pro 200 美元用户如果需要继续使用该档位，可以在 <code>Settings → My Plan</code> 检查订阅状态。已安排取消或降级的用户，可在当前计费周期结束前撤销。</p><p>如果通过 Apple App Store 或 Google Play 订阅，续费与付款恢复由对应商店处理。通过 chatgpt.com 订阅的用户，在续费失败时会收到与账户关联邮箱的处理说明。</p>]]></content>
    
    
    <summary type="html">OpenAI 暂停 ChatGPT Pro 200 美元套餐的新订阅与升级，现有订阅仍可正常续费，Pro 100 美元套餐继续开放。本文说明取消、降级和续费失败后暂时无法恢复原套餐的影响。</summary>
    
    
    
    <category term="行业观察" scheme="https://51allai.com/categories/%E8%A1%8C%E4%B8%9A%E8%A7%82%E5%AF%9F/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="pricing" scheme="https://51allai.com/tags/pricing/"/>
    
    <category term="openai" scheme="https://51allai.com/tags/openai/"/>
    
    <category term="chatgpt" scheme="https://51allai.com/tags/chatgpt/"/>
    
  </entry>
  
  <entry>
    <title>Google 推出 Gemini Windows 应用，Alt + Space 随时调用</title>
    <link href="https://51allai.com/posts/2026/09/google-gemini-windows-app/"/>
    <id>https://51allai.com/posts/2026/09/google-gemini-windows-app/</id>
    <published>2026-09-10T16:13:50.000Z</published>
    <updated>2026-09-10T16:13:50.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>Google 于 9 月 10 日推出 Gemini Windows 应用，支持 Windows 10 及以上系统和 x64、ARM64 设备。安装后按 <code>Alt + Space</code> 即可从当前工作界面调出 Gemini，并在桌面工作区处理文档、连接 Google 应用、生成图片或进行深度研究。<br><img src="https://images.51allai.com/blog/google-gemini-windows-app-cover_20260911_001732.png" alt="Gemini Windows 应用与 Alt Space 桌面快捷键" fetchpriority="high" decoding="async"></p></blockquote><h2 id="Windows-10-或更高版本即可安装"><a href="#Windows-10-或更高版本即可安装" class="headerlink" title="Windows 10 或更高版本即可安装"></a>Windows 10 或更高版本即可安装</h2><p><a href="https://gemini.google/desktop">Gemini Windows 应用</a>已开放下载，系统要求为 Windows 10 或更高版本，同时支持 x64 和 ARM64 架构。覆盖范围跟随 Gemini 应用现有的语言和国家或地区名单，具体功能会因账号和地区而异。</p><p>Windows 版本补齐了 Gemini 的两套主流桌面入口。Google 在 4 月先推出了 <a href="/posts/2026/04/gemini-macos-swift-client/">Gemini macOS 客户端</a>，要求 Apple Silicon 和 macOS 15；Windows 版本则覆盖更早的 Windows 10，并同时兼容两种处理器架构。</p><p><img src="https://images.51allai.com/blog/%E6%88%AA%E5%B1%8F2026-09-11_00.16.15_20260911_001759.png" alt="Gemini Windows 应用与 Alt Space 桌面快捷键" loading="lazy" decoding="async"></p><h2 id="Alt-Space-从当前工作界面调出-Gemini"><a href="#Alt-Space-从当前工作界面调出-Gemini" class="headerlink" title="Alt + Space 从当前工作界面调出 Gemini"></a>Alt + Space 从当前工作界面调出 Gemini</h2><p>应用运行后，按 <code>Alt + Space</code> 可以直接调出 Gemini，无需先切到浏览器。这个快捷键可以在设置中修改，也可以从 Windows 任务栏或系统托盘打开应用。</p><p>快捷入口适合处理临时任务，例如润色文字、总结长文档、起草消息和整理想法。它的变化不在于新增一个模型，而是把 Gemini 从网页标签页移到桌面常驻入口，减少应用之间的切换。</p><h2 id="桌面工作区保留-Gemini-的完整工具入口"><a href="#桌面工作区保留-Gemini-的完整工具入口" class="headerlink" title="桌面工作区保留 Gemini 的完整工具入口"></a>桌面工作区保留 Gemini 的完整工具入口</h2><p>Windows 应用内有独立的桌面工作区。用户可以连接 Gmail、Google Drive、Docs 和 Calendar，从邮件、文档与日程中查找或汇总信息。连接 Google 应用时，Gemini 会按相应账号与服务的可用范围工作。</p><p>创作工具也进入桌面工作区，包括用 Nano Banana 生成图片、用 Gemini Omni 生成视频，以及使用 Deep Research 执行多步骤资料研究。这些能力集中在同一个客户端内，但各项功能的实际可用性仍取决于 Gemini 对账号和地区的开放范围。</p><h2 id="下载安装后即可设置快捷键"><a href="#下载安装后即可设置快捷键" class="headerlink" title="下载安装后即可设置快捷键"></a>下载安装后即可设置快捷键</h2><p>Windows 10 及以上用户可以从桌面版下载页获取安装程序。完成安装并登录 Google 账号后，可直接使用默认的 <code>Alt + Space</code>，也可以进入设置改成自己的组合键。</p>]]></content>
    
    
    <summary type="html">Google 于 2026 年 9 月 10 日推出 Gemini Windows 应用，支持 Windows 10 及以上系统和 x64、ARM64 设备。本文梳理下载入口、Alt + Space 快捷键、Google 应用连接与桌面工作区功能。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="desktop-agent" scheme="https://51allai.com/tags/desktop-agent/"/>
    
    <category term="google" scheme="https://51allai.com/tags/google/"/>
    
    <category term="gemini-desktop" scheme="https://51allai.com/tags/gemini-desktop/"/>
    
  </entry>
  
  <entry>
    <title>OpenAI 为 ChatGPT Work 推出数据智能体，可生成交互式仪表盘</title>
    <link href="https://51allai.com/posts/2026/09/openai-chatgpt-work-data-agent/"/>
    <id>https://51allai.com/posts/2026/09/openai-chatgpt-work-data-agent/</id>
    <published>2026-09-10T15:12:19.000Z</published>
    <updated>2026-09-10T15:12:19.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>OpenAI 于 2026 年 9 月 10 日为 ChatGPT Work 推出数据智能体。用户可用自然语言查询已授权的企业数据，追问指标变化的原因，再将分析生成可编辑、分享和刷新的交互式仪表盘。<br><img src="https://images.51allai.com/blog/openai-chatgpt-work-data-agent-cover_20260910_232836.png" alt="ChatGPT Work 数据智能体与交互式仪表盘" fetchpriority="high" decoding="async"></p></blockquote><h2 id="从业务问题直接开始分析"><a href="#从业务问题直接开始分析" class="headerlink" title="从业务问题直接开始分析"></a>从业务问题直接开始分析</h2><p>Data 智能体运行在 ChatGPT Work 中，主要处理企业里的产品、运营、销售和财务数据问题。用户可以直接询问“上周活跃用户为什么变化”，让它比较前后时段、查找可能的驱动因素，并继续追问结果。使用过程不要求用户手写数据库查询语句。</p><p>它不只输出一次性回答。分析结果可以转成内置交互式仪表盘，团队成员能够编辑、分享和刷新。用户也可以把品牌规范加入任务，调整图表和页面的视觉样式。</p><p><img src="https://images.51allai.com/blog/%E6%88%AA%E5%B1%8F2026-09-10_23.29.29_2_20260910_233011.png" alt="ChatGPT Work 数据智能体与交互式仪表盘" loading="lazy" decoding="async"></p><h2 id="可连接数据仓库、文档和-BI-工具"><a href="#可连接数据仓库、文档和-BI-工具" class="headerlink" title="可连接数据仓库、文档和 BI 工具"></a>可连接数据仓库、文档和 BI 工具</h2><p>已公布的数据源包括 Amazon Redshift、Datadog、Google BigQuery、ClickHouse、Databricks、MongoDB 和 Snowflake。Google Drive 与 SharePoint 里的文件和文档也能加入分析。</p><p>单有原始表格还不足以准确理解企业指标。Data 智能体还可读取业务术语、指标定义、自定义计算方式和数据间的关系。这些上下文可以来自 Databricks Genie Ontology、dbt、GitHub、Snowflake Horizon 和现有 BI 仪表盘。BI 是商业智能的缩写，这里指企业已有的数据分析和报表系统。</p><p>它还能在 Omni、Oracle BI、Power BI、Sigma、Tableau 和 ThoughtSpot 中创建或操作仪表盘。因此，团队可以保留现有数据平台，通过 ChatGPT Work 用自然语言指挥分析。</p><h2 id="查询继续遵守现有数据权限"><a href="#查询继续遵守现有数据权限" class="headerlink" title="查询继续遵守现有数据权限"></a>查询继续遵守现有数据权限</h2><p>企业管理员决定哪些数据连接可用，以及哪些角色可以使用它们。Data 智能体发出查询时，会执行已连接账号原有的表、行和列级权限。连接并不会让成员越过数据平台已有的访问范围。</p><p>分析完成后，Data 智能体可以通过 Slack 或电子邮件分享结果，也可以通过已连接工具执行用户批准的后续操作。这类写入和对外发送会继续受工作区设置、应用权限与确认机制约束。</p><h2 id="在插件目录安装后使用-Data"><a href="#在插件目录安装后使用-Data" class="headerlink" title="在插件目录安装后使用 @Data"></a>在插件目录安装后使用 @Data</h2><p>具备 ChatGPT Work 访问权限的账号，可以在 Plugins 目录找到 Data，选择“Install plugin”并完成所需的账号连接。之后在对话中输入 <code>@Data</code>，再直接提出业务问题。</p><p>企业管理员也可以从“Workspace settings &gt; Plugins”为团队安装或开放 Data，然后配置 Databricks、Snowflake 等数据源插件及可用角色。在 ChatGPT Work 中运行数据分析任务，会沿用 <a href="/posts/2026/08/openai-plus-codex-five-hour-limit/">ChatGPT Work 与 Codex 共享额度</a> 的用量结构。</p>]]></content>
    
    
    <summary type="html">OpenAI 为 ChatGPT Work 推出数据智能体，可连接企业数据源，用自然语言调查指标变化并生成可编辑、分享和刷新的交互式仪表盘。本文说明连接范围、权限边界与启用步骤。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="ai-agents" scheme="https://51allai.com/tags/ai-agents/"/>
    
    <category term="openai" scheme="https://51allai.com/tags/openai/"/>
    
    <category term="chatgpt" scheme="https://51allai.com/tags/chatgpt/"/>
    
  </entry>
  
  <entry>
    <title>DeepSeek 发布 V4.1 Flash，552B 开源模型支持图像输入</title>
    <link href="https://51allai.com/posts/2026/09/deepseek-v41-flash-open-source-multimodal/"/>
    <id>https://51allai.com/posts/2026/09/deepseek-v41-flash-open-source-multimodal/</id>
    <published>2026-09-10T12:32:02.000Z</published>
    <updated>2026-09-10T12:32:02.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>DeepSeek 于 9 月 10 日正式发布 V4.1 Flash。新模型共有 552B 主干参数，可原生处理文本与图像，已以 MIT 许可开源；API 模型名更换为 <code>deepseek-flash</code>，旧 Flash 模型名暂时保留路由兼容。<br><img src="https://images.51allai.com/blog/deepseek-v41-flash-open-source-multimodal-cover_20260910_204304.png" alt="DeepSeek V4.1 Flash 552B 开源模型与多模态 API" fetchpriority="high" decoding="async"></p></blockquote><h2 id="V4-1-Flash-正式进入-API-与开源仓库"><a href="#V4-1-Flash-正式进入-API-与开源仓库" class="headerlink" title="V4.1 Flash 正式进入 API 与开源仓库"></a>V4.1 Flash 正式进入 API 与开源仓库</h2><p>DeepSeek V4.1 Flash 已从两天的中间版本测试转为正式版。临时模型名 <code>deepseek-v4.1-flash-expires-on-0910</code> 不再是正式入口，开发者应把 <code>model</code> 改为 <code>deepseek-flash</code>，API 基础地址仍是 <code>https://api.deepseek.com</code>。</p><p>模型文件、推理代码、提示词编码实现和评测复现说明已放入 <a href="https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash">DeepSeek-V4.1-Flash 开源仓库</a>。仓库和模型权重均使用 MIT 许可，文件可直接下载。</p><h2 id="552B-参数不会在每个阶段全部激活"><a href="#552B-参数不会在每个阶段全部激活" class="headerlink" title="552B 参数不会在每个阶段全部激活"></a>552B 参数不会在每个阶段全部激活</h2><p>V4.1 Flash 是一个拥有 552B 主干参数的混合专家模型（MoE）。MoE 会在每次计算时只调用部分参数：读取输入时每个 Token 激活 8B 参数，生成输出时激活 16B。</p><p>模型采用 Causal Encoder-Decoder（因果编码器—解码器）结构，由 20 层因果编码器和 20 层解码器组成。它把全局 KV Cache 压缩到每个 Token 890 字节，约为上一代 V4 Flash 的四分之一。KV Cache 是模型为上下文保留的中间数据，这个规格直接决定长对话和智能体任务需要保留多少高速存储。</p><h2 id="deepseek-flash-同时接收文本和图像"><a href="#deepseek-flash-同时接收文本和图像" class="headerlink" title="deepseek-flash 同时接收文本和图像"></a><code>deepseek-flash</code> 同时接收文本和图像</h2><p>正式版把图像理解并入主 Flash API。<code>deepseek-flash</code> 可以接收 JPEG、PNG、GIF 和 WebP 图片，用于描述图片、读取截图文字或分析图表。图片可以用 Base64 内联、公开 URL 或 Files API 的 <code>file_id</code> 三种方式传入。</p><p>API 规格同时保留 1M Token 上下文、最大 384K Token 输出和单账号 2500 并发。它支持 JSON Output、Tool Calls、Responses API 和 Anthropic API；使用 OpenAI 兼容的 Chat Completions 接口时，图片只能放在 <code>user</code> 消息中。</p><h2 id="旧-Flash-模型名只剩兼容路由"><a href="#旧-Flash-模型名只剩兼容路由" class="headerlink" title="旧 Flash 模型名只剩兼容路由"></a>旧 Flash 模型名只剩兼容路由</h2><p>V4 Flash 与 V4 Flash Vision Exp 已下线。为了避免现有应用立即失效，<code>deepseek-v4-flash</code> 和 <code>deepseek-v4-flash-vision-exp</code> 两个旧模型名会暂时路由到 V4.1 Flash，账单按 Flash 价格计算。新接入应直接使用 <code>deepseek-flash</code>，现有项目也可以把模型名放进配置项，避免继续依赖过渡期别名。</p><p>新价格已于 9 月 10 日 12:00 生效：空闲时段每百万 Token 的缓存命中输入、缓存未命中输入和输出分别为 0.02 元、1 元和 4 元，高峰时段价格翻倍。完整的新旧价差和 V4 Pro 过渡路由已在 <a href="/posts/2026/09/deepseek-v41-flash-release-plan/">V4.1 Flash 发布与 API 降价预告</a> 中单独梳理。</p>]]></content>
    
    
    <summary type="html">DeepSeek 正式发布 V4.1 Flash。552B MoE 模型已开源，采用 MIT 许可并原生处理文本和图像；API 统一使用 deepseek-flash，支持 1M 上下文和最大 384K 输出。</summary>
    
    
    
    <category term="大模型" scheme="https://51allai.com/categories/%E5%A4%A7%E6%A8%A1%E5%9E%8B/"/>
    
    
    <category term="model-release" scheme="https://51allai.com/tags/model-release/"/>
    
    <category term="open-source" scheme="https://51allai.com/tags/open-source/"/>
    
    <category term="deepseek" scheme="https://51allai.com/tags/deepseek/"/>
    
    <category term="deepseek-v4" scheme="https://51allai.com/tags/deepseek-v4/"/>
    
    <category term="multimodal" scheme="https://51allai.com/tags/multimodal/"/>
    
  </entry>
  
  <entry>
    <title>豆包搜索 Global 版新增图搜图，可返回相似图与网页结果</title>
    <link href="https://51allai.com/posts/2026/09/doubao-search-visual-search/"/>
    <id>https://51allai.com/posts/2026/09/doubao-search-visual-search/</id>
    <published>2026-09-10T03:27:49.000Z</published>
    <updated>2026-09-10T03:27:49.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>豆包搜索 Global 版在 2026 年 9 月新增图搜图。开发者可以把图片 URL 或 Base64 编码作为查询输入，也可指定图片局部并补充文字提示；返回结果同时包含相关图片和网页级信息。<br><img src="https://images.51allai.com/blog/doubao-search-visual-search-cover_20260910_113248.png" alt="豆包搜索 Global 版图搜图与网页结果" fetchpriority="high" decoding="async"></p></blockquote><h2 id="图片成为豆包搜索的查询输入"><a href="#图片成为豆包搜索的查询输入" class="headerlink" title="图片成为豆包搜索的查询输入"></a>图片成为豆包搜索的查询输入</h2><p>这次更新面向火山引擎豆包搜索 Global 版 API。它不是豆包 App 新增入口的说明，而是给企业和开发者接入搜索能力的接口更新。</p><p>豆包搜索在 7 月开放服务时，已经提供 API、Skill 和 MCP 等接入方式，具体背景可参考<a href="/posts/2026/07/doubao-search-service/">豆包搜索服务开放与接入方式</a>。9 月加入图搜图后，Global 版的查询输入从文字扩展到图片。此前 8 月上线的是“文搜图”，也就是输入文字找图片；这次的“图搜图”直接使用一张图片发起检索。</p><h2 id="支持整图、局部图片和文字辅助检索"><a href="#支持整图、局部图片和文字辅助检索" class="headerlink" title="支持整图、局部图片和文字辅助检索"></a>支持整图、局部图片和文字辅助检索</h2><p>图搜请求需要把 <code>SearchType</code> 设为 <code>visual</code>，并在 <code>ImageQuery</code> 中提供图片。图片可以使用 HTTP 或 HTTPS URL，也可以传入纯 Base64 编码，两种方式必须二选一。</p><p><code>RegionOfInterest</code> 用于指定图片中的矩形区域。开发者可以用 0 到 1 之间的相对坐标设置区域边界，让检索只关注图片的一部分。若不传该字段，系统会使用整张图片。</p><p>文字字段 <code>Query</code> 在图搜模式下可以留空。需要缩小检索方向时，也可以加入不超过 100 个字符的文字提示。例如，商品图片中同时出现人物和服装时，应用可以指定服装区域，再用文字补充要找的对象。</p><table><thead><tr><th>请求字段</th><th>作用</th><th>已确认边界</th></tr></thead><tbody><tr><td><code>SearchType</code></td><td>选择图搜模式</td><td>值为 <code>visual</code></td></tr><tr><td><code>ImageQuery.Url</code></td><td>通过网络地址传图</td><td>与 Base64 二选一</td></tr><tr><td><code>ImageQuery.ImageBase64</code></td><td>直接传图片编码</td><td>不包含 Data URL 前缀</td></tr><tr><td><code>RegionOfInterest</code></td><td>指定检索区域</td><td>不传时使用整图</td></tr><tr><td><code>Query</code></td><td>用文字辅助图片检索</td><td>可留空，最长 100 个字符</td></tr></tbody></table><h2 id="一次返回图片与网页级信息"><a href="#一次返回图片与网页级信息" class="headerlink" title="一次返回图片与网页级信息"></a>一次返回图片与网页级信息</h2><p>图搜结果以 <code>Documents</code> 数组返回。每条结果包含排序位置、网页 URL 和标题；<code>Snippet</code> 中可以同时出现文字片段与图片，图片字段包括宽度、高度、地址和替代文本。结果还可带有文件类型、站点名称和站点图标。</p><p>这套结构让接入方不必只展示一组图片缩略图。应用可以把相似图片与它所在的网页放在一起，保留可点击的页面入口和站点信息；也可以把这些字段继续交给智能体做整理、筛选或溯源。</p><p>单次请求默认返回 10 条结果，最多可设为 20 条。<code>MaxSnippetLength</code> 控制单个摘要片段长度，默认 300，最大 3000。</p><h2 id="通过-Global-版-API-接入"><a href="#通过-Global-版-API-接入" class="headerlink" title="通过 Global 版 API 接入"></a>通过 Global 版 API 接入</h2><p>开发者通过 <code>POST https://open.feedcoopapi.com/search_api/global_search</code> 调用接口，并在请求头中使用 API Key 完成 Bearer 鉴权。Global 版默认限流为账号维度 10 QPS，也就是每秒最多处理 10 次请求；需要更高额度时可提交工单扩容。</p><p>Global 版只支持按量后付费，不支持订阅套餐。每个火山引擎账号每月有 500 次免费联网搜索额度，这部分额度与 Custom 版共用，也不区分搜索类型。图搜图适合先用免费额度验证返回图片、网页字段和业务流程，再决定是否持续接入。</p>]]></content>
    
    
    <summary type="html">豆包搜索 Global 版在 2026 年 9 月新增图搜图：开发者可用图片 URL 或 Base64 发起检索，并获得相似图片、网页标题、URL 与站点信息。本文梳理请求字段、返回结构和调用边界。</summary>
    
    
    
    <category term="智能体" scheme="https://51allai.com/categories/%E6%99%BA%E8%83%BD%E4%BD%93/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="ai-search" scheme="https://51allai.com/tags/ai-search/"/>
    
    <category term="bytedance" scheme="https://51allai.com/tags/bytedance/"/>
    
    <category term="doubao" scheme="https://51allai.com/tags/doubao/"/>
    
    <category term="web-search" scheme="https://51allai.com/tags/web-search/"/>
    
  </entry>
  
  <entry>
    <title>Google 推出 Pics，Docs 与 Slides 可直接修图</title>
    <link href="https://51allai.com/posts/2026/09/google-pics-workspace-image-editor/"/>
    <id>https://51allai.com/posts/2026/09/google-pics-workspace-image-editor/</id>
    <published>2026-09-10T03:11:32.000Z</published>
    <updated>2026-09-10T03:11:32.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>Google 于 2026 年 9 月 1 日正式推出 AI 图像创作与编辑工具 Pics。符合条件的个人与 Workspace 用户可从独立网页进入，也能在 Docs 和 Slides 中直接修改图片；工具支持对象级局部编辑、图中文字修改、多人协作及 2K、4K JPEG 导出。<br><img src="https://images.51allai.com/blog/google-pics-workspace-image-editor-cover-v2_20260910_111903.png" alt="Google Pics 接入 Docs 与 Slides 的 AI 图像编辑工具" fetchpriority="high" decoding="async"></p></blockquote><h2 id="Pics-把生成和局部编辑放进同一画布"><a href="#Pics-把生成和局部编辑放进同一画布" class="headerlink" title="Pics 把生成和局部编辑放进同一画布"></a>Pics 把生成和局部编辑放进同一画布</h2><p><a href="https://pics.new/">Google Pics</a> 是 Google Workspace 的独立图像创作与编辑工具，底层使用 Gemini 的 Nano Banana 图像模型。用户可以输入文字生成新图，也可以从电脑、Google Drive 或 Google Photos 导入已有图片继续修改。电脑与 Drive 支持上传 JPG、PNG、BMP 和 TIFF 文件。</p><p>Pics 会为同一条提示词提供多个生成结果。已有图片还能作为元素或风格参考，例如沿用一张图片的配色。站内此前介绍过 <a href="/posts/2026/02/google-nano-banana-2/">Nano Banana 2 的图像生成与编辑能力</a>；Pics 将这类模型能力封装成面向普通用户和团队的可视化编辑器。</p><h2 id="对象、选区和文字可以分开修改"><a href="#对象、选区和文字可以分开修改" class="headerlink" title="对象、选区和文字可以分开修改"></a>对象、选区和文字可以分开修改</h2><p>编辑图片时，用户可以把提示词作用于整张图，也可以点选具体对象，或拖动框选一个区域后再描述修改要求。一次操作最多可以加入五处对象、选区或文字修改，确认后统一应用。</p><p>Pics 会识别图片里的文字。用户可以直接替换文字内容，也能要求改变字重、斜体等样式。裁剪工具提供旋转和画幅调整，内置选项包括 16:9、1:1 和 4:3。</p><p>这种操作方式适合修改海报、社交媒体图片和演示插图：需要换一个对象时，不必重新生成整张图；需要制作不同语言版本时，可以直接处理图中文字和版式。</p><h2 id="Docs-与-Slides-可以直接打开-Pics-编辑器"><a href="#Docs-与-Slides-可以直接打开-Pics-编辑器" class="headerlink" title="Docs 与 Slides 可以直接打开 Pics 编辑器"></a>Docs 与 Slides 可以直接打开 Pics 编辑器</h2><p>在 Google Docs 或 Slides 中选中图片后，用户可以打开 Pics 编辑器，完成修改后用新结果替换文档或幻灯片里的原图。编辑器运行在当前应用内，不需要先把图片下载到本地再上传。</p><p>Pics 文件沿用 Workspace 的协作方式，可以邀请其他人以查看者或编辑者身份加入，也可以通过链接分享。用户还能在 Drive 中创建或打开 Pics 文件；Google 已安排继续扩展从 Drive 直接打开普通图片并编辑的入口。</p><h2 id="个人与企业账户需要符合指定套餐"><a href="#个人与企业账户需要符合指定套餐" class="headerlink" title="个人与企业账户需要符合指定套餐"></a>个人与企业账户需要符合指定套餐</h2><p>个人账户需要订阅 Google AI Pro 或 Ultra。企业账户支持 Business Standard、Business Plus、Enterprise Standard 和 Enterprise Plus；教育账户支持 Google AI Pro for Education，AI Expanded Access 附加方案也在开放范围内。组织管理员可以按网域、组织部门或群组关闭 Pics。</p><p>功能采用分批开放：快速发布网域从 9 月 1 日开始，最长需要 15 天；计划发布网域从 9 月 15 日开始，最长也需要 15 天。Pics 支持中文生成和编辑，适用范围覆盖支持 Google Workspace 的国家和地区；德国的个人账户不在开放范围内。</p><h2 id="目前只支持桌面端，4K-下载消耗更多额度"><a href="#目前只支持桌面端，4K-下载消耗更多额度" class="headerlink" title="目前只支持桌面端，4K 下载消耗更多额度"></a>目前只支持桌面端，4K 下载消耗更多额度</h2><p>Pics 目前只在桌面端使用。Google 列出的浏览器范围是最新版和前一个版本的 Chrome、Firefox，以及 Windows 上的 Microsoft Edge；其他浏览器可能无法使用全部功能。</p><p>完成图片后，可以下载原始尺寸、2K JPEG 或 4K JPEG，也可以打印或与协作者共享。下载较高分辨率会更快消耗推广期额度。生成式 AI 功能受使用上限约束，Google 为用户提供的较高访问额度至少持续到 2027 年 2 月 28 日；从 Docs 或 Slides 调用 Pics 时，仍沿用这些应用现有的 Nano Banana 图像生成额度。</p>]]></content>
    
    
    <summary type="html">Google 推出 AI 图像创作与编辑工具 Pics，用户可在独立网页、Docs 和 Slides 中生成或修改图片。本文梳理局部编辑、图中文字处理、2K/4K 导出、开放套餐与桌面端限制。</summary>
    
    
    
    <category term="多模态" scheme="https://51allai.com/categories/%E5%A4%9A%E6%A8%A1%E6%80%81/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="image-generation" scheme="https://51allai.com/tags/image-generation/"/>
    
    <category term="google" scheme="https://51allai.com/tags/google/"/>
    
    <category term="gemini" scheme="https://51allai.com/tags/gemini/"/>
    
    <category term="nano-banana" scheme="https://51allai.com/tags/nano-banana/"/>
    
  </entry>
  
  <entry>
    <title>Suno 发布 v6 系列，新增局部编辑与多模态创作</title>
    <link href="https://51allai.com/posts/2026/09/suno-v6-music-models/"/>
    <id>https://51allai.com/posts/2026/09/suno-v6-music-models/</id>
    <published>2026-09-09T15:56:33.000Z</published>
    <updated>2026-09-09T15:56:33.000Z</updated>
    
    <content type="html"><![CDATA[<blockquote><p>Suno 于 9 月 9 日发布 v6、v6-wild 和 v6-mini 三款音乐模型。新系列支持用自然语言修改歌曲局部、组合多首歌曲的元素，并可从文字、音频、图片或视频开始创作；v6-mini 对免费账户开放。<br><img src="https://images.51allai.com/blog/suno-v6-music-models-cover_20260910_000126.png" alt="Suno v6 三款音乐模型与局部编辑和多模态创作" fetchpriority="high" decoding="async"></p></blockquote><h2 id="三款模型对应不同创作方式"><a href="#三款模型对应不同创作方式" class="headerlink" title="三款模型对应不同创作方式"></a>三款模型对应不同创作方式</h2><p>Suno v6 系列由三个模型组成。v6 面向目标较明确的创作和后续精修，v6-wild 用于尝试变化更大的方向，v6-mini 则是所有账户都能使用的入口。</p><table><thead><tr><th>模型</th><th>主要用途</th><th>可用账户</th></tr></thead><tbody><tr><td>v6</td><td>按明确目标生成和精修歌曲</td><td>Pro、Premier</td></tr><tr><td>v6-wild</td><td>探索不同编曲和声音方向</td><td>Pro、Premier</td></tr><tr><td>v6-mini</td><td>日常音乐生成</td><td>包括免费账户在内的所有用户</td></tr></tbody></table><p>当前月付价格为：Free 免费，Pro 每月 10 美元，Premier 每月 30 美元。免费用户可以直接使用 v6-mini；需要使用 v6 或 v6-wild 的用户需订阅 Pro 或 Premier。</p><h2 id="自然语言可以只修改歌曲的一部分"><a href="#自然语言可以只修改歌曲的一部分" class="headerlink" title="自然语言可以只修改歌曲的一部分"></a>自然语言可以只修改歌曲的一部分</h2><p>v6 系列允许用户选中已有歌曲的一段，再用日常语言说明改法。系统可以替换这一段，同时保留歌曲其余部分。例如，用户可以要求改变副歌的演唱方式，也可以只替换歌词中的一个词或一行，不必从头生成整首歌。</p><p>这类局部编辑把“生成”和“修改”放进同一条工作流。用户先得到完整歌曲，再针对不满意的段落继续调整，适合需要反复修改歌词、演唱或编曲细节的创作。</p><h2 id="多首歌曲的元素可以在一次请求中组合"><a href="#多首歌曲的元素可以在一次请求中组合" class="headerlink" title="多首歌曲的元素可以在一次请求中组合"></a>多首歌曲的元素可以在一次请求中组合</h2><p>新系列可以在一次请求中组合多个来源。用户可指定从一首歌取人声、从另一首歌取鼓点，再添加新歌词和风格要求，生成新的混音结果。</p><p>采样处理也进入同一流程。用户可以指定时间点，从歌曲中提取一段乐器素材，再围绕它生成新的节拍。这比先导出音频、在其他软件中切片，再返回生成工具的步骤更短。</p><h2 id="文字、音频、图片和视频都能作为起点"><a href="#文字、音频、图片和视频都能作为起点" class="headerlink" title="文字、音频、图片和视频都能作为起点"></a>文字、音频、图片和视频都能作为起点</h2><p>v6 系列接受文字、音频、图片和视频作为创作输入。用户可以从一句描述、语音备忘录、视觉素材或视频开始，再让模型把这些参考转成音乐。图片和视频在这里提供情绪与氛围参考，并不是把画面直接转换成固定音效。</p><p>如果主要需求是通过 Gemini 或 API 从图文生成歌曲，可以对照阅读 <a href="/posts/2026/09/google-lyria-35-gemini-api/">Google Lyria 3.5 的使用入口与 API 价格</a>。Suno v6 这次更新的重点，是在生成之后继续局部编辑、混音和采样。</p><h2 id="普通用户怎么选"><a href="#普通用户怎么选" class="headerlink" title="普通用户怎么选"></a>普通用户怎么选</h2><p>免费账户先使用 v6-mini，适合从提示词或多模态素材快速开始一首歌。Pro 和 Premier 用户在目标清楚时可选择 v6；需要寻找不同方向时，可先用 v6-wild 生成方案，再把选中的结果交给 v6 继续调整。</p><p>三款模型共用局部编辑、多来源混音、采样与多模态输入能力。选择时先看账户权限，再看任务是精确执行还是探索方向，不需要把三个模型依次使用一遍。</p>]]></content>
    
    
    <summary type="html">Suno 发布 v6、v6-wild 和 v6-mini 三款音乐模型，加入自然语言局部改歌、多来源混音、采样分离及图文音视频生成入口。本文说明三款模型的适用场景、账户范围与当前订阅价格。</summary>
    
    
    
    <category term="多模态" scheme="https://51allai.com/categories/%E5%A4%9A%E6%A8%A1%E6%80%81/"/>
    
    
    <category term="product-update" scheme="https://51allai.com/tags/product-update/"/>
    
    <category term="model-release" scheme="https://51allai.com/tags/model-release/"/>
    
    <category term="audio-generation" scheme="https://51allai.com/tags/audio-generation/"/>
    
    <category term="suno" scheme="https://51allai.com/tags/suno/"/>
    
  </entry>
  
</feed>
