AI Agent
📅 2026-09-22 ⏱️ 12 分钟 Dean Dean

腾讯混元 Hy4 与手机智能体:官方发布事实、模型能力和 Android 执行边界

腾讯混元 Hy4 Preview 已由腾讯官方发布并开源。本文基于官方公告说明 Hy4 的产品体验和 API 入口,并区分模型能力与 Android 手机 Agent 执行。

腾讯混元 Hy4 模型入口与 Android 手机 Agent 执行边界示意
📋 核心要点
  • 腾讯在 2026 年 8 月 28 日发布 Tencent Hunyuan Hy4 Preview 并宣布开源;官方公告称其已进入 WorkBuddy、CodeBuddy 国内版与国际版、元宝和 ima。
  • 官方公告给出的 API 入口包括腾讯云 TokenHub 和 OpenRouter;开源权重、自有产品体验和 API 调用是三类不同使用路径。
  • 腾讯公告将 Hy4 的变化放在更长周期的软件开发理解、步骤安排、调试和验证,复杂办公分析与跨文件处理,以及科学推理等方向;这些属于厂商自述,不是第三方独立评测。
  • Hy4 是模型层能力,不等于 Android 手机上的权限、工具、审批和结果验证;需要手机里出现真实结果时,应另行评估执行运行时。

腾讯混元 Hy4 Preview 发布了哪些具体入口

腾讯混元 Hy4 的准确信息,先看 2026 年 8 月 28 日的官方发布。腾讯在当天发布 Tencent Hunyuan Hy4 Preview,并宣布开源。完整发布事实可见腾讯混元 Hy4 Preview 官方公告

公告给出的可用路径不是一个笼统入口,而是覆盖产品体验、API 调用和开源权重三类方式。根据这份公告,Hy4 Preview 已在腾讯自己的 WorkBuddy、CodeBuddy 国内版与国际版、元宝和 ima 中上线体验;API 访问可通过腾讯云 TokenHub 和 OpenRouter;同时,Hy4 Preview 已开放开源分发。这里的“上线体验”“API 访问”和“开源权重”含义不同,不能混成一个结论。

入口类型官方公告中的具体名称适合谁先看读者要注意什么
产品体验WorkBuddy、CodeBuddy 国内版、CodeBuddy 国际版、元宝、ima想直接感受 Hy4 输出的普通用户或团队可用范围、账号条件和产品形态以各入口实际状态为准
API 调用腾讯云 TokenHub、OpenRouter需要把模型接入应用、工具或服务的开发者计费、地域、速率和模型参数应以对应平台当前文档为准
开源权重Hy4 Preview 开源分发需要研究、部署或按许可探索模型能力的团队部署条件、许可证和推理成本需要单独评估

公告中的两周 Hy4 发布试用属于当时发布信息,不能当作当前长期免费权益。公告中的测试和对比也属于腾讯发布材料中的自述,不是第三方独立基准测试。对实际项目来说,更可靠的做法是结合官方文档、自己的任务样本、延迟、成本、输出稳定性和接入条件来评估。

Hy4 发布说明模型可以从多个路径被体验、调用或部署;它不自动说明 Android 手机上的消息、日历、设置、文件或应用界面已经可以被模型直接操作。模型入口和手机执行层需要分开判断。

Hy4 相比上一代有哪些官方变化

腾讯公告把 Hy4 的变化放在几类具体能力方向上。第一类是更长周期的软件开发任务:公告描述了对软件开发中的理解、步骤安排、调试和验证能力的提升。对开发者来说,这类变化主要影响模型如何理解代码上下文、拆解修复步骤和生成验证思路;它不等于模型已经能直接操作 Android 手机应用。

第二类是复杂办公分析和跨文件处理。公告将 Hy4 与文档、表格、演示等办公场景联系起来,强调跨文件分析和处理能力。读者可以把它理解为模型在输出报告、整理资料、处理表格或生成演示内容时的能力方向;实际效果仍应由自己的文件样本、格式要求和协作流程验证。

第三类是科学推理。公告把科学推理列为 Hy4 强调的方向之一。这说明腾讯希望 Hy4 在更复杂的推理题、分析题或专业问题上发挥作用,但公告中的厂商测试和对比不等于独立评测结论。是否适合某个科研、教育或业务场景,还要结合题目类型、事实核对、推理稳定性和输出可解释性检查。

如果把 Hy4 与 Hy3 放在同一条线上看,重点是代际、开放方式和应用入口。Hy3 作为上一代相关模型,已有自己的公开资料和产品集成背景;需要了解 Hy3 与手机 Agent 的关系,可以回到腾讯混元 Hy3 与手机 Agent:模型能力如何连接 Android 动作。Hy4 的这些变化说明模型层能力方向,不能直接推导出手机执行能力。

Hy4 的产品体验、API 和开源权重怎么区分

根据官方公告,想体验 Hy4 的读者可以先看产品入口:WorkBuddy、CodeBuddy 国内版、CodeBuddy 国际版、元宝和 ima。产品体验入口适合验证模型回答风格、文本生成、代码辅助、资料理解或知识问答体验。它们通常更接近最终用户产品,但也会受到账号、地区、产品版本和具体功能入口影响。

需要把 Hy4 接入自己的应用或工具时,官方公告给出的 API 入口是腾讯云 TokenHub 和 OpenRouter。API 入口适合开发者把模型纳入客服、办公、代码、知识库、内容生成或内部工具。这里要单独评估认证方式、调用限制、上下文长度、价格、日志、数据处理要求和失败恢复。

开源权重是第三条路径。它适合需要研究、私有化部署、模型评估或按开源许可进行二次开发的团队。自托管并不等于更简单:你需要准备算力、推理服务、模型更新、监控、安全边界和成本管理。开源权重提供了更直接的技术探索空间,但也把部署和运维责任交给使用方。

这三类入口都属于模型层。无论通过产品体验、API,还是自托管权重使用 Hy4,都不等于手机系统已经获得新的控制能力。如果你的目标是让 Android 手机完成实际任务,例如写入日历、发送消息、保存备忘、打开应用或修改设置,还需要知道模型接入到哪个手机运行时、有哪些受支持工具、是否具备权限、何时需要用户确认,以及执行后如何验证。

腾讯混元模型家族和相关入口可结合腾讯混元官方模型页面查看;Hy4 的具体发布事实仍建议优先回到 Hy4 Preview 官方公告核对。

Hy4 模型能力和 Android 手机动作要分开看

Hy4 可以承担模型层工作:理解自然语言、生成内容、总结资料、拆解步骤、解释上下文,或作为开发者系统中的推理和生成模块。Android 手机动作则会改变真实设备状态,例如创建日程、发送消息、保存文件、修改系统设置、调用地图、读取屏幕或提交表单。两者之间需要运行时、工具、权限和验证链路。

一个手机任务可以拆成五步。第一步是意图,用户说“把明天上午的客户电话记到日历”。第二步是模型理解,识别日期、时间、对象和动作。第三步是步骤安排,决定需要创建日历事项并补齐标题。第四步是执行,手机侧工具调用日历或系统能力。第五步是验证,用户能在目标日历中看到事件,并确认账号、时间和提醒规则正确。

Hy4 主要影响第二步和第三步。模型越强,越可能把模糊指令拆得更清楚,处理更复杂的上下文,生成更合适的候选内容。但第四步和第五步不由模型自动完成。Android 权限、应用状态、账号归属、用户确认和结果回读,都需要手机侧执行层负责。

这也是为什么“模型强就等于能操作手机”是错误判断。模型可以说出“下一步点击发送”,但真正发送消息需要目标联系人、消息内容、应用权限、确认节点和发送记录。模型可以总结会议行动项,但把行动项写入备忘录或日历,是另一个受权限和工具约束的任务。

如果你要系统理解 Android 手机 Agent 的闭环,可以阅读AI 智能体控制 Android 手机:从自然语言意图到确认、执行和验证。那篇文章处理的是执行架构,本页处理的是 Hy4 模型事实和模型到执行层的边界。

Android 手机 Agent 执行需要哪些条件

在 FoneClaw 中,我们把模型和 Android 执行层分开处理:配置的模型负责理解、推理和拆解任务,FoneClaw 作为独立配置的 Android 手机 Agent 运行时,提供受治理的受支持工具。这个分层让用户能清楚判断:当前任务是模型回答,还是已经进入会改变手机状态的执行步骤。

Android 手机 Agent 执行至少需要四个条件。第一,任务必须在支持范围内,例如屏幕与应用、设备状态、通信、邮件、日历、备忘和任务流程等场景。第二,权限要明确,缺少权限时应进入恢复路径,而不是给出虚假的完成反馈。第三,高影响动作要有适用审批,例如发送、保存、共享、删除、改设置和创建日程。第四,执行后要有可见结果,能够让用户检查目标页面、记录列表、系统状态或工具返回。

FoneClaw 当前以 100+ 内置工具作为公开能力概览,并提供按工具启用和审批控制。工具的作用不是绕过 Android,也不是把模型输出直接变成无条件动作,而是把可执行任务转换为明确参数、权限检查、确认点和结果反馈。当前能力范围可查看FoneClaw 功能页面,安装入口集中在FoneClaw 下载页面

模型选择本身不会建立消费者应用之间的互通,也不会自动形成 Hy4 专属集成。Hy4 可以作为某些系统中的模型能力,用来理解复杂意图和生成步骤;FoneClaw 负责的是 Android 手机上受支持动作的执行边界。读者评估任何组合时,都应分别检查模型、运行时、权限、工具、审批和结果验证。

如果你的系统需要在不同模型之间路由任务,再统一交给 Android 执行层,可以继续看手机智能体模型路由指南:Kimi、DeepSeek、GLM 与 Android 执行怎么选

模型和手机 Agent 栈怎么选

选择 Hy4、Hy3 或 Android 手机 Agent 栈时,先看最终结果是什么。如果你需要的是解释、摘要、代码、客服回复、创意文案、知识问答或开发接入,模型能力本身就是主要评估对象。此时应比较官方入口、API、开源条件、响应稳定性、成本、上下文能力和输出质量。

如果最终结果必须出现在手机里,例如日历新增事件、备忘录保存记录、消息草稿出现在会话、设备状态改变或文件被整理,那么模型只是其中一环。你还需要执行层处理权限、工具、确认、恢复和结果回读。

可以用下面的清单做判断:

  1. 只需要模型输出吗?优先评估 Hy4 的产品体验、API 或开源权重。
  2. 需要真实 Android 状态变化吗?确认是否有手机 Agent 运行时和受支持工具。
  3. 动作是否影响外部对象?发送、共享、删除、提交和改设置都应有确认。
  4. 结果能否回看?日历、备忘、消息、邮件和设置都应有可验证状态。
  5. 是否需要多模型路线?模型可以替换或路由,但执行层仍要统一管理权限和结果。

Hy4 的价值在模型层,手机 Agent 的价值在执行层。正确组合不是找一个万能名称,而是把“理解和生成”交给合适模型,把“手机上真实发生的动作”交给有权限、确认和验证能力的运行时。

常见问题

腾讯混元 Hy4 是腾讯混元模型家族的新一代模型实体。腾讯在 2026 年 8 月 28 日发布 Tencent Hunyuan Hy4 Preview,并宣布开源。官方公告称它已进入 WorkBuddy、CodeBuddy 国内版与国际版、元宝和 ima,并可通过腾讯云 TokenHub 与 OpenRouter 调用。
Hy4 属于模型层,可以用于理解、生成、推理和拆解任务;手机智能体属于执行层,需要 Android 运行时、受支持工具、权限、用户确认和结果验证。模型能力不会自动变成手机操作能力。
Hy4 本身不等于 Android 手机控制器。它可以通过产品、API 或开源权重被应用和开发系统接入;若要在 Android 上创建日历、发送消息、保存备忘或修改设置,还需要手机侧执行层和相应权限。
如果只比较模型生成和推理,应看官方资料、API、开源条件和自己的任务样本。若任务需要手机里真实状态变化,更关键的是执行层是否可靠。Hy3 的历史背景和产品集成可看专门页面。
不等于。强模型可以更好地理解意图和生成步骤,但 Android 手机动作还需要系统权限、应用状态、工具调用、审批节点和执行后验证。没有这些条件,模型输出仍只是回答、草稿或建议。