腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。
Hy3 在同类规模中表现最佳,可媲美万亿参数级旗舰模型,适用于多数智能体场景。
量化版可通过 llama.cpp 运行并启用 MTP,大幅降低硬件门槛,实现单 GPU 部署。
模型采用 Apache 2.0 开源协议,支持商用,并提供 2 周免费 API(通过 OpenRouter)。
Tencent Hunyuan a sorti des versions quantifiées 1 et 4 bits de son modèle phare 295B MoE Hy3. HY3 est le meilleur performant parmi ses pairs, rivalisant a...
Tencent Hunyuan a sorti des versions quantifiées 1 et 4 bits de son modèle phare 295B MoE Hy3. HY3
est le meilleur performant parmi ses pairs, rivalisant avec les modèles phares avec des niveaux de trillions de paramètres, adaptés à la plupart des scénarios agents. La version quantitative peut fonctionner llama.cpp et activer le MTP, abaissant significativement le seuil matériel et permettant un déploiement sur un seul GPU. Le modèle utilise le protocole open source Apache 2.0, prend en charge un usage commercial et offre une API gratuite de 2 semaines (via OpenRouter).
腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。
Hy3 在同类规模中表现最佳,可媲美万亿参数级旗舰模型,适用于多数智能体场景。
量化版可通过 llama.cpp 运行并启用 MTP,大幅降低硬件门槛,实现单 GPU 部署。
模型采用 Apache 2.0 开源协议,支持商用,并提供 2 周免费 API(通过 OpenRouter)。
腾讯混元发布 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。发布信息称,量化版可通过 llama.cpp 运行并启用 MTP,从而降低硬件门槛并支持单 GPU 部署。
Hy3 被腾讯混元定位为旗舰级模型。发布方称其在同类规模中表现最佳,可媲美万亿参数级旗舰模型,并适用于多数智能体场景;相关材料未提供具体评测数据或测试条件。
Aioga 判断,此次更新的核心看点是以量化版本扩大模型的本地部署可行性,而非基础模型参数规模本身。性能对比目前仅见发布方表述,仍需结合公开基准与实际任务验证。
该模型采用 Apache 2.0 协议并支持商用,可能降低开发者试用和集成的许可门槛。单 GPU 运行能力也可能扩大可部署环境,但材料未说明所需显存、GPU 型号及量化后的性能损失。 值得关注后续是否公布 1-bit 与 4-bit 版本的显存占用、推理速度、精度变化及评测方法。开发者可在两周免费 API 期内通过 OpenRouter 测试具体任务,再评估本地部署与商用适配。
La source fournit un titre, un résumé, une attribution et un lien original. Aioga ne republie pas l’article intégral.
Canal de collecte: Agrégation de résumés · Domaine source: x.com
Source: X:腾讯混元 (@TencentHunyuan)
Lien original: Ouvrir la source
Archive Aioga: Ouvrir la page de veille
Content record: social-summary · Updated: 2026-07-14T08:53:06.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga agrège l’actualité mondiale de l’IA et conserve les sources pour vérification et citation.