腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。
Hy3 在同类规模中表现最佳,可媲美万亿参数级旗舰模型,适用于多数智能体场景。
量化版可通过 llama.cpp 运行并启用 MTP,大幅降低硬件门槛,实现单 GPU 部署。
模型采用 Apache 2.0 开源协议,支持商用,并提供 2 周免费 API(通过 OpenRouter)。
텐센트 훈위안은 자사의 플래그십 295B MoE 모델 Hy3의 1비트 및 4비트 양자화 버전을 출시했습니다. HY3는 동급 모델들 중 가장 우수한 성능을 보이며, 대부분의 에이전트 시나리오에 적합한 수조 매개변수 레벨을 가진 대표 모델들과 경쟁합니다. 정량 버전은 llama.c...
텐센트 훈위안은 자사의 플래그십 295B MoE 모델 Hy3의 1비트 및 4비트 양자화 버전을 출시했습니다. HY3는 동급 모델들 중 가장 우수한 성능을 보이며, 대부분의 에이전트
시나리오에 적합한 수조 매개변수 레벨을 가진 대표 모델들과 경쟁합니다. 정량 버전은 llama.cpp 실행하고 MTP를 활성화하여 하드웨어 임계값을 크게 낮추고 단일 GPU 배포를 가능하게 합니다. 이 모델은 오픈소스 Apache 2.0 프로토콜을 사용하며, 상업적 사용을 지원하고, 2주간 무료 API(OpenRouter를 통해)를 제공합니다.
腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。
Hy3 在同类规模中表现最佳,可媲美万亿参数级旗舰模型,适用于多数智能体场景。
量化版可通过 llama.cpp 运行并启用 MTP,大幅降低硬件门槛,实现单 GPU 部署。
模型采用 Apache 2.0 开源协议,支持商用,并提供 2 周免费 API(通过 OpenRouter)。
腾讯混元发布 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。发布信息称,量化版可通过 llama.cpp 运行并启用 MTP,从而降低硬件门槛并支持单 GPU 部署。
Hy3 被腾讯混元定位为旗舰级模型。发布方称其在同类规模中表现最佳,可媲美万亿参数级旗舰模型,并适用于多数智能体场景;相关材料未提供具体评测数据或测试条件。
Aioga 判断,此次更新的核心看点是以量化版本扩大模型的本地部署可行性,而非基础模型参数规模本身。性能对比目前仅见发布方表述,仍需结合公开基准与实际任务验证。
该模型采用 Apache 2.0 协议并支持商用,可能降低开发者试用和集成的许可门槛。单 GPU 运行能力也可能扩大可部署环境,但材料未说明所需显存、GPU 型号及量化后的性能损失。 值得关注后续是否公布 1-bit 与 4-bit 版本的显存占用、推理速度、精度变化及评测方法。开发者可在两周免费 API 期内通过 OpenRouter 测试具体任务,再评估本地部署与商用适配。
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.
수집 채널: 요약 집계 · 원본 도메인: x.com
출처: X:腾讯混元 (@TencentHunyuan)
원문 링크: 원문 열기
Aioga 아카이브: 정보 페이지 보기
Content record: social-summary · Updated: 2026-07-14T08:53:06.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga는 전 세계 AI 동향을 집계하고 확인과 인용을 위해 출처 정보를 보존합니다.