{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-07-23T07:21:26.498Z","headline":"腾讯混元发布 Hy3 模型 1-bit/4-bit 量化版，单 GPU 可运行","description":"腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。Hy3 在同类规模中表现最佳，可媲美万亿参数级旗舰模型，适用于多数智能体场景。量化版可通过 llama.cpp 运行并启用 MTP，大幅降低硬件门槛，实现单 GPU 部署。模型采用 Apache 2.0 开源协议，支持商用，并提供 2 周免费 API（通过 OpenRouter）。","url":"https://www.aioga.com/news/cmrkfkwum01hvbizs4ggn4u38/","mainEntityOfPage":"https://www.aioga.com/news/cmrkfkwum01hvbizs4ggn4u38/","datePublished":"2026-07-14T08:53:06.000Z","dateModified":"2026-07-14T08:53:06.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://x.com/TencentHunyuan/status/2076953120765280284","https://aihot.virxact.com/items/cmrkfkwum01hvbizs4ggn4u38"],"canonicalUrl":"https://www.aioga.com/news/cmrkfkwum01hvbizs4ggn4u38/","directAnswer":{"@type":"Answer","text":"腾讯混元发布 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。发布信息称，量化版可通过 llama.cpp 运行并启用 MTP，从而降低硬件门槛并支持单 GPU 部署。","url":"https://www.aioga.com/news/cmrkfkwum01hvbizs4ggn4u38/","dateCreated":"2026-07-14T08:53:06.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"X：腾讯混元 (@TencentHunyuan) source article","url":"https://x.com/TencentHunyuan/status/2076953120765280284","datePublished":"2026-07-14T08:53:06.000Z","provider":{"@type":"Organization","name":"X：腾讯混元 (@TencentHunyuan)","url":"https://x.com/TencentHunyuan/status/2076953120765280284"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.virxact.com/items/cmrkfkwum01hvbizs4ggn4u38","datePublished":"2026-07-14T08:53:06.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.virxact.com/items/cmrkfkwum01hvbizs4ggn4u38"}}],"aggregationSource":"X：腾讯混元 (@TencentHunyuan)","originalPublisher":{"name":"X：腾讯混元 (@TencentHunyuan)","url":"https://x.com/TencentHunyuan/status/2076953120765280284"},"article":{"id":"cmrkfkwum01hvbizs4ggn4u38","slug":"cmrkfkwum01hvbizs4ggn4u38","url":"https://www.aioga.com/news/cmrkfkwum01hvbizs4ggn4u38/","title":"腾讯混元发布 Hy3 模型 1-bit/4-bit 量化版，单 GPU 可运行","title_en":"We've just released the 1-bit & 4-bit version of Hy3， a flagship-scale 295B model that can be served…","summary":"腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。Hy3 在同类规模中表现最佳，可媲美万亿参数级旗舰模型，适用于多数智能体场景。量化版可通过 llama.cpp 运行并启用 MTP，大幅降低硬件门槛，实现单 GPU 部署。模型采用 Apache 2.0 开源协议，支持商用，并提供 2 周免费 API（通过 OpenRouter）。","source":"X：腾讯混元 (@TencentHunyuan)","sourceUrl":"https://x.com/TencentHunyuan/status/2076953120765280284","aiHotUrl":"https://aihot.virxact.com/items/cmrkfkwum01hvbizs4ggn4u38","publishedAt":"2026-07-14T08:53:06.000Z","category":"模型更新","score":75,"selected":true,"articleBody":["腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。","Hy3 在同类规模中表现最佳，可媲美万亿参数级旗舰模型，适用于多数智能体场景。","量化版可通过 llama.cpp 运行并启用 MTP，大幅降低硬件门槛，实现单 GPU 部署。","模型采用 Apache 2.0 开源协议，支持商用，并提供 2 周免费 API（通过 OpenRouter）。"],"articleImages":[],"mediaStatus":"none","articleBodyZh":[],"translationStatus":"","bodyOrigin":"social-summary","editorial":{"summary":"腾讯混元发布 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。发布信息称，量化版可通过 llama.cpp 运行并启用 MTP，从而降低硬件门槛并支持单 GPU 部署。","background":"Hy3 被腾讯混元定位为旗舰级模型。发布方称其在同类规模中表现最佳，可媲美万亿参数级旗舰模型，并适用于多数智能体场景；相关材料未提供具体评测数据或测试条件。","viewpoint":"Aioga 判断，此次更新的核心看点是以量化版本扩大模型的本地部署可行性，而非基础模型参数规模本身。性能对比目前仅见发布方表述，仍需结合公开基准与实际任务验证。","implications":"该模型采用 Apache 2.0 协议并支持商用，可能降低开发者试用和集成的许可门槛。单 GPU 运行能力也可能扩大可部署环境，但材料未说明所需显存、GPU 型号及量化后的性能损失。","nextStep":"值得关注后续是否公布 1-bit 与 4-bit 版本的显存占用、推理速度、精度变化及评测方法。开发者可在两周免费 API 期内通过 OpenRouter 测试具体任务，再评估本地部署与商用适配。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-07-22T21:50:53.139Z","sourceHash":"de9af6d190db9b9c","review":{"approved":true,"groundedness":96,"clarity":94,"duplicationRisk":18,"blockingIssues":[],"notes":["“两周免费 API 期内”与来源基本一致，但免费期的起算时间、适用范围及具体条款未见说明，实际测试前宜通过 OpenRouter 确认。","关于本地部署价值和许可门槛的表述使用了“判断”“可能”等限定词，属于与来源事实明确区分的分析观点。"]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","low-source-overlap","no-html","independent-ai-review"]}},"tags":["模型更新","X：腾讯混元 (@TencentHunyuan)"],"translations":{"zh-CN":{"title":"腾讯混元发布 Hy3 模型 1-bit/4-bit 量化版，单 GPU 可运行","summary":"腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。Hy3 在同类规模中表现最佳，可媲美万亿参数级旗舰模型，适用于多数智能体场景。量化版可通过 llama.cpp 运行并启用 MTP，大幅降低硬件门槛，实现单 GPU 部署。模型采用 Apache 2.0 开源协议，支持商用，并提供 2 周免费 API（通过 OpenRouter）。","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"腾讯混元发布 Hy3 模型 1-bit/4-bit 量化版，单 GPU 可运行 - Aioga AI资讯","description":"腾讯混元发布旗舰级 295B MoE 模型 Hy3 的 1-bit 与 4-bit 量化版本。Hy3 在同类规模中表现最佳，可媲美万亿参数级旗舰模型，适用于多数智能体场景。量化版可通过 llama.cpp 运行并启用 MTP，大幅降低硬件门槛，实现单 GPU 部署。模型采用 Apache 2.0 开源协议，支持商用，并提供 2 周免费 API（通过 Open","url":"https://www.aioga.com/news/cmrkfkwum01hvbizs4ggn4u38/"},"en":{"title":"Tencent Hunyuan has released 1-bit/4-bit quantized versions of the Hy3 model, which can run on a single GPU","summary":"Tencent Hunyuan has released 1-bit and 4-bit quantized versions of its flagship 295B MoE model Hy3. HY3 performs best among its peers, rivaling flagship models with trillion-parameter levels, suitable for most agent scenarios. The quant version can run llama.cpp and enable MTP, significantly lowering the hardware threshold and enabling single-GPU deployment. The model uses the open-source Apache 2.0 protocol, supports commercial use, and offers a 2-week free API (via OpenRouter).","category":"Models","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan has released 1-bit/4-bit quantized versions of the Hy3 model, which can run on a single GPU - Aioga AI News","description":"Tencent Hunyuan has released 1-bit and 4-bit quantized versions of its flagship 295B MoE model Hy3. HY3 performs best among its peers, rivaling flagship models with trillion-parame","url":"https://www.aioga.com/en/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:04.641Z"},"ja":{"title":"騰訊鴻源は、1台のGPUで動作可能なHy3モデルの1ビット/4ビット量子化版をリリースしました","summary":"騰訊渾源は、旗艦モデル295B MoEモデルHy3の1ビットおよび4ビット量子化版を発売しました。 HY3は、1兆パラメータレベルのフラッグシップモデルと競合し、ほとんどのエージェントシナリオに適した性能を発揮しています。 クオンツバージョンはllama.cpp実行しMTPを有効にし、ハードウェアの閾値を大幅に下げ、単一GPU展開を可能にします。 このモデルはオープンソースのApache 2.0プロトコルを使用し、商用利用をサポートし、2週間の無料API(OpenRouter経由)を提供しています。","category":"モデル更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"騰訊鴻源は、1台のGPUで動作可能なHy3モデルの1ビット/4ビット量子化版をリリースしました - Aioga AIニュース","description":"騰訊渾源は、旗艦モデル295B MoEモデルHy3の1ビットおよび4ビット量子化版を発売しました。 HY3は、1兆パラメータレベルのフラッグシップモデルと競合し、ほとんどのエージェントシナリオに適した性能を発揮しています。 クオンツバージョンはllama.cpp実行しMTPを有効にし、ハードウェアの閾値を大幅に下げ、単一GPU展開を可能にします。 このモデル","url":"https://www.aioga.com/ja/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:04.798Z"},"ko":{"title":"텐센트 훈위안은 단일 GPU에서 실행할 수 있는 Hy3 모델의 1비트/4비트 양자 버전 버전을 출시했습니다","summary":"텐센트 훈위안은 자사의 플래그십 295B MoE 모델 Hy3의 1비트 및 4비트 양자화 버전을 출시했습니다. HY3는 동급 모델들 중 가장 우수한 성능을 보이며, 대부분의 에이전트 시나리오에 적합한 수조 매개변수 레벨을 가진 대표 모델들과 경쟁합니다. 정량 버전은 llama.cpp 실행하고 MTP를 활성화하여 하드웨어 임계값을 크게 낮추고 단일 GPU 배포를 가능하게 합니다. 이 모델은 오픈소스 Apache 2.0 프로토콜을 사용하며, 상업적 사용을 지원하고, 2주간 무료 API(OpenRouter를 통해)를 제공합니다.","category":"모델 업데이트","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"텐센트 훈위안은 단일 GPU에서 실행할 수 있는 Hy3 모델의 1비트/4비트 양자 버전 버전을 출시했습니다 - Aioga AI 뉴스","description":"텐센트 훈위안은 자사의 플래그십 295B MoE 모델 Hy3의 1비트 및 4비트 양자화 버전을 출시했습니다. HY3는 동급 모델들 중 가장 우수한 성능을 보이며, 대부분의 에이전트 시나리오에 적합한 수조 매개변수 레벨을 가진 대표 모델들과 경쟁합니다. 정량 버전은 llama.cpp 실행하고 MTP를 활성화하여 하드웨어 임","url":"https://www.aioga.com/ko/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:04.709Z"},"es":{"title":"Tencent Hunyuan ha lanzado versiones cuantizadas de 1 bit/4 bits del modelo Hy3, que pueden funcionar en una sola GPU","summary":"Tencent Hunyuan ha lanzado versiones cuantizadas de 1 y 4 bits de su modelo insignia 295B MoE Hy3. HY3 rinde mejor entre sus pares, rivalizando con modelos insignia con niveles de un billón de parámetros, adecuados para la mayoría de los escenarios de agentes. La versión cuantitativa puede ejecutar llama.cpp y habilitar MTP, reduciendo significativamente el umbral de hardware y permitiendo el despliegue con una sola GPU. El modelo utiliza el protocolo de código abierto Apache 2.0, soporta uso comercial y ofrece una API gratuita de 2 semanas (a través de OpenRouter).","category":"Modelos","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan ha lanzado versiones cuantizadas de 1 bit/4 bits del modelo Hy3, que pueden funcionar en una sola GPU - Aioga Noticias de IA","description":"Tencent Hunyuan ha lanzado versiones cuantizadas de 1 y 4 bits de su modelo insignia 295B MoE Hy3. HY3 rinde mejor entre sus pares, rivalizando con modelos insignia con niveles de ","url":"https://www.aioga.com/es/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:04.880Z"},"fr":{"title":"Tencent Hunyuan a sorti des versions quantisées 1 bit/4 bits du modèle Hy3, qui peuvent fonctionner sur un seul GPU","summary":"Tencent Hunyuan a sorti des versions quantifiées 1 et 4 bits de son modèle phare 295B MoE Hy3. HY3 est le meilleur performant parmi ses pairs, rivalisant avec les modèles phares avec des niveaux de trillions de paramètres, adaptés à la plupart des scénarios agents. La version quantitative peut fonctionner llama.cpp et activer le MTP, abaissant significativement le seuil matériel et permettant un déploiement sur un seul GPU. Le modèle utilise le protocole open source Apache 2.0, prend en charge un usage commercial et offre une API gratuite de 2 semaines (via OpenRouter).","category":"Modèles","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan a sorti des versions quantisées 1 bit/4 bits du modèle Hy3, qui peuvent fonctionner sur un seul GPU - Aioga Actualités IA","description":"Tencent Hunyuan a sorti des versions quantifiées 1 et 4 bits de son modèle phare 295B MoE Hy3. HY3 est le meilleur performant parmi ses pairs, rivalisant avec les modèles phares av","url":"https://www.aioga.com/fr/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:04.834Z"},"de":{"title":"Tencent Hunyuan hat 1-Bit/4-Bit-quantisierte Versionen des Hy3-Modells veröffentlicht, die auf einer einzigen GPU laufen können","summary":"Tencent Hunyuan hat 1-Bit- und 4-Bit-quantisierte Versionen seines Flaggschiffs 295B MoE Modell Hy3 veröffentlicht. HY3 schneidet unter seinen Konkurrenten am besten ab und konkurriert mit Flaggschiffmodellen mit Billionen-Parameter-Leveln, die für die meisten Agentenszenarien geeignet sind. Die Quant-Version kann llama.cpp ausführen und MTP aktivieren, wodurch die Hardware-Schwelle deutlich gesenkt wird und eine Single-GPU-Bereitstellung ermöglicht wird. Das Modell verwendet das Open-Source-Protokoll Apache 2.0, unterstützt kommerzielle Nutzung und bietet eine zweiwöchige kostenlose API (über OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan hat 1-Bit/4-Bit-quantisierte Versionen des Hy3-Modells veröffentlicht, die auf einer einzigen GPU laufen können - Aioga KI-News","description":"Tencent Hunyuan hat 1-Bit- und 4-Bit-quantisierte Versionen seines Flaggschiffs 295B MoE Modell Hy3 veröffentlicht. HY3 schneidet unter seinen Konkurrenten am besten ab und konkurr","url":"https://www.aioga.com/de/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:11.141Z"},"pt-BR":{"title":"A Tencent Hunyuan lançou versões quantizadas de 1 bit/4 bits do modelo Hy3, que podem rodar em uma única GPU","summary":"A Tencent Hunyuan lançou versões quantizadas de 1 e 4 bits de seu modelo topo de linha 295B MoE Hy3. O HY3 tem melhor desempenho entre seus pares, rivalizando com modelos topo de linha com níveis de trilhões de parâmetros, adequados para a maioria dos cenários de agentes. A versão quantitativa pode rodar llama.cpp e ativar o MTP, reduzindo significativamente o limite de hardware e permitindo a implantação de uma única GPU. O modelo utiliza o protocolo open-source Apache 2.0, suporta uso comercial e oferece uma API gratuita de 2 semanas (via OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"A Tencent Hunyuan lançou versões quantizadas de 1 bit/4 bits do modelo Hy3, que podem rodar em uma única GPU - Aioga Notícias de IA","description":"A Tencent Hunyuan lançou versões quantizadas de 1 e 4 bits de seu modelo topo de linha 295B MoE Hy3. O HY3 tem melhor desempenho entre seus pares, rivalizando com modelos topo de l","url":"https://www.aioga.com/pt-BR/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:09.314Z"},"ru":{"title":"Tencent Hunyuan выпустила 1-битные/4-битные квантизированные версии модели Hy3, которые могут работать на одном GPU","summary":"Tencent Hunyuan выпустила 1- и 4-битные квантизированные версии своей флагманской модели 295B MoE Hy3. HY3 показывает лучшие результаты среди своих конкурентов, конкурируя с флагманскими моделями с уровнем триллионного параметра, подходящими для большинства сценариев с агентами. Квантовая версия может запускать llama.cpp и включать MTP, значительно снижая аппаратный порог и позволяя развёртывать одну GPU. Модель использует открытый протокол Apache 2.0, поддерживает коммерческое использование и предлагает двухнедельный бесплатный API (через OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan выпустила 1-битные/4-битные квантизированные версии модели Hy3, которые могут работать на одном GPU - Aioga Новости ИИ","description":"Tencent Hunyuan выпустила 1- и 4-битные квантизированные версии своей флагманской модели 295B MoE Hy3. HY3 показывает лучшие результаты среди своих конкурентов, конкурируя с флагма","url":"https://www.aioga.com/ru/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:10.005Z"},"ar":{"title":"أصدرت شركة تينسنت هونيوان نسخا كمومية بنظام 1-بت/4-بت من نموذج Hy3، والتي يمكن تشغيلها على وحدة معالجة رسومات واحدة","summary":"أصدرت تينسنت هونيوان نسخا كمومية بنظام 1-بت و4-بت من طرازها الرائد 295B MoE Hy3. تقدم HY3 أفضل أداء بين نظرائها، حيث تنافس النماذج الرائدة ذات مستويات تريليون معاملات، وهي مناسبة لمعظم سيناريوهات الوكلاء. يمكن للنسخة الكمية تشغيل llama.cpp وتمكين MTP، مما يقلل بشكل كبير من عتبة الأجهزة ويتيح نشر وحدة معالجة رسومات واحدة. يستخدم النموذج بروتوكول Apache 2.0 مفتوح المصدر، ويدعم الاستخدام التجاري، ويقدم واجهة برمجة تطبيقات مجانية لمدة أسبوعين (عبر OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"أصدرت شركة تينسنت هونيوان نسخا كمومية بنظام 1-بت/4-بت من نموذج Hy3، والتي يمكن تشغيلها على وحدة معالجة رسومات واحدة - Aioga أخبار الذكاء الاصطناعي","description":"أصدرت تينسنت هونيوان نسخا كمومية بنظام 1-بت و4-بت من طرازها الرائد 295B MoE Hy3. تقدم HY3 أفضل أداء بين نظرائها، حيث تنافس النماذج الرائدة ذات مستويات تريليون معاملات، وهي مناسبة ل","url":"https://www.aioga.com/ar/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:10.899Z"},"hi":{"title":"Tencent Hunyuan ने Hy1 मॉडल के 4-बिट/4-बिट मात्रात्मक संस्करण जारी किए हैं, जो एकल GPU पर चल सकते हैं","summary":"Tencent Hunyuan ने अपने प्रमुख 1B MoE मॉडल Hy4 के 3-बिट और 3-बिट मात्रात्मक संस्करण जारी किए हैं। HY3 अपने साथियों के बीच सबसे अच्छा प्रदर्शन करता है, ट्रिलियन-पैरामीटर स्तरों के साथ फ्लैगशिप मॉडल को टक्कर देता है, जो अधिकांश एजेंट परिदृश्यों के लिए उपयुक्त है। क्वांट संस्करण llama.cpp चला सकता है और एमटीपी को सक्षम कर सकता है, हार्डवेयर सीमा को काफी कम कर सकता है और एकल-जीपीयू परिनियोजन को सक्षम कर सकता है। मॉडल ओपन-सोर्स अपाचे 2.0 प्रोटोकॉल का उपयोग करता है, व्यावसायिक उपयोग का समर्थन करता है, और 2-सप्ताह का मुफ्त एपीआई (ओपनराउटर के माध्यम से) प्रदान करता है।","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan ने Hy1 मॉडल के 4-बिट/4-बिट मात्रात्मक संस्करण जारी किए हैं, जो एकल GPU पर चल सकते हैं - Aioga AI समाचार","description":"Tencent Hunyuan ने अपने प्रमुख 1B MoE मॉडल Hy4 के 3-बिट और 3-बिट मात्रात्मक संस्करण जारी किए हैं। HY3 अपने साथियों के बीच सबसे अच्छा प्रदर्शन करता है, ट्रिलियन-पैरामीटर स्तरों के स","url":"https://www.aioga.com/hi/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:12.241Z"},"it":{"title":"Tencent Hunyuan ha rilasciato versioni quantizzate a 1 bit/4 bit del modello Hy3, che possono funzionare su una singola GPU","summary":"Tencent Hunyuan ha rilasciato versioni quantizzate a 1 e 4 bit del suo modello di punta MoE 295B Hy3. HY3 si svolge meglio tra i suoi pari, rivaleggiando con i modelli di punta con livelli di un trilione di parametri, adatti alla maggior parte degli scenari agente. La versione quantitativa può eseguire llama.cpp e abilitare MTP, abbassando significativamente la soglia hardware e consentendo il deployment su una sola GPU. Il modello utilizza il protocollo open-source Apache 2.0, supporta l'uso commerciale e offre un'API gratuita di 2 settimane (tramite OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan ha rilasciato versioni quantizzate a 1 bit/4 bit del modello Hy3, che possono funzionare su una singola GPU - Aioga Notizie IA","description":"Tencent Hunyuan ha rilasciato versioni quantizzate a 1 e 4 bit del suo modello di punta MoE 295B Hy3. HY3 si svolge meglio tra i suoi pari, rivaleggiando con i modelli di punta con","url":"https://www.aioga.com/it/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:09.986Z"},"nl":{"title":"Tencent Hunyuan heeft 1-bit/4-bit gekwantiseerde versies van het Hy3-model uitgebracht, die op één enkele GPU kunnen draaien","summary":"Tencent Hunyuan heeft 1-bit en 4-bit gekwantiseerde versies van zijn vlaggenschip 295B MoE model Hy3 uitgebracht. HY3 presteert het beste onder zijn concurrenten en kan concurreren met vlaggenschipmodellen met biljoen-parameterniveaus, geschikt voor de meeste agentscenario's. De quant-versie kan llama.cpp draaien en MTP inschakelen, waardoor de hardwaredrempel aanzienlijk verlaagd wordt en single-GPU wordt uitgezet. Het model gebruikt het open-source Apache 2.0-protocol, ondersteunt commercieel gebruik en biedt een gratis API van twee weken (via OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan heeft 1-bit/4-bit gekwantiseerde versies van het Hy3-model uitgebracht, die op één enkele GPU kunnen draaien - Aioga AI-nieuws","description":"Tencent Hunyuan heeft 1-bit en 4-bit gekwantiseerde versies van zijn vlaggenschip 295B MoE model Hy3 uitgebracht. HY3 presteert het beste onder zijn concurrenten en kan concurreren","url":"https://www.aioga.com/nl/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:09.519Z"},"tr":{"title":"Tencent Hunyuan, tek bir GPU üzerinde çalışabilen Hy3 modelinin 1-bit/4-bit kuantize edilmiş versiyonlarını piyasaya sürdü","summary":"Tencent Hunyuan, amiral gemisi 295B MoE modeli Hy3'ün 1-bit ve 4-bit kuantize versiyonlarını piyasaya sürdü. HY3, çoğu ajan senaryosu için uygun trilyon parametre seviyelerine sahip amiral gemisi modellerle rekabet ederek rakipleri arasında en iyi performans sergiliyor. Quant versiyonu llama.cpp çalıştırabilir ve MTP'yi etkinleştirebilir, bu da donanım eşiğini önemli ölçüde düşürür ve tek GPU dağıtımını mümkün kılar. Model, açık kaynak Apache 2.0 protokolünü kullanır, ticari kullanımı destekler ve OpenRouter üzerinden 2 haftalık ücretsiz API sunar.","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan, tek bir GPU üzerinde çalışabilen Hy3 modelinin 1-bit/4-bit kuantize edilmiş versiyonlarını piyasaya sürdü - Aioga AI Haberleri","description":"Tencent Hunyuan, amiral gemisi 295B MoE modeli Hy3'ün 1-bit ve 4-bit kuantize versiyonlarını piyasaya sürdü. HY3, çoğu ajan senaryosu için uygun trilyon parametre seviyelerine sahi","url":"https://www.aioga.com/tr/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:11.879Z"},"vi":{"title":"Tencent Hunyuan đã phát hành các phiên bản lượng tử hóa 1-bit/4-bit của mô hình Hy3, có thể chạy trên một GPU duy nhất","summary":"Tencent Hunyuan đã phát hành các phiên bản lượng tử hóa 1-bit và 4-bit của mẫu 295B MoE hàng đầu Hy3. HY3 hoạt động tốt nhất trong số các đồng nghiệp của nó, cạnh tranh với các mẫu hàng đầu với mức thông số nghìn tỷ, phù hợp với hầu hết các tình huống của đại lý. Phiên bản định lượng có thể chạy llama.cpp và kích hoạt MTP, giảm đáng kể ngưỡng phần cứng và cho phép triển khai GPU đơn. Mô hình này sử dụng giao thức Apache 2.0 mã nguồn mở, hỗ trợ sử dụng thương mại và cung cấp API miễn phí 2 tuần (thông qua OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan đã phát hành các phiên bản lượng tử hóa 1-bit/4-bit của mô hình Hy3, có thể chạy trên một GPU duy nhất - Tin tức AI Aioga","description":"Tencent Hunyuan đã phát hành các phiên bản lượng tử hóa 1-bit và 4-bit của mẫu 295B MoE hàng đầu Hy3. HY3 hoạt động tốt nhất trong số các đồng nghiệp của nó, cạnh tranh với các mẫu","url":"https://www.aioga.com/vi/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:11.438Z"},"id":{"title":"Tencent Hunyuan telah merilis versi kuantisasi 1-bit/4-bit dari model Hy3, yang dapat berjalan pada satu GPU","summary":"Tencent Hunyuan telah merilis versi kuantisasi 1-bit dan 4-bit dari model 295B MoE andalannya Hy3. HY3 berkinerja terbaik di antara rekan-rekannya, menyaingi model unggulan dengan tingkat triliunan parameter, cocok untuk sebagian besar skenario agen. Versi kuantitatif dapat menjalankan llama.cpp dan mengaktifkan MTP, secara signifikan menurunkan ambang batas perangkat keras dan memungkinkan penyebaran GPU tunggal. Model ini menggunakan protokol Apache 2.0 sumber terbuka, mendukung penggunaan komersial, dan menawarkan API gratis selama 2 minggu (melalui OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan telah merilis versi kuantisasi 1-bit/4-bit dari model Hy3, yang dapat berjalan pada satu GPU - Berita AI Aioga","description":"Tencent Hunyuan telah merilis versi kuantisasi 1-bit dan 4-bit dari model 295B MoE andalannya Hy3. HY3 berkinerja terbaik di antara rekan-rekannya, menyaingi model unggulan dengan ","url":"https://www.aioga.com/id/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:09.285Z"},"th":{"title":"Tencent Hunyuan ได้เปิดตัวรุ่น Hy3 เวอร์ชันเชิงปริมาณ 1 บิต/4 บิต ซึ่งสามารถทํางานบน GPU ตัวเดียวได้","summary":"Tencent Hunyuan ได้เปิดตัวรุ่น 295B MoE รุ่น Hy3 รุ่นเรือธง 1 บิตและ 4 บิต HY3 ทํางานได้ดีที่สุดในบรรดารุ่นเรือธงที่มีระดับล้านล้านพารามิเตอร์เหมาะสําหรับสถานการณ์ตัวแทนส่วนใหญ่ เวอร์ชัน quant สามารถเรียกใช้ llama.cpp และเปิดใช้งาน MTP ซึ่งช่วยลดเกณฑ์ฮาร์ดแวร์ลงอย่างมากและเปิดใช้งานการปรับใช้ GPU เดี่ยว โมเดลนี้ใช้โปรโตคอล Apache 2.0 แบบโอเพ่นซอร์ส รองรับการใช้งานเชิงพาณิชย์ และเสนอ API ฟรี 2 สัปดาห์ (ผ่าน OpenRouter)","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan ได้เปิดตัวรุ่น Hy3 เวอร์ชันเชิงปริมาณ 1 บิต/4 บิต ซึ่งสามารถทํางานบน GPU ตัวเดียวได้ - ข่าว AI Aioga","description":"Tencent Hunyuan ได้เปิดตัวรุ่น 295B MoE รุ่น Hy3 รุ่นเรือธง 1 บิตและ 4 บิต HY3 ทํางานได้ดีที่สุดในบรรดารุ่นเรือธงที่มีระดับล้านล้านพารามิเตอร์เหมาะสําหรับสถานการณ์ตัวแทนส่วนใหญ่ เว","url":"https://www.aioga.com/th/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:12.287Z"},"pl":{"title":"Tencent Hunyuan wypuścił 1-bitowe/4-bitowe kwantyzowane wersje modelu Hy3, które mogą działać na jednym GPU","summary":"Tencent Hunyuan wypuścił wersje kwantyzowane 1 i 4 bitowe swojego flagowego modelu 295B MoE Hy3. HY3 radzi sobie najlepiej wśród swoich konkurentów, rywalizując z flagowymi modelami o poziomach biliona parametrów, odpowiednich dla większości scenariuszy agentów. Wersja quant może uruchamiać llama.cpp i włączać MTP, co znacząco obniża próg sprzętowy i umożliwia wdrożenie pojedynczej karty graficznej. Model wykorzystuje otwarty protokół Apache 2.0, obsługuje komercyjne zastosowania i oferuje 2-tygodniowe bezpłatne API (za pośrednictwem OpenRouter).","category":"模型更新","source":"X：腾讯混元 (@TencentHunyuan)","pageTitle":"Tencent Hunyuan wypuścił 1-bitowe/4-bitowe kwantyzowane wersje modelu Hy3, które mogą działać na jednym GPU - Aioga Wiadomości AI","description":"Tencent Hunyuan wypuścił wersje kwantyzowane 1 i 4 bitowe swojego flagowego modelu 295B MoE Hy3. HY3 radzi sobie najlepiej wśród swoich konkurentów, rywalizując z flagowymi modelam","url":"https://www.aioga.com/pl/news/cmrkfkwum01hvbizs4ggn4u38/","contentTranslated":true,"sourceHash":"bc2353aea744de25","translatedAt":"2026-07-19T12:15:11.730Z"}}}}