模型动态
模型动态
Hy4 preview 轻量版 腾讯混元开源的Hy4量化压缩模型
Hy4 preview 轻量版是腾讯混元将原本 1.5TB 的 Hy4 preview 开源大模型,通过自研 Sherry 1.25bit 稀疏量化与 MIX-STQ1_0 逐层混合精度技术,压缩至约 214GB 的版本。
2026-09-02
模型动态
Fusion Model FUMO Lab 推出的智能分配模型
Fusion Model 是 FUMO Lab 推出的智能分配模型。模型能根据不断演化的任务状态,动态将计算需求分配给最适合的异构模型,实现
2026-09-02
模型动态
Zing-0.5 Loopit 开源的实时交互视频世界模型
Zing-0.5 是 Loopit 开源的实时交互视频世界模型,5B 参数,基座为 Wan2.2-TI2V-5B,采用 Apache 2.0 协议。核心能力是
2026-08-29
模型动态
Gemini Omni 1.1 Flash 谷歌推出的 AI 视频生成模型
Gemini Omni 1.1 Flash 是谷歌推出的 AI 视频生成模型,面向开发者和专业创作者,支持从 360p 快速预览到 4K 超高清的多档位输出。
2026-08-28
模型动态
Hy4 preview 腾讯混元开源的新一代旗舰大模型
Hy4 preview 是腾讯混元推出的开源旗舰大模型,总参数 770B、激活参数 49B、上下文长度达 1M。模型通过与腾讯内部软工、游戏、金融、安全等领域专家深度共建,模型在代码开发、办公分析、游戏制作、科学研究等真实生产力任务上表现卓越。
2026-08-28
模型动态
Hy-MT2-1.8B 腾讯混元推出的端侧翻译大模型
Hy-MT2-1.8B 是腾讯混元推出的端侧翻译大模型,仅 1.8B 参数却支持 33 个语种互译,翻译质量在 FLORES-200 等基准上超越微软、豆包等商业 API。
2026-08-27
模型动态
Gemini 3.5 Transcribe 谷歌推出的最新语音转文本模型
Gemini 3.5 Transcribe 是 Google 推出的最新语音转文本模型,支持实时流式和预录音频处理两种模式,前者通过 Live API 实现亚秒级延迟,后者支持说话人归属与词级时间戳。
2026-08-27
模型动态
Qwen3.8-Flash 阿里通义推出的多模态 MoE 模型
Qwen3.8-Flash 是阿里云通义千问推出的多模态 MoE 模型,总参数量 125B,每 token 仅激活 6B,原生支持 262K 上下文。
2026-08-27
模型动态
GLM-5.3-Flash 智谱开源的原生多模态模型
GLM-5.3-Flash 是智谱最新推出的开源大模型,总参数三百二十亿,激活参数仅十八亿,为 GLM-5 系列首个原生多模态模型。模型综合智能指数达五十七分,与 Claude Opus 4.8 持平,定价仅为其四十分之一。
2026-08-27
模型动态
Breeze TTS 2 BreezeBlue 推出的新一代语音合成模型
Breeze TTS 2 是 BreezeBlue 推出的新一代语音合成模型,支持通过自然语言零样本设计角色音色,用自然语言指令精准控制情绪、语速、口音等表演细节。
2026-08-26
模型动态
PixVerse R2 爱诗科技推出的实时全模态世界模型
PixVerse R2 是爱诗科技推出的实时全模态世界模型,为PixVerse R1 的升级版本。模型支持文字、图像、音频及动作信号等多模态输入,能在运行中持续接收用户控制、实时更新世界状态并连续输出同步音视频。
2026-08-26
模型动态
Agnes 2.5 Pro Alpha Agnes AI 开源的多模态推理模型
Agnes 2.5 Pro Alpha 是 Agnes AI 开源的多模态推理模型,采用 Apache 2.0 协议,权重托管于 Hugging Face。模型支持文本与图像输入,上下文窗口达 1M tokens,擅长复杂代码生成、科学推理、长文档分析与 Agent 工作流。
2026-08-25