Qwen3-4B-Thinking-2507 登场:4B 模型也能拥有 256K 超长上下文与顶尖推理能力?
AI 领域再次迎来震撼弹!全新发布的 Qwen3-4B-Thinking-2507 模型,不仅在推理能力上实现巨大飞跃,更在一个仅 4B 参数的轻量级模型中, …
Read More →
AI 领域再次迎来震撼弹!全新发布的 Qwen3-4B-Thinking-2507 模型,不仅在推理能力上实现巨大飞跃,更在一个仅 4B 参数的轻量级模型中, …
OpenAI 正式开源 gpt-oss-120b 及 gpt-oss-20b 两款强大推理模型。本文将深入探讨其创新的 MoE 架构、与 GPT-4o 等模型的性能比较、多语言能 …
腾讯混元团队再次震撼 AI 社群,正式开源四款从 0.5B 到 7B 的小尺寸模型。这些模型专为消费级硬件设计,具备惊人的 256k 长文本处理能力与强大的 Agent 功能,让 …

AI 领域的黑马 Z.ai 再掀波澜!全新发布的 GLM-4.5 和 GLM-4.5-Air 模型不仅在参数规模上令人瞩目,更以创新的「混合推理模式」和在多项权威基准测试中的惊人 …

阿里云通义千问团队正式发布 Qwen3-Coder,这款拥有 4800 亿参数的 MoE 模型在代码和 Agentic 任务上表现卓越,原生支持 256K 超长上下文, …

Mistral Large 2 是一款新一代的大型语言模型,具有卓越的成本效益、速度和性能。它支持多种语言和编程语言,并在多个基准测试中展现出优异的表现。 …


Meta 推出了 Llama 3.1 系列模型,其中包括 405B 参数的旗舰模型,这是首个能与顶级闭源 AI 模型相媲美的开源模型。新模型扩展了上下文长度,支持多种语言,并提供了 …

{: width=“100%” } 图片来自Claude 3.5 Sonnet{:target="_blank"} Claude 3.5 …
© 2026 Communeify. All rights reserved.