Qwen3.5 开源权重再受关注:国产大模型为什么能成为企业备选方案
Qwen3.5-397B-A17B 采用 MoE 架构并开放权重,代表国产开源大模型继续提升。企业应把开源模型纳入多模型备选体系。
Model Topic
专题介绍
DeepSeek 围绕推理能力、开源生态和低成本部署受到关注。这里整理模型发布、技术路线、开发者使用和行业落地动态。
Start Here
Qwen3.5-397B-A17B 采用 MoE 架构并开放权重,代表国产开源大模型继续提升。企业应把开源模型纳入多模型备选体系。
Sam Altman 在 Sun Valley 表示企业最关心如何降低 AI 成本,大模型行业正在从追求最强能力转向成本、效率和 ROI。
外媒称 OpenAI 和 Google 通过海外子公司向中国相关企业提供 AI 服务,引发 AI 软件出口管控讨论,模型访问权正在成为新的地缘科技议题。
Meta 开始对 Muse Spark 1.1 API 收费,意味着大厂 AI 投入从烧钱建设转向商业化回收,模型价格战和开发者生态将迎来新变化。
ZML 发布 LLMD 推理服务器,目标是让 LLaMA、Gemma、Qwen、Mistral 等模型能在 NVIDIA、AMD、TPU、Intel 和 Apple Metal 等硬件上更灵活部署。
本文追踪 Anthropic 针对中国及中国控股企业访问 Claude 的限制升级,分析其对AI开发者、企业选型、国产模型、开源生态和全球AI供应链的影响。
本文从金融、医疗、制造、教育、零售、政务、内容和企业服务等行业出发,分析当前AI应用的主要痛点、落地阻力和未来改进方向。
Vibe Coding 的关键流程是描述目标、选择工具、生成原型、运行测试、反馈修改和部署上线,适合从小功能开始逐步迭代。
DeepSeek V4 被曝适配华为 Ascend 芯片,相关团队还称完成 V4-Pro 后训练,这让国产 AI 算力从宣传进入更真实的工程验证阶段。
DeepSeek V4 Flash 和 Pro 的定价、缓存与长上下文能力,让企业开始重新评估闭源模型、开源模型和混合路由的总体成本。
DeepSeek 官方文档已提供 Claude Code、OpenCode、OpenClaw 和 GitHub Copilot 等集成方式,说明 AI 编程正在进入多模型路由阶段。
DeepSeek V4 支持 Thinking 和 Non-Thinking 双模式,企业应按任务复杂度选择模式,避免用高成本推理处理简单内容。
Related Topics