GLM-4.7 最新发布|Coding Agent 更稳:概览与快速使用(transformers / vLLM / SGLang / Thinking)
GLM-4.7 最新发布能力概览与快速上手:聚焦 Coding Agent(多语言代码生成/终端任务)、工具调用与复杂推理,并提供 transformers 推理示例、vLLM/SGLang 本地部署(OpenAI 风格 API)及 Thinking/Preserved Thinking 参数建议。
聚合全球 AI 模型、公司、开源项目和基础设施动态,帮助读者快速判断哪些更新值得继续关注。
GLM-4.7 最新发布能力概览与快速上手:聚焦 Coding Agent(多语言代码生成/终端任务)、工具调用与复杂推理,并提供 transformers 推理示例、vLLM/SGLang 本地部署(OpenAI 风格 API)及 Thinking/Preserved Thinking 参数建议。
OpenAI 发布 GPT-5.2 模型系列,面向专业知识型工作与长时运行智能体,在长上下文、工具调用、视觉与软件工程等方面实现显著提升,并公布多项基准新纪录与定价信息。
美国商务部即将批准英伟达高端 H200 AI 芯片出口至中国,标志着美国对华科技限制政策出现松动,此举被视为中美科技关系趋稳的重要信号
DeepSeek-V3.2 是 DeepSeek 推出的最新开源大语言模型,在推理能力和智能体性能上实现重大突破,性能媲美 GPT-5 和 Gemini-3.0-Pro。
Qwen3-Omni 端到端多模态模型,支持文本/图像/音频/视频与实时语音,Thinker–Talker + MoE,多码本降延迟;覆盖 119 种语言,附评测结论、部署建议与 vLLM/Transformers 实操。
Qwen3-Next 系列发布:Gated DeltaNet × Gated Attention 混合架构,80B 总参仅激活约 3B,实现长上下文、高并发与低延迟;Instruct 与 Thinking 分工明确,覆盖从生产对话到深度推理的全场景。
DeepSeek V3.1 支持Claude Code,混合推理架构:引入 Think/Non‑Think ,编程与智能体(Agent)能力大幅提升,128K 长上下文与 MoE 带来高性能与低成本的最佳平衡。
沉浸式翻译插件因网页快照功能导致用户敏感信息大规模泄露,涉及个人隐私、商业机密、知识产权等敏感数据。本文深度分析该安全事件的技术漏洞、社区争议及官方应对措施。
智谱AI发布新一代旗舰模型GLM-4.5,专为智能体应用打造,具备高效MoE架构、原生智能体能力和极高性价比。本文结合官方技术报告和用户实测,全面解析GLM-4.5的技术突破、性能表现、应用生态及未来展望。
阿里云Qwen-MT翻译模型重磅升级:支持92种语言、秒级响应、成本仅0.5美元/百万token,挑战GPT-4翻译霸主地位。本文深度解析其技术架构、多语言支持能力、定制化功能和商业化前景,为AI翻译选型提供参考。