GPT-5.6 Luna 直接降价 80%:百万 Token 输出只要 1.2 美元
OpenAI 下调 GPT-5.6 Terra 与 Luna API 价格:Terra 降价 20%,Luna 降价 80%,输入最低 0.20 美元、输出 1.20 美元 / 百万 token,Sol 价格不变。
23 篇文章
比较大语言模型的能力、推理方式与部署要求,查找模型解读、选型参考和使用教程。
选型时先确认任务、上下文长度和硬件预算,再阅读对应模型的技术解读与部署教程。关注量化、推理成本和适用场景,避免只根据榜单选择模型。
OpenAI 下调 GPT-5.6 Terra 与 Luna API 价格:Terra 降价 20%,Luna 降价 80%,输入最低 0.20 美元、输出 1.20 美元 / 百万 token,Sol 价格不变。
Kimi K3 正式发布:2.8 万亿参数、原生多模态、100 万 token 上下文,API 输入 3 美元、输出 15 美元。本文对比 GPT-5.6 Sol 与 Claude Fable 5 的价格、能力和适用场景。
DeepSeek-V4 正式发布!百万上下文标配,Agent 能力超越开源模型,推理性能比肩 GPT-4o 和 Claude Opus。Pro 版本达到顶级闭源模型水平,Flash 版本更快更经济。全新注意力机制 + DSA 稀疏注意力,计算和显存需求大幅降低
DeepSeek-V3.2 是 DeepSeek 推出的最新开源大语言模型,在推理能力和智能体性能上实现重大突破,性能媲美 GPT-5 和 Gemini-3.0-Pro。
vLLM 现已原生支持小红书 dots.ocr 模型,提供免费商用的多语言 OCR 功能。本教程将指导您如何通过两行命令快速部署,轻松实现对包含文本、表格、公式在内的100多种语言文档的高效解析与识别。
Qwen3-Next 系列发布:Gated DeltaNet × Gated Attention 混合架构,80B 总参仅激活约 3B,实现长上下文、高并发与低延迟;Instruct 与 Thinking 分工明确,覆盖从生产对话到深度推理的全场景。
智谱AI发布新一代旗舰模型GLM-4.5,专为智能体应用打造,具备高效MoE架构、原生智能体能力和极高性价比。本文结合官方技术报告和用户实测,全面解析GLM-4.5的技术突破、性能表现、应用生态及未来展望。
月之暗面(Moonshot AI)发布的Kimi K2技术报告,深度解析万亿参数开源模型的三大创新:MuonClip优化器保障训练稳定性、数据改写提升token效用、高稀疏MoE架构实现性能与推理效率平衡。本文详细解读报告核心技术与工程经验。
阿里云通义千问Qwen3系列大语言模型全面介绍,从0.6B到235B的多规模模型,结合MoE与Dense架构,实现性能与效率的完美平衡,支持119种语言,具备卓越的编码和数学能力
OpenAI发布新一代推理模型o3和o4-mini,在编码、数学、科学和视觉任务等多个领域展现卓越性能。两款模型在基准测试中表现优异,并在安全性和成本效益方面取得重大突破。
Meta Llama 4涉嫌刷榜争议与高管离职风波交织,AI战略面临考验
深入浅出解析当前AI领域四大核心技术:Agent智能体、RAG检索增强生成、Function Call函数调用与MCP模型上下文协议。通过生动比喻和实例,帮助读者快速理解这些技术的本质、关系及应用场景。
DeepSeek-V3-0324 是 DeepSeek 公司最新发布的模型升级版本,在推理能力、前端开发、中文写作等多方面实现了显著提升。
深入对比分析Mistral Small 3.1和Gemma 3两款大语言模型,从参数规模、技术特点、性能表现和应用场景等多个维度进行详细评估。探讨24B参数的Mistral Small 3.1如何在效率和性能上挑战27B参数的Gemma 3,以及这对AI领域的影响。
阿里云通义千问团队发布QwQ-32B模型,采用纯强化学习方法,以32B参数量挑战DeepSeek R1的671B参数。QwQ-32B在数学推理、代码生成等任务上展现出惊人性能,开创了AI小模型新纪元。本文深入分析两大模型优劣势,探讨开源AI发展新趋势。
微软 OmniParser V2.0 是新一代 AI 视觉解析工具,可将 GUI 界面转换为结构化数据,具有更快的处理速度和更高的检测准确率,支持多平台输入并可与主流 LLM 无缝集成。
探索如何使用LLM-Reasoner框架让模型像DeepSeek R1一样进行深度思考,通过结构化推理提升大语言模型的逻辑分析能力。包含完整的配置和部署指南,助您打造具备强大推理能力的AI系统。
DeepSeek R1 是 DeepSeek 公司推出的一款基于强化学习的大语言模型,它在推理能力上取得了重大突破,甚至能与 OpenAI 的 o1-1217 相媲美。
字节跳动开源基于 Golang 的大模型应用开发框架 Eino,提供稳定、可扩展的开发体验。Eino 基于明确的组件定义和强大的流程编排能力,覆盖开发全流程,帮助开发者快速构建高质量的大模型应用。框架具有内核稳定、敏捷扩展、高可靠易维护等特点,并提供丰富的工具生态支持。
详细介绍如何部署和使用LangChain Open Canvas,这是一个开源的AI辅助写作和编程工具,替代openai canvas。本教程涵盖了安装配置、功能特性、私有化部署等核心内容,帮助您快速搭建自己的AI协作平台。
CogAgent-9B: 智谱AI与清华大学联合打造的革命性GUI智能体,以9B参数量实现卓越的界面理解与自动化交互能力,在MM-Vet等多项基准测试中大幅领先现有模型
本文深入对比分析了SGLang、Ollama、VLLM、LLaMA.cpp等主流大模型部署工具的技术特点、性能表现和最佳实践。从架构设计、推理性能、资源消耗、易用性、部署难度等多个维度进行全面评测,并结合具体应用场景提供详细的选型建议,帮助读者快速掌握这些强大的AI模型部署工具。
"DeepSeek - V3 模型深度剖析。其架构融合 MLA 与 DeepSeekMoE,负载均衡策略创新。14.8 万亿 tokens 预训练,HAI - LLM 框架与 FP8 技术助力。MTP 等创新技术加持,性能超开源、近闭源,多领域出色。成本效益优,训练与 API 价格低,是 AI 关键参考,推动语言模型发展。”