追踪全球 AI 行业最新动态
GPT-5.5 在推理、数学和代码能力上全面超越 GPT-5,推理速度提升 2.5 倍,输入价格 ¥36/M tokens,输出 ¥216/M tokens,支持 256K 上下文窗口和原生多模态。
Claude Sonnet 5 支持 1M tokens 上下文,在复杂推理、专业写作和代码生成方面表现优异,输入 ¥14/M tokens,输出 ¥72/M tokens,Artifacts 功能全面升级。
DeepSeek V4 Pro 采用 MIT 开源协议发布,1M 上下文窗口,输入 ¥3.1/M tokens,输出 ¥6.3/M tokens。在 MMLU-Pro、HumanEval 等基准测试中与 GPT-5.4 持平,成为性价比最高的开源模型。
Gemini 3.5 Flash 在保持 1M 上下文的同时,推理速度提升 3 倍,输入价格仅 ¥11/M tokens,输出 ¥65/M tokens。原生支持视频、音频、图像多模态输入,Search Grounding 功能全面升级。
Meta Llama 4 包含 8B、70B、405B 三个版本,全部开源。405B 版本在多项基准测试中接近 GPT-5.4 水平,支持多语言和代码生成,采用 Apache 2.0 协议。
Grok 4 在数学、科学和代码推理方面表现突出,支持 1M 上下文,集成 X 平台实时数据。xAI 宣布 Grok 4 已向 X Premium+ 用户全面开放。
Kimi K2.6 在长文档理解、多轮对话和工具调用方面大幅提升,支持 262K 上下文,输入 ¥6.8/M tokens,输出 ¥29/M tokens。新增原生图片理解和代码解释器,API 已全面开放。
GLM-5.1 在 Agent 任务和工具调用方面大幅增强,支持 200K 上下文,性能对标 GPT-5.4。同步开源 GLM-5.1-9B 和 32B 版本,推动国产开源生态发展。
Qwen3-Max 在图像理解、视频分析和文档识别方面达到新高度,支持 1M 上下文。阿里云宣布 Qwen3-Max API 价格下调 60%,输入 ¥1.4/M tokens,输出 ¥5.6/M tokens,成为最具性价比的多模态模型。
Mistral Large 3 采用 123B 参数 MoE 架构,在代码生成、多语言和长文本任务上表现优异,输入 ¥7.2/M tokens,输出 ¥22/M tokens。同步开源 Mistral 3 Small 24B,推动欧洲 AI 生态。
AI 云服务商 CoreWeave 完成 86 亿美元新一轮融资,估值超过 350 亿美元。此次融资将用于扩建数据中心和采购 NVIDIA B200 GPU,满足全球 AI 推理需求激增。
Seed 2 Pro 支持 256K 上下文,在中文理解和创意写作方面保持领先。字节跳动宣布豆包 App 日活突破 8000 万,成为中国用户量最大的 AI 助手,同步开放 Seed 2 Pro API 内测。
Anthropic 完成由 Google、Salesforce 等领投的 75 亿美元 E 轮融资,估值达 615 亿美元。资金将用于 Claude 模型研发、全球扩张和安全研究,进一步挑战 OpenAI 的市场地位。