Claude Opus 5 发布:1M 上下文、128K 输出,价格只有 Fable 5 一半
Anthropic 发布 Claude Opus 5:面向复杂 Agent 编程和企业工作,支持 1M 上下文、128K 输出,API 价格为输入 5 美元、输出 25 美元 / 百万 token,只有 Claude Fable 5 的一半。
9 篇文章
浏览关于 AI 模型 的 9 篇文章、工具介绍与使用记录,按发布时间查找相关内容。
Anthropic 发布 Claude Opus 5:面向复杂 Agent 编程和企业工作,支持 1M 上下文、128K 输出,API 价格为输入 5 美元、输出 25 美元 / 百万 token,只有 Claude Fable 5 的一半。
Qwen3.5-Omni 是新一代原生全模态大模型,支持文本、图像、音频、视频输入输出。采用 Thinker-Talker 架构和 Hybrid-Attention MoE,支持 256k 上下文、10 小时音频、400 万帧视频处理,在 215 个基准测试中达到 SOTA。
GLM-4.6V 免费开源多模态 AI 大模型完整教程。支持图像识别、OCR文字提取、PDF文档理解、视频分析等功能,128K超长上下文,106B/9B 两个版本可选,支持本地部署和云端调用,包含下载安装、API使用、实战案例等详细说明
Qwen3-Omni 端到端多模态模型,支持文本/图像/音频/视频与实时语音,Thinker–Talker + MoE,多码本降延迟;覆盖 119 种语言,附评测结论、部署建议与 vLLM/Transformers 实操。
阿里云通义千问Qwen3系列大语言模型全面介绍,从0.6B到235B的多规模模型,结合MoE与Dense架构,实现性能与效率的完美平衡,支持119种语言,具备卓越的编码和数学能力
Google最新发布的Gemma 3 QAT模型完整介绍:量化感知训练技术、多模态能力、边缘设备部署及性能优势。深入解析其在低资源环境中保持高性能的革命性技术。
CogAgent-9B: 智谱AI与清华大学联合打造的革命性GUI智能体,以9B参数量实现卓越的界面理解与自动化交互能力,在MM-Vet等多项基准测试中大幅领先现有模型
本文深入对比分析了SGLang、Ollama、VLLM、LLaMA.cpp等主流大模型部署工具的技术特点、性能表现和最佳实践。从架构设计、推理性能、资源消耗、易用性、部署难度等多个维度进行全面评测,并结合具体应用场景提供详细的选型建议,帮助读者快速掌握这些强大的AI模型部署工具。
Google 最新发布的 Gemini 2.0 Flash AI模型完整介绍:性能提升2倍、多模态能力、应用场景及未来规划。深入解析其在AI助手、编程开发、数据分析等领域的革新。