3. 模型与基准 (Models & Benchmarks)
- DeepSeek V4正式版全量商用:1.6万亿参数+100万上下文,首创峰谷定价...
2 minutes ago · 2026年7月15日,DeepSeek V4正式版全量商用:Pro旗舰版1.6万亿参数、Flash轻量版2840亿,全系支持100万上下文窗口,并国内首创"峰谷分时计费"——谷时调用算力费直降约60%。本文横评 DeepSeek V4 与 GPT-5.6 Sol、Claude Sonnet 5 的 API 性价比,并附三行代码接入指南与谷时降本实操。
- 2026年AI大模型综合排行榜 - AnyRank - AnyRank
2 minutes ago · 趣事与总结 本月榜单显示, Anthropic 和 Google 在第一梯队竞争极其激烈,二者在编程能力(Code Arena / SWE-bench)与综合指标上交替领先;同时, 国产大模型 (智谱、月之暗面、阿里巴巴)表现异常强劲,稳居全球前20,并在中文特定语境与性价比上确立了护城河。
- DeepSeek-V4-Pro - AI模型价格对比 (2026/7/16)
2 minutes ago · DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家模型,总参数量为 1.6T(万亿),激活参数量为 49B(十亿),支持 100 万 Token 的上下文窗口。 该模型专为高级推理、编程以及长周期智能体工作流而设计,在知识、数学和软件工程基准测试中均表现出色。
- AI Benchmarks 2026 - MMLU, GPQA, SWE-bench | LM Market Cap
1 day ago · Compare AI models across 17 benchmarks including MMLU, GPQA Diamond, MATH-500, HumanEval, SWE-bench, and Arena Elo. See current leaders, score history, and interactive charts for 350+ models.
- Open-Source LLM Leaderboard 2026 | LM Market Cap
1 day ago · Open LLM leaderboard ranking the best open-source language models by benchmarks, pricing, and capabilities. Compare Llama, DeepSeek, Qwen, Mistral, and Gemma with live scores.
- 6 月 GitHub 热点项目盘点:飙星榜 + 总榜全收录,这些开源项目正在引...
1 day ago · 飙星榜 Top 10本月涨势最猛的项目按 2026 年 6 月单月新增 Star 数降序排列以下是跑得最快的 10 个项目排名项目月增 ★总 ★一句话描述 1microsoft/markitdown34,072161k将 PDF、Word、PPT、Excel、音视频一键转为 Markdown 2harry0703/MoneyPrinterTurbo29,27293.9k接入 LLM 一键生成高清短视频 ...