3. 模型与基准 (Models & Benchmarks)
- 2026年6月技术热点速递:LLM省Token神器、阿里开源AI代码审查、微软正...
1 day ago · # 2026年6月技术热点速递 今天从 Hacker News 前端挑了几个值得聊的话题,涉及 LLM 成本优化、AI 代码审查、微软 Linux 战略、以及一个硬件黑客工具。 ## 1. Lowfat:省掉 91.8% 的 LLM Token 用 Claude Code 或 Codex 写代码的人
- AI 编程工具—Cursor进阶使用deepseek V3 模型(deepseek + cursor...
今日模型配置页面,这里我们勾掉之前已经激活的模型.创建deepseek-chat 的模型后,选中这个模型,然后在下面的配置框中输入我们刚才生成的API keys.
- GitHub开源MacOS小工具:整合本地语音识别与LLM纠错实现自动输入
3 minutes ago · 近日,一款名为 typeformic 的 macOS 效率小 工具 在 GitHub 开源社区引起关注。该项目由开发者 ‘uk0’ 发布,旨在解决语音输入准确率低、后期修改成本高的问题。项目采用了一种创新的混合技术 架构:首先利用 macOS 系统自带的本地语音模型进行语音转文字处理,保证了音频数据的隐私 安全 与识别的 ...
- 本周 GitHub Trending 9 个仓库:当榜单前三有俩在卖"砍掉 90% token",...
3 minutes ago · 这周 GitHub trending 前几名里,headroom 的卖点是"在喂给 LLM 之前砍掉 60-95% 的 token",codegraph 的卖点是"预索引代码图谱,更少 token、更少工具调用",再往下 rtk 是"CLI 代理省 60-90% token"。
- AI Benchmarks 2026 - MMLU, GPQA, SWE-bench | LM Market Cap
1 day ago · Compare AI models across 17 benchmarks including MMLU, GPQA Diamond, MATH-500, HumanEval, SWE-bench, and Arena Elo. See current leaders, score history, and interactive charts for 350+ models.
- CVPR 2026|LLM会写3D视觉代码吗?清华联合智源用GeoCodeBench给出答...
1 day ago · 这是一个面向3D几何计算机视觉的PhD级codingbenchmark,团队从2025年CV顶会论文和官方仓库中构建任务,最终形成了47个仓库、100个问题实例,专门评测大语言模型是否真的能「读懂论文、理解几…