[ SECTION / AI ]
大模型 LLM
大模型与 LLM 技术前沿、推理优化与训练实践。
32 篇内容01
AI / 2025.12.17 / 2 MIN
我是怎么用 Skills 把 AI 助手调教成专属打工人的
手把手教你用 Skills 功能,让 Codex 和 Claude 从啥都懂一点的通才,变成只听你话的专属助手。
↗
02
AI / 2025.12.13 / 2 MIN
ai-bindgen:用 Rust 过程宏让 LLM 在编译时帮你写代码,我试了这个「邪门」项目
ai-bindgen 是一个实验性 Rust 过程宏项目,能在编译时调用 LLM 代码生成。本文深度体验这个编译时 AI 工具,探讨 Rust 元编程的边界,以及 AI 辅助编程的正确姿势
↗
03
//
AI / 2025.12.04 / 1 MIN
欧洲AI的逆袭:Mistral 3如何用开源策略挑战硅谷巨头
在AI竞赛被美国科技巨头主导的今天,一家法国公司正用完全不同的玩法改写游戏规则。Mistral 3的发布不仅是一次技术升级,更是对AI垄断格局的一次有力挑战。
↗
04
//
AI / 2025.11.11 / 2 MIN
247GB 就能把 Kimi K2 Thinking 搬回家:Dynamic 1-bit GGUF 实操笔记
用 Unsloth 发布的动态 1-bit GGUF 量化版,让 1T 级 Kimi K2 Thinking 在消费级硬件上跑起来,含安装、下载、运行、部署和避坑指南。
↗
05
AI / 2025.10.30 / 2 MIN
Tokencake:多智能体KV缓存调度,把延迟打到 vLLM 一半以下
北航、北大、阿里提出 Tokencake,多智能体 KV Cache 框架,用时间+空间双调度、CPU 缓冲与渐进预留,在外部函数调用场景让端到端延迟相较 vLLM 降低 47%,GPU 内存利用率提升近 17%。
↗
06
//
AI / 2025.10.04 / 1 MIN
Agno-Go:Go语言写AI Agent,比Python快16倍是什么体验?
用Go语言重写AI Agent框架,性能提升16倍,180纳秒启动一个智能体,内存占用只要1.2KB,这就是Agno-Go带来的极致体验
↗
07
AI / 2025.09.28 / 1 MIN
AI泡沫真的来了?一位金融老司机的冷思考
面对热火朝天的AI投资狂潮,一位华尔街老兵提出了不一样的声音:我们可能正在经历一场新的技术泡沫。从电力瓶颈到监管盲区,这篇文章用大白话告诉你,AI热潮背后可能隐藏的风险。
↗
08
AI / 2025.08.08 / 1 MIN
别再复制粘贴了!这个叫 Cursor CLI 的“怪物”让你在终端里和 AI 并肩作战。
告别在浏览器与终端之间来回切换!Cursor CLI 将强大的 AI Agent 注入命令行,支持聊天式生成代码、文件读写、代码审查与自动化集成(CI/CD),帮助开发者在 SSH、Vim/Neovim、本地或远程环境下保持心流、显著提升开发效率。
↗
09
AI / 2025.07.29 / 1 MIN
智谱GLM-4.5发布:挑战GPT-4的AI代码能力新标杆
智谱AI发布GLM-4.5系列模型,拥有3550亿参数,在SWE-bench测试中超越GPT-4.1,全球AI排名第三,支持代码生成、PPT制作、网站开发等全栈能力。
↗
10
//
AI / 2025.01.29 / 1 MIN
DeepSeek突发大招:V3.2-Exp稀疏注意力机制登场,API价格再砍一半
DeepSeek-V3.2-Exp重磅发布,DSA稀疏注意力技术突破,推理速度提升2-3倍,内存减少30-40%,API价格再降50%以上
↗
AI / 2025.12.17 / 2 MIN
我是怎么用 Skills 把 AI 助手调教成专属打工人的
手把手教你用 Skills 功能,让 Codex 和 Claude 从啥都懂一点的通才,变成只听你话的专属助手。
↗
02
AI / 2025.12.13 / 2 MIN
ai-bindgen:用 Rust 过程宏让 LLM 在编译时帮你写代码,我试了这个「邪门」项目
ai-bindgen 是一个实验性 Rust 过程宏项目,能在编译时调用 LLM 代码生成。本文深度体验这个编译时 AI 工具,探讨 Rust 元编程的边界,以及 AI 辅助编程的正确姿势
↗
03
//
AI / 2025.12.04 / 1 MIN
欧洲AI的逆袭:Mistral 3如何用开源策略挑战硅谷巨头
在AI竞赛被美国科技巨头主导的今天,一家法国公司正用完全不同的玩法改写游戏规则。Mistral 3的发布不仅是一次技术升级,更是对AI垄断格局的一次有力挑战。
↗
04
//
AI / 2025.11.11 / 2 MIN
247GB 就能把 Kimi K2 Thinking 搬回家:Dynamic 1-bit GGUF 实操笔记
用 Unsloth 发布的动态 1-bit GGUF 量化版,让 1T 级 Kimi K2 Thinking 在消费级硬件上跑起来,含安装、下载、运行、部署和避坑指南。
↗
05
AI / 2025.10.30 / 2 MIN
Tokencake:多智能体KV缓存调度,把延迟打到 vLLM 一半以下
北航、北大、阿里提出 Tokencake,多智能体 KV Cache 框架,用时间+空间双调度、CPU 缓冲与渐进预留,在外部函数调用场景让端到端延迟相较 vLLM 降低 47%,GPU 内存利用率提升近 17%。
↗
06
//
AI / 2025.10.04 / 1 MIN
Agno-Go:Go语言写AI Agent,比Python快16倍是什么体验?
用Go语言重写AI Agent框架,性能提升16倍,180纳秒启动一个智能体,内存占用只要1.2KB,这就是Agno-Go带来的极致体验
↗
07
AI / 2025.09.28 / 1 MIN
AI泡沫真的来了?一位金融老司机的冷思考
面对热火朝天的AI投资狂潮,一位华尔街老兵提出了不一样的声音:我们可能正在经历一场新的技术泡沫。从电力瓶颈到监管盲区,这篇文章用大白话告诉你,AI热潮背后可能隐藏的风险。
↗
08
AI / 2025.08.08 / 1 MIN
别再复制粘贴了!这个叫 Cursor CLI 的“怪物”让你在终端里和 AI 并肩作战。
告别在浏览器与终端之间来回切换!Cursor CLI 将强大的 AI Agent 注入命令行,支持聊天式生成代码、文件读写、代码审查与自动化集成(CI/CD),帮助开发者在 SSH、Vim/Neovim、本地或远程环境下保持心流、显著提升开发效率。
↗
09
AI / 2025.07.29 / 1 MIN
智谱GLM-4.5发布:挑战GPT-4的AI代码能力新标杆
智谱AI发布GLM-4.5系列模型,拥有3550亿参数,在SWE-bench测试中超越GPT-4.1,全球AI排名第三,支持代码生成、PPT制作、网站开发等全栈能力。
↗
10
//
AI / 2025.01.29 / 1 MIN
DeepSeek突发大招:V3.2-Exp稀疏注意力机制登场,API价格再砍一半
DeepSeek-V3.2-Exp重磅发布,DSA稀疏注意力技术突破,推理速度提升2-3倍,内存减少30-40%,API价格再降50%以上
↗