梦兽编程
AI 套装

[ SECTION / AI ]

大模型 LLM

大模型与 LLM 技术前沿、推理优化与训练实践。
32 篇内容
01 AI / 2025.12.17 / 2 MIN 我是怎么用 Skills 把 AI 助手调教成专属打工人的 手把手教你用 Skills 功能,让 Codex 和 Claude 从啥都懂一点的通才,变成只听你话的专属助手。 02 AI / 2025.12.13 / 2 MIN ai-bindgen:用 Rust 过程宏让 LLM 在编译时帮你写代码,我试了这个「邪门」项目 ai-bindgen 是一个实验性 Rust 过程宏项目,能在编译时调用 LLM 代码生成。本文深度体验这个编译时 AI 工具,探讨 Rust 元编程的边界,以及 AI 辅助编程的正确姿势 03 // AI / 2025.12.04 / 1 MIN 欧洲AI的逆袭:Mistral 3如何用开源策略挑战硅谷巨头 在AI竞赛被美国科技巨头主导的今天,一家法国公司正用完全不同的玩法改写游戏规则。Mistral 3的发布不仅是一次技术升级,更是对AI垄断格局的一次有力挑战。 04 // AI / 2025.11.11 / 2 MIN 247GB 就能把 Kimi K2 Thinking 搬回家:Dynamic 1-bit GGUF 实操笔记 用 Unsloth 发布的动态 1-bit GGUF 量化版,让 1T 级 Kimi K2 Thinking 在消费级硬件上跑起来,含安装、下载、运行、部署和避坑指南。 05 AI / 2025.10.30 / 2 MIN Tokencake:多智能体KV缓存调度,把延迟打到 vLLM 一半以下 北航、北大、阿里提出 Tokencake,多智能体 KV Cache 框架,用时间+空间双调度、CPU 缓冲与渐进预留,在外部函数调用场景让端到端延迟相较 vLLM 降低 47%,GPU 内存利用率提升近 17%。 06 // AI / 2025.10.04 / 1 MIN Agno-Go:Go语言写AI Agent,比Python快16倍是什么体验? 用Go语言重写AI Agent框架,性能提升16倍,180纳秒启动一个智能体,内存占用只要1.2KB,这就是Agno-Go带来的极致体验 07 AI / 2025.09.28 / 1 MIN AI泡沫真的来了?一位金融老司机的冷思考 面对热火朝天的AI投资狂潮,一位华尔街老兵提出了不一样的声音:我们可能正在经历一场新的技术泡沫。从电力瓶颈到监管盲区,这篇文章用大白话告诉你,AI热潮背后可能隐藏的风险。 08 AI / 2025.08.08 / 1 MIN 别再复制粘贴了!这个叫 Cursor CLI 的“怪物”让你在终端里和 AI 并肩作战。 告别在浏览器与终端之间来回切换!Cursor CLI 将强大的 AI Agent 注入命令行,支持聊天式生成代码、文件读写、代码审查与自动化集成(CI/CD),帮助开发者在 SSH、Vim/Neovim、本地或远程环境下保持心流、显著提升开发效率。 09 AI / 2025.07.29 / 1 MIN 智谱GLM-4.5发布:挑战GPT-4的AI代码能力新标杆 智谱AI发布GLM-4.5系列模型,拥有3550亿参数,在SWE-bench测试中超越GPT-4.1,全球AI排名第三,支持代码生成、PPT制作、网站开发等全栈能力。 10 // AI / 2025.01.29 / 1 MIN DeepSeek突发大招:V3.2-Exp稀疏注意力机制登场,API价格再砍一半 DeepSeek-V3.2-Exp重磅发布,DSA稀疏注意力技术突破,推理速度提升2-3倍,内存减少30-40%,API价格再降50%以上