Kimi K3 技术博客:开放的前沿智能
月之暗面发布 2.8 万亿参数的 Kimi K3——全球首个开源 3T 级模型,性能逼近 Claude Fable 5 和 GPT 5.6 Sol,API 价格仅为顶级闭源模型的 1/3 到 1/5。本文逐段拆解官方发布稿,还原技术设计取舍,并标出跑分话术里该打折扣的地方。
面向 AI 工程师
围绕 AI 的脉动,精选真正值得跟进的变化与判断 —— 情报、深度、访谈、专题。
2026-08-02 精选
洞见
Explorative modeling: Train on the best of K guesses
Alexi Gladstone 提出「探索式建模」(Explorative Modeling)新范式:让生成模型在 K 个候选预测中训练「最优者」而非直接回归均值,解决多解生成任务退化为模糊平均输出的核心问题。作为第三条预训练轴,可在图像、视频、语言上单调提升现有模型,收益随规模增长(数据 7%→36%、参数 13%→23%),实现 6.2× 样本效率与 4.1× FLOP 效率;作为端到端生成模型,在控制任务上以最多 256× 更少推理算力匹敌扩散模型,为生成式 AI 提供新的扩展方向。
Hacker News
实践
microsoft/generative-ai-for-beginners
微软官方《Generative AI for Beginners》课程:21 课,从 Prompt 工程、RAG 到 Agent与多模态应用,配套 Jupyter Notebook 动手练习,当前 11.4 万+ star 并登上 GitHub Trending。是生成式 AI 应用开发领域最受欢迎的免费课程之一,适合希望系统学习 LLM 应用开发的开发者按课推进。
GitHub Trending
影响
abus-aikorea/voice-pro
voice-pro 是一站式语音工具 Gradio WebUI:集成 Edge-TTS、kokoro 等主流 TTS,E2/F5-TTS 与 CosyVoice 零样本声音克隆,Whisper 音频处理、YouTube 下载、Demucs 人声分离及多语言翻译,面向创作者与开发者。将声音克隆、转写、分离等能力整合进本地可运行的界面,显著降低 AI 语音内容生产门槛,对播客、配音、短视频创作者有实用价值。
GitHub Trending
精选
月之暗面发布 2.8 万亿参数的 Kimi K3——全球首个开源 3T 级模型,性能逼近 Claude Fable 5 和 GPT 5.6 Sol,API 价格仅为顶级闭源模型的 1/3 到 1/5。本文逐段拆解官方发布稿,还原技术设计取舍,并标出跑分话术里该打折扣的地方。
对话 OpenAI 研究科学家 Noam Brown,深度拆解测试时间算力(Test-Time Compute)对现代 AI 模型评估带来的颠覆性影响,以及为什么传统的 Benchmark 评分表正在失效。
对话 Databricks 联合创始人 Matei Zaharia 和 Reynold Xin,深度探讨 Databricks 从 Lakehouse 到 Agent Cloud 的战略演进、开源 Agent 托管框架 Omnigent、以及为 AI 代理时代重塑的数据库架构(LTAP)。
按专题浏览
全部专题 →最新