
Kimi K3大模型分析:能力、架构与定位全梳理,上下文推理表现@晚点
详解 Kimi K3:强到冲击 Anthropic 估值的模型什么样?开源了权重,没开源产生权重的“流水线”。 7 月 27 日,Kimi 公开了 K3 的完整权重和技术报告。这是首个接近 3T 规模的开放权重(开源)模型:总参数量 2.8...
DeepSeek怎么用、哪款模型好用、价格和性能怎么样,以及梁文锋的技术路线、商业化进展。
完整版实录 | 梁文锋4小时投资人交流会:克制是一种战略 导读:本文整…

详解 Kimi K3:强到冲击 Anthropic 估值的模型什么样?开源了权重,没开源产生权重的“流水线”。 7 月 27 日,Kimi 公开了 K3 的完整权重和技术报告。这是首个接近 3T 规模的开放权重(开源)模型:总参数量 2.8...

DeepSeek V4.1 Flash 中间版本开启内测,官方称采用新结构、原生多模态、性能与成本均改善。实测「你好」一问思考仅0.3秒、生成159.3 token/秒;重度长文本推理达420 token/秒。同任务端到端对比 V4 Vision-Exp 快3.9×–6.0×,调用价却与 V4 Flash 相同。发布前一日更扩招150名工程师。

为什么资本追逐 AI Native,不再理睬互联网老登 资本不奖励守旧,不是因为守旧的人有错。是守旧的部分已经明码标价,没有信息差,也就没有超额收益。 全文脉络表 · 资本为何追逐 AI Native,不再理睬「互联网老登」 主线因果链(第...

【导读】马化腾、马云们“抄”对了答案;梁文锋、杨植麟们面前只剩一张白纸。上一代做的是应用题——公式有了算对就行;这一代做的是证明题——公式不存在,自己推。 国内互联网照着美国西方抄就行 应用题?VS 证明题? 上一代运气好:ICQ跑通了,马...

完整版实录 | 梁文锋4小时投资人交流会:克制是一种战略 导读:本文整理自梁文锋与投资人的近 4 小时交流会,围绕 DeepSeek 的愿景、开源、定价、商业化、组织方式、算力与 Scaling、Coding Agent、后训练和推理效率等...

梁文锋没有生活,杨植麟没有退路 导读:两个广东人,如何改写中国 AI 的牌桌 Kimi K3 发布的这一周,美国科技圈都在集体惋惜,杨植麟这样一个优秀的年轻人,为什么当年没有留在美国。 Kimi K3 在前端能力上超越所有模型 这个话题在 ...