Aman Sanger

Aman Sanger

Aman Sanger
Anysphere联合创始人
海外PC 优先级✓ 已收录 1 期访谈

立场时间线 7 条 · 7 个议题

同一议题按时间排列,说法变化一目了然。

编程Agent
2026-08

Cursor被600亿美元收购表明编程Agent团队已被视为战略性的模型/平台资产,而非单一IDE产品

“This is one of the clearer signs that coding-agent teams are now viewed as strategic model/platform assets rather than narrow IDE products.(这是编程Agent团队现在被视为战略模型/平台资产而非单一IDE产品的最明确信号之一。)”

来源访谈 →
相关观点 (1)Eiso Kant · 交易定性:Eiso Kant 强调 NVIDIA 这笔交易既非整体收购也非传统人才收购,而是技术授权加团队雇佣的独特结构,为员工和投资者提供了优渥退出方案。
后训练
2026-08

GLM-5.3的能力飞跃并非来自更大规模的基础模型预训练,而是完全依靠扩展后训练

“Scaling post-training is all we did for GLM-5.3.(扩展后训练是我们为GLM-5.3所做的全部工作。)”

来源访谈 →
相关观点 (2)唐杰 · 强化学习:GLM-5.3相比前代架构并无根本改变,性能飞跃完全来自长周期高复杂度环境中的强化学习唐杰 · 环境合成:训练环境可完全合成、大规模自动化生成,扩展后训练的难度重心已从模型转移到环境本身
小模型
2026-08

27B量级的开源模型正变得愈发强大和实用,已能胜任真实世界编码、办公流和智能体任务

“凭借其原生多模态、百万级上下文窗口及广泛的推理支持,被明确定位为适用于真实世界编码、办公流和智能体的专业工具。这显示27B量级模型正变得愈发强大和实用。”

来源访谈 →
相关观点 (3)老石 · 开源模型 vs 闭源模型:支持开源,认为其超越了私有模型阿尔温德·贾恩 · 多模型依赖:企业不再愿意只依赖一两家模型提供商,且认为离开开源模型就无法生存。塞巴斯蒂安·拉什卡, 内森·兰伯特 · 开源模型:以DeepSeek、Kimi、MiniMax为代表的中国公司正通过发布性能强劲的开源模型获得全球影响力
基准测试
2026-08

不应盲目相信厂商发布的基准测试数字,评分器中的小错误就可能使得分从65%飙升至93.6%,开发者应运行自己的评估

“评分器中的小错误或可导致系统得分从65%飙升至93.6%,呼吁开发者应运行自己的评估,而非盲目相信营销数字。”

来源访谈 →
相关观点 (2)吴恩达 · 软件基础:扎实的软件工程基础不可或缺,缺乏经验的开发者若只依赖编程代理“随性编码”,会因不了解技术权衡而做出糟糕选择刘刚 · 估值谈判:早期项目估值必须健康合理:过高会让创始人压力过大、动作变形,过低则影响团队招募,应基于下一阶段真实资金需求确定。
推理成本
2026-08

随着大模型API商业化进入深水区,焦点转向通过推测解码、量化等优化在单卡或有限硬件上实现高吞吐、低成本的本地化部署

“社区关注的焦点集中在如何通过推测解码、量化等基础设施优化,在单卡或有限硬件上实现高吞吐、低成本的本地化部署。”

来源访谈 →
相关观点 (3)游凯超 · 协同设计:模型必须根据硬件特性与基础设施协同设计才能最大化效率,否则算法再好也难以落地雷军 · AI芯片架构:未来芯片应实现分布式AI架构,将AI计算能力下沉到各子系统,让计算发生在数据产生处,同时优化NPU以适配大模型推理。弗朗索瓦·肖莱 · 数据效率:随着计算能力增长放缓,AI研究的瓶颈将从算力转向数据,研究重点应从追求更大模型转向提升数据效率。
模型评价
2026-08

DeepSeek V4 Flash 0731 的实际好用程度令人惊讶

“It's actually crazy how good DSv4 Flash 0731 is(DeepSeek V4 Flash 0731的好用程度确实令人疯狂。)”

来源访谈 →

金句墙 3 条

访谈收录

A