标签: GPT5
降价80%,但这次不只是价格战。OpenAI突然宣布GPT-5.6全线调整,入门
降价80%,但这次不只是价格战。OpenAI突然宣布GPT-5.6全线调整,入门款Luna直接从每百万token输入1美元砍到0.2美元,输出从6美元砍到1.2美元,折合人民币输入才1块3毛5。Terra也降了20%,旗舰Sol价格没动,但出了加速模式,最高快2.5倍,加量不加价。真正值得关注的不是降价本身,而是降价的逻辑,这钱是GPT-5.6Sol自己省出来的。OpenAI说得很清楚:Sol参与了自家生产系统的GPU底层优化,重写Kernel、改进推测解码,端到端成本压下去20%,Token生成效率提了15%。模型自己帮自己降本,降下来的成本又反哺到价格上。左脚踩右脚,飞升循环就这么转起来了。这背后藏着更大的牌:Luna不是拿来干传统杂活的。它能调工具、执行多步工作流,定位是成本敏感型Agent主力。降价80%,本质是在降低Agent长期运行的入场门槛。以前因为太贵不敢频繁跑的审查、验证、监控任务,现在可以变成常规操作。一个飞轮已经成型:模型参与优化自己—成本下降—价格降低—更多Agent工作流跑起来—调用规模扩大—再推动下一轮优化。这不是价格战,这是要把Agent从demo阶段直接推进生产环境。压力现在给到了另一边,该谁出牌了。
【#Gemini掉出全球前十#】当地时间7月21日,谷歌DeepMind发布三款
【#Gemini掉出全球前十#】当地时间7月21日,谷歌DeepMind发布三款轻量的新模型,主打“更快、更智能、更具成本效益”,但因智能程度没有满足外界的期待,评价两极分化。与此同时,旗舰模型Gemini3.5Pro依然没有露面成为此次焦点,从排行榜来看,谷歌的模型已经排在十名开外。根据谷歌官方博客,此次发布的三款模型定位不同。Gemini3.6Flash是主力模型,与上一代相比能使用更少的token,在相同成本下提供更高质量的工作;而Gemini3.5Flash-Lite则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini3.5FlashCyber是一种网络安全模型,专为发现和修补关键软件漏洞而构建。但根据评测来看,此次谷歌的新模型在智能上并不出色。AI模型评测平台Arena.ai的研究显示,Gemini3.6Flash在前端代码竞技场中以1537分排名第12位。
KimiK3发布真的被这次Kimi全新K3狠狠惊艳到,国产开源模型直接刷新纪录!
KimiK3发布真的被这次Kimi全新K3狠狠惊艳到,国产开源模型直接刷新纪录!2.8万亿超大参数搭配百万token超长上下文,一整篇代码仓库、长篇文献丢进去都能完整读懂,读写逻辑丝滑顺畅。原生搭载视觉多模态,看图写代码、对照画面修改设计都能一键搞定。专门针对编程、深度研究优化,自主调试程序、修复报错不用反复指令,开发者办公效率直接翻倍。全新注意力架构大幅提速,长文本加载不会卡顿。最戳人的是全面开放使用,网页端、代码工具、API同步上线,普通爱好者和技术从业者都能上手实测。