昊梵体育网

亲亲畅谈科技的文章

之前AI搞不定的复杂手办模型,现在用GPT6轻松搞定了!这个机器人手办模型的生成

之前AI搞不定的复杂手办模型,现在用GPT6轻松搞定了!这个机器人手办模型的生成

之前AI搞不定的复杂手办模型,现在用GPT6轻松搞定了!这个机器人手办模型的生成
终于用上GPT6了,开始测试中[酷] ​​​

终于用上GPT6了,开始测试中[酷] ​​​

终于用上GPT6了,开始测试中[酷] ​​​

AGI来没来,你得先让我用上GPT6啊,到现在也没给推送最新的模型啊,等GPT6

AGI来没来,你得先让我用上GPT6啊,到现在也没给推送最新的模型啊,等GPT6
GPT-6 Astra 这次的成绩有点夸张了。从目前公布的这批 Benchmar

GPT-6 Astra 这次的成绩有点夸张了。从目前公布的这批 Benchmar

GPT-6 Astra 这次的成绩有点夸张了。从目前公布的这批 Benchmar
GPT-6 Astra 这次的成绩有点夸张了。

从目前公布的这批 Benchmark 来看,我觉得 GPT-6 很可能已经是现阶段世界上综合能力最强的模型。

最离谱的还是 ARC-AGI-3,GPT-5.6 Sol 只有 7.8%,GPT-6 直接干到了接近 99%。FrontierMath Tier 4 达到 97.6%,BenchCAD 95.9%,Terminal-Bench Science 也从 22. ​

GPT-6 Astra 这次的成绩有点夸张了。 从目前公布的这批 Benchmark 来看,我觉得 GPT-6 很可能已经是现阶段世界上综合能力最强的模型。 最离谱的还是 ARC-AGI-3,GPT-5.6 Sol 只有 7.8%,GPT-6 直接干到了接近 99%。FrontierMath Tier 4 达到 97.6%,BenchCAD 95.9%,Terminal-Bench Science 也从 22. ​

GPT-6 Astra 这次的成绩有点夸张了。 从目前公布的这批 Benchmark 来看,我觉得 GPT-6 很可能已经是现阶段世界上综合能力最强的模型。 最离谱的还是 ARC-AGI-3,GPT-5.6 Sol 只有 7.8%,GPT-6 直接干到了接近 99%。FrontierMath Tier 4 达到 97.6%,BenchCAD 95.9%,Terminal-Bench Science 也从 22. ​

GPT-6真的来了。AGI越来越进了!OpenAI正式发布GPT-6 Astra

GPT-6真的来了。AGI越来越进了!OpenAI正式发布GPT-6 Astra

GPT-6真的来了。AGI越来越进了! OpenAI正式发布GPT-6 Astra,重点已经完全转向Coding、Computer Use、Research和复杂多步工作。 我觉得GPT-6最重要的变化不是“聊天更聪明”。 而是AI越来越像一个真正会用电脑、能独立完成工作的员工。 AI的下一阶段,就是从回答你,到替你干活。 ​

GPT-6真的来了。AGI越来越进了! OpenAI正式发布GPT-6 Astra,重点已经完全转向Coding、Computer Use、Research和复杂多步工作。 我觉得GPT-6最重要的变化不是“聊天更聪明”。 而是AI越来越像一个真正会用电脑、能独立完成工作的员工。 AI的下一阶段,就是从回答你,到替你干活。 ​
传闻中的iPhone ultra折叠屏手机[doge] ​​​

传闻中的iPhone ultra折叠屏手机[doge] ​​​

传闻中的iPhone ultra折叠屏手机[doge] ​​​

OpenAI的新模型Astra,第一次触发了“Critical”级别的网络安全能

OpenAI的新模型Astra,第一次触发了“Critical”级别的网络安全能

OpenAI的新模型Astra,第一次触发了“Critical”级别的网络安全能力门槛。 简单理解: AI已经开始具备自主发现未知漏洞、继续研究利用方式的能力。 大模型越来越强以后,一个非常明显的变化就是: 它获得的已经不是“知识”,而是真正的行动能力。 ​

OpenAI的新模型Astra,第一次触发了“Critical”级别的网络安全能力门槛。 简单理解: AI已经开始具备自主发现未知漏洞、继续研究利用方式的能力。 大模型越来越强以后,一个非常明显的变化就是: 它获得的已经不是“知识”,而是真正的行动能力。 ​

Claude Fable 5.1这次最让我感兴趣的,是Anthropic已经不怎

Claude Fable 5.1这次最让我感兴趣的,是Anthropic已经不怎

Claude Fable 5.1这次最让我感兴趣的,是Anthropic已经不怎么强调“聊天”了。 官方直接把它定义成能连续工作数小时、跨多个软件执行任务的模型。 这就是我一直说的: 大模型下一阶段真正的竞争,不是回答问题,而是工作能力。 ​

Claude Fable 5.1这次最让我感兴趣的,是Anthropic已经不怎么强调“聊天”了。 官方直接把它定义成能连续工作数小时、跨多个软件执行任务的模型。 这就是我一直说的: 大模型下一阶段真正的竞争,不是回答问题,而是工作能力。 ​

ChatGPT广告业务不到200天,年化收入已经突破10亿美元。我觉得这件事非常

ChatGPT广告业务不到200天,年化收入已经突破10亿美元。我觉得这件事非常

ChatGPT广告业务不到200天,年化收入已经突破10亿美元。 我觉得这件事非常重要。 AI商业模式正在从“订阅+API”,正式增加第三条超级现金流:广告。 当ChatGPT周活超过10亿以后,它已经不只是AI工具了。 它正在变成新的流量入口。 ​

ChatGPT广告业务不到200天,年化收入已经突破10亿美元。 我觉得这件事非常重要。 AI商业模式正在从“订阅+API”,正式增加第三条超级现金流:广告。 当ChatGPT周活超过10亿以后,它已经不只是AI工具了。 它正在变成新的流量入口。 ​

腾讯Hy4这次我觉得真正杀进国产开源模型第一梯队了。770B总参数、49B激活、

腾讯Hy4这次我觉得真正杀进国产开源模型第一梯队了。770B总参数、49B激活、

腾讯Hy4这次我觉得真正杀进国产开源模型第一梯队了。 770B总参数、49B激活、百万级上下文,重点直接瞄准Coding和复杂Agent任务。 国产模型现在已经不只是卷聊天和跑分。 下一阶段真正比的是:谁能让Agent干活。 ​

腾讯Hy4这次我觉得真正杀进国产开源模型第一梯队了。 770B总参数、49B激活、百万级上下文,重点直接瞄准Coding和复杂Agent任务。 国产模型现在已经不只是卷聊天和跑分。 下一阶段真正比的是:谁能让Agent干活。 ​

ChatGPT这个更新,我觉得越来越像Agent时代的“企业App Store”

ChatGPT这个更新,我觉得越来越像Agent时代的“企业App Store”

ChatGPT这个更新,我觉得越来越像Agent时代的“企业App Store”。 公司现在可以直接把GitHub里的整个Plugin Marketplace导入ChatGPT,而且每天自动同步。 以后一个团队完全可以维护自己的AI能力库: 运营装运营Skill, 财务装财务Skill, 开发装Coding Skill。 通用模型 + 企业自己的Skill库,可能 ​

ChatGPT这个更新,我觉得越来越像Agent时代的“企业App Store”。 公司现在可以直接把GitHub里的整个Plugin Marketplace导入ChatGPT,而且每天自动同步。 以后一个团队完全可以维护自己的AI能力库: 运营装运营Skill, 财务装财务Skill, 开发装Coding Skill。 通用模型 + 企业自己的Skill库,可能 ​

腾讯这次Hy4我觉得终于真正杀进国产开源模型第一梯队了。770B总参数、49B激

腾讯这次Hy4我觉得终于真正杀进国产开源模型第一梯队了。770B总参数、49B激

腾讯这次Hy4我觉得终于真正杀进国产开源模型第一梯队了。 770B总参数、49B激活、100万上下文,重点直接瞄准Coding、办公和科研。 而且WorkBuddy、CodeBuddy免费两周,Hy3免费期继续延长到9月底。 现在国产模型已经不只是卷Benchmark了。 能力、Agent、价格、免费额度,全部一起卷。 用户爽了。 ​

腾讯这次Hy4我觉得终于真正杀进国产开源模型第一梯队了。 770B总参数、49B激活、100万上下文,重点直接瞄准Coding、办公和科研。 而且WorkBuddy、CodeBuddy免费两周,Hy3免费期继续延长到9月底。 现在国产模型已经不只是卷Benchmark了。 能力、Agent、价格、免费额度,全部一起卷。 用户爽了。 ​