比亚迪半导体是国内少数具备IDM全栈能力的车规芯片企业,今年5月发布的国内首款4nm车规智驾芯片璇玑A3已进入规模化量产,三颗协同可释放超2100TOPS算力。 据彭博社报道,日本知名游戏品牌任天堂(Nint…...
倒是谷歌内部对新一代旗舰模型的态度还挺有意思的。 官方还重点强调了Argon的防御性网络安全优势。 一些接触过Gemini 4的员工认为,模型在实际编程任务中并没有跑分那么亮眼,网页和应用的前端界面设计仍是…...
二、OpenAI 推出 GPT‑6.1 Sol 大模型,以五分之一成本实现接近 Astra 级别的综合性能OpenAI 正式对外发布GPT‑6.1 Sol,作为 GPT‑6 Sol 的升级版本,这款模型在…...
演示部分也不含糊,有人要它用 Three.js 现搭一个空间站,让它在页面里绕着地球转,十六分钟到手,连地球贴图都自己去网上抓,图的是经纬度和颜色对得上;另一组测试要一段浮筒飞机水面滑行的物理过程,它给出的…...
这次,Sol和Luna是用与GPT-6Astra相似的训练方法打造的,它们汲取了Astra在专业工作、事实准确性、代码编写、计算机视觉操作以及人类对齐上的最先进成果。 相比于GPT-5.6的促销价,GPT…...
就在今天,OpenAI 放了个大招。主角大多是上了年纪的女性:有人在厨房揉面,手机就竖在台面上;有人拉陶坯,两手糊满了泥;还有人顶着一头卷发筒,在美容院里坐着。 这回 OpenAI 琢磨的是另一件事:模型…...
据官方公布的基准测试来看,在 AutomationBench 测试(评估 AI Agent 跨不同应用完成业务工作流的能力)中,GPT-6Sol 在 xhigh 推理级别下的表现超过了最高推理级别的 C…...
上一代Luna的输出价格是1.20美元,这一次只剩0.50美元。Luna在ArtificialAnalysis智能指数上拿到37分,比DeepSeekV4.1Flash的39分还低。 把两家新模型的价格…...
昨天,OpenAI发布GPT-6 Sol与GPT-6Luna,官方口径:相比GPT-5.6的促销价,API再降50%——而且是永久定价,不玩限时。 两款模型是什么公开资料能确认的是,这次发布把GPT-6…...
当地时间9月22日,Anthropic推出Claude Opus 5.5,同期OpenAI发布GPT-6 Sol和GPT-6 Luna,三款模型都把性价比作为核心卖点。小米称,该模型刷新了国产模型的性价比纪录…...
Anthropic 这次没有把普通单价降到与 Sol 相同,却把缓存读取从每百万 token 0.50 美元降到了 0.20 美元。长任务客户能获得多少优惠,开始更多地取决于缓存命中率,而不只是价格表上的普…...
Anthropic表示,相较于新推出的Fable 5.1,该模型在大幅降低价格的同时,任务处理能力显著提升。Sol在性能与成本间取得平衡,能力略高于Luna,但比最强大的Astra更为经济;Luna则完全侧重…...
在这项测试上,Opus 5.5 拿到 40.0%,GPT-6 Sol 最好的成绩是 xhigh 档的 33.2%,差了将近 7 个百分点,而且Anthropic 注明,Opus 5.5 这次是在不启用备用模…...
八月的统计里,付费买 AI 服务的美国企业中 Anthropic 占 43.8%、OpenAI 占39.8%,两家几乎是贴身状态;同一份数据里,前沿模型吃掉的 token 份额从八月初的 53% 滑到九月初…...
根据披露,对于Sol级别及以上能力的模型,所有强化学习(RL)训练、评估及推理工作负载均须接受实时监控;当前估算显示,监控开销约占被监控推理算力的20%。 巴克莱最新研究报告显示,前沿AI实验室推行的“节奏控…...
本周初,OpenAI与Anthropic几乎同步启动了新一代旗舰模型的灰度测试,这一默契举动引发市场高度关注。 另一边,Anthropic选择跳过5.1版本,直接推出Opus5.2模型。目前该模型仅在Clau…...
OpenAI 此前向媒体提供的一份受发布禁令限制的预发布草稿显示,Astra 在 ARC-AGI-3 评测中的成绩为 98.6%。 Chen 表示,他希望行业能够形成新的规范:当公司修改模型基准测试成绩时,…...
OpenAI称GPT-6 Astra是目前最智能的模型,相比GPT-5.6 Sol,它在软件工程、科研、网络安全和专业工作等方向都有提升,计算机操作进步尤其明显。大模型研究员姚宇航告诉「AIX财经」,Open…...
这个99.9%的高分的前提是,它跑在OpenAI为自家模型适配的Harness上,所以效果会更突出。对此,OpenAI直接称它“世界上最好的ComputerUse模型”:GPT-6 Astra把软件当作“…...
ChatGPT Plus和Pro订阅用户将率先体验到升级版GPT-5.6 Sol模型。OpenAI透露,内部评估显示,相较于GPT-5.5-Instant,GPT-5.6 Luna的事实性错误率降低了62…...
Opus 记住了 Sol 给它上的这一课。Opus一口回绝——它的内部推理日志显示,它明确知道这是违反《谢尔曼法》的价格合谋,属于美国反垄断法严厉禁止的行为。Opus 直接一封邮件怼过去,标题大意是:用我…...
OpenAI 检查模型运行过程后发现,问题并不完全来自模型能力,而是测试框架限制了 Agent 的长期记忆。 ARC-AGI-3为了保证评测公平,采用了一个统一、简化的测试框架,但这个框架没有考虑到 Ag…...
7月11日,OpenAI近期推出的GPT-5.6系列旗舰模型Sol被曝出重大漏洞,该模型在处理任务时会出现随机误删本地文件的严重故障,且删除文件极大概率无法恢复。目前已有用户发出警示,呼吁不要在未受保护的驱动…...
该模型通过后训练技术,成功为规模更小的Luna模型定制了完整的训练方案,并在内部评估中取得显著性能提升——其聚合RSI指数较前代GPT-5.5高出16.2个百分点。OpenAI研究员Kathy Shi在技术分…...
GPT-5.6 Luna:是该系列中速度最快、价格最实惠的模型,以最低的成本提供强大的能力。 OpenAI 计划在未来几周内,在ChatGPT、Codex 和 API 中全面推出 GPT-5.6 Sol、T…...