地址: 宿州市括某之森448号 邮箱: dissenting@163.com 工作时间:上午9点-下午8点

资讯中心

  • 首页
  • Our Portfolio
  • 三家科技公司新推模型,聚焦加速与上下文扩展

三家科技公司新推模型,聚焦加速与上下文扩展

2026-09-20

当天,三家科技企业推出了新模型。阿里发布了Qwen3.8-Omni-Flash,支持的上下文长度达到1M;智谱推出了GLM-5.3-FlashX,推理速度达200tokens/s;而谷歌则更新了Gemini 4 Pro。这三款产品名称中都含有“快”和“长”的元素,显示了当前市场趋势。过去一年,大模型的参数竞争逐渐转向推理速度和上下文长度的比拼,“Flash”后缀已成为各家产品中的常见标识。

在模型之外,硬件领域也在发力。据悉,苹果正开发名为Baltra的AI服务器,搭载M8 Ultra,这表明一家以终端设备为主的公司正在向基础计算力扩展。同时,Booster K1人形机器人也已正式上市。从纯软件到具身智能,AI的应用正在不断深化。这两项发展有密切关联——模型性能的实现依赖于强大的计算基础和可执行的物理设备。

在具体应用场景方面,特斯拉已将大型模型的语音助手扩展到更多车型,而腾讯则在内部测试其AI语音助手Chatterfly,其特点是本地化数据存储。车载语音助手解决了驾驶时的互动需求,而本地化存储则回应了用户对数据隐私的关切。这些进展虽然不像新模型发布那样引人注目,但却对AI实际应用的可行性起到关键作用。 球友会

从当天的动态来看,行业在模型层、基础设施层和应用层同时推进:模型专注于速度和上下文扩展,基础设施提升计算自主性,应用层则向具体场景深入。这三方面互相独立又紧密相连。

订阅我们的时事通讯并获取最新消息