标签:GPU
DeepSeek V4 Pro API 缓存命中价格高峰时段涨 11 倍
8 月 17 日,DeepSeek 调整了 V4 Pro API 的定价,其中缓存命中价格在空闲时段上涨 5 倍,高峰时段更是上涨 11 倍,从每百万 Token 0.025 元涨至 0.3 元。这...
OpenAI与Anthropic降价应战中国AI对手
美国领先AI实验室OpenAI与Anthropic正通过发布更便宜的模型来应对中国竞争对手的挑战,以留住对价格敏感的客户。这场价格战源于企业AI支出不断攀升,促使公司...
对标 Claude Cowork:DeepSeek Harness 公测,同步开放插件生态
8 月 13 日消息,DeepSeek-V4-Pro-0813 正式开源,同时还推出了其开源(MIT 协议)的代码智能体框架 Harness 的 v0.1 开发者预览版(基于 Cordis),并同步开...
Meta发布开源Glimmer模型,展示扎克伯格个人超级智能愿景
Meta于周一发布了开源权重模型Muse Glimmer,该模型拥有300亿参数,旨在消费级硬件上本地运行AI代理,为CEO马克·扎克伯格提出的“个人超级智能”愿景提供了迄今...
谷歌 Chrome、微软 Edge 浏览器双双要求:下载本地 AI 模型需预留 20GB 空间
今年 5 月,有人发现谷歌 Chrome 会自动向符合条件的 PC 下载一个约 4GB 的 AI 模型,引发不少争议。Chrome 利用该模型在设备本地运行部分 AI 功能,减少把任...
蚂蚁集团百灵开源 Ling-3.0-flash 模型:124B 总参数、5.1B 激活参数
蚂蚁集团旗下百灵大模型官方昨日宣布,新一代原生混合推理模型 Ling-3.0-flash 现已正式开源。 Ling-3.0-flash 采用 124B 总参数、5.1B 激活参数的 MoE 架构...
DeepSeek涨价30倍仍最便宜,工程师称租赁GPU也能复现低价
DeepSeek 近期宣布涨价,幅度高达 30 倍,但第三方平台 OpenCode 工程师 dax 在帖子中表示,即便租赁 GPU 也能复现其当前价格,并推测这次涨价并非因为亏损,...
澳洲AI云公司Firmus股权融资20亿美元
澳大利亚AI云服务商Firmus宣布完成一笔20亿美元的战略股权融资,投资方阵容包括Blackstone、Coatue、英伟达和Jane Street。本轮融资将用于加速其在澳大利亚的...
Runware 推出集装箱式 AI 推理 Pod,加速 GPU 部署
AI 推理与原生计算公司 Runware 于 2026 年 8 月 4 日发布 Sonic Inference Pod,这是一种集装箱式模块化数据中心,旨在快速扩充面向模型提供商的 AI 推理基...
Nebius Q1营收增684%,行云科技将Token收入写入合同,算力业迈入TaaS时代
全球AI算力基础设施行业近期出现两起标志性事件,被市场解读为行业正从传统的IaaS(基础设施即服务)时代迈入TaaS(Token as a Service)时代。 第一起事件来...
津公网安备12011002023007号