标签:大模型
New刚写完V4.1主算子就要“转业”?DeepSeek资深算子工程师深夜独白
大模型狂飙的这半年,宏观叙事越来越走向极端:一边是创始人动辄颠覆一切的狂言,一边是耸人听闻的末日威胁。而当变革的重锤砸向AI开发的一线,那些用代码推...
NewDeepSeek Harness官方桌面端即将就绪:爽用V4.1 Flash还得靠自家
9月15日消息,8月中旬V4 Pro正式版发布的时候,DeepSeek还顺带着推出了DeepSeek Harness(简称DSH),这是官方配套的客户端,但之前是Web界面,现在终于能等...
NewMeta新研究:字节模型蒸馏后,天花板破了
Token词元替代了Byte字节,但不意味着大模型都得是Token。 字节模型,特别是蒸馏后,有点儿新说法。 最近,来自Meta FAIR和华盛顿大学的论文《突破Token天...
NewOpenAI着手修复GPT-6 Astra降智问题:国内用户受伤最深 快来检测中招没
9月15日消息,OpenAI的旗舰大模型GPT-6 Astra发布有几天了,最初全网都在夸它的强大令人震撼,这几天很多都变成吐槽了,因为降智严重。 每次有新版大模型发...
NewGartner发布2026中国人工智能十大趋势
Gartner发布2026年中国AI十大趋势,包括全栈式自主可控AI、务实驱动的模型创新、可扩展的智能体劳动力、AI超级入口等,涉及模型芯片自主化、技术栈韧性、开源...
New突发,英伟达“封杀”Claude最强模型
Anthropic的顶级金主们,正在集体拔网线。 英伟达、Palantir、博思艾伦,硅谷最不差钱、也最舍得在AI上砸钱的几家公司,最近默契地干了同一件事—— 在核心业...
New22亿Agent即将上线,AI计算底座如何接住这场洪流?一场大会给你讲透了
就在上周,海外SaaS巨头Salesforce正式上线了一批“job-ready”(即用型)长周期智能体。 销售Agent Hunter可以跨天、跨周持续跟进一个销售机会——自己做研究、...
New书生发布 Intern-S1-Pro:1T 参数 MoE 多模态科学推理模型
书生 InternLM 团队在 Hugging Face 上线了 Intern-S1-Pro,这是一款总参数规模达到 1T 的多模态科学推理模型,采用 MoE(混合专家)架构,共配置 512 个专家...
New阶跃发布 StepAudio 3 系列语音大模型,拿下多个全球第一
9 月 15 日消息,今日阶跃正式发布 StepAudio3 系列模型,包括 StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,其中...
OpenAI 联合创始人布罗克曼:仅前沿 AI 大模型研发需放缓
9 月 14 日消息,OpenAI 总裁兼联合创始人格雷格 · 布罗克曼(Greg Brockman)提出,人工智能研发的放缓举措,应当仅限于像他们这样开发顶尖大模型的企业。 ...
津公网安备12011002023007号