标签:ViT

字节跳动 CEO 梁汝波称坚持自研大语言模型、接受短期落后,回应豆包、飞书、火山引擎整合

8 月 6 日消息,据虎嗅报道,今日(8 月 6 日)上午,字节跳动举办了 2026 年度年中全员会。公司 CEO 梁汝波、刚刚成立的“创造力服务平台”(Creativity Servi...

微软发布 Mage-VL:从零训练的流式多模态模型,视频理解提速 3.5 倍

微软近日在 Hugging Face 平台发布了 Mage-VL,一款面向图像与视频理解的流式多模态基础模型。该模型的核心创新在于其视觉编码器 Mage-ViT 完全从零训练,规...

OpenAI CEO 奥尔特曼提出用 AI 打造亲子晨间播客,遭网友批评

OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)对于“酷(cool)”的理解,似乎与大多数人并不相同。 例如,在他的 X 个人简介中,他写着一句“AI is cool i g...

事关AI业务!字节跳动新动作

7月30日,字节跳动启动面向AI业务的组织调整,加强豆包、飞书、火山引擎在企业生产力场景的产品与服务协同。 根据调整方案,飞书产品团队与豆包产品团队将进...

Qwen Fine-tuning

Qwen Fine-tuning: Unleashing the Potential of Large Language Models In the rapidly evolving landscape of artificial intelligence, large language mo...

华为云今日宣布正式上线 OpenClaw 体验计划

随着开源 AI 智能体 OpenClaw(“小龙虾”)的爆火,华为云今日宣布正式上线 OpenClaw 体验计划,支持用户将 AI 智能体部署在云端,通过与本地隐私数据隔离,实...

通义千问图像理解,AI在视觉内容分析中的革命性突破

随着人工智能技术的迅猛发展,通义千问作为阿里巴巴集团推出的大型语言模型,不仅在自然语言处理领域表现出色,其在图像理解方面的能力也日益凸显。通义千问...

航空航天设计,AI技术驱动的创新与未来

在当今快速发展的科技时代,航空航天设计正经历着前所未有的变革。传统的设计方法往往依赖于经验和手工计算,而如今,人工智能(AI)技术的引入,正在重新定...

目标识别,AI工具如何提升图像与视频中的目标检测精度

在当今人工智能快速发展的背景下,目标识别技术已成为多个领域的重要支撑。无论是自动驾驶、智能安防,还是工业检测和医疗影像分析,目标识别都发挥着关键作...

柯布西耶粗野主义,现代建筑的革命性先驱

在现代建筑史上,柯布西耶(Le Corbusier)被誉为“现代主义建筑之父”。他的理论与实践不仅塑造了20世纪建筑的面貌,也深刻影响了全球建筑风格的发展。其中,...
12363