标签:文字
Meta 发布首个实时音频感知 AI 模型,支持 20 余人分轨转写
9 月 2 日消息,科技媒体 9to5Mac 昨日(9 月 1 日)发布博文,报道称 Meta 公司推出 Muse Voice Transcribe,这是其首个实时音频感知模型。 开发者可通过 Me...
谷歌 AI 图片设计工具 Pics 上线,Docs / Slides 办公套件可直接调用修图
9 月 2 日消息,谷歌昨日(9 月 1 日)发布博文,宣布正式上线 AI 图像设计与编辑工具 Google Pics。用户可通过 pics.new 使用网页版,也可在 Google Docs 和...
DeepSeek-V4-Flash-Vision-Exp 模型已开源,多模态 Agent 能力接近 Opus-4.8
刚刚,DeepSeek V4 首个多模态模型 DeepSeek-V4-Flash-Vision-Exp 在 Hugging Face 上线,采用 MIT License 开源。 公开内容包括模型文件、Tokenizer、Promp...
MiniMax开始靠别人赚钱
MiniMax半年财报显示收入1.17亿美元,研发投入2.97亿美元。B端及开放平台收入占比升至63.4%,AI原生产品退居次位。公司面临客户增长与模型成本赛跑,毛利率提...
小米发布三款玄戒芯片,但未定义何为AI手机
8月24日,小米在玄戒技术沟通会上发布三款芯片,试图为AI提供可量化的能力证据。玄戒O3拥有200 TOPS的NPU算力,玄戒O100以1.22TB/s带宽突破端侧大模型的“内存...
商汤开源8B模型SenseNova U1.5 Lite,称比肩闭源GPT-Image-2
商汤科技今日正式开源其8B参数多模态模型SenseNova U1.5 Lite,官方宣称该模型在复杂排版、精准编辑等核心场景上比肩闭源的GPT-Image-2。这是继三周前发布Pre...
DeepSeek视觉模型实测:认错梁文锋,复刻网页不如GLM-5.3
DeepSeek在千呼万唤中推出了视觉理解模型DeepSeek-V4-Flash-Vision-Exp,正式补齐多模态能力。该模型原生支持图片输入,可识别图像、读取截图和图表。价格延...
高盛合伙人警告:华尔街普及 AI 或削弱金融从业者思考能力
8 月 25 日消息,高盛负责一项旗舰人工智能项目的合伙人警告称,AI 在华尔街的快速普及可能削弱下一代金融从业者的思考能力。 “这里存在一个巨大的风险:在 A...
商汤科技发布SenseNova U1.5 Lite正式版
8月21日,商汤科技宣布,正式开源轻量级、原生统一多模态大模型SenseNova U1.5 Lite。据介绍,模型重点围绕真实视觉任务重新完善训练数据、任务设计与后训练...
最强生图模型要来了?OpenAI 被曝偷偷测试 GPT Image 2.5
OpenAI 可能正在测试一款新的 AI 图像模型。 这两天,多名海外用户发现,一个名为 luna-lisa-alpha 的神秘模型出现在 LMArena 测试平台中。 从目前流出的...
津公网安备12011002023007号