分类
平台
排序
MOSS-Speech开源:国内首款语音到语音大模型,不再依赖文本中介
复旦大学MOSS团队发布了全新MOSS-Speech,首度实现端到端的语音到语音对话;目前已在Hugging Face提供在线演示,权重与源码同步开放。MOSS-Speech采用“分层拆解”思路:保留并冻结原MOSS文本模...
传华为 AI 眼镜暂定2026年上半年亮相:轻量化机身配三电池设计
有消息称,华为正筹备在2026年上半年发布一款全新的 AI 眼镜。新品主打轻量化,内部采用三块锂电池方案,外观提供流光银、钛银灰、摩登黑三款时尚配色。该眼镜将预装鸿蒙系统,可实现跨设备无缝...
韩国推出全球首个 AI 综合法:严控“高风险”场景
1 月 22 日,韩国政府正式发布被称为“全球首个”的人工智能综合监管法案。据 媒体报道,《人工智能基本法》已全面生效,推进速度甚至快于欧盟计划在 2027 年分阶段实施的相关法规。韩国希望借...
Sora改名引商标争议:Cameo指责OpenAI伤害品牌,法院火速颁禁令
最近,OpenAI因产品取名再陷商标风波:从Sora应用中的“cameo”功能,到尚未发布的硬件名称“io”,均被质疑与现有商标过于接近,引发行业关注。今年9月,OpenAI在Sora应用中推出一项深...
Mistral AI加速升级为全栈服务商,打造欧洲算力与定制化新壁垒
在最近举行的巴黎 Mistral AI Now 峰会上,这家备受关注的创业公司公布了新的发展方向——正式由单纯做模型研发的企业,全面升级为覆盖算力基础设施、底层模型以及上层应用的全栈 AI 服务提供方...
谷歌AI试衣迎来大升级:用一张自拍就能虚拟试穿
谷歌周四发布了AI试穿的新版本,现在只要一张自拍就能进行虚拟试衣。过去需要上传全身照,这次更新大幅降低了使用门槛。依托谷歌的Gemini2.5Flash Image模型Nano Banana,系统会根据自拍生成你...
谷歌翻译重磅更新:任意耳机一键变同传,Gemini助力还原“原声”对话
TechCrunch称,谷歌翻译应用最近上线一项测试版能力——用户只要戴上任意耳机,就能在耳机里即时听到高质量的译音,同时尽量保留原说话者的语气、重音与节奏。换句话说,普通耳机瞬间就能当作随...
昆仑万维推出 Mureka V8:AI 音乐从“能生成”迈向“可发行”
2026年1月28日下午,昆仑万维官宣上线昆仑天工 Mureka V8 音乐大模型。这一步意味着 AI 音乐创作迎来一次实质性飞跃。核心能力全线升级Mureka V8在多项关键技术上同步升级,明显拉近了AI生成作...
千问 App 接入高德:阿里 AI 走向现实世界,文字指令直通导航打车
据 媒体 报道,12月18日,阿里旗下的千问 App 宣布接入首个生态场景——高德地图,这意味着千问 AI 助手开始具备对物理世界的理解与执行能力。通过系统级打通高德每日超千亿次调用的时空引擎及...
向僵硬AI说再见!快手Kling 2.6把你的声音“装进”角色里,复杂舞蹈也能精准还原
快手近日把其视频生成器 Kling 升级到 2.6 版本,带来语音控制和动作控制两项核心能力,为AI视频创作迈出关键一步。本次更新不仅支持原生音频同步生成,还在复杂动作的还原精度上大幅提升。语音...
有消息称字节跳动计划投入230亿美元加码 AI 基础设施
正文:为追赶美国科技大厂在人工智能上的领先优势,字节跳动正显著提高其 AI 投资预算。根据《金融时报》及多位知情人士的消息,字节跳动已拟定 2026 年的资本开支方案,预计投入约 230亿美元(...
“电子废料”不能说了?微软强塞 AI 惹众怼,官方社区屏蔽“Microslop”
微软最近在 Windows 11 里强势推动各类 AI 功能,没想到掀起了一场舆论风暴。因担心系统稳定性被忽略,国外网友给微软安了个带嘲讽意味的外号——“Microslop”。近日有消息称,微软在自家 Disc...










