欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
新鲜AI产品点击了解:https://top.aibase.com/
1、开源端到端语音大模型step-Audio-AQAA:听懂音频直接生成自然语音
Step-Audio-AQAA 是一个开源的端到端语音大模型,能够直接从原始音频输入生成自然流畅的语音输出,显著提升了人机交互的体验。该模型由双码本音频标记器、骨干 LLM 和神经声码器三部分组成,能够高效处理语音中的复杂信息,为未来的智能语音应用奠定了坚实的基础。

【AiBase提要:】
Step-Audio-AQAA 可以直接从音频输入生成自然语音,提升人机交互体验。
模型架构由双码本音频标记器、骨干 LLM 和神经声码器三个模块组成,能够高效捕捉语音中的复杂信息。
Step-Audio-AQAA 的推出标志着语音交互技术的重要进展,为未来智能语音应用提供了新思路。
详情链接:https://huggingface.co/stepfun-ai/Step-Audio-AQAA
2、百度发布“绘想”平台与MuseSteamer:AI生成视频,一张图即可搞定专业级大片!
百度发布“绘想”平台与MuseSteamer,通过生成式AI和多模态技术提供全面的视频生成解决方案,满足搜索、广告等场景需求。MuseSteamer具备强大的可控性和高性价比,用户只需上传图片即可生成专业级视频内容,极大简化了视频 *** 流程。

【AiBase提要:】
MuseSteamer支持音视频一体化生成,实现电影级 *** 效果。
支持连续10秒动态视频生成,提升创作效率。
️ 用户仅需上传一张图片即可生成专业级视频内容。
详情链接:https://huixiang.baidu.com/
3、浙大与阿里联合发布OmniAvatar:音频驱动全身数字人模型震撼登场
浙大与阿里联合发布的OmniAvatar模型在音频驱动数字人技术上取得重大突破,能够生成自然流畅的全身数字人视频,尤其在歌唱场景中表现出色。该模型支持通过文本提示精细控制生成细节,并具备多场景应用潜力,为营销、教育及娱乐等领域带来创新可能。
【AiBase提要:】
音频驱动技术实现全身数字人视频生成
支持文本提示控制细节,提升灵活性
开源项目为商业场景提供广阔应用空间
4、百度搜索迎来十年来更大改版:AI智能框、百看、AI助手全面进化
百度搜索进行了十年来更大规模的改版,引入了智能框、百看和AI助手等创新功能,显著提升了用户的搜索体验和创作能力。
【AiBase提要:】
🧠 智能框支持千字输入,增强多模态交互能力。
百看功能升级,支持混合内容输出和智能体服务。
️ AI助手新增视频通话功能,提升创作与搜索能力。
5、xAI控制台新增Grok4及Grok4Code引用,标志着下一代AI模型即将发布
xAI在开发者控制台中新增了对Grok4及Grok4Code的引用,预示着下一代人工智能模型的发布即将来临。Grok4被描述为‘全能型AI的巅峰之作’,而Grok4Code则专注于编程优化。这两款模型的引用表明其公开发布已进入最后准备阶段。

【AiBase提要:】
🧠 Grok4作为xAI的旗舰模型,专注于自然语言处理、数学推理和综合推理能力的提升。
Grok4Code专为编程优化,计划与代码编辑器无缝整合,提高开发效率。
xAI通过API提供Grok4访问权限,未来将扩展至多模态能力,降低开发者整合门槛。
6、Gemini Live重磅升级!无缝连接Google应用,智能生活触手可及
Gemini Live的升级通过与Google生态系统的深度整合,提升了用户的智能交互体验,同时兼顾了隐私保护,展现了其在智能助手领域的潜力。
【AiBase提要:】
Gemini Live将与Google Maps、Calendar等应用深度整合,提升跨应用操作效率。
🧠支持多模态交互,如扫描信息自动生成任务或日程,增强实用性。
Google注重隐私保护,用户可自主管理权限以确保数据安全。
7.武汉首发全国首辆 AI 外卖配送车,配送效率大幅提升
武汉推出全国首辆搭载 AI 技术的外卖配送车 —— 智音车,配送效率提升显著,标志外卖行业的技术革新。
【AiBase 提要:】
智音车在武汉首发,配备北斗双频芯片,提升外卖配送效率。
外卖小哥配送效率提升30%,日均多赚80元。
定位精度高达1米,智音车技术前景广阔。
8、Anthropic年化收入已达40亿美元,较年初增长近4倍、与 Cursor 竞争加剧
文章指出,AI独角兽Anthropic年化收入已达40亿美元,较年初增长近四倍,同时其竞争对手Cursor也在积极扩展业务,双方竞争加剧。Cursor依赖Anthropic的技术,并通过引入高管和创新提升竞争力。人工智能技术的快速发展推动了编程工具的需求增长,各公司都在争夺市场份额。
【AiBase提要:】
🤖 Anthropic年化收入达到40亿美元,较年初增长近四倍。
Cursor通过引入Anthropic的高管增强市场竞争力。
人工智能技术快速发展,编程工具需求持续增加。
(举报)
扎根印制电路板技术研发二十年,专注于汽车电子、高频通讯等中高端领域的协和电子(605258)本周启动招股,下周四(11月19日)即将网上申购。 多年的沉淀,令其收获了一批优质客户。不过随着行业规模增长放缓、各类成本抬升以及行业龙头集中度提高,协和电子往日优势逐渐消退,利润水平也逐年降低,此...
1947年,美国贝尔实验室的威廉.肖克利和他的两位助手布拉顿、巴丁,研制出了世界上第一只晶体管,为集成电路产业打开时代大门,也造就了现代信息社会的根基――“芯片”。 但是现代信息社会并不能避不开国与国之间的问题。 “芯片强则产业强,芯片兴则经济兴,没有高端芯片就没有真正的产业安全和国...
威腾电气,一家缺乏科创属性、爱夸夸其谈还带着问题供应商的公司,正在冲击科创板市场。 2021年1月14日,以输配电中母线产品研发、制造及销售为主业的威腾电气,正式通过上市委会议,距离科创板上市又近了一步。 但这对投资者而言,可能并不是一件好事。 由于身在传统电力行业,科研步伐又...
钱流不进口袋的企业,真的算是赚钱企业吗? 盈利,是大部分投资者最关心的问题。但企业盈利的有效性,是有前提的,现金流就是这个前提。但这部分,往往会被许多投资者忽略,正如巴菲特的那句著名评论:“现金是氧气,99%的时间你不会注意它,直到它没有了”。 没有现金流入的盈利只是纸面数字,纸面数...
以19%市占率位居精微屏蔽罩市场头部玩家的和林微纳,即将亮相科创板。 2021年3月9日,主要产品为微机电(MEMS)精微电子零部件的和林微纳,开启了科创板招股。公司与楼氏电子、瑞声科技、裕元电子和银河机械,一同成为精微屏蔽罩市场的主要玩家,2019年五家企业合计占到全球市场总份额的80%...
作为“光伏、风电”等大热门行业上游关键零部件供应商的新风光,即将登陆科创资本市场。 2021年3月24日,以大功率电力电子节能控制技术为核心技术平台,构筑电气控制装备产品体系的新风光,在科创板开启招股环节。 招股资料显示,新风光本次共计将募资5.9亿元,其中1.5亿元用于变频器和SV...