Soundraw是一个专为创作者打造的AI音乐生成器,无需任何音乐创作知识,几分钟内便可以创作出与你的内容完美匹配的歌曲。用户只需访问Soundraw,点击Create Music选项,然后选择相关标签生成音乐即可。
Proactive Agent是清华大学联合面壁智能等团队推出的新一代主动Agent交互范式 ,具备主动性,能预测用户需求并在没有直接指令的情况下采取行动。Proactive Agent观察环境和用户行为,推断出潜在的任务,并自主提供帮助。
AI教程资讯
2025-01-31
EMOVA(EMotionally Omni-present Voice Assistant)是多模态全能模型,是香港科技大学、香港大学和华为诺亚方舟实验室等机构共同推出的。EMOVA能处理图像、文本和语音模态,实现能看、能听、会说的全模态交互。
AI教程资讯
2025-01-31
OminiControl是高度通用且参数高效的图像生成框架,为扩散变换器模型如FLUX 1设计,实现对图像生成过程的精细控制。OminiControl支持主题驱动控制和空间控制,例如边缘引导和绘画生成,仅需在基础模型中增加0 1%的参数。
AI教程资讯
2025-01-31
Talker-Reasoner是谷歌DeepMind推出的AI代理架构,借鉴人类的认知理论,将代理分为两个模块:Talker和Reasoner。Talker模拟人类的快速直觉思维(System 1),处理即时对话和反应;Reasoner模仿缓慢的逻辑推理(System 2),负责复杂的多步规划和决策。
AI教程资讯
2025-01-31