拜拜导航

帅气的我简直无法用语言描述!

阿里推出全模态大模型 Qwen3-Omni-Flash:支持实时流式输出与 119 种语言交互的多场景 AI 能力解析

阿里正式发布 Qwen3-Omni-Flash,这是一款面向多模态智能交互的全场景大模型。根据官方介绍 ,Qwen3-Omni-Flash 支持文本、语音、图像等多种输入方式,并具备实时流式输出能...
8个月前
02540

阿里通义千问推出 Qwen3-TTS!支持 49 种音色、10 种语言与方言的多角色语音合成模型

阿里通义千问正式发布新一代 语音合成大模型 Qwen3-TTS,面向更真实、多样与可控的声音生成需求。该模型支持 49 种高度拟人的角色音色,涵盖不同性别、年龄、情绪与人物设定,同时覆盖 10 种...
8个月前
02480

微软 Excel 网页版上线全新“智能体模式”:AI 全程参与数据处理与推理分析

微软正式在 Excel 网页版中推出 “智能体模式”(Agent Mode),让 AI 能够以更自然、更自主、更智能的方式参与数据处理任务。从数据整理、公式生成、结构化分析到复杂流程执行,AI 不...
8个月前
01940

灵光AI助手上线科普动画生成功能:一键可视化复杂原理,提升学习效率

灵光AI助手推出全新能力:一键生成科普动画,让复杂知识更易理解 在科学知识传播不断提速的时代,人们对高质量、易理解的学习内容需求日益增长。为帮助用户更高效地掌握复杂原理,灵光AI助手正式上线...
8个月前
02670

智谱 AI 输入法全新上线:GLM-ASR 系列语音识别技术向开发者全面开源

智谱 AI 全新发布桌面输入法,GLM-ASR 语音识别技术正式开源 随着语音交互技术在办公、内容创作、实时沟通中的应用越来越普遍,用户对于高精度语音识别的需求不断提升。智谱 AI 近日正式发...
8个月前
02430

Qwen-Image-i2L:单张图秒变 AI 风格模型,一键生成 LoRA、个性化创作更轻松

阿里通义团队推出的 Qwen-Image-i2L 技术引发广泛关注。这项能力允许用户仅凭 一张图片,即可自动生成可微调的 LoRA 风格模型,大幅降低个性化 AI 图像生成的门槛。相比传统 LoR...
8个月前
01900

OpenAI 下一代图像生成模型曝光:Chestnut 与 Hazelnut 在盲测中展现显著提升

OpenAI 正在悄然推进两款代号为 “Chestnut” 和 “Hazelnut” 的新一代图像生成模型的测试。这两款模型目前正在 Design Arena 和 LM Arena 进行小规模的盲...
8个月前
02210

阿里云析言XiYan-SQL智能体,登顶BIRD-CRITIC全球榜单!

阿里云析言XiYan-SQL智能体,登顶BIRD-CRITIC全球榜单! 📖近日,阿里云飞天实验室自研数据分析智能体 “析言 XiYan-SQL” 在全球权威SQL诊断评测基准 BIRD-CRITIC...
8个月前
01950

上海交大发布全球首个光子芯片垂直大模型 LightSeek

上海交通大学无锡光子芯片研究院(CHIPX)正式发布 全球首个覆盖光子芯片全链路的专业大模型 LightSeek。该模型基于千亿级多模态架构打造,深度融合 110nm 中试线工艺与 数十万组真实制...
8个月前
02240

抖音副总裁李亮解读 AI 手机助手:基于用户授权的技术探索,与隐私无关

在近期的采访中,抖音副总裁 李亮 就外界关注的 “AI 手机助手” 话题进行了详细回应。他强调,AI 手机助手执行的所有操作均建立在 机主明确授权 的前提下,本质上属于用户驱动的功能增强,而非黑客...
8个月前
02940