阿里与上交大提出 LLM 长文本计算新解法:可处理文本长达 1900k 字节、效率提升 2.4 倍2025-08-22 10:59编译 | 郭 思编辑丨陈彩娴在实际应用大模型的过程中,尤其是处理长文本的上下文信息时,如何高效灵活地调度计算资源成为一个学术界与工业界共同关注的问题。大语言模型所能容纳的上下文长度直接影响了诸如 Ch ...深站
人大 Sora 思辩:Sora 到底懂不懂物理世界?2025-08-22 10:41Sora 发布至今,虽然仍未正式对外开放,但对其技术细节、切实影响的讨论从未停歇。讨论的背后,是为了探索人工智能的更本质问题。对旧有视觉生成思路的检验和校正,是 Sora 带来的直观影响。在此基础上, ...深站
从 0 到 1,揭秘中国首个 AI 音乐 SOTA 模型2025-08-22 09:51【雷峰网(公众号:雷峰网)】雨果曾经说过:“开启人类智慧宝库的三把钥匙,即数字、字母、音符。”音乐早已成为人类表达情感的最佳载体。但音乐创作是一件门槛很高的事情,因为音乐创作不是某一个人的独角戏,而一 ...深站
上海AI实验室开源发布高质量语料“万卷CC”2025-08-22 09:38近日,上海人工智能实验室上海AI实验室)发布新一代高质量大模型预训练语料“万卷CC”WanJuan-CC),首批开源的语料覆盖过去十年互联网上的公开内容,包含1千亿字符100Btoken),约400G ...深站
徽风皖韵绕濠江 经典黄梅戏澳门上演2025-08-22 09:23来源标题:徽风皖韵绕濠江 经典黄梅戏澳门上演新华社澳门5月25日电记者齐菲、刘刚)第五届粤港澳大湾区中国戏剧文化节之澳门—安徽黄梅戏文化周正在此间举行。中国戏剧梅花奖“二度梅& ...深站
黑客大会遇上元宇宙:极客精神的又一次狂欢2025-08-22 09:191993年的拉斯维加斯,18岁的 Jeff Moss 正准备面临一场悲伤的别离。他的一位黑客朋友由于爸爸工作调动即将离开美国,为了给这份友谊再留下些纪念,Jeff 决定给朋友办一个盛大的告别 Part ...深站
多模态AI技术「涌现」,AI公司的「新机会」2025-08-22 09:00ChatGPT-4的横空出世,让AI行业再一次柳暗花明。某AI企业人士如此评价GPT-4的进步:“GPT-3或3.5像一个六年级学生,而GPT-4像一个聪明的十年级学生。”即将毕业的小学生与新晋高中生 ...深站
别再声讨零一万物了2025-08-22 08:57最近两天,由原阿里技术副总裁、深度学习框架 Caffe 发明者贾扬清一则朋友圈引发的关于“国内某大厂新模型套壳 LLaMA 架构”的问题在中国人工智能圈与科技媒体中产生了热烈讨论。由于贾扬清在国内 A ...深站
独家|杨红霞创业入局“端侧模型”,投后估值 1.5 亿美元2025-08-22 08:57近日,关于字节跳动大语言模型研发技术专家杨红霞离职创业的事情,坊间传得沸沸扬扬。雷峰网独家获悉,杨红霞已于 5 月下旬正式从字节跳动离职,开始筹备 AI 创业项目。不过,杨红霞不做“大”模型,而是将方 ...深站
谁将替代 Transformer?2025-08-22 08:54【雷峰网(公众号:雷峰网)】2017年谷歌发表的论文《Attention Is All You Need》成为当下人工智能的一篇圣经,此后席卷全球的人工智能热潮都可以直接追溯到 Transformer ...深站