人工智能归档 | 第31页共65页

Qwen3-TTS-Flash发布：17种音色+9大方言的中文TTS革命

6个月前高效码农

“ 一句话先给结论：这是 2025 年最便宜、最快速、方言最多的中文 TTS，没有之一。读完你能： ① 用 3 行代码让北京大爷给你读热搜；② 用 5 行脚本批量生成 17 种音色的短视频配音；③ 把 …

DeepSeek-V3.1-Terminus重磅升级：Agent能力飙升，FP8推理全解析（附本地部署指南）

6个月前高效码农

TL;DR：DeepSeek-V3.1-Terminus 是 DeepSeek 系列在 V3.1 基础上面向 agent 能力与语言一致性的一次迭代，强化了 Search Agent / Code …

Qwen3-Omni 全面解析：阿里通义千问发布的全能多模态大模型

6个月前高效码农

引言：为什么说Qwen3-Omni是AI领域的”全能选手”？还记得那些只能处理文字的传统AI模型吗？它们就像只会一种乐器的音乐家，虽然技艺精湛，但表现力有限。而现在，阿里通义 …

清华团队发布DeepDive深度搜索智能体，知识图谱+多轮强化学习突破搜索边界

6个月前高效码农

引言在信息爆炸的今天，我们每天都在搜索。无论是用 Google、Bing，还是国内的百度、知乎搜索，我们习惯了“输入关键词—得到答案”的流程。但当问题变得复杂，比如“请列出 19 世纪在巴黎活跃过 …

自主研究代理革命：UDR如何实现无需微调的全自定义研究策略

6个月前高效码农

Universal Deep Research：重新定义自主研究代理的灵活性与控制力本文欲回答的核心问题 “能否构建一个既支持高度自定义研究策略、又兼容任意大语言模型的研究系统，而不需重新训练或微调 …

Stock GPT：用自然语言对话管理库存的AI智能助手

6个月前高效码农

Stock GPT：用自然语言对话管理库存的智能助手在库存管理领域，我们经常面临这样的困境：需要快速查询库存状态，却被复杂的数据库查询语言所阻碍。Stock GPT的出现彻底改变了这一现状，它是一款 …

美团开源5600亿参数LongCat-Flash-Thinking模型：如何实现推理效率飞跃？

6个月前高效码农

I. 摘要与概述 LongCat-Flash-Thinking 是一个高效的开源大型推理模型，由美团 LongCat 团队开发。它总参数量达到 5600 亿，但平均激活参数仅为 270 亿，这得益于创 …

DeepSeek-R1-Safe如何重塑AI安全格局？浙大华为联合研发的四大训练流程揭秘

6个月前高效码农

在人工智能技术迅猛发展的今天，大模型的能力边界不断拓展，但其安全性与合规性也日益成为行业关注的焦点。今天我们要介绍的 DeepSeek-R1-Safe，正是为了解决这一难题而诞生的创新解决方案。什么 …

谷歌新突破！TTD-DR深度研究代理如何刷新行业纪录？

6个月前高效码农

近期，大型语言模型（LLMs）的快速发展推动了深度研究（DR）代理的兴起。这些代理展现出令人惊叹的能力，包括生成新颖的想法、高效检索信息、执行实验以及撰写综合报告和学术论文。目前，大多数公开的 DR …

用WiFi信号捕捉人体动作？这项黑科技竟能实现高精度姿态估计！

6个月前高效码农

WiFi信号实现人体姿态估计：技术原理与未来展望引言在计算机视觉领域，通过摄像头、激光雷达（LiDAR）和雷达进行人体姿态估计的技术已经取得显著进展。然而，这些方法面临诸多挑战：摄像头：受光照和 …

ROMA框架：多智能体递归拆分协作的30秒上手指南

6个月前高效码农

ROMA：让多智能体“套娃”式协作像搭积木一样简单把“复杂任务拆到原子级”这件事做成框架，30 秒上手，5 分钟写出第一个专属 Agent。本文要回答的核心问题 ROMA 到底是什么？它如何把“ …

终极AI模型决策指南：Grok 4 Fast真的够聪明高效吗？

6个月前高效码农

在人工智能迅猛发展的今天，各类大模型层出不穷，如何从众多模型中选出一款既“聪明”又高效，并且价格合理的模型，已成为许多开发者和企业关注的重点。xAI 推出的 Grok 4 Fast 作为一款强调推理能 …

ParaThinker突破AI推理瓶颈：并行思考让小模型秒杀大模型

6个月前高效码农

ParaThinker：原生并行思考——大语言模型推理能力的新突破本文欲回答的核心问题大语言模型在提升推理能力时，为何会遇到性能瓶颈？如何通过新的计算范式突破这一限制？ParaThinker作为一 …

破解LLM难题：AggLM如何用强化学习超越多数投票

6个月前高效码农

大型语言模型中的解决方案聚合：多数投票并非总是正确大家好，如果你对大型语言模型（LLM）感兴趣，想知道如何让它们在解决复杂问题时更聪明一些，那你来对地方了。最近我一直在思考这个问题，特别是通过生成多 …

Qwen3-ASR-Toolkit突破长音频转录限制：智能分割+并行处理技术揭秘

6个月前高效码农

在数字媒体爆炸式增长的今天，音频和视频内容的转录需求日益增加。无论是会议记录、讲座整理还是播客内容转化，自动语音识别（ASR）技术都扮演着关键角色。然而，许多ASR服务对音频长度和大小设置了严格限制， …

Wan-Animate颠覆行业？AI精准动画生成与无缝角色替换技术全解析

6个月前高效码农

你有没有想过，如何用一段视频的动作和表情，让一张静态的角色图片“活”起来？或者，你好奇怎么在视频中替换角色，同时保持场景的灯光和色调一致？如果这些问题听起来耳熟，那你来对地方了。今天，我们来聊聊Wan …

Memori记忆引擎：为大型语言模型注入类人记忆的革命性技术

6个月前高效码农

Memori：为大型语言模型构建类人记忆的智能引擎前言：当AI学会记忆想象一下这样的场景：当你与AI助手讨论项目需求时，它记得你上周提到的技术栈偏好；当你咨询代码问题时，它了解你正在使用的框架版本 …

为什么强化学习微调‘忘性’更小？RL’s Razor原理与实战全解析

6个月前高效码农

为什么强化学习微调“忘性”更小？一篇说透 RL’s Razor 原理与实战核心问题：同样把模型微调到一个新任务，为什么强化学习（RL）比监督微调（SFT）更能保住老本？一句话答案：RL …

LEGO 是什么？一款把“AI 芯片设计”做成搭积木的开源框架

6个月前高效码农

“ 关键词：LEGO 加速器、自动生成 RTL、空间加速器、张量应用、AI 芯片设计、Gemmini 对比、数据流融合、MIT Han Lab 一句话先给答案 LEGO 是 MIT Han Lab 2 …

DeepSeek-R1：通过强化学习激励大语言模型推理能力

6个月前高效码农

摘要 DeepSeek-R1 是 DeepSeek-AI 团队提出的一种基于强化学习（Reinforcement Learning, RL）的大语言模型（LLM），其核心目标是通过 RL 框架激励模型 …