Listen to a podcast, please open Podcast Republic app. Available on Google Play Store and Apple App Store.
| Episode | Date |
|---|---|
|
UC Berkeley:随动如我 看日常视频练出机器人灵巧手
|
Aug 07, 2026 |
|
FPRM:基于定点收敛的可自适应深度循环Transformer 700万参数AI逻辑反超大模型
|
Aug 06, 2026 |
|
Microsoft:FastContext 训练高效的编程代理代码库探索器 解耦代码搜索与修复
|
Aug 05, 2026 |
|
ErdosBench:数学评估基准文档 108KB文档里的AI冒烟测试
|
Aug 04, 2026 |
|
Weibo:VibeThinker-3B 小规模模型的极限推理性能突破 3B模型逻辑碾压万亿大厂
|
Aug 03, 2026 |
|
Stanford:Co-STORM 多智能体协作对话辅助复杂信息寻优 AI组团辩论挖掘未知的未知
|
Jul 31, 2026 |
|
UC Berkeley:VIMPO 基于价值隐含策略优化的LLM强化学习 让AI精准揪出逻辑错误
|
Jul 30, 2026 |
|
万向解密:机器语言引擎与前沿AI隐写通道研究 AI用外星语绕过监控
|
Jul 29, 2026 |
|
UC Berkeley:LOCUS 美国地方条例语料库及分层法律分析 AI破解七百万页地方法规
|
Jul 28, 2026 |
|
智谱 GLM-5:从Vibe Coding转向智能体工程的基座模型 让AI自主开发软件
|
Jul 27, 2026 |
|
Stanford:STORM 多视角对话式维基百科长文合成系统 让AI学会深度提问
|
Jul 24, 2026 |
|
AI招人竟然重女轻男 LLM在招聘中的性别偏见研究
|
Jul 23, 2026 |
|
Surflo:全局潜变量流匹配三维几何重建 几张照片秒变高精3D
|
Jul 22, 2026 |
|
Zep:用于智能体记忆的时序知识图谱架构 攻克AI失忆症
|
Jul 21, 2026 |
|
Alibaba:LingBot-World-Infinity 无限交互世界模型
|
Jul 20, 2026 |
|
MIT:监督式存储训练 非递归预训练循环神经网络 用SMT破解AI记忆瓶颈
|
Jul 20, 2026 |
|
Mirage:基于潜空间存储的视频世界模型 终结AI视频空间崩塌
|
Jul 17, 2026 |
|
dots.tts:连续自回归语音大模型技术报告 54毫秒克隆真人呼吸声
|
Jul 16, 2026 |
|
InterleaveThinker:强化智能体交错生成系统 教AI画逻辑连环画
|
Jul 15, 2026 |
|
Orchestra-o1:全模态智能体协同编排框架
|
Jul 14, 2026 |
|
Robust-U1:多模态大模型视觉自我修复与鲁棒理解 AI学会先修复再理解模糊图像
|
Jul 13, 2026 |
|
Mistral OCR 4:文档智能识别前沿模型发布 开启文档智能
|
Jul 13, 2026 |
|
MRAgent:基于图结构与主动重构的大模型记忆框架 AI像人脑一样重建记忆
|
Jul 10, 2026 |
|
Fara-7B:赋能高效计算机操作的端侧代理模型 AI学会像人一样看屏幕用电脑
|
Jul 09, 2026 |
|
MiniMax Sparse Attention:超长文本高效稀疏注意力机制 实现百万级秒回
|
Jul 08, 2026 |
|
NVIDIA:SpatialClaw 以代码作为智能体空间推理的操作界面 让AI拥有精准空间感
|
Jul 07, 2026 |
|
Microsoft:VIBEVOICE 长篇多人语音合成技术报告 实现90分钟多人对谈
|
Jul 06, 2026 |
|
规模与可塑性:LLM持续学习挑战 大模型难逃可塑性丧失
|
Jul 05, 2026 |
|
Anthropic Claude Code:专业领域知识的持久价值 懂业务的人编程赢过程序员
|
Jul 04, 2026 |
|
Alibaba:AgentScope 1.0 开发者优先的多智能体应用框架 给AI装上手脚
|
Jul 03, 2026 |
|
COLLEAGUE.SKILL:基于专家知识蒸馏的自动化AI技能生成系统 把离职同事大脑装进AI
|
Jul 02, 2026 |
|
Alibaba:WorldOlympiad 视频世界模型多维综合测评基准 AI视频到底懂不懂物理
|
Jul 01, 2026 |
|
Microsoft:Arbor 基于假设树细化的通用自主研究框架 树灵框架让AI进化为科学家
|
Jun 30, 2026 |
|
Princeton:i1 文生图模型全开源配方
|
Jun 29, 2026 |
|
Meta:Autodata 构建高质量合成数据的智能体数据科学家 让大模型自己喂自己
|
Jun 28, 2026 |
|
Audio-Interaction:实时感知的通用在线对话引擎 音频大模型学会了主动插话
|
Jun 26, 2026 |
|
SIA:AI自主升级权重与代码
|
Jun 25, 2026 |
|
Z.ai:SCAIL-2 统一端到端角色动画框架 终结AI视频肢体融合
|
Jun 24, 2026 |
|
Tencent:DRPO LLM强化学习的散度正则化策略 解决大模型推理崩塌
|
Jun 23, 2026 |
|
Google DeepMind:AlphaProof Nexus攻克56年数学难题 AI驱动数学研究探索
|
Jun 22, 2026 |
|
Anthropic:如何防止AI为了目标不择手段 教导 Claude “为什么” AI 对齐科学研究
|
Jun 19, 2026 |
|
METR:衡量AI复杂软件任务处理能力 AI胜任月度任务倒计时
|
Jun 18, 2026 |
|
DiPO:解耦困惑度策略优化与细粒度探索平衡
|
Jun 17, 2026 |
|
Agents’ Last Exam:AI考试满分干活零分 衡量人工智能经济产出的专业基准
|
Jun 16, 2026 |
|
强随机流映射:从加性噪声SDE到路径解映射 让AI在噪声中狂飙
|
Jun 15, 2026 |
|
NVIDIA:Nemotron 3 Ultra 高效混合专家推理模型技术报告 英伟达550B大模型炼成记
|
Jun 12, 2026 |
|
两用困境:技术如何重塑国际关系合作 如何欺骗大国
|
Jun 11, 2026 |
|
MIT:VPO矢量策略优化 通过训练多样性提升推理搜索效率 让AI不再钻牛角尖
|
Jun 11, 2026 |
|
最后一篇人类撰写的论文:Agent-Native 研究成果
|
Jun 10, 2026 |
|
NVIDIA:GRAIL全数字化类人机器人动作生成管线 让机器人梦中进化
|
Jun 10, 2026 |
|
Google:Magenta与Lyria实时音乐生成模型
|
Jun 10, 2026 |
|
NVIDIA:Cosmos 3 具身智能的全模态世界模型
|
Jun 08, 2026 |
|
Microsoft:SkillOpt自主进化智能体
|
Jun 08, 2026 |
|
百度:PaddleOCR-VL-1.6文档解析0.9B小模型击败千亿巨兽
|
Jun 08, 2026 |
|
AI训练的黄金配比 深度学习类别数据规模预测研究
|
Jun 05, 2026 |
|
Qwen-VLA:统一视觉-语言-动作具身智能基础模型 操控各种形态机器人
|
Jun 05, 2026 |
|
EML:算子重构数学宇宙
|
Jun 05, 2026 |
|
Gabliteration:LLM行为对齐的神经权重修正框架 让AI听话不降智
|
Jun 03, 2026 |
|
约束衰减:LLM Agent后端代码生成的脆弱性 架构约束让AI原形毕露
|
Jun 03, 2026 |
|
Google DeepMind:Gemini Embedding 2 原生多模态嵌入模型 重塑检索RAG
|
Jun 03, 2026 |
|
Anthropic:AI拒绝机制竟然只是一条线
|
Jun 02, 2026 |
|
LLaVA-OneVision-2:AI不再靠截图看视频 编解码流驱动的感知智能
|
Jun 02, 2026 |
|
Anthropic:Claude Opus 4.8最强大的通用模型发布
|
Jun 02, 2026 |
|
Carnegie Mellon:大语言模型休眠 离线循环优化内存
|
May 29, 2026 |
|
Allen Institute:大模型MoE架构的最优配方
|
May 29, 2026 |
|
Meituan:LongCat-Video-Avatar 1.5 技术报告 开源音视频生成框架
|
May 29, 2026 |
|
Meta:SAM 3 目标物体精准检测、分割与跟踪大模型
|
May 28, 2026 |
|
Mila:生成式递归推理模型 多轨迹概率计算框架 用随机扰动破解AI逻辑迷宫
|
May 28, 2026 |
|
Code as Agent Harness:代码是AI智能体的脚手架
|
May 28, 2026 |
|
OpenAI:积极对齐 促进人类繁荣的AI新范式
|
May 27, 2026 |
|
SDFT:自蒸馏治好AI偏科 自我蒸馏消除语言模型微调分布偏差
|
May 27, 2026 |
|
MIT:SDFT 自蒸馏微调 基于在线学习的持续学习方法
|
May 27, 2026 |
|
Tencent:混元Hy-MT2多语言翻译模型技术报告 440MB离线翻译超越大模型
|
May 26, 2026 |
|
Harvard:与智能系统对话的语言博弈游戏
|
May 26, 2026 |
|
CMU:Agent Harness Engineering综述
|
May 26, 2026 |
|
Anthropic:识破AI的隐藏目标 LLM奖励模型谄媚倾向
|
May 25, 2026 |
|
Nature:TabPFN中小型表格数据专用深度学习基础模型
|
May 25, 2026 |
|
Stanford:大模型喂垃圾数据反而更聪明
|
May 25, 2026 |
|
Multilingual Prompt Engineering:LLM多语言提示工程综述
|
May 23, 2026 |
|
MMSkills:让AI看懂屏幕操作 通用视觉智能体多模框架
|
May 23, 2026 |
|
Anthropic:智能体对齐 AI为生存勒索人类
|
May 23, 2026 |
|
商汤:SenseNova-U1 原生统一多模态大模型
|
May 22, 2026 |
|
Nous Research:Token叠加让AI训练提速
|
May 22, 2026 |
|
MemWeaver:让AI拥有个性化分层记忆
|
May 22, 2026 |
|
Tencent:Pixal3D 像素对齐实现高保真3D生成
|
May 21, 2026 |
|
Anthropic:用RLHF训练有用无害LLM
|
May 21, 2026 |
|
Anthropic:Claude Opus 4.5 技术报告
|
May 21, 2026 |
|
Alibaba:SlimQwen单卡跑通800亿大模型
|
May 20, 2026 |
|
ByteDance:UI-TARS纯视觉智能体
|
May 20, 2026 |
|
Aris:多智能体对抗协作自主科研框架
|
May 20, 2026 |
|
UniCorrn:跨维度找同款 跨2D与3D模态的统一几何匹配框架
|
May 19, 2026 |
|
LeWorldModel:具备物理直觉的极简世界模型
|
May 19, 2026 |
|
Google DeepMind:AI组队效率为何暴跌七成 智能体系统规模化扩展科学初探
|
May 19, 2026 |
|
NVIDIA:大模型关掉99%大脑 更稀疏、更快速、更精简的Transformer
|
May 18, 2026 |
|
斯坦福:深度学习泛化理论 一行代码让AI训练提速五倍
|
May 18, 2026 |
|
Google DeepMind:AI联合数学家 智能体协作工作站 加速数学发现
|
May 18, 2026 |
|
Anthropic:如何调教AI 用原则实现对齐
|
May 17, 2026 |
|
TabPFN:一秒搞定表格分类
|
May 17, 2026 |
|
ByteDance:视觉思维补齐AI世界模型物理短板
|
May 17, 2026 |
|
Multi-Stream LLM:让AI边听边想的多流大模型
|
May 16, 2026 |
|
Meta:Fast Byte Latent Transformer内存带宽降低一半
|
May 16, 2026 |
|
Thinking Machines:200毫秒响应的AI原生交互
|
May 16, 2026 |
|
Anthropic:教AI学佛防叛变 MSM对齐泛化
|
May 15, 2026 |
|
ELF:让文字像图像般流动 刷榜机器翻译和文本摘要任务
|
May 15, 2026 |
|
MIT:别让AI透支你的大脑 ChatGPT对学习技能与大脑认知的负面影响研究
|
May 15, 2026 |
|
微软:Bitnet.cpp 手机离线流畅运行千亿大模型
|
May 14, 2026 |
|
模块化记忆:实现持续学习智能体的关键
|
May 14, 2026 |
|
百度:PaddleOCR-VL高效多语言文档解析视觉语言模型
|
May 13, 2026 |
|
Google:推测解码加速Transformer等自回归LLM
|
May 13, 2026 |
|
智能体世界模型:AI从预测者到造物主
|
May 13, 2026 |
|
普华永道:金融领域LLM 从传统RAG到智能体非向量推理系统 如何精准啃透长篇财报
|
May 12, 2026 |
|
ZAYA1-8B:基于MoE++架构的高效推理模型
|
May 12, 2026 |
|
TabPFN-2.5:下一代表格基础模型
|
May 12, 2026 |
|
OpenAI:AI智能体Context Engineering指南
|
May 11, 2026 |
|
PersonaLive:让数字人直播不掉链子
|
May 11, 2026 |
|
UniVidX:千段视频掌握物理法则 基于扩散先验的多模态全能视频生成框架
|
May 11, 2026 |
|
IBM:SmolDocling精准解析复杂PDF 超轻量端到端多模态文档解析模型
|
May 09, 2026 |
|
Google:Gemma 4本地模型提速三倍
|
May 09, 2026 |
|
PageIndex:无需向量基于推理的RAG框架
|
May 09, 2026 |
|
RecursiveMAS:AI智能体在潜空间直接对话
|
May 08, 2026 |
|
OpenAI:FD-loss让AI一步出图
|
May 08, 2026 |
|
OpenHands:开源AI软件开发Agents智能体平台
|
May 08, 2026 |
|
GigaWorld:让机器人反应提速九倍
|
May 07, 2026 |
|
华为:MoCapAnything V2 视频精准驱动任意3D骨骼
|
May 07, 2026 |
|
Meta:Tuna-2 细粒度视觉感知
|
May 07, 2026 |
|
BixBench:生物学AI Agent基准测试
|
May 06, 2026 |
|
MinerU2.5:高效高分辨率文档解析模型
|
May 06, 2026 |
|
OpenAI:推理模型的可监测性评估研究
|
May 06, 2026 |
|
Tequila:三值量化让手机跑大模型
|
May 05, 2026 |
|
Alibaba:零成本修复AI绘图信噪比偏差
|
May 05, 2026 |
|
普华永道:榨干提示词缓存红利-AI智能体提示词缓存评估
|
May 05, 2026 |
|
MultiWorld:可扩展的多Agents多视角视频世界模型
|
May 04, 2026 |
|
SkVM:Token消耗减半的高效AI Agent智能体时代编译运行系统
|
May 04, 2026 |
|
智能体Context Engineering:给AI一本自我进化笔记
|
May 04, 2026 |
|
Context Engineering:上下文工程综述
|
May 02, 2026 |
|
Vista4D:视频拍完也能重新运镜Video Reshooting
|
May 02, 2026 |
|
DFlash:让LLM无损加速快6倍
|
May 02, 2026 |
|
GPQA:博士开卷也挂科 研究生级科学基准测试
|
May 01, 2026 |
|
Context Engineering 2.0:AI如何读懂你
|
May 01, 2026 |
|
RKLD:精准切除AI隐私记忆
|
May 01, 2026 |
|
*思维链监控:AI正学会隐藏内心独白
|
Apr 30, 2026 |
|
Alibaba:零成本修复AI生图失真
|
Apr 30, 2026 |
|
Nature:LLM行为特征 潜意识学习
|
Apr 30, 2026 |
|
LLaDA2.0-Uni:统一AI逻辑与视觉
|
Apr 29, 2026 |
|
混元世界模型HY-World 2.0:单张照片造出3D世界
|
Apr 29, 2026 |
|
GenericAgent:92行代码AI通用智能体自进化
|
Apr 29, 2026 |
|
STOP:高效并行推理路径修剪框架省下七成AI算力
|
Apr 28, 2026 |
|
线性时间与恒定内存:基于RNN的Embedding
|
Apr 28, 2026 |
|
MIT:RLM AI靠写代码读透千万字
|
Apr 28, 2026 |
|
GeneBench:多阶段基因组学与定量生物学AI Agent评估
|
Apr 27, 2026 |
|
人类最后的考试:前沿AI测评基准
|
Apr 27, 2026 |
|
LingBot-Map:复杂场景高性能实时3D建模
|
Apr 27, 2026 |
|
OpenAI:AI为什么藏不住心里话 推理模型思维链CoT可控性研究
|
Apr 26, 2026 |
|
RAG-Anything:全能多模态知识检索 看透长文档图表
|
Apr 26, 2026 |
|
SAMA:让AI视频动得稳 解耦语义锚定与运动对齐的视频编辑
|
Apr 26, 2026 |
|
Google:ConvApparel对话式推荐系统
|
Apr 25, 2026 |
|
Nvidia:Lyra AI让单张照片变4D
|
Apr 25, 2026 |
|
Artificial Analysis:AI智能指数4.0评估体系
|
Apr 25, 2026 |
|
MindDR:高效多Agents Deep Research框架
|
Apr 24, 2026 |
|
QuantCode-Bench:LLM量化交易策略生成评估基准
|
Apr 24, 2026 |
|
DiPO:用困惑度破解AI瓶颈
|
Apr 24, 2026 |
|
AI为什么说话越来越像LLM Post-training输出多样性研究
|
Apr 22, 2026 |
|
Deep Neural Lesion:深度神经病变一比特摧毁大模型
|
Apr 22, 2026 |
|
W-RAC:高效低成本RAG网页文档检索框架
|
Apr 22, 2026 |
|
ClawGUI:让AI精准操控手机-GUI智能体全栈训练、评估与部署框架
|
Apr 21, 2026 |
|
MOSS-TTS:实现一小时声音克隆
|
Apr 21, 2026 |
|
EverMemOS:长程推理自组织存储操作系统终结AI健忘
|
Apr 21, 2026 |
|
StepFun:RealRestorer 挑战顶级闭源修图模型
|
Apr 20, 2026 |
|
Claude Code 设计架构深度解析
|
Apr 20, 2026 |
|
Anthropic:透明之翼计划 AI时代网络安全
|
Apr 20, 2026 |
|
Aurora:让大模型边干边学
|
Apr 19, 2026 |
|
Google:内存缓存破解大模型记忆瓶颈
|
Apr 19, 2026 |
|
Cursor+NVIDIA:多智能体系统加速GPU内核优化
|
Apr 18, 2026 |
|
Tsinghua:On-Policy Distillation LLM 在线蒸馏方法与优化
|
Apr 18, 2026 |
|
Anthropic:Weak-to-Strong Researcher AI克隆自己搞科研碾压人类
|
Apr 18, 2026 |
|
Weak-to-Strong Generalization:用弱模型监督训练超级AI
|
Apr 17, 2026 |
|
Cursor:多智能体层级协作写出百万行代码
|
Apr 17, 2026 |
|
UPenn:AI裁员的双输陷阱
|
Apr 17, 2026 |
|
Alibaba VulnSage:AI一美元挖出146个零日漏洞
|
Apr 16, 2026 |
|
Google:Memory Caching让AI过目不忘
|
Apr 16, 2026 |
|
清华:PDFMathTranslate保留排版的学术文档翻译工具
|
Apr 16, 2026 |
|
Tencent:HY-Embodied-0.5具身智能基础模型报告
|
Apr 15, 2026 |
|
Google Agent2Agent开放协议发布
|
Apr 15, 2026 |
|
Kronos:专为股市K线定制的预训练大模型
|
Apr 15, 2026 |
|
WildDet3D:全场景提示式三维物体检测-让AI看懂平面照片的3D深度
|
Apr 14, 2026 |
|
M365 Copilot用户感知的定性研究
|
Apr 14, 2026 |
|
Google:PaperOrchestra多智能体协作AI论文撰写框架
|
Apr 14, 2026 |
|
Netflix:VOID让AI学会推演视频物理因果
|
Apr 13, 2026 |
|
真幻渲染:基于AAA级游戏的超大规模双向视频数据集
|
Apr 13, 2026 |
|
神经计算机:没有操作系统的神经计算机
|
Apr 12, 2026 |
|
Meta:Muse Spark模型评估方法与基准报告-顶尖AI闭卷考成绩单曝光
|
Apr 12, 2026 |
|
Microsoft Copilot:2025年用户行为研究报告-手机医生和深夜哲学家
|
Apr 12, 2026 |
|
Meta:AI扩展框架第2版描绘AI紧急逃生系统
|
Apr 11, 2026 |
|
OpenAI:人工智能时代儿童保护蓝图
|
Apr 11, 2026 |
|
Google:DeepSearchQA基准测试顶尖AI为何做不好深度调研
|
Apr 11, 2026 |
|
Cursor:Warp Decode让MoE推理快1.8倍
|
Apr 09, 2026 |
|
OpenAI:以后AI发钱养你 智能时代以人为本的治理之道
|
Apr 09, 2026 |
|
Microsoft:高薪并非AI避风港
|
Apr 09, 2026 |
|
NVDIA:KV缓存变换编码KVTC 20倍压缩打破大模型内存墙
|
Apr 08, 2026 |
|
Astera+NVIDA:TTT-E2E Test-Time Training让AI边阅读边重塑大脑
|
Apr 08, 2026 |
|
Anthropic+Mila:DFC揪出AI的隐藏偏见
|
Apr 08, 2026 |
|
Lightricks:LTX-2高效高质量长视频与音频生成模型
|
Apr 07, 2026 |
|
Perplexity:DRACO深度研究能力的跨领域基准测试
|
Apr 07, 2026 |
|
PixelSmile:精准编辑图像和面部表情
|
Apr 07, 2026 |
|
ICLR 2026 浙大:利用LLM实现代码的高级性能优化
|
Apr 06, 2026 |
|
Sakana AI:AI战略官Marlin重定义商业智能的AI深层调研助手
|
Apr 06, 2026 |
|
Google DeepMind:当心AI助理被洗脑AI Agent Traps识别与防御智能体攻击框架
|
Apr 06, 2026 |
|
Qwen3-TTS:实现97毫秒极速语音合成克隆
|
Apr 05, 2026 |
|
Anthropic:绝望的AI真的会敲诈-LLM情感研究
|
Apr 05, 2026 |
|
Google:TimesFM时间序列模型精准预测未来
|
Apr 04, 2026 |
|
GPQA:博士开卷也挂科 研究生级科学基准测试
|
Apr 01, 2026 |
|
AliasRobotics:杜绝人形机器人黑客走进家门
|
Apr 01, 2026 |
|
微软:Agent Lightning让AI Agent智能体自我进化
|
Apr 01, 2026 |
|
ARC-AGI-3:互动式通用推理基准评估测试
|
Mar 31, 2026 |
|
AutoFigure-Edit:AI生成可编辑的科研插图
|
Mar 31, 2026 |
|
Vibe Coding XR:AI XR扩展现实原型设计实现手势交互与环境感知
|
Mar 31, 2026 |
|
Meta:TRIBE v2多模态大脑编码基础模型精准预判大脑反应
|
Mar 30, 2026 |
|
Meta:v-Sonar与v-LCM多模态1500种语言全球通用语义空间刷榜视频检索和字幕生成任务
|
Mar 30, 2026 |
|
QuantAgent:高频交易AI多智能体框架
|
Mar 30, 2026 |
|
Anthropic CEO:AI治愈癌症实现150岁人生
|
Mar 29, 2026 |
|
MinerU-Diffusion:扩散解码并行OCR刷榜复杂布局表格公式识别
|
Mar 29, 2026 |
|
多模块GRPO:新型强化学习算法
|
Mar 29, 2026 |
|
自主智能体新型漏洞ISC:顶级AI正自发突破安全底线
|
Mar 28, 2026 |
|
AgentScope:百万级智能体高效协作
|
Mar 28, 2026 |
|
OpenResearcher:深度研究智能体完整开源方案
|
Mar 28, 2026 |
|
Memento-Skills:AI自主设计技能库
|
Mar 27, 2026 |
|
Nvidia:Nemotron-Cascade 2级联RL MoE揽IMO和IOI金牌
|
Mar 27, 2026 |
|
daVinci-MagiHuman:单卡2秒生成数字人
|
Mar 27, 2026 |
|
HyperAgents:自我进化的新型AI框架
|
Mar 26, 2026 |
|
V-JEPA 2.1:视频自监督学习显著提升机器人操纵导航
|
Mar 26, 2026 |
|
Yann LeCun:LeWorldModel端到端像素级世界模型
|
Mar 26, 2026 |
|
Apple:XSA排他性自注意力修复Transformer缺陷
|
Mar 25, 2026 |
|
LightRAG:简单快速的图结构RAG
|
Mar 25, 2026 |
|
Fish Audio S2:指令驱动的多人多轮语音合成系统
|
Mar 25, 2026 |
|
MiroThinker:三个维度提升智能体复杂推理能力
|
Mar 24, 2026 |
|
EvoScientist:自演进多智能体端到端科学发现框架AI横扫顶会
|
Mar 24, 2026 |
|
首尔世界模型:AI让地图街景生动鲜活
|
Mar 24, 2026 |
|
Mem0:终结AI助理失忆症
|
Mar 23, 2026 |
|
MetaClaw:让AI助理学会自我进化
|
Mar 23, 2026 |
|
AutoDev:人工智能驱动的自动化软件开发框架
|
Mar 23, 2026 |
|
AllenAI:MolmoPoint指向性标记刷新GUI交互视频追踪世界记录
|
Mar 22, 2026 |
|
Yann LeCun:时间拉直教AI路径规划
|
Mar 22, 2026 |
|
AllenAI:ScholarQA-CS2面向专家标注的自动化评估流程
|
Mar 22, 2026 |
|
Baidu:Qianfan-OCR端到端文档智能统一模型
|
Mar 21, 2026 |
|
ByteDance:MoDA深度注意力实现跨层记忆
|
Mar 21, 2026 |
|
Datadog:Bits AI SRE自主化运维与故障排查助手
|
Mar 21, 2026 |
|
注意力残差:治愈AI深度失忆
|
Mar 20, 2026 |
|
MemOS:LLM记忆操作系统
|
Mar 20, 2026 |
|
OpenMOSS:RLCF社区反馈强化学习训练AI科学家
|
Mar 20, 2026 |
|
DeepSeek:Engram死记硬背让AI更聪明
|
Mar 19, 2026 |
|
Google DeepMind:MedGemma看病比医生还准的4B模型
|
Mar 19, 2026 |
|
ServiceNow+Mila:EnterpriseOps-Gym评估企业级智能体
|
Mar 19, 2026 |
|
Astera: TTT-E2E让AI边读边改权重
|
Mar 18, 2026 |
|
普林斯顿:OpenClaw-RL让AI在对话中实时进化
|
Mar 18, 2026 |
|
Google:ELIXR用LLM读懂X光片
|
Mar 18, 2026 |
|
AI-Trader:全自动化实时金融大模型评估基准-美股、A股和加密货币
|
Mar 16, 2026 |
|
SPO:自监督Prompt提示词工程优化
|
Mar 16, 2026 |
|
SkillFortify:数学逻辑应对Agentic AI技能漏洞
|
Mar 16, 2026 |
|
TradingAgents:AI模拟真实交易公司
|
Mar 16, 2026 |
|
Menlo VC:医疗保健行业竟成2025 AI领头羊
|
Mar 16, 2026 |
|
Essential-Web:15分钟筛选24万亿数据
|
Mar 16, 2026 |
|
BeyondWeb:30亿小模型靠重构数据逆袭
|
Mar 13, 2026 |
|
DCLM:好数据胜过暴力算力
|
Mar 13, 2026 |
|
MMLU-Redux:AI竟然在背错题拿高分
|
Mar 13, 2026 |
|
加州大学:Clawdrain掏空OpenClaw AI预算
|
Mar 12, 2026 |
|
MIT:2025年95%企业AI投资零回报
|
Mar 12, 2026 |
|
普华永道:2025全球AI就业指数-赋能效率与价值增长
|
Mar 12, 2026 |
|
Anthropic:2026.1经济指数报告与AI影响分析
|
Mar 11, 2026 |
|
Google:开源TranslateGemma小模型翻译反超大模型
|
Mar 11, 2026 |
|
阿里:SWE-CI评估Agent在持续集成中的代码维护能力
|
Mar 11, 2026 |
|
FinePhrase:万亿级合成数据实战指南
|
Mar 10, 2026 |
|
Anthropic:助手轴与LLM角色人格
|
Mar 10, 2026 |
|
Anthropic:2026 AI替代人类数据与趋势
|
Mar 10, 2026 |
|
Google:思想社会-推理模型协同进化
|
Mar 09, 2026 |
|
Anthropic:识别AI面试
|
Mar 09, 2026 |
|
GPT-5.4:重塑专业智能与计算机交互
|
Mar 09, 2026 |
|
Anthropic:Petri 2.0识破AI作弊
|
Mar 08, 2026 |
|
Google DeepMind:D4RT教AI看懂4D世界
|
Mar 08, 2026 |
|
北邮:AI Memory记忆综述-理论、分类、评估与前沿趋势
|
Mar 08, 2026 |
|
Ai2:Olmo Hybrid混合架构省一半数据
|
Mar 07, 2026 |
|
OpenAI:推理模型难以控制CoT思维链
|
Mar 07, 2026 |
|
Meta:多模预训练世界模型
|
Mar 07, 2026 |
|
GPT-5.3 Instant:更流畅实用的日常对话体验
|
Mar 07, 2026 |
|
BFL AI:自监督多模态可扩展合成
|
Mar 07, 2026 |
|
Google发表Nature论文如何提升LLM个性化推荐能力
|
Mar 07, 2026 |
|
Meta: Agentic Code Reasoning
|
Mar 05, 2026 |
|
阿里Qwen:长程智能体规划评估
|
Mar 05, 2026 |
|
基于文本合成的多轮工具使用轨迹
|
Mar 05, 2026 |
|
斯坦福:Cartridges将海量语料库压缩为轻量化虚拟缓存
|
Mar 04, 2026 |
|
阿里:通义AI开源深度科研智能体
|
Mar 03, 2026 |
|
Perplexity:pplx-embed高性能网页检索压缩
|
Mar 03, 2026 |
|
Sakana:瞬间内化记忆
|
Mar 03, 2026 |
|
ByteDance:用户反馈驱动的AGI模型训练框架
|
Mar 01, 2026 |
|
OpenAI:划定AGI安全红线
|
Mar 01, 2026 |
|
OpenAI:GPT-5助克隆效率提升79倍
|
Mar 01, 2026 |
|
Anthropic:别把人生决策权交给AI
|
Mar 01, 2026 |
|
Anthropic:别让AI偷走你的自主权
|
Mar 01, 2026 |
|
AI2 Allen AI 读论文自动推导科学定律
|
Mar 01, 2026 |
|
OpenAI发布AI数据智能体
|
Feb 28, 2026 |
|
Anthropic:AI困境-如何随任务复杂性而变化
|
Feb 28, 2026 |
|
Google PaperBanana让AI精准绘制学术插图
|
Feb 28, 2026 |
|
斯坦福:AI经常会犯哪些错误
|
Feb 27, 2026 |
|
ETH Zurich:上下文让AI变笨且费钱
|
Feb 26, 2026 |
|
Anthropic:如何防止AI失控
|
Feb 26, 2026 |
|
Cursor:智能体自主控制计算机
|
Feb 26, 2026 |
|
Anthropic:让AI模拟多种人格
|
Feb 25, 2026 |
|
Google:让多Agents默契合作
|
Feb 25, 2026 |
|
Waymo世界模型-自动驾驶模拟的新前沿
|
Feb 24, 2026 |
|
METR 衡量AI完成长任务能力
|
Feb 24, 2026 |
|
Meta, DeepMind, Amazon等共同发布Agent推理框架
|
Feb 24, 2026 |
|
斯坦福大学LLM推理失败研究综述
|
Feb 23, 2026 |
|
OpenClaw时代OpenAI智能体版图与安全防线
|
Feb 23, 2026 |
|
斯坦福大学2025人工智能报告
|
Feb 23, 2026 |
|
DeepMind DialogLab让AI掌握群聊潜规则
|
Feb 22, 2026 |
|
Anthropic 发布美国人工智能基建蓝图
|
Feb 22, 2026 |
|
Warp Oz 2026企业级AI Agents指南
|
Feb 22, 2026 |
|
Anthropic首起AI主导网络间谍攻击防御报告
|
Feb 20, 2026 |
|
Anthropic: Claude Prompt自动缓存
|
Feb 20, 2026 |
|
OpenAI GABRIEL结构化海量非结构化文本和图像
|
Feb 20, 2026 |
|
OpenAI EVMbench 区块链智能合约安全的AI测评基准
|
Feb 20, 2026 |
|
Anthropic AI智能体监测实践
|
Feb 19, 2026 |
|
Anthropic G轮:估值3800亿与企业智能扩张
|
Feb 19, 2026 |
|
清华大学智谱AI:GLM-5 从氛围编程迈向智能体工程
|
Feb 19, 2026 |
|
Datadog发布秘籍提升 LLM 性能、安全性和监控能力
|
Feb 18, 2026 |
|
Google论文:提升AI思考深度而非长度
|
Feb 17, 2026 |
|
OpenAI GPT-5.2自主推导物理定律
|
Feb 17, 2026 |
|
DeepMind的智能AI代理经济蓝图
|
Feb 16, 2026 |
|
AI并不会减少工作——加州大学伯克利分校研究
|
Feb 15, 2026 |