📡 实时动态
🔥 AI 热点资讯 📄 论文追踪 🐙 GitHub 热门 🤗 HuggingFace 热门
📈 行业洞察
📊 行业数据 💰 创业与投资 ⚖️ 全球AI政策 🏥 AI + 医疗 🌎 世界模型
🔬 技术纵深
🎯 基准测试 🏷️ 产品实测 🖥️ GPU 全景 ⚡ TPU/GPU/CUDA ⚡ AI 与能源
📚 学习成长
📚 学习资料 🤖 Agent 开发 🛠️ Prompt 工程

AI 资讯 Dashboard

汇聚前沿 AI 动态、学习资源与开发工具,一站掌握人工智能最新脉搏

📡
10 条最新资讯
📈
4 笔新融资/收购
🔬
模型排名变动
📚
新增 2 篇教程

📡 实时动态

追踪AI领域每日变化

🔥 AI 热点资讯

追踪全球 AI 领域最新动态与重大突破

🔥
重磅$1220亿融资超级应用

OpenAI 完成 $1220亿融资(史上最大),周活用户破9亿;Anthropic 51.2万行代码泄露;Apple Siri 第三方扩展将催生 AI App Store

OpenAI 宣布完成 $1220 亿融资轮(Amazon、NVIDIA、SoftBank、Microsoft 参投),估值冲击 $3000 亿,ChatGPT 周活跃用户突破 9 亿,搜索用量一年翻三倍,广告试点 6 周 ARR 破 $1 亿。OpenAI 同时宣布终止视频生成器 Sora,将聚焦构建"统一超级应用"整合 ChatGPT、Codex、浏览和 Agent。Anthropic 遭遇重大安全事件——超 51.2 万行代码泄露,暴露未发布功能和 Claude 内部指令。Apple 宣布 iOS 27 将开放 Siri 第三方 AI 扩展,设立专属 App Store 板块,实质创建"AI App Store"。Microsoft Copilot Cowork 正式发布,集成 Claude 处理长期多步骤任务,并推出 Researcher Agent 和 Critique 功能。世界模型赛道持续升温:LeCun €5亿创办 AMI Labs,DeepMind Genie 3 实时生成 3D 世界。

OpenAI / The Verge / Bloomberg / Microsoft / Fortune|2026.04.01

OpenAI 完成 $1220 亿融资,ChatGPT 周活破 9 亿,宣布终止 Sora 转型"超级应用"

融资OpenAI / The Verge2026.03.31

Amazon、NVIDIA、SoftBank、Microsoft 参投,估值冲击 $3000 亿。ChatGPT 网页+移动端流量 6 倍于第二名,搜索用量一年翻三倍。终止 Sora 视频生成器,聚焦构建 ChatGPT+Codex+浏览+Agent "统一超级应用"。

Anthropic 超 51.2 万行代码泄露:暴露未发布功能和 Claude 内部指令

安全The Verge2026.03.31

泄露代码包含未发布功能、Claude 内部系统指令等敏感信息。继此前"Mythos"模型代号泄露后,Anthropic 再次面临安全管理质疑。

Apple iOS 27 将开放 Siri 第三方 AI 扩展,实质创建"AI App Store"

产品Bloomberg / The Verge2026.03.29

Mark Gurman 报道 Apple 正将 Siri 和 Apple Intelligence 开放给第三方服务。Extensions 将拥有专属 App Store 板块,用户可安装 ChatGPT 之外的 AI 聊天机器人并在 Siri 内运行。

微软 Copilot Cowork 正式发布:集成 Claude 处理长期多步骤任务

产品Microsoft2026.03.30

通过 Frontier Program 推出 Copilot Cowork,集成 Anthropic Claude 执行"长时间多步骤任务"。同时发布 Researcher Agent(信息收集)和 Critique 功能(GPT 起草、Claude 编辑校准)。

GPT-5.4 与 Gemini 3.1 Pro 以 0.01 分差并列全球第一,行业聚焦规模化部署

模型WhatLLM / Artificial Analysis2026.03.06

GPT-5.4 (xhigh) 智能指数 57.17 vs Gemini 3.1 Pro Preview 57.18,差距仅 0.01。Claude Opus 4.6、DeepSeek-R2 紧随其后,顶级模型间差距缩至 1-2 分,API 价格同比暴降 40-80%。

世界模型军备竞赛:LeCun €5亿创办 AMI Labs,DeepMind Genie 3 实时生成 3D 世界

融资Introl / CNET / Euronews2026.03

LeCun 离开 Meta 创办 AMI Labs 融资 €5 亿,押注世界模型超越 LLM。DeepMind Genie 3 首个实时交互世界模型,World Labs 推出 Marble 商业产品(免费至 $95/月)。

Apple Intelligence 在中国"误启动"后紧急下线,需与阿里等本地公司合作

产品Bloomberg / 9to5Mac2026.03.30

中国用户报告 iPhone 上出现 Apple Intelligence 功能后,Bloomberg Gurman 确认为"误启动",Apple 已迅速下线。中国政府要求 Apple 必须与阿里巴巴等本地公司合作提供 AI 功能。

国防 AI 公司 Shield AI 完成 $15 亿融资,加速"AI 飞行员"实战部署

融资腾讯新闻 / Edgen Tech2026.03.31

Shield AI 完成 $15 亿融资进入白热化竞争。国防 AI 领域估值持续飙升,AI 自主无人系统从试验走向实战部署。

智谱 AI 发布 GLM-5 开源旗舰:744B 参数,首个完全用华为昇腾训练的前沿模型

开源CSDN / 智谱AI2026.02.11

GLM-5 杀入全球前 5,744B 参数完全在华为 Ascend 芯片上训练,打破 NVIDIA GPU 垄断。开源中文模型阵营再添重量级选手,MoE 架构成为 2026 绝对主流。

HuggingFace 本周:TRL v1.0 后训练库发布、IBM Granite 4.0 3B Vision、LeRobot v0.5

开源HuggingFace Blog2026.03.31

TRL v1.0 正式版发布,成为后训练(RLHF/DPO)标准库。IBM Granite 4.0 3B Vision 面向企业文档理解,LeRobot v0.5.0 扩展机器人 AI 所有维度。开源生态加速成熟。

📄 AI 论文追踪

追踪前沿 AI 研究论文,洞察技术发展脉搏

🔥 本周热门论文 (Top Papers This Week)

DeepSeek-R2: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
基于强化学习的推理能力激励方法,MoE架构新突破
DeepSeek-AI, Daya Guo, Dejian Yang et al.
DeepSeek 🧠 推理能力 2026.02
  • 提出改进的 GRPO 训练框架,推理准确率提升 18%
  • MoE 架构 671B 参数,37B 激活,训练效率大幅提升
  • 在 MATH-500 和 AIME 2025 上超越 GPT-5 和 Claude Opus 4
📑 arXiv 🔧 训练方法 🔥 4.2k citations
Llama 4: Open Foundation Models with Mixture of Experts
Meta开源MoE架构大模型,10M上下文窗口
Meta AI, Thomas Scialom, Hugo Touvron et al.
Meta FAIR 🏗️ 架构创新 2026.01
  • Scout (17B active/109B total) 支持 10M tokens 上下文窗口
  • Maverick (17B active/400B total) 128专家MoE,综合能力领先
  • 完全开源权重,推动开源模型生态发展
📑 arXiv 🏗️ 架构创新 🔥 3.8k citations
Gemini 2.5: Advancing Multimodal Reasoning at Scale
原生多模态推理能力大幅飞跃,长视频理解领跑
Google DeepMind, Gemini Team et al.
Google DeepMind 📸 多模态 2026.03
  • 原生多模态架构,无需独立视觉编码器即可处理图像/视频/音频
  • 1M token 上下文支持长达数小时的视频理解和分析
  • 在 MathVista、MMMU 等多模态推理基准上创下新 SOTA
📑 arXiv 🧠 推理能力 🔥 2.9k citations
Autonomous Agent Planning with Hierarchical Task Decomposition
层次化任务分解实现自主Agent规划新SOTA
Shunyu Yao, Noah Shinn, Karthik Narasimhan et al.
MIT Google 🤖 Agent 2026.03
  • 提出 HiPlan 框架,将复杂任务自动分解为层次化子目标
  • 结合 Monte Carlo Tree Search 实现动态规划与回溯
  • 在 WebArena 和 SWE-bench 上分别提升 23% 和 17%
📑 arXiv 🤖 Agent 🔥 1.5k citations
Qwen3 Technical Report
阿里通义千问系列全面升级,中文能力再创新高
Qwen Team, Jinze Bai, Shuai Bai et al.
阿里巴巴 🔧 训练方法 2026.02
  • 0.5B 到 235B 全系列开源,涵盖 Dense 和 MoE 架构
  • 中英双语能力并驾齐驱,数学推理超越 GPT-4o
  • 多模态版本 Qwen3-VL 在文档理解和 OCR 任务中表现卓越
📑 arXiv 🏗️ 架构创新 🔥 2.1k citations
Scaling Constitutional AI: Principles for Harmless AI Systems
宪法AI扩展研究,从原则到大规模安全对齐
Anthropic, Yuntao Bai, Amanda Askell et al.
Anthropic 🛡️ 安全对齐 2026.02
  • 提出 RLAIF v2 框架,AI 反馈替代人类标注效率提升 10 倍
  • 新增多语言安全原则,覆盖 50+ 语言文化语境
  • 在 TruthfulQA 和 BBQ 偏见基准上达到最优安全-能力平衡
📑 arXiv 🛡️ 安全对齐 🔥 1.8k citations
FlashAttention-3: Fast and Exact Attention with IO-Awareness
第三代高效注意力机制,Hopper架构深度优化
Tri Dao, Daniel Y. Fu et al.
Princeton Together AI ⚡ 推理优化 2026.01
  • 针对 NVIDIA Hopper (H100/H200) 架构深度优化
  • 利用异步操作和 warp 级别并行,FP16 速度提升 1.5-2.0x
  • 支持 FP8 精度,训练和推理吞吐量接近理论峰值
📑 arXiv ⚡ 推理优化 🔥 2.6k citations
GraphRAG 2.0: From Local to Global Retrieval-Augmented Generation
图结构检索增强生成升级版,全局推理能力大幅提升
Microsoft Research, Darren Edge, Ha Trinh et al.
Microsoft 🔍 检索增强 2026.02
  • 引入动态知识图谱构建,实时更新检索索引
  • 多粒度社区摘要支持从局部到全局的知识推理
  • 在多跳问答任务上准确率提升 35%,延迟降低 60%
📑 arXiv 🔍 检索增强 🔥 1.2k citations
The Spike, the Sparse and the Sink: Anatomy of Massive Activations and Attention Sinks
系统性解剖Transformer中的极端激活与注意力汇聚现象
Jiachen Zhu et al.
arXiv 🏗️ 架构创新 2026.03.06
  • 揭示 Massive Activations 作为模型隐式参数,在层间维持近常数隐藏表示
  • Attention Sinks 调节注意力输出并使注意力头偏向短程依赖
  • 确认 pre-norm 配置是两种现象共现的关键架构选择
📑 arXiv 🏗️ 架构创新 🔥 New
Judge Reliability Harness: Stress Testing the Reliability of LLM Judges
开源工具系统测试LLM评审可靠性,被ICLR 2026接收
Morgan Sandler et al. (RAND Corporation)
RAND 📊 评估基准 2026.03.06
  • 提出开源 Judge Reliability Harness,系统评估 LLM 评审的一致性和准确性
  • 测试发现无模型在所有基准上均可靠——格式变化、改写均影响评分
  • 已被 ICLR 2026 "Agents in the Wild" Workshop 接收
📑 arXiv 📊 评估基准 🔥 New
Bilevel Autoresearch: Meta-Autoresearching Itself
用自动研究循环来优化自动研究循环本身,5x改进
Yaonan Qu et al.
arXiv 🤖 Agent 2026.03.24
  • 双层框架:外层循环元优化内层自动研究循环,无需更强模型
  • 在 Karpathy GPT 预训练基准上 5x 改进(-0.045 vs -0.009 val_bpb)
  • 外层自主发现组合优化、多臂赌博机等搜索机制
📑 arXiv 🤖 Agent 🔥 New
RelayS2S: A Dual-Path Speculative Generation for Real-Time Dialogue
双路径混合架构实现低延迟+高质量实时语音对话
Long Mai Thanh et al.
arXiv ⚡ 推理优化 2026.03.24
  • 快路径(S2S)推测生成前缀立即播放,慢路径(ASR→LLM)生成高质量续接
  • P90 启动延迟与纯 S2S 模型相当,保留 99% 级联管线响应质量
  • 轻量验证器门控交接,可无缝嵌入现有级联管线
📑 arXiv ⚡ 推理优化 🔥 New
Mecha-nudges for Machines
面向AI Agent的"机械助推":如何影响AI决策而不影响人类
Giulio Frey et al.
arXiv 🛡️ 安全对齐 2026.03.24
  • 引入 mecha-nudges 概念:系统性影响 AI Agent 决策的选择呈现方式
  • 结合贝叶斯说服框架与 V-usable 信息理论,统一度量"可用信息比特"
  • Etsy 数据实证:ChatGPT 发布后商品列表机器可用信息显著增加
📑 arXiv 🛡️ 安全对齐 🔥 New
LLM Olympiad: Why Model Evaluation Needs a Sealed Exam
提出奥林匹克式密封评估,防止基准追踪作弊
Jan Christian Blaise Cruz et al.
arXiv 📊 评估基准 2026.03.24
  • 评估前密封试题、提前冻结模型、统一评估框架
  • 解决当前 LLM 评估中的 benchmark-chasing 和测试数据泄露问题
  • 评估后公开完整任务集和代码,确保可复现和可审计
📑 arXiv 📊 评估基准 🔥 New

📈 论文趋势分析

🏆 2026 顶会论文录取率对比

ICLR 2026
32%
NeurIPS 2025
25.8%
ICML 2026
27.5%
ACL 2026
23.2%
CVPR 2026
25.1%
AAAI 2026
23.4%

* 投稿数量持续创新高,ICLR 2026 收到 12,000+ 投稿,录取率略有上升反映评审标准调整

🏆 机构排行榜

1
🇬🇧 Google DeepMind
高影响力论文 48 篇 | h-index 提升最快
代表作:Gemini 2.5, Scaling Test-Time Compute
2
🇺🇸 Meta FAIR
高影响力论文 42 篇 | 开源贡献最多
代表作:Llama 4, Segment Anything 2
3
🇺🇸 OpenAI
高影响力论文 35 篇 | 单篇引用最高
代表作:GPT-5 Technical Report, DALL-E 4
4
🇺🇸 Anthropic
高影响力论文 28 篇 | 安全研究领跑
代表作:Claude 4 System Card, Constitutional AI v2
5
🇺🇸 Microsoft Research
高影响力论文 38 篇 | 应用研究广泛
代表作:GraphRAG 2.0, Phi-4
6
🇨🇳 清华大学
高影响力论文 32 篇 | 亚洲高校第一
代表作:ChatGLM-4, Agent 评估框架 AgentBench
7
🇺🇸 Stanford
高影响力论文 30 篇 | AI 安全与治理
代表作:Alpaca, Stanford AI Index Report 2026
8
🇨🇳 DeepSeek
高影响力论文 18 篇 | 增速最快新秀
代表作:DeepSeek-R2, DeepSeek-V3
9
🇺🇸 MIT
高影响力论文 26 篇 | 理论研究深厚
代表作:Liquid Neural Networks, Agent Planning
10
🇨🇳 北京大学
高影响力论文 20 篇 | 多模态研究突出
代表作:MiniCPM-V, 多模态对齐研究

📚 经典必读论文

🏗️ Transformer 基础
Attention Is All You Need
提出 Transformer 架构,奠定现代 AI 基础
2017arXiv
BERT: Pre-training of Deep Bidirectional Transformers
双向预训练模型,开启 NLP 预训练时代
2018arXiv
Language Models are Few-Shot Learners (GPT-3)
175B 参数模型展示 in-context learning 能力
2020arXiv
Scaling Laws for Neural Language Models
揭示模型规模、数据量与性能的幂律关系
2020arXiv
🔧 指令微调与对齐
Training language models to follow instructions (InstructGPT)
RLHF 方法让模型遵循人类指令
2022arXiv
Direct Preference Optimization (DPO)
无需奖励模型的偏好优化,简化 RLHF 流程
2023arXiv
Constitutional AI: Harmlessness from AI Feedback
用 AI 反馈替代人类标注实现安全对齐
2022arXiv
Self-Play Fine-Tuning (SPIN)
通过自博弈持续提升模型对齐质量
2024arXiv
🧠 推理能力
Chain-of-Thought Prompting Elicits Reasoning
思维链提示法,显著提升推理任务表现
2022arXiv
Tree of Thoughts: Deliberate Problem Solving with LLMs
思维树方法,支持搜索和回溯的推理框架
2023arXiv
Self-Consistency Improves Chain of Thought Reasoning
多路径采样+投票,提升推理可靠性
2022arXiv
DeepSeek-R1: Incentivizing Reasoning via RL
强化学习激励推理,开源推理模型标杆
2025arXiv
🤖 Agent 智能体
ReAct: Synergizing Reasoning and Acting in LLMs
推理-行动交替范式,Agent 核心架构
2022arXiv
Toolformer: LMs Can Teach Themselves to Use Tools
模型自学使用外部工具,提升实用能力
2023arXiv
HuggingGPT: Solving AI Tasks with ChatGPT and Friends
LLM 作为控制器调度 HuggingFace 模型
2023arXiv
Generative Agents: Interactive Simulacra of Human Behavior
生成式智能体模拟人类社会行为
2023arXiv
📸 多模态
Learning Transferable Visual Models (CLIP)
对比学习连接图像与文本,零样本视觉识别
2021arXiv
High-Resolution Image Synthesis with LDMs (Stable Diffusion)
潜空间扩散模型,开源图像生成革命
2022arXiv
Visual Instruction Tuning (LLaVA)
视觉指令微调,开源多模态大模型新范式
2023arXiv
Sora: Video Generation Models as World Simulators
视频生成模型展示世界模拟器潜力
2024Link
⚡ 效率优化
LoRA: Low-Rank Adaptation of Large Language Models
低秩适应,消费级 GPU 即可微调大模型
2021arXiv
QLoRA: Efficient Finetuning of Quantized LLMs
4-bit 量化 + LoRA,单卡微调 65B 模型
2023arXiv
FlashAttention: Fast and Memory-Efficient Attention
IO 感知的精确注意力,训练加速 2-4x
2022arXiv
Fast Inference from Transformers via Speculative Decoding
投机解码用小模型加速大模型推理
2023arXiv

🛠️ 论文工具推荐

🔎

Semantic Scholar

AI 驱动的学术搜索引擎,智能推荐相关论文,追踪引用关系和研究趋势

🔗 访问
🔘

Connected Papers

可视化论文关联图谱,快速发现某个领域的核心论文和最新进展

🔗 访问
💻

Papers With Code

论文+代码+排行榜三合一平台,快速找到论文对应的开源实现

🔗 访问
📄

arXiv Sanity

由 Andrej Karpathy 创建,个性化推荐和筛选 arXiv 论文

🔗 访问
🤗

Hugging Face Papers

社区驱动的每日热门论文排行,支持讨论和一键查看模型/数据集

🔗 访问

🐙 GitHub 热门AI项目

追踪开源 AI 项目动态,发现最受关注的工具与框架

🔥 本周趋势项目 (Trending This Week)

🌱 新兴项目关注 (Rising Stars)

Claude Code 最佳实践集合,提示技巧、项目模板和工作流指南
📅 ~45 天⭐ 26.8k📈 ~596/天
Claude CodeBest PracticesAwesome List
bytedance/deer-flow🔥 爆发增长
字节跳动开源深度研究 Agent 框架,多步推理与自动化研究
📅 ~60 天⭐ 25.9k📈 ~430/天
LangGraphMulti-AgentDeep Research
mastra-ai/mastra🔥 爆发增长
Gatsby 团队 TypeScript AI 框架,现代化 Agent 开发,内置 MCP
📅 ~90 天⭐ 21.8k📈 ~240/天
TypeScriptAgent FrameworkMCP
coze-dev/coze-studio🔥 爆发增长
扣子开源 AI Agent 可视化开发平台,全功能工具链
📅 ~60 天⭐ 20.1k📈 ~335/天
Visual IDEAgent BuilderAll-in-One
OpenAI 官方轻量级多 Agent 工作流框架
📅 ~30 天⭐ 19.4k📈 ~647/天
OpenAIMulti-AgentLightweight
emcie-co/parlant📈 快速增长
面向客户交互的对话控制层,AI Agent 客服场景上下文工程
📅 ~75 天⭐ 17.8k📈 ~237/天
Context EngineeringCustomer AIConversational
LLM 驱动 A/H/美股智能分析器,Gemini 决策仪表盘
📅 ~57 天⭐ 17.3k📈 ~303/天
GeminiStock AnalysisFinance

📁 分类浏览

langchain-ai/langchain
Agent 工程平台,LLM 应用标准框架
⭐ 128.6k
microsoft/autogen
微软 Agentic AI 编程框架
⭐ 55.3k
crewAIInc/crewAI
多智能体协作与角色扮演框架
⭐ 45.4k
langchain-ai/langgraph
图结构构建弹性 Agent 工作流
⭐ 25.9k
mastra-ai/mastra
TypeScript AI 框架,来自 Gatsby 团队
⭐ 21.8k
openai/openai-agents-python
OpenAI 官方轻量级多 Agent 框架
⭐ 19.4k
elizaOS/eliza
面向所有人的自主 Agent 平台
⭐ 17.7k
camel-ai/camel
首个多 Agent 框架,探索规模定律
⭐ 16.2k
pydantic/pydantic-ai
Pydantic 风格 GenAI Agent 框架
⭐ 15.3k
ollama/ollama
本地运行大模型的最简方案
⭐ 164.4k
huggingface/transformers
最流行的预训练模型库
⭐ 157.6k
ggml-org/llama.cpp
C/C++ LLM 推理引擎,极致性能
⭐ 97.2k
vllm-project/vllm
高吞吐量 LLM 推理与服务引擎
⭐ 72.4k
hiyouga/LlamaFactory
统一高效微调 100+ LLM/VLM
⭐ 68.0k
BerriAI/litellm
统一 API 代理,100+ LLM 一站接入
⭐ 38.2k
sgl-project/sglang
高性能推理框架,结构化生成
⭐ 24.2k
modelscope/ms-swift
魔搭一站式模型微调部署
⭐ 13.0k
langgenius/dify
Agentic 工作流平台,自带 RAG
⭐ 131.6k
infiniflow/ragflow
领先的开源 RAG 引擎
⭐ 74.4k
Mintplex-Labs/anything-llm
全能 AI 桌面应用,内置 RAG
⭐ 55.9k
mem0ai/mem0
AI Agent 通用记忆层
⭐ 49.0k
khoj-ai/khoj
AI 第二大脑,自托管知识助手
⭐ 33.3k
HKUDS/LightRAG
轻量级 RAG 框架
⭐ 29.1k
chroma-core/chroma
AI 原生开源向量数据库
⭐ 26.5k
onyx-dot-app/onyx
企业级 AI 搜索与知识管理
⭐ 17.8k
firecrawl/firecrawl
Web 数据 API,网站转 LLM 格式
⭐ 89.4k
OpenHands/OpenHands
开源 AI 软件工程师平台
⭐ 68.8k
continuedev/continue
开源 AI 代码助手
⭐ 31.7k
CopilotKit/CopilotKit
Agent 前端框架,React + Angular
⭐ 29.2k
ComposioHQ/composio
1000+ 工具集、认证沙箱
⭐ 27.3k
microsoft/semantic-kernel
微软 AI 集成 SDK
⭐ 27.4k
comet-ml/opik
LLM 评估、测试和监控
⭐ 18.1k
screenpipe/screenpipe
24/7 屏幕录制 AI 搜索
⭐ 17.2k
open-webui/open-webui
用户友好 AI 界面,多后端
⭐ 126.2k
ChatGPTNextWeb/NextChat
跨平台 ChatGPT 客户端
⭐ 87.4k
Mintplex-Labs/anything-llm
全能 LLM 桌面应用
⭐ 55.9k
oobabooga/text-generation-webui
文本生成 Web 界面
⭐ 46.2k
mudler/LocalAI
OpenAI 替代,本地无需 GPU
⭐ 43.4k
janhq/jan
离线优先开源 ChatGPT 替代
⭐ 40.9k
chatboxai/chatbox
桌面 AI 聊天客户端
⭐ 38.8k
coze-dev/coze-studio
扣子 AI Agent 可视化平台
⭐ 20.1k

🌐 语言分布

AI
项目语言占比
Python40%
TypeScript25%
C/C++10%
Go8%
Rust5%
JavaScript5%
Other7%

🤗 Hugging Face 热门

开源 AI 社区最新热门模型、Spaces 应用与数据集

🌐 生态数据

1,020,000+
总模型数量
较去年增长 58%
280,000+
总数据集数量
覆盖 200+ 任务类型
520,000+
总 Spaces 数量
Gradio + Streamlit + Docker
18M+
月活跃用户
开发者 + 研究者社区
85M+
日均下载量
模型 + 数据集合计
3,500+
每日新增模型
约每周 24,000+ 个新模型

🔥 热门模型 (Trending Models)

通义千问3代旗舰 MoE 模型,支持 119 种语言,激活参数 22B,综合性能比肩 GPT-4o
❤️ 12.8K ⬇️ 4.2M
💬 对话模型 Apache 2.0 PyTorch GGUF
DeepSeek 第二代推理模型,强化学习训练,数学/代码推理能力大幅跃升
❤️ 28.5K ⬇️ 8.6M
💬 对话模型 MIT PyTorch GGUF
Meta Llama 4 系列旗舰 MoE 模型,128 个专家,原生多模态支持
❤️ 8.2K ⬇️ 3.1M
🔎 视觉语言 Llama License PyTorch GGUF
Mistral 中型旗舰模型,欧洲 AI 代表作,多语言能力突出,推理高效
❤️ 5.6K ⬇️ 2.8M
💬 对话模型 Apache 2.0 PyTorch GGUF
微软小模型之王,14B 参数性能比肩 70B 级别,适合端侧部署
❤️ 6.3K ⬇️ 5.1M
💬 对话模型 MIT PyTorch ONNX GGUF
Google Gemma 3 系列指令微调版,支持图文理解,140+ 语言
❤️ 7.1K ⬇️ 3.5M
🔎 视觉语言 Gemma License PyTorch GGUF
新一代文生图模型,Stable Diffusion 团队打造,图像质量和文字渲染大幅提升
❤️ 18.2K ⬇️ 6.8M
📸 图像生成 FLUX License PyTorch
OpenAI 语音识别旗舰加速版,速度提升 6x,99 种语言支持
❤️ 4.8K ⬇️ 32M
🗣️ 语音 MIT PyTorch ONNX
通义千问代码专用模型,HumanEval 93.2%,超越 GPT-4o 的开源代码模型
❤️ 5.2K ⬇️ 4.5M
💻 代码 Apache 2.0 PyTorch GGUF
智源多功能多语言嵌入模型,支持稠密/稀疏/多向量检索,100+ 语言
❤️ 3.6K ⬇️ 42M
📝 文本嵌入 MIT PyTorch ONNX
Stability AI 音乐/音效生成模型,支持文本到音频,最长生成 3 分钟高质量音频
❤️ 2.9K ⬇️ 890K
🎵 音乐/音频 Stability License PyTorch
书生·万象视觉语言模型,文档理解/图表分析/OCR 全面领先,支持多图对话
❤️ 4.1K ⬇️ 1.5M
🔎 视觉语言 MIT PyTorch

🎨 热门 Spaces (Trending Spaces)

💬
Qwen3 Chat Demo 🟢 运行中
by Qwen
通义千问3旗舰模型在线体验,支持多轮对话、代码生成、数学推理
💬 聊天 ❤️ 6.8K 🔗 体验
🎨
FLUX.1 Image Gen 🟢 运行中
by black-forest-labs
FLUX.1 文生图在线体验,极高质量图像生成,精准文字渲染
🎨 图像 ❤️ 14.2K 🔗 体验
📊
Open LLM Leaderboard 🟢 运行中
by open-llm-leaderboard
开源大模型综合评测排行榜,覆盖推理/知识/数学/代码等维度
📊 可视化 ❤️ 9.5K 🔗 体验
🛢
InstantMesh 🟢 运行中
by TencentARC
单张图片秒级生成 3D 网格模型,支持多角度输出和纹理映射
🎨 图像 ❤️ 3.8K 🔗 体验
🎤
Whisper Transcribe 🟢 运行中
by openai
OpenAI Whisper 在线语音转文字,支持 99 种语言自动识别和翻译
🎵 音频 ❤️ 5.1K 🔗 体验
🥊
Chatbot Arena 🟢 运行中
by lmarena-ai
LLM 盲测对战平台,匿名 A/B 测试,社区投票驱动的 Elo 排名
💬 聊天 ❤️ 11.3K 🔗 体验
🧠
DeepSeek-R2 Demo 🟢 运行中
by deepseek-ai
DeepSeek-R2 推理模型在线演示,展示思维链和深度推理过程
💬 聊天 ❤️ 7.4K 🔗 体验
📄
PDF Chat 🟢 运行中
by smol-ai
上传 PDF 文档即可对话,基于 RAG 的智能文档问答工具
🔧 工具 ❤️ 2.6K 🔗 体验
🎵
MusicGen 🟢 运行中
by facebook
Meta 音乐生成模型,文本描述即可创作音乐,支持旋律引导
🎵 音频 ❤️ 4.3K 🔗 体验

📊 热门数据集 (Trending Datasets)

🌐
HuggingFaceFW/fineweb-2
HuggingFace 团队精选多语言网页预训练数据集,覆盖 1000+ 语言
💾 60TB+ 预训练 ⬇️ 2.8M
💬
teknium/OpenHermes-2.5
百万级高质量 GPT-4 生成指令数据,社区 SFT 微调首选
💾 1M 条 指令微调 ⬇️ 1.6M
💭
HuggingFaceH4/ultrachat_200k
20 万条高质量多轮对话数据,用于训练 Zephyr 等模型的核心数据
💾 200K 条 对话 ⬇️ 980K
🧠
Open-Orca/OpenOrca
大规模增强推理数据集,包含 FLAN 子集和多样化思维链样本
💾 4.2M 条 推理 ⬇️ 720K
📚
HuggingFaceTB/cosmopedia
300 亿 token 合成教科书数据,用 Mixtral 生成,覆盖数学/科学/历史等
💾 30B tokens 预训练 ⬇️ 510K
💻
bigcode/the-stack-v2
全球最大开源代码数据集 V2,覆盖 600+ 编程语言,3.3TB 去重代码
💾 3.3TB 代码 ⬇️ 450K
🗣️
lmsys/lmsys-chat-1m
100 万条真实用户与 25 个 LLM 的对话记录,宝贵的偏好对齐数据源
💾 1M 条 对话/偏好 ⬇️ 380K

🏆 开源模型排行榜 (Open LLM Leaderboard)

# 模型 参数量 类型 MMLU HumanEval GSM8K 综合分
1 Qwen3-235B-A22B 235B Instruct
92.1
90.2
95.4
92.6
2 DeepSeek-R2-671B 671B Instruct
91.3
92.5
96.1
92.3
3 Llama-4-Maverick-400B 400B Instruct
90.5
88.1
94.2
90.9
4 Mistral-Medium-3-73B 73B Instruct
88.4
85.6
91.0
88.3
5 Qwen2.5-72B-Instruct 72B Instruct
86.2
87.4
92.3
88.0
6 gemma-3-27b-it 27B Instruct
83.5
80.2
88.7
84.1
7 phi-4-14B 14B Instruct
82.0
83.1
89.2
84.8
8 Llama-4-Scout-17B 109B Instruct
81.3
79.5
87.8
82.9
9 DeepSeek-V3-Base 671B Base
84.6
72.8
86.4
81.3
10 Qwen2.5-72B-Base 72B Base
80.1
65.4
82.5
76.0

📈 行业洞察

市场趋势与产业格局

📊 AI 行业数据

关键指标一览,洞察行业发展趋势

$1500亿+
2025 全球 AI 投资总额
较 2024 增长约 50%,美国和中国占据主要份额
100万+
HuggingFace 模型数量
开源模型生态持续爆发,月新增模型超过 5 万个
+68%
AI 相关岗位增长率 (YoY)
ML Engineer、AI Researcher 和 Prompt Engineer 需求最旺盛
78%
企业 AI 采用率
全球 500 强企业中超过 78% 已部署生成式 AI 应用

主流大模型参数对比

模型厂商参数量上下文窗口开源特点
GPT-5OpenAI未公开1M原生多模态,推理能力强
Claude Opus 4Anthropic未公开200K扩展思维,代码能力领先
Gemini 2.5 ProGoogle未公开1M跨模态推理,长文本理解
Llama 4 MaverickMeta400B (17B active)1MMoE 架构,128 专家
Qwen 3 235B阿里巴巴235B128K中文能力卓越,全模态
DeepSeek-R2DeepSeek671B (37B active)128KMoE,推理能力突出
Grok-3xAI未公开128K实时数据,推理优化
Mistral Large 2Mistral123B128K欧洲最强开源模型

💰 AI 创业与投资雷达

追踪全球 AI 领域最新融资、独角兽排名与收购动态

🚀 最新融资事件

OpenAI G轮 $400 亿
SoftBank 领投,微软、Thrive Capital、Coatue 等跟投
史上最大私募融资;估值达 $3,000 亿,转型营利性实体
2025年10月
xAI C轮 $60 亿
a16z, Sequoia, Fidelity, 沙特主权基金
Elon Musk 旗下 AI 公司;估值 $500 亿,加速 Colossus 超算集群建设
2025年12月
Anthropic E轮 $35 亿
Lightspeed, Spark Capital, Google, Salesforce
估值达 $615 亿;Claude 系列模型市场份额持续扩大
2025年11月
Databricks J轮 $100 亿
Thrive Capital, a16z, 新加坡GIC, T. Rowe Price
估值 $620 亿;数据与AI平台融合龙头,准备IPO
2025年12月
Figure AI B轮 $6.75 亿
Microsoft, NVIDIA, Intel Capital, Bezos Expeditions
AI 人形机器人公司;估值 $26 亿,Figure 02 已进入商业试点
2025年2月
Mistral AI C轮 $6.4 亿
General Catalyst, a16z, BPI France
估值 $64 亿;欧洲最有价值AI初创,聚焦开源+商业双轨模式
2025年1月
月之暗面 (Moonshot AI) B+轮 $3 亿
腾讯、阿里、红杉中国、小红书
估值约 $33 亿;Kimi 长文本对话产品月活突破 3600 万
2025年3月
Cohere D轮 $5 亿
PSP Investments, NVIDIA, Cisco, Salesforce Ventures
估值 $55 亿;企业级 AI 部署领军,专攻 RAG 和 Agent 工作流
2025年7月
Perplexity AI C轮 $5 亿
Institutional Venture Partners, NVIDIA, Jeff Bezos
估值 $90 亿;AI 搜索引擎月查询量突破 5 亿次
2025年6月

🦄 AI 独角兽估值排行 Top 15

1 🇺🇸 OpenAI
$3,000亿
AGI/对话
2 🇺🇸 Databricks
$620亿
数据+AI
3 🇺🇸 Anthropic
$615亿
AGI/安全
4 🇺🇸 xAI
$500亿
AGI/搜索
5 🇺🇸 Scale AI
$140亿
数据标注
6 🇺🇸 Perplexity
$90亿
AI搜索
7 🇫🇷 Mistral AI
$64亿
开源LLM
8 🇨🇦 Cohere
$55亿
企业AI
9 🇨🇳 智谱AI
$50亿
通用大模型
10 🇨🇳 MiniMax
$45亿
多模态
11 🇨🇳 月之暗面
$33亿
长文本对话
12 🇺🇸 Figure AI
$26亿
人形机器人
13 🇺🇸 Glean
$25亿
企业搜索
14 🇨🇳 百川智能
$22亿
通用大模型
15 🇺🇸 Runway
$15亿
AI视频

🤝 近期重大收购 / 合并

Google ← Wiz
$320 亿
Google 收购云安全公司 Wiz(含 AI 威胁检测),史上最大网络安全收购
2025年3月 完成
AMD ← ZT Systems
$49 亿
AMD 收购 AI 基础设施公司 ZT Systems,增强 AI 服务器和数据中心能力
2025年8月 完成
Salesforce ← Informatica
$80 亿
Salesforce 收购数据管理巨头 Informatica,强化 AI 数据管线和 Agent 平台
2025年9月 宣布
Amazon ← Anthropic(增持)
$40 亿
Amazon 追加投资 Anthropic 至累计 $80 亿,深化 AWS 与 Claude 生态绑定
2025年3月
ServiceNow ← Moveworks
$15 亿
ServiceNow 收购 AI 企业助手 Moveworks,强化 IT 服务自动化 Agent
2024年11月 完成
Databricks ← Tabular
未披露(约$20亿)
Databricks 收购 Apache Iceberg 创始团队公司,巩固数据湖仓 AI 生态
2025年6月

📈 投资趋势总览

全球 AI 年度投资总额

$720亿
2024
$1,300亿
2025
$1,600亿*
2026E

* 2026为预估值 | 数据含VC+PE+企业战投

各领域投资占比(2025)

大模型/AGI35%
AI基础设施18%
AI应用/Agent13%
AI+医疗10%
机器人9%
自动驾驶7%
其他8%

AI 投资地区分布(2025)

🇺🇸 美国58%
🇨🇳 中国20%
🇪🇺 欧盟10%
🇮🇱 以色列/中东6%
🌎 其他6%

全球 AI 政策法规

追踪各国 AI 监管动态,为开发者与企业提供合规指引

🌎 各国/地区 AI 政策全景

🇺🇸
美国
AI 行政令 + NIST AI RMF + 国会立法
部分生效
  • 拜登 AI 行政令 (EO 14110) 已部分修订,特朗普政府调整方向
  • NIST AI 600-1(生成式AI风险框架)已发布
  • 国会推进《AI LEAD Act》与《No Fakes Act》
  • 各州层面立法活跃:加州 SB-1047 签署通过
影响力
9/10
🇪🇺
欧盟
EU AI Act(人工智能法案)
分阶段生效中
  • 2024年8月正式生效;禁止条款2025年2月起执行
  • 高风险AI系统合规要求2026年8月全面实施
  • 通用AI模型(GPAI)透明度义务2025年8月起适用
  • 建立AI Office负责监督与执法;罚款最高3500万欧或全球营收7%
影响力
9.5/10
🇨🇳
中国
生成式AI管理办法 + 算法备案 + 数据安全
已生效
  • 《生成式AI服务管理暂行办法》2023年8月生效,2025年修订完善
  • 算法备案制度:所有对公服务的AI大模型需完成备案
  • 2025年《人工智能法(草案)》公开征求意见
  • 数据出境安全评估趋严;AI训练数据合规要求提高
影响力
8.5/10
🇬🇧
英国
Pro-innovation AI Regulation
审议中
  • 采取"促创新"监管路径,由现有监管机构分行业执行
  • AI Safety Institute(AISI)开展前沿模型评估
  • 2025年发布《AI Opportunities Action Plan》
  • 暂无统一AI立法,但考虑引入法定义务
影响力
6.5/10
🇯🇵
日本
AI 战略 2025 + AI事业者指南
指南发布
  • 以软法(指南)为主,不急于立法硬性约束
  • 2024年发布《AI事业者ガイドライン》自律指南
  • 积极推动AI在制造、医疗、防灾领域应用
  • G7 广岛AI进程主导者,推动国际治理协调
影响力
5/10
🇰🇷
韩国
AI 基本法
2026年1月生效
  • 2024年12月国会通过《AI基本法》,亚洲首部综合性AI法
  • 建立高风险AI分类管理制度
  • AI影响评估与透明度报告义务
  • 设立国家AI委员会统筹政策协调
影响力
6/10

📅 全球 AI 监管时间线

2023.08
🇨🇳 生成式AI
管理办法生效
2023.10
🇺🇸 拜登AI
行政令签署
2024.03
🇪🇺 EU AI Act
欧洲议会通过
2024.08
🇪🇺 AI Act
正式生效
2024.09
🇺🇸 加州SB-1047
AI安全法签署
2024.12
🇰🇷 AI基本法
国会通过
2025.02
🇪🇺 AI禁止
条款生效
2025.08
🇪🇺 GPAI
透明度义务
2025.Q4
🇨🇳 AI法草案
征求意见
2026.01
🇰🇷 AI基本法
正式生效
2026.08
🇪🇺 高风险AI
全面合规

✅ AI 开发者 / 企业合规要点

📜
模型透明度报告:公开训练数据概况、模型能力与局限性评估、能源消耗数据(EU AI Act GPAI 要求)
🔒
数据合规与隐私:确保训练数据来源合法;遵守 GDPR、中国数据安全法;建立数据删除响应机制
风险评估制度:高风险AI系统需进行上市前合规评估;建立持续监控和事件报告机制
🏷
AI内容标识:AI生成内容需明确标注;深度伪造内容须携带水印和元数据标记
👥
人类监督保障:高风险决策场景(医疗、司法、招聘)必须保留人工审核环节
🛠
算法备案(中国):面向公众提供 AI 服务的算法需向网信部门备案;定期安全评估
📊
偏见与公平性测试:部署前进行多维度偏见检测;关注种族、性别、年龄等维度公平性
💰
知识产权合规:关注训练数据版权风险;跟踪各地 AI 版权诉讼判例(NYT v. OpenAI 等)
🌐
跨境合规:多地运营需满足各辖区要求;注意数据本地化和模型出口管制(如美国芯片出口管制间接影响)

🏥 AI + 医疗

追踪 AI 在医疗健康领域的最新突破、监管动态与产业应用

📰 医疗AI最新动态

Google DeepMind AlphaFold 3 实现全分子结构预测

🔬 药物研发Nature / DeepMind2025.05

AlphaFold 3 能预测蛋白质、DNA、RNA、配体等所有生命分子的结构和相互作用,准确度远超实验方法。Isomorphic Labs 已利用该技术与礼来、诺华合作推进多个药物管线。

FDA 已授权超过 1000 款 AI/ML 医疗器械

📋 FDA审批FDA2026.01

截至 2026 年初,FDA 累计授权超过 1000 款 AI/ML 医疗设备,其中约 76% 用于放射影像分析。2025 年全年新增批准约 200 款,同比增长 25%,AI医疗器械进入加速期。

Insilico Medicine AI 药物 INS018_055 进入 Phase II 临床

🔬 药物研发Insilico Medicine2025.06

全球首个由 AI 发现靶点并设计分子的候选药物 INS018_055(治疗特发性肺纤维化)顺利进入 Phase II 临床试验,从靶点发现到临床仅用 30 个月,传统流程需约 6 年。

GPT-4 通过美国医师资格考试 (USMLE),分数超过多数考生

🩺 临床诊断Microsoft Research / NEJM AI2025.03

研究证实 GPT-4 在 USMLE 三步考试中均超过及格线,部分科目得分超过 90%。后续 Med-PaLM 2 和 GPT-4V 在多模态医学推理中进一步提升,引发关于 AI 辅助诊断的广泛讨论。

Recursion 与罗氏达成 $150 亿 AI 药物发现合作

🔬 药物研发Recursion / Roche2025.12

AI 生物技术公司 Recursion 与罗氏达成大规模合作协议,利用其 AI 平台加速神经科学和肿瘤学领域的药物发现。Recursion 已建成全球最大的生物化学数据集之一,覆盖超 2.4 万亿个实验数据点。

AI 辅助乳腺癌筛查:减少 44% 放射科医生工作量

📷 医学影像The Lancet Oncology2025.09

瑞典大规模临床试验证实,AI 辅助乳腺 X 光筛查在不降低癌症检出率的前提下,将放射科医生阅片工作量减少 44%。AI 系统在高密度乳腺组织中的检出率甚至优于人类。

直觉外科发布 da Vinci 5,集成 AI 实时决策支持

🤖 手术机器人Intuitive Surgical2025.03

第五代达芬奇手术系统集成 AI 视觉分析和实时力反馈,手术精度提升 10 倍。AI 可自动识别关键解剖结构并提供术中导航,已获 FDA 510(k) 批准。

AI 心理治疗工具 Woebot 获 FDA 突破性设备认定

🧠 心理健康Woebot Health / FDA2025.08

Woebot 基于认知行为疗法(CBT)的 AI 心理治疗聊天机器人获得 FDA 突破性设备认定,临床试验显示其对青少年抑郁症的疗效与传统治疗相当,可及性大幅提高。

AI 基因组分析将罕见病诊断周期从 5 年缩短至数周

🧬 基因组学Nature Genetics2025.11

Google DeepVariant 和 Illumina DRAGEN AI 联合方案在罕见病基因诊断中将变异检测准确率提升至 99.7%,平均诊断时间从数年缩短至 2-4 周,已帮助超 10 万患者获得精准诊断。

GRAIL Galleri 多癌种早筛检测获 NHS 大规模试点

💊 精准医疗GRAIL / NHS England2025.10

AI 驱动的 Galleri 液态活检技术可通过单次血液检测筛查 50+ 种癌症,英国 NHS 启动 14 万人大规模试点。AI 模型从 cfDNA 甲基化模式中识别癌症信号,早期检出率达 67%。

🏆 里程碑时间线

2020年11月
AlphaFold 2 解决蛋白质折叠问题
DeepMind 的 AlphaFold 2 在 CASP14 竞赛中达到原子级精度,被《Science》评为年度十大突破之首。随后免费公开超 2 亿种蛋白质结构。
★★★★★
2021年6月
AI 加速新冠口服药 Paxlovid 研发
辉瑞利用 AI 加速筛选和优化先导化合物,将新冠口服药 Paxlovid 的临床前研发时间从常规 4 年压缩至数月。该药获 FDA 紧急使用授权。
★★★★☆
2022年9月
FDA 授权的 AI 医疗器械突破 500 款
FDA 累计授权超过 500 款 AI/ML 医疗器械,主要集中在放射学 (75%)、心血管 (11%) 和血液学 (4%) 领域,标志着 AI 医疗进入规模化应用阶段。
★★★★☆
2023年3月
GPT-4 通过美国医师资格考试
OpenAI GPT-4 在 USMLE Step 1/2/3 考试中均超过及格线,部分科目得分位于 80-90 百分位。Google Med-PaLM 2 随后在医疗问答中达到专家水平。
★★★★★
2024年5月
AlphaFold 3 实现全分子结构预测
AlphaFold 3 将预测范围从蛋白质扩展至 DNA、RNA、配体等所有生命分子。Isomorphic Labs 与礼来、诺华签署合计超 30 亿美元合作协议。
★★★★★
2025年6月
首个 AI 端到端发现的药物进入 Phase II
Insilico Medicine 的 INS018_055 成为全球首个从 AI 发现靶点到 AI 设计分子的候选药物进入 Phase II 临床试验,用于治疗特发性肺纤维化。
★★★★★
2025年12月
AI 辅助多癌种液态活检进入大规模临床验证
GRAIL Galleri、Exact Sciences 等 AI 液态活检平台在多国启动大规模前瞻性临床试验,AI 模型可从 cfDNA 中检测 50+ 种癌症,推动"一滴血查癌"走向现实。
★★★★☆
2026年2月
FDA 授权 AI 医疗器械突破 1000 款
FDA 授权的 AI/ML 医疗设备累计突破 1000 款里程碑,覆盖影像诊断、病理分析、心电监测、药物交互等领域。中国 NMPA 同期审批超 200 款 AI 三类医疗器械。
★★★★☆

🌎 AI医疗应用全景图

🔬

药物研发

AI 将药物研发从传统的 10-15 年压缩至 2-4 年,成本降低 70%。涵盖靶点发现、先导化合物优化、毒性预测、临床试验设计等全流程。

🏢 代表公司:Insilico Medicine · Recursion · Isomorphic Labs · Relay Therapeutics · Absci
🔧 关键技术:分子生成模型 · 虚拟筛选 · ADMET预测 · 蛋白质-配体对接
AI管线 300+ Phase I+ 约30个 成本降低 ~70%
📷

医学影像AI

AI 在放射学(CT/MRI/X光)、数字病理、皮肤镜和眼底影像分析中已达到甚至超越人类专家水平,是 FDA 批准 AI 医疗器械最多的领域。

🏢 代表产品:Viz.ai · Aidoc · Paige AI · IDx-DR · SkinVision
🔧 关键技术:卷积神经网络 · Vision Transformer · 自监督预训练 · 3D影像分析
FDA批准 760+ 肺结节检出 96.4% 糖网筛查 95.5%
🧬

基因组与精准医疗

AI 驱动的基因组分析实现了个性化治疗方案、罕见病快速诊断和癌症早期筛查,推动医疗从"千人一方"走向"一人一方"。

🏢 代表公司:Illumina · Tempus AI · GRAIL · 23andMe · Deep Genomics
🔧 关键技术:变异检测 · cfDNA分析 · 药物基因组学 · 多组学整合
变异检测 99.7% 50+癌种早筛 罕见病诊断提升40%
🤖

手术机器人与辅助

AI 增强的手术机器人实现更精准的微创手术,AI 视觉系统自动识别关键解剖结构,AR/AI 导航系统提供术中实时指引。

🏢 代表产品:da Vinci 5 · Mako · ROSA · Ion · Hugo RAS
🔧 关键技术:力反馈控制 · 实时解剖分割 · 术中路径规划 · AR叠加导航
全球装机 9000+ 精度提升 10x 并发症降低 30%
🧠

心理健康AI

AI 心理健康工具提供全天候可及的心理支持,基于 CBT 等循证疗法的聊天机器人可辅助治疗抑郁、焦虑等常见心理疾病。

🏢 代表产品:Woebot · Wysa · Talkspace AI · Ginger · Spring Health
🔧 关键技术:情绪识别 · NLP对话 · 行为模式分析 · 危机预警系统
用户 500万+ 症状缓解 ~50% FDA认定 3项
🩺

临床决策支持

AI 临床决策支持系统整合电子病历、影像、检验数据和最新文献,辅助医生做出更精准的诊疗决策,减少误诊和漏诊。

🏢 代表公司:Epic AI · Glass Health · Hippocratic AI · Abridge · Nuance DAX
🔧 关键技术:医学LLM · 知识图谱 · 多模态融合 · 临床路径推荐
误诊率降低 ~30% 文档效率+65% 覆盖 3万+疾病

⚖️ 监管与伦理

🇺🇸 美国 FDA

1,000+
已授权 AI/ML 医疗器械数量
  • De Novo / 510(k) / PMA 三条审批路径
  • 2024 年发布 AI 医疗器械生命周期管理框架
  • 要求算法透明性和持续真实世界性能监测
  • 2025 年新增 AI 临床决策支持软件指南

🇪🇺 欧盟 EU MDR + AI Act

AI Act 2026
《欧盟 AI 法案》关键条款 2026 年 2 月全面生效
  • AI 医疗器械被归类为"高风险"系统
  • 强制要求数据质量管理和算法可解释性
  • CE 标志需同时满足 MDR 和 AI Act 双重合规
  • 设立 AI 监管沙盒供创新产品测试

🇨🇳 中国 NMPA

200+
已批准 AI 三类医疗器械数量
  • AI 医疗器械按三类(最高风险)管理
  • 2024年发布《人工智能医疗器械注册指导原则》
  • 要求算法锁定、临床验证和真实世界数据
  • 鼓励 AI 在基层医疗和远程诊断中应用

⚖️ 伦理挑战

AI 医疗面临的核心伦理问题
  • 数据隐私:患者医疗数据安全与知情同意
  • 算法偏见:训练数据不均衡导致诊断差异
  • 责任归属:AI 误诊时的法律责任认定
  • 可解释性:黑箱模型在临床决策中的信任问题
  • 医疗公平:AI 技术在欠发达地区的可及性

📈 投资与市场

$328亿
2025 年全球 AI 医疗市场规模
预计 2030 年达 $1,879 亿
CAGR 38.5%
$142亿
2025 年 AI 医疗领域融资总额
同比增长 32%
平均单笔融资 $8,500万
$61亿
AI 药物研发细分市场规模
占 AI 医疗总市场 ~19%
增速最快的细分领域
$89亿
AI 医学影像市场规模
最成熟的 AI 医疗细分领域
占总市场 ~27%

📈 AI医疗各细分领域投资占比(2025)

医学影像27%
药物研发19%
临床决策支持16%
基因组/精准医疗12%
手术机器人10%
心理健康8%
其他8%

🏆 AI医疗融资 Top 公司(截至2026年初)

公司领域累计融资估值代表产品
Tempus AI精准医疗$16亿$61亿 (已IPO)基因组AI分析平台
Recursion药物研发$14亿$42亿 (已IPO)AI生物化学平台
Insitro药物研发$7.4亿$24亿机器学习药物发现
Viz.ai医学影像$3.5亿$12亿AI卒中检测
Insilico Medicine药物研发$4.1亿$8.9亿INS018_055 (IPF)
Hippocratic AI临床AI$2.6亿$5亿医疗LLM Agent

🌎 世界模型动态

追踪视频生成、物理模拟与世界模型前沿进展

🎬 视频生成与世界模型格局(2026 Q1 · 3月29日更新)

行业趋势:世界模型赛道全面爆发!4月核心信号:① Yann LeCun 离开 Meta 创办 AMI Labs,€5 亿融资、€30 亿估值,史上最大预发布融资之一,押注世界模型超越 LLM 路径;② Google DeepMind 发布 Genie 3,首个实时交互世界模型,24fps 生成持续 3D 环境;③ World Labs 推出 Marble 商业产品(免费至 $95/月),世界模型首次商业化;④ NVIDIA Cosmos 下载突破 200 万,机器人和自动驾驶开发者拥抱物理感知合成数据;⑤ OpenAI 终止 Sora 视频生成器,聚焦统一超级应用——视频/世界模型路线出现分化。

🚀 AMI Labs — 世界模型最大赌注 — LeCun(图灵奖得主)认为 LLM 永远无法实现通用智能,需要理解物理现实而非仅预测文本。AMI Labs 巴黎总部 2026 年 1 月成立,目标构建能理解因果关系和物理定律的 AI 系统。

🎬 Genie 3 — 实时 3D 世界生成 — DeepMind 的 Genie 3 可在 24fps 下实时生成可交互的持续 3D 环境,标志着从视频生成到可交互世界模拟的范式转变。

🤖 具身智能持续突破 — LeRobot v0.5.0 扩展所有维度;NXP 将 VLA 微调带到嵌入式平台;Holotron-12B 混合 SSM 架构实现高吞吐 Computer Use Agent。

📚 LLM 天花板论实证 — 2024 年数学证明 LLM 无法学习所有可计算函数、必然产生幻觉。世界模型通过具身体验学习物理,而非仅从文本模式中推断,被视为通往 AGI 的替代路径。

🔭 世界模型关键玩家速览

AMI Labs (LeCun)🆕 €5亿 物理世界理解
DeepMind Genie 3🆕 实时交互3D世界模型
World Labs Marble🆕 首个商业化世界模型
OpenAI Sora视频生成旗舰
Google Veo / Lumiere多模态视频+物理
NVIDIA Cosmos (200万+下载)自动驾驶世界模型
Holotron-12B (H+NVIDIA)高吞吐 Computer Use Agent
Runway Gen-4创意工具+API
Solaris首个多人视频世界模型

📅 更新:2026.04.01 | 数据来源:Introl、Fortune、WhatLLM、NVIDIA GTC 2026、HuggingFace Blog、The Verge、Bloomberg、OpenAI、arXiv、Euronews

🎮 Solaris — 首个多人视频世界模型

Solaris 是首个支持多人交互的视频世界模型,基于 Minecraft 环境构建,能够同时模拟多个玩家的视角和行为。

数据引擎SolarisEngine(自研数据收集系统)
训练数据1,260 万帧 Minecraft 游戏画面
训练策略分阶段:单人 → 多人(渐进式泛化)
核心技术Checkpointed Self Forcing
多人交互 Minecraft 开源研究

🔬 技术纵深

硬核技术对比与分析

🎯 AI 基准测试排行榜

基于 LMSYS Chatbot Arena、MMLU、HumanEval 等权威评测的最新排名(2026年3月数据)

🏆 Chatbot Arena 排名 (ELO Rating) - Top 15

📊 多维度评测对比(Top 10)

模型 MMLU
知识广度
HumanEval
代码能力
GSM8K
数学推理
MATH
高等数学
ARC-C
科学推理
HellaSwag
常识推理
TruthfulQA
真实性
MT-Bench
对话质量

🏅 专项排行

🔓 开源 vs 闭源:各 Benchmark 最强对比

开源最强
闭源最强
开源模型在多数基准测试上与闭源模型的差距正在逐步缩小,部分指标已接近持平。
DeepSeek-R2、Llama 4、Qwen2.5 等开源模型表现尤为突出。

🏷 AI 产品实测对比

主流 AI 产品功能、定价与评分横向比较(2026.03 更新)

🌟 主流AI产品横评

🤖
ChatGPT (GPT-4o / 4.5)
💬 对话
免费版GPT-4o mini,每日限额
月付$20 (Plus) / $200 (Pro)
优势生态最全 · 多模态强 · 插件丰富
短板Pro价格高 · 推理偶有幻觉
评分★★★★★ 4.7
💜
Claude (Opus 4 / Sonnet 4)
💬 对话
免费版Sonnet 4 有限用量
月付$20 (Pro) / $100 (Max)
优势长文理解 · 代码顶级 · 安全性高
短板无联网搜索 · 图像生成弱
评分★★★★★ 4.8
💎
Gemini (2.5 Pro / Ultra)
💬 对话
免费版Gemini 2.5 Flash 免费
月付$20 (Advanced)
优势百万token · Google生态 · 多模态强
短板创意写作一般 · 响应偶慢
评分★★★★☆ 4.5
🔍
Perplexity Pro
🔎 搜索
免费版基础搜索 + 有限Pro搜索
月付$20 (Pro)
优势实时联网 · 引用溯源 · 准确度高
短板长文创作弱 · 代码能力有限
评分★★★★☆ 4.4
💻
GitHub Copilot
💻 代码
免费版个人免费(限量补全)
月付$10 (个人) / $19 (商业)
优势IDE原生集成 · Agent模式 · 多模型
短板离线不可用 · 私有代码隐忧
评分★★★★☆ 4.5
Cursor
💻 代码
免费版有限请求/月
月付$20 (Pro) / $40 (Business)
优势Agent编码 · 全项目理解 · 极速迭代
短板VS Code限定 · 大项目偶卡
评分★★★★★ 4.7
🎨
Midjourney v7
🎨 图像
免费版限时试用 25 张
月付$10 (Basic) / $30 (Standard)
优势美学顶级 · 风格多样 · 一致性强
短板文字渲染弱 · Discord依赖减少
评分★★★★★ 4.6
🎵
Suno AI v4
🎵 音乐
免费版每日 5 首生成
月付$10 (Pro) / $30 (Premier)
优势歌词+旋律一体 · 风格丰富 · 商用可
短板专业编曲弱 · 版权争议
评分★★★★☆ 4.3
🎬
Runway Gen-4 / Pika 2.0
🎥 视频
免费版限量 credits 试用
月付$12-$28 (Standard)
优势视频质量高 · 运镜控制 · 图生视频
短板长视频受限 · credits消耗快
评分★★★★☆ 4.2
💫
通义千问 / 豆包
💬 对话
免费版完全免费使用
月付免费 / API 按量
优势中文最强 · 免费大方 · 本土生态
短板英文逊色 · 联网数据范围
评分★★★★☆ 4.3

📈 功能对比矩阵

功能 / 模型 ChatGPT Claude Gemini Perplexity 通义千问 豆包
上下文长度128K200K1M128K128K128K
多模态(图像输入)
图像生成✔ GPT-4o✔ Imagen3
代码能力★★★★★★★★★★★★★★★★★★★★★★★
中文能力★★★★★★★★★★★★★★★★★★★★★★★★
联网搜索✔ 核心
文件上传
视频理解🟠
深度思考/推理✔ o3/o4-mini✔ Extended✔ Thinking🟠✔ QwQ🟠

💲 API 调用价格对比(每百万 Token, USD)

$2.5
$10
GPT-4o
$3
$15
Claude
Sonnet 4
$1.25
$5
Gemini
2.5 Pro
$0.27
$1.10
DeepSeek
V3
$0.50
$1.50
Qwen
Max
$0.15
$0.60
GPT-4o
mini
输入价格
输出价格

🖥 GPU 全景

AI 加速芯片全面对比、价格走势与市场供需分析

🔬 GPU 型号对比

🟢 NVIDIA
H100 SXM
显存80 GB HBM3
FP16/BF16989 TFLOPS
FP81,979 TFLOPS
内存带宽3.35 TB/s
TDP700 W
互联NVLink 4.0 (900 GB/s)
训练+推理
单卡 ~$25,000-30,000 | 二手 ~$18,000
🟢 NVIDIA
H200 SXM
显存141 GB HBM3e
FP16/BF16989 TFLOPS
FP81,979 TFLOPS
内存带宽4.8 TB/s
TDP700 W
互联NVLink 4.0 (900 GB/s)
训练+推理
单卡 ~$30,000-40,000
🟢 NVIDIA
B200
显存192 GB HBM3e
FP16/BF162,250 TFLOPS
FP84,500 TFLOPS
FP49,000 TFLOPS
内存带宽8.0 TB/s
TDP1,000 W
互联NVLink 5.0 (1.8 TB/s)
训练+推理
单卡 ~$30,000-40,000(预估)
🟢 NVIDIA
GB200 NVL72
配置36 CPU + 72 GPU
总显存13.5 TB HBM3e
FP8 总算力720 PFLOPS
FP4 总算力1,440 PFLOPS
NVLink 带宽130 TB/s 全互联
功耗~120 kW (整机柜)
互联NVLink 5.0 + NVSwitch
超大规模训练
整柜 ~$2M-3M(预估)
🔴 AMD
Instinct MI300X
显存192 GB HBM3
FP16/BF161,307 TFLOPS
FP82,614 TFLOPS
内存带宽5.3 TB/s
TDP750 W
互联Infinity Fabric (896 GB/s)
训练+推理
单卡 ~$10,000-15,000
🔴 AMD
Instinct MI350X
显存288 GB HBM3e
FP16/BF16~2,300 TFLOPS(预估)
FP8~4,600 TFLOPS(预估)
内存带宽~8 TB/s(预估)
TDP~750 W(预估)
互联Infinity Fabric 4.0
训练+推理 2025 H2
价格待定 | 预计对标 B200
🔵 Intel
Gaudi 3
显存128 GB HBM2e
BF161,835 TFLOPS
FP83,670 TFLOPS
内存带宽3.7 TB/s
TDP900 W
互联24x 200Gb RoCE
训练+推理
单卡 ~$12,000-15,000(预估)
🔷 Google
TPU v5p
HBM95 GB HBM2e/芯片
BF16459 TFLOPS/芯片
INT8918 TOPS/芯片
内存带宽2.76 TB/s/芯片
互联ICI (4.8 Tb/s)
规模最大 8,960 芯片 Pod
大规模训练 GCP 独占
云租赁 ~$4.20/芯片/小时
🔷 Google
TPU v6e (Trillium)
HBM32 GB HBM
BF16918 TFLOPS
INT81,836 TOPS
内存带宽1.6 TB/s
能效较 v5e 提升 67%
发布2024 年
训练+推理 GCP 独占 2024 新品
云租赁 ~$2.69/芯片/小时
🇨🇳 华为
昇腾 910B
显存64 GB HBM2e
FP16320 TFLOPS
INT8640 TOPS
内存带宽1.6 TB/s
TDP400 W
互联HCCS (392 GB/s)
训练+推理 国产替代
不公开定价 | 主要供国内大厂

📈 GPU 价格趋势

旗舰GPU市场价走势(2023-2026)

$70K $50K $30K $10K $0 2023 Q1 Q3 2024 Q1 Q3 2025 Q1 Q3 2026
H100 峰值
~$40K
GB300 ~$60-68K
供不应求
B200 发布
~$35K
H100 ~$18K
H100
H200
B200
GB300

云 GPU 租赁价格对比($/小时)

$1.10
A100 80G
$2.50
H100 SXM
$3.50
H200
$1.50
MI300X
$0.80
Gaudi 3

* 基于 Lambda、CoreWeave、AWS 等平台的竞价/按需均价(2026年3月)。实际价格随供需波动。

📦 GPU 供需分析

主要云厂商 GPU 库存状态

☁️ AWS
H100 等待期 1-2 周 | H200 紧张
⚡ Azure
H100 有限供应 | GB200 预售中
⚡ GCP
TPU v5p 充足 | H100 可用
☁️ Oracle
大量 H100/H200 集群上线
⚡ CoreWeave
H100 现货充足 | B200 部署中
🇨🇳 国内云
高端GPU受限 | 昇腾 910B 为主

📅 供给改善时间线

2026 Q1 Blackwell B200 量产爬坡中,首批 GB200 NVL72 交付微软、Meta 等大客户
2026 Q2-Q3 B200 供给大幅改善,H100 二手市场价格预计跌破 $15K;AMD MI350X 发布
2026 Q4 GB200 NVL72 广泛可用,云 GPU 租赁价格预计下降 30-40%
2027 NVIDIA Rubin (R100) 预计发布,3nm 制程;AMD MI400 系列;整体供给趋于平衡

TPU / GPU / CUDA 深度知识

硬件架构、编程模型与迁移实战

🧩 TPU 架构与开发框架

核心硬件单元

MXU(矩阵乘法单元)128×128 脉动阵列
内存HBM(高带宽内存)
芯片互联ICI 3D Torus 拓扑
原生精度BF16(Brain Float 16)
稀疏加速SparseCore(v5+ 专用)

开发框架生态

首选框架JAX + XLA 编译器
传统支持TensorFlow(原生 TPU 支持)
PyTorch 桥接PyTorch/XLA(torch_xla)
高级库Flax / Optax(JAX 生态)
大模型训练Pax / MaxText

🔬 GPU 架构深度解析

核心组件

SM(流多处理器)GPU 基本计算单元
CUDA Core通用并行计算核心
Tensor Core矩阵乘加专用单元(AI 加速关键)
显存HBM(高端)vs GDDR(消费级)
互联NVLink(900GB/s)vs PCIe 5.0(128GB/s)

代际架构对比

Ampere (A100)7nm | 312 TFLOPS BF16 | 80GB HBM2e
Hopper (H100)4nm | 989 TFLOPS BF16 | 80GB HBM3
Blackwell (B200)4nm | 2,250 TFLOPS BF16 | 192GB HBM3e

💡 Tensor Core 是 AI 训练性能的核心:每代翻倍提升 TFLOPS

💻 CUDA 编程核心

线程层级模型

Thread最小执行单元
Warp32 线程 SIMT 执行组
Block线程块(共享内存协作)
GridBlock 组成的网格(一次 Kernel 调用)

内存层级 & 执行模型

内存层级寄存器 → 共享内存 → L2 → 全局内存
Kernel 函数__global__ 修饰,GPU 端并行执行
Stream异步执行队列(计算/传输重叠)

关键加速库

cuDNN / cuBLAS深度学习 & 线性代数基础库
NCCL多 GPU 集合通信库
TensorRT推理优化引擎(量化+图优化)
TritonPython 原生 GPU Kernel 编写
FlashAttentionIO 感知注意力(省显存 5-20×)

🔄 TPU → GPU 代码迁移指南

JAX vs PyTorch 范式对比

编程范式JAX 函数式 vs PyTorch 命令式
自动微分jax.grad() vs loss.backward()
随机数显式 PRNGKey vs torch.manual_seed
并行策略pmap/pjit vs DDP/FSDP
编译优化jax.jit (XLA) vs torch.compile

7 步迁移指南

梳理模型结构,分离 JAX 特有变换(vmap/pmap)
替换 jax.numpy → torch 张量操作
重写状态管理(Flax params → nn.Module state_dict)
适配优化器(Optax → torch.optim)
替换数据管线(tf.data → DataLoader)
实现分布式训练(pjit → FSDP/DeepSpeed)
性能调优(Profiler 对比、混合精度校准)

转换工具

torch_xlaPyTorch 代码跑在 TPU 上
jax2torchJAX 函数转 PyTorch 模块
HF Accelerate统一 API 适配 TPU/GPU/CPU
DeepSpeed大模型分布式训练框架(GPU 侧)

AI 与能源

算力爆发下的能源挑战与绿色转型之路

💡 AI 算力能耗

~400 TWh
2025 全球数据中心总耗电
其中 AI 工作负载占比约 40%(~160 TWh),相当于英国全国用电量
~580 TWh
2026 预测总耗电量
AI 驱动数据中心能耗年增长率 30-40%,IEA 预测 2030 年将超 1,000 TWh
10x
AI 查询 vs 搜索能耗比
单次 GPT-4 查询约 0.01 kWh(~10 Wh),Google 搜索约 0.0003 kWh(0.3 Wh)
~500 吨 CO₂
训练 GPT-4 级模型碳排放
相当于约 100 辆汽车一年的排放量,或 250 次纽约-伦敦往返航班

🏢 主要科技公司数据中心能耗(2025年)

公司数据中心能耗同比增长可再生能源占比
Microsoft~24 TWh+34%100% 承诺
Google~25 TWh+17%~90%
Amazon (AWS)~30 TWh+28%100% 承诺
Meta~14 TWh+40%100% 承诺
Oracle~5 TWh+60%~70%
字节跳动~10 TWh+45%~50%

⚡ 能源趋势

☢️ Microsoft — 核能全面押注

重启三里岛核电站(835 MW),签约 20 年购电协议;投资 SMR 小型模块化反应堆技术,目标 2028 年部署首批 SMR 为数据中心供电。
合作方:Constellation Energy、NuScale

☢️ Google — SMR 先锋

与 Kairos Power 签约购买 500 MW 小型核反应堆电力(预计 2030 年投产);同时在全球范围内签署 40+ GW 可再生能源 PPA 协议。
合作方:Kairos Power、NextEra Energy

☢️ Amazon — 核电+太阳能组合

以 $6.5 亿收购 Talen Energy 核电数据中心园区(960 MW);在全球部署 20 GW+ 太阳能和风能项目,是全球最大企业可再生能源买家。
合作方:Talen Energy、Brookfield

🌿 可再生能源趋势

全球数据中心可再生能源占比:2023 年 ~40% → 2025 年 ~55% → 2030 年目标 ~80%。欧洲领先(~70%),北美快速追赶(~60%),亚太(~35%)。

🌎 选址热点地区

北欧(冰岛/挪威/瑞典):地热+水电+天然冷却;加拿大魁北克:廉价水电 $0.04/kWh;中东(沙特/UAE):大规模太阳能+主权基金投资;美国德州/弗吉尼亚:能源充足+政策友好。

🔋 新兴能源技术

绿色氢能:微软测试氢燃料电池备用电源;液冷技术:可降低数据中心 PUE 至 1.1 以下;长时储能:铁-空气电池和液流电池为间歇性可再生能源提供稳定性。

📈 能源 vs 算力增长

AI 算力需求 vs 能源供给增长(2022-2027 预测)

🟢 AI 算力需求(指数 2022=100)
🟠 数据中心电力供给(指数 2022=100)
差距扩大
⚠️ 供不应求
202220232024202520262027
AI 算力需求(年增 ~70%)
数据中心电力供给(年增 ~15%)
供需差距

* 算力需求基于 NVIDIA/AMD 出货量与云厂商 CapEx 推算;电力数据参考 IEA、Goldman Sachs 报告

📚 学习成长

从入门到精通

📚 学习资料

精选 AI/LLM 领域最优质的学习资源与教程

📓

Transformer 架构详解

🟢 入门

从零理解 Self-Attention、Multi-Head Attention、位置编码等核心概念,配合代码实现深入掌握 Transformer。

🔗 The Illustrated Transformer
📓

参数高效微调 (LoRA / QLoRA / PEFT)

🟡 中级

掌握低秩适应 (LoRA)、量化微调 (QLoRA) 等参数高效微调技术,用消费级 GPU 微调大模型。

🔗 HuggingFace PEFT 文档
📹

RLHF / DPO 对齐技术

🔴 高级

深入理解基于人类反馈的强化学习 (RLHF)、直接偏好优化 (DPO) 等模型对齐方法的原理与实践。

🔗 RLHF 详解 - HuggingFace
📓

分布式训练 (DeepSpeed / FSDP)

🔴 高级

学习数据并行、模型并行、流水线并行等分布式训练策略,掌握 DeepSpeed ZeRO 和 PyTorch FSDP。

🔗 DeepSpeed 官方文档
📓

预训练数据工程

🟡 中级

掌握大规模语料收集、数据清洗、去重、Tokenizer 训练等预训练数据准备的完整流程。

🔗 HuggingFace Datasets
📓

模型评估与基准测试

🟡 中级

了解 MMLU、HumanEval、GSM8K、MT-Bench 等主流评测基准,学会科学评估模型能力。

🔗 Open LLM Leaderboard
📓

vLLM 高吞吐推理引擎

🟡 中级

基于 PagedAttention 的高性能 LLM 推理引擎,支持连续批处理,吞吐量可达 HuggingFace 的 24 倍。

🔗 vLLM 文档
📓

TensorRT-LLM

🔴 高级

NVIDIA 官方 LLM 推理优化库,深度利用 GPU 特性,提供 FP8/INT4 量化和 Inflight Batching。

🔗 GitHub 仓库
📓

llama.cpp 本地推理

🟢 入门

纯 C/C++ 实现的 LLM 推理引擎,支持 CPU/GPU 混合推理和 GGUF 量化格式,在消费级硬件上运行大模型。

🔗 GitHub 仓库
📄

模型量化技术对比

🟡 中级

对比 GPTQ、AWQ、GGUF、bitsandbytes 等量化方案的精度损失、速度提升和适用场景。

🔗 HF 量化指南
📄

Serving 框架对比

🟡 中级

全面对比 vLLM、TGI、SGLang、Triton、Ollama 等主流 LLM Serving 框架的性能、功能与适用场景。

🔗 SGLang 项目
📄

推理成本优化策略

🔴 高级

从 KV-Cache 优化、Speculative Decoding、Prompt Caching 到混合精度策略,全方位降低推理成本。

🔗 Anyscale 技术博客
📑

Attention Is All You Need

架构

Transformer 架构的奠基之作,提出 Self-Attention 机制,彻底改变了 NLP 和 AI 领域的发展方向。

🔗 arXiv
📑

DeepSeek-V3 Technical Report

训练

详细阐述 DeepSeek-V3 的 MoE 架构设计、多阶段训练策略和大规模分布式训练工程实践。

🔗 arXiv
📑

Chain-of-Thought Prompting

推理

首次提出思维链提示方法,通过中间推理步骤显著提升大模型在数学和逻辑推理任务上的表现。

🔗 arXiv
📑

Visual Instruction Tuning (LLaVA)

多模态

提出视觉指令微调方法,将视觉编码器与语言模型结合,开创了开源多模态大模型的新范式。

🔗 arXiv
📑

ReAct: Reasoning and Acting in LLMs

Agent

提出推理-行动交替范式,让 LLM 能够结合推理和外部工具使用,是 AI Agent 的核心架构之一。

🔗 arXiv
📑

Direct Preference Optimization (DPO)

训练

提出无需训练奖励模型的偏好优化方法,大幅简化了 RLHF 流程,成为模型对齐的主流方案。

🔗 arXiv

🤖 Agent 开发

探索 AI Agent 框架、工具链与最佳实践

⚙️ 主流框架对比

⛓️

LangChain / LangGraph

最成熟的 LLM 应用开发框架,LangGraph 支持有状态的多步骤 Agent 工作流编排。

⭐ 100k+ Stars🎯 复杂工作流🟡 中等上手
👥

CrewAI

基于角色的多 Agent 协作框架,定义 Agent 角色、目标和任务,实现团队协作。

⭐ 25k+ Stars🎯 多Agent协作🟢 易上手
💬

AutoGen / AG2

微软开源的多 Agent 对话框架,支持灵活的 Agent 间通信模式和人机协作。

⭐ 38k+ Stars🎯 对话式Agent🟡 中等上手
💡

OpenAI Agents SDK

OpenAI 官方 Agent 开发工具包,深度集成 Function Calling 和 Assistants API。

⭐ 15k+ Stars🎯 OpenAI生态🟢 易上手
🔌

Anthropic MCP

Model Context Protocol - 标准化的 AI 模型与外部工具/数据源连接协议,类似 AI 的 USB-C。

⭐ 40k+ Stars🎯 工具标准化🟡 中等上手
🎨

Dify

开源 LLM 应用开发平台,提供可视化工作流编排、RAG 引擎和 Agent 能力,低代码快速构建。

⭐ 60k+ Stars🎯 低代码平台🟢 易上手

📖 开发教程

📓

Agent 架构设计模式

🟡 中级

深入学习 ReAct、Plan-and-Execute、Reflection、Tree-of-Thoughts 等主流 Agent 架构模式。

🔗 LangChain Blog
📓

Tool Use 工具调用实现

🟢 入门

从 Function Calling 到自定义工具注册,掌握让 AI Agent 使用外部工具的核心技术。

🔗 Anthropic Tool Use 文档
📓

Agent Memory 系统设计

🟡 中级

学习短期记忆、长期记忆、实体记忆等 Agent 记忆系统的设计与实现方案。

🔗 LangChain Memory
📹

Multi-Agent 协作模式

🔴 高级

探索 Supervisor、Hierarchical、Debate 等多 Agent 协作模式及其在复杂任务中的应用。

🔗 LangGraph Multi-Agent
📓

RAG 检索增强生成

🟡 中级

从基础 RAG 到 Advanced RAG,掌握文档切分、向量检索、重排序、查询改写等关键技术。

🔗 LlamaIndex 文档
📓

Agent 评估与调试

🟡 中级

使用 LangSmith、Weights & Biases 等工具对 Agent 进行追踪、评估和调试,确保可靠性。

🔗 LangSmith 文档

🚀 实战项目

🔬

GPT Researcher

🟡 中级

自主研究 Agent,能自动搜索、阅读、总结网页内容并生成研究报告。学习 Agent 工作流的绝佳项目。

AgentRAG
🔗 GitHub
💻

Open Interpreter

🟢 入门

让 LLM 在本地运行代码的开源项目,支持 Python、JavaScript、Shell,理解代码执行 Agent 的基础。

Agent开源
🔗 GitHub
🏢

MetaGPT

🔴 高级

模拟软件公司的多 Agent 框架,包含产品经理、架构师、工程师等角色,自动完成软件开发全流程。

Multi-Agent代码生成
🔗 GitHub

🔌 MCP 生态

📄

MCP 协议简介

🟢 入门

Model Context Protocol 是 Anthropic 推出的开放协议,标准化 AI 模型与外部数据源和工具的连接方式。

🔗 MCP 官网
📦

热门 MCP Server

🟢 入门

官方和社区维护的 MCP Server:Filesystem、GitHub、Slack、PostgreSQL、Puppeteer、Brave Search 等。

🔗 MCP Servers 仓库
📓

开发自定义 MCP Server

🟡 中级

使用 TypeScript 或 Python SDK 开发自己的 MCP Server,让 AI 访问你的私有数据和工具。

🔗 快速开始

🛠 Prompt 工程技巧

掌握前沿提示词工程方法,释放大语言模型的最大潜能

📚 核心技巧库

📝 实战模板

🔧 Prompt 工具推荐