Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: CAR:字节跳动×复旦重磅推出!自适应推理框架让大模型效率飙升,准确率再攀新高
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AIGC 资讯 > CAR:字节跳动×复旦重磅推出!自适应推理框架让大模型效率飙升,准确率再攀新高
AIGC 资讯

CAR:字节跳动×复旦重磅推出!自适应推理框架让大模型效率飙升,准确率再攀新高

站外新闻
最近更新: 2026年6月7日 下午8:28
CAR 复旦大学 大型语言模型 字节跳动 推理框架
SHARE

💡 站外导读:随着大模型应用场景的不断扩展,如何在保障准确性的前提下提升推理效率,已成为行业核心痛点。传统模型面对复杂问题时统一采用长链推理,导致算力成本高昂、响应延迟明显;面对简单问题又可能因过度思考而浪费资源。字节跳动与复旦大学联合推出的CAR框架,正是为解决这一矛盾而生。它通过基于置信度的动态推理切换,让模型能智能选择最优推理路径,在效率与准确性间取得最佳平衡,为大模型的规模化落地提供了全新解题思路。

CAR是什么

CAR(Certainty-based Adaptive Reasoning)是字节跳动联合复旦大学推出的自适应推理框架,能提升大型语言模型(LLM)和多模态大型语言模型(MLLM)在不同任务中的推理效率与准确性。框架基于动态地在短答案和长形式推理之间切换,根据模型对答案的置信度(通过困惑度PPL衡量)决定是否需要进行详细推理。当模型对短答案的置信度较低时,CAR会触发长形式推理提高答案的准确性,当置信度较高时,直接输出短答案,节省计算资源和时间。CAR在视觉问答(VQA)和关键信息提取(KIE)等任务中表现突出,在数学等复杂推理任务中展现出良好的性能。

阅读目录
  • CAR是什么
  • CAR的主要功能
  • CAR的技术原理
  • CAR的项目地址
  • CAR的应用场景
      • 📝 站长洞察 (Editor’s Insight)

CAR

CAR的主要功能

  • 动态推理切换:CAR能智能地在短答案和长形式推理之间进行切换。对于简单问题,直接输出短答案提高效率;对于复杂问题,触发长形式推理确保准确性。
  • 提升推理效率:CAR显著减少模型生成的token数量,降低计算成本和推理时间,提高模型在实际应用中的效率。
  • 提高推理准确性:在需要详细推理的情况下,激活长形式推理,提高模型在复杂任务中的表现,确保推理结果的准确性。
  • 适应多种任务:CAR适用视觉问答(VQA)和关键信息提取(KIE)等任务,在数学推理、常识推理等复杂任务中发挥作用,具有广泛的适用性。

CAR的技术原理

  • 模型训练:用包含短答案和长形式推理答案的训练数据对LLM或MLLM进行训练。训练时,模型需要学习如何根据不同的提示生成相应的短答案或长形式推理答案。优化目标是交叉熵损失,用最小化预测token的概率分布与真实token的分布之间的差异训练模型。
  • 获取短答案的PPL:在训练数据上进行短答案推理,计算每个短答案的困惑度(PPL)。PPL是衡量模型对答案置信度的指标,PPL越低,表示模型对答案的置信度越高。
  • 高斯分布建模:假设正确和错误短答案的PPL分数分别服从高斯分布。基于训练数据估计分布的参数,分别计算正确和错误答案的PPL均值和方差,得到两个高斯分布模型。
  • 推理过程:对于新的输入,首先生成短答案计算PPL值。根据高斯分布模型计算该PPL值下答案正确的概率。

CAR的项目地址

  • arXiv技术论文:https://arxiv.org/pdf/2505.15154

CAR的应用场景

  • 视觉问答(VQA):CAR在简单问题上直接输出短答案,提高效率;在复杂问题上触发长形式推理,确保准确。
  • 关键信息提取(KIE):根据置信度动态选择推理方式,减少token使用量,保持高准确率。
  • 数学推理:在简单数学问题上直接输出答案,在复杂问题上进行详细推理,提升准确性和效率。
  • 常识推理:针对简单常识问题直接给出答案,复杂问题则进行长形式推理,减少token消耗。
  • 多模态任务:结合文本和图像信息,动态选择推理方式,提升多模态任务的准确性和效率。

📝 站长洞察 (Editor’s Insight)

CAR框架的推出,精准踩中了当前大模型产业化的关键节点——从“模型能力竞赛”转向“推理效能深挖”。它揭示的深层趋势是:未来大模型的竞争,将不仅是参数规模的比拼,更是推理智能的较量。CAR通过置信度驱动的自适应机制,本质上赋予了模型一种“元认知”能力,让它能够评估自身答案的可靠性并动态调整策略。这种思路与人类的认知决策过程高度相似,标志着模型设计正从静态计算向动态智能演进。从产业角度看,CAR为降低API调用成本、提升端侧部署可行性提供了极具前景的方案,尤其对追求高并发、低延迟的应用场景意义重大。它暗示着,下一阶段的技术突破点将集中于模型自我优化与资源动态分配的精细化管理,这或许是实现AI普惠与商业可持续性的关键钥匙。

司农:南京农业大学开源农业大模型,40亿token数据驱动,赋能智慧农业全场景
Ming‑Flash‑Omni 2.0 – 蚂蚁开源的全模态大模型
昆仑万维开源Skywork UniPic:1.5B参数多模态模型,媲美GPT-4o,支持图像理解、生成与编辑
渣打银行裁员8000人:AI替代低价值人力,银行业‘冰冷转型’下的人类岗位危机
ChatGPT高延迟故障已修复:OpenAI确认API服务全面恢复正常
TAGGED:CAR复旦大学大型语言模型字节跳动推理框架
分享
Email 复制链接 打印
Share
上一篇 Onit:开源Mac AI助手,高亮即问、无缝接入多模型,效率飙升
下一篇 上海交大开源PC Agent-E框架:仅312条数据训练,性能暴涨241%超越Claude 3.7
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

GPT‑5.4 – OpenAI推出面向专业工作的旗舰AI模型
AIGC 资讯
110 亿参数塞进六类科学大脑:上智院开放”神珍”多模态模型,从蛋白质到气象场一个模型全读懂
AIGC 资讯
人形机器人迎来飞跃!逐际动力张巍:智能水平已达 GPT-3 阶段
AIGC 资讯
全息流体渐变通用占位特色图
索尼音乐再诉AI巨头Udio:指控其违规复制逾三万段录音
AIGC 资讯

相关推荐

AI 工具AIGC 资讯

阿里通义Qwen3.5-Max-Preview评测:国内第一的AI大模型,数学与创意写作能力跃升揭秘

站外新闻
AIGC AI评测 Qwen3.5-Max-Preview 大模型 阿里通义千问
AI 工具AIGC 资讯

GPT-5.4发布:OpenAI旗舰模型如何以75%成功率超越人类,重新定义专业工作自动化?

站外新闻
AI Agent GPT-5.4 openai 专业工作自动化
AI 工具AIGC 资讯

VRAG-RL框架详解:阿里通义如何用强化学习突破多模态RAG推理瓶颈?

站外新闻
VRAG-RL 多模态RAG 强化学习 视觉语言模型 阿里通义
AI 工具AIGC 资讯

Meta重磅发布WorldGen:一句话生成可交互3D世界,游戏开发与VR内容创作将迎巨变

站外新闻
3D世界生成 AIGC meta WorldGen 游戏开发
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent openai 多模态大模型 AI绘画 字节跳动 开源模型 开源工具 早报 具身智能 大语言模型 MoE架构 开源大模型 强化学习 阿里通义 Anthropic 腾讯混元 多模态AI 大模型 开源框架 AI智能体 教程 chatgpt AI工具 扩散模型 AI视频生成 蚂蚁集团 开源
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.