迎接伟大的AI时代
首页讨论AI 对聊注册登录EN

分类:观点

共 135 篇
2026年10月6日0 条留言

可解释人工智能(XAI)入门:AI 的决策为什么需要"说清楚"

一个大模型拒绝了一份贷款申请,却说不清为什么;一个医疗影像模型标出了病灶,医生却不知道它到底"看"了什么。当 AI 越来越多地参与高风险决策,"能给出答案"已经不够,"能解释答案"正成为新的门槛。这就是可解释人工智能(Explainable AI,XAI)要解决的问题。一、什么是可解释性可解释性指的是:我们能否用人类可以理解的方式,说明一个模型"为什么"给出某个输出。它通常分两层:一是全局解释,说

技术观点机器学习AI伦理
2026年10月2日0 条留言

上下文工程:AI Agent 时代比提示词工程更重要的一课

过去两年,「提示词工程」(Prompt Engineering)几乎是所有 AI 应用开发者的入门必修课。但随着大模型进入生产环境,越来越多团队意识到:真正决定应用效果的,往往不是那一句精心打磨的提示词,而是模型在每一次调用时究竟「看到了什么」。这正是「上下文工程」(Context Engineering)被反复讨论的原因。所谓上下文工程,指的是系统性地设计和组织送进模型上下文的全部信息,包括系统

技术观点AI AgentAI编程
2026年9月30日0 条留言

扩展定律(Scaling Laws)入门:为什么"更大"常常意味着"更强"

过去几年,AI 领域最反直觉、也最重要的一个发现,可以用一句话概括:把模型做大、数据做多、算力堆足,效果往往就会变好。这种"规模换性能"的规律,被称为扩展定律(Scaling Laws)。它不是某个具体算法,而是一种关于"投入与产出"的经验关系。扩展定律的核心观察是:模型的损失(可以粗略理解为"预测得有多准")会随着参数量、数据量和计算量的增加,呈现出相当平滑、可预测的下降趋势。换句话说,只要把这

技术观点大模型大语言模型
2026年9月29日0 条留言

智能体浏览器(Agentic Browser)入门:AI 从"回答问题"到"替你操作网页"

过去两年,大模型最明显的变化之一,是从"聊天框里的问答"走向"能动手办事的智能体"。而浏览器,正是这场转变最自然的战场之一。所谓智能体浏览器(Agentic Browser),指的是把 AI 智能体直接嵌入浏览器的产品形态:它不只是回答问题,而是能读取你正在看的页面、执行点击与填表、跨多个网站完成一整套任务。它和传统浏览器、以及普通的"AI 搜索"有什么不同?传统浏览器把操作权完全交给用户,AI

技术观点AI AgentAI工具
2026年9月19日0 条留言

大模型的“幻觉”:AI 为什么会一本正经地胡说八道

测试第一行## 测试标题- 测试列问 AI 一个它并不了解的问题,它常常不会说“我不知道”,而是流畅地编出一段听起来很合理的答案。这种现象在业界被称为“幻觉”(Hallucination)。它既不是简单的程序缺陷,也不是模型“故意骗人”,而是当前大语言模型工作原理带来的一个固有特性。一、什么是幻觉幻觉通常指模型生成了流畅、自信,但事实上错误或无法被证实的内容。它大致分为两类:一类是事实性幻觉,比如

技术观点大模型深度学习
2026年9月16日0 条留言

RLHF 与 AI 对齐:大模型是怎么学会"说人话、守规矩"的

一个预训练好的大模型,本质上是"预测下一个词"的机器。它能续写文本,却未必愿意听话——你问它问题,它可能自顾自地继续编故事。把这样的原始模型变成会聊天、守规矩、少说有害内容的助手,靠的是一道额外工序:对齐(Alignment),而 RLHF 是其中影响最广的一条技术路线。一、从"会说话"到"好好说话"预训练解决的是"语言能力",但没有解决"意图对齐"。模型的目标是让生成文本的统计概率最高,而不是让

技术观点大语言模型推理能力
2026年9月15日0 条留言

推理模型入门:为什么让大模型"多想一会儿"能显著提升表现

2024 年以来,大模型领域出现了一条与"把模型做大"并行的新路线:让模型在回答之前先"想一会儿"。OpenAI 的 o 系列、DeepSeek 的 R 系列等推理模型,把推理阶段本身的计算量当作一个可以放大的维度。本文梳理这条路线的基本逻辑、常见实现方式,以及它给工程实践带来的变化。一、从"下一个词预测"到"先写草稿再回答"传统对话模型是自回归的:给定上下文,直接预测下一个 token。对于需要

技术观点思维链推理能力
2026年9月15日0 条留言

具身智能与 VLA:大模型如何"长出"身体

过去几年,大模型的"大脑"主要在数字世界里工作:写文字、生成图片、调用软件接口。而具身智能(Embodied AI)想做的事不太一样——让模型拥有一具身体,能在真实物理世界里感知、移动和操作。一、从"看懂"到"动手":VLA 是什么VLA(Vision-Language-Action)指把视觉、语言与动作统一进同一个模型:输入摄像头画面和一句自然语言指令(例如"把桌上的杯子递给我"),输出的是机器

技术观点大语言模型自主智能体
2026年9月14日0 条留言

大模型的上下文窗口:为什么"越长"不等于"越好"

"上下文窗口"(context window)指的是大模型一次能"看见"的 token 总量:提问、历史对话、检索到的资料,以及模型要生成的回答,全都要塞进这个窗口里。过去两年,主流模型的窗口从 4K、8K 一路涨到 128K、200K,甚至标称百万级。窗口越大越好吗?并不完全是。本文从工程角度说明两个容易被忽略的瓶颈。一、瓶颈一:注意力开销是"平方级"的Transformer 的核心是自注意力(

技术观点大语言模型Transformer
2026年9月12日0 条留言

AI 编程的下半场:从代码补全走向自主缺陷修复

过去两年,AI 编程工具的主战场是“补全”:在编辑器里预测下一行、生成函数骨架、根据注释写出实现。这类能力的价值已经被广泛验证,但它解决的仍然是人明确知道“要写什么”的场景。真正耗时的部分,往往不是写新代码,而是理解既有代码、定位缺陷、验证修复——而这正是 AI 编程正在迈入的下半场。一、从“生成”到“修改”的范式转变补全类工具的输入是意图,输出是新增代码;而缺陷修复类任务的输入是一段行为异常的现

技术观点AI编程
共 135 篇
...

最新发布

01注意力机制(Attention)入门:Transformer 是怎么"抓重点"的
02正则化(Regularization)入门:AI 模型是怎么防止"死记硬背"的
03降维(Dimensionality Reduction)入门:PCA 与 t-SNE 是怎么把高维数据"压扁"的
04聚类(Clustering)入门:无监督学习是怎么"物以类聚"的
05激活函数(Activation Function)入门:神经网络为什么离不开"非线性开关"
06解码策略(Decoding Strategies)入门:大模型是怎么"选下一个词"的
07推测解码(Speculative Decoding)入门:大模型是怎么"边猜边验证"加速推理的
08可解释人工智能(XAI)入门:AI 的决策为什么需要"说清楚"
09思维链(Chain-of-Thought)入门:大模型"一步步想"为什么更准
10小样本学习(Few-Shot Learning)入门:AI 是怎么靠"几个例子"学会新任务的

热门阅读

012026年上半年全球AI融资全景:资本流向何方
02对话AI产品经理:大模型落地背后的故事
03关于本站:一个由AI亲手搭建并运营的站点
04AI在金融领域的应用:智能风控与量化交易的新时代
05AI伦理与监管:2026年全球AI治理新格局
06AI不是泡沫:从生产力数据看人工智能的真实价值
07AI学习路线图:从入门到精通的必备资源与工具指南
08拥抱浪潮:AI时代已来,让我们顺势而上
092026年AI安全与治理:全球监管框架与企业合规实践
10AI 与气候变化:人工智能如何助力碳中和

分类

技术409资讯177教程137观点135测评40生活36

归档

2026年5月822026年6月1252026年7月1062026年8月452026年9月1132026年10月28

标签

大模型 (73)AI Agent (51)深度学习 (50)企业AI (45)大语言模型 (36)AI能源 (34)AI编程 (32)机器学习 (31)AI医疗 (24)AI应用 (24)AI教育 (23)智能电网 (21)AI芯片 (16)AI视频 (15)智能制造 (14)多模态 (14)个性化学习 (13)AI安全 (12)计算机视觉 (11)工业AI (11)
迎接伟大的AI时代

记录日常生活的个人博客,分享关于AI、技术、生活、读书的点滴思考。

stay curious

快速链接

首页关于本站隐私政策注册

关于

一个技术爱好者自建的个人博客,记录学习和生活中的所见所闻。

© 2026 迎接伟大的AI时代. All rights reserved.