大模型
共 22 篇模型发布、能力边界与价格口径
OpenAI 开源 722 篇数学手稿:一个未发布模型产出的 372 个结果族
10 月 6 日,OpenAI 在 GitHub 上建了一个叫 `openai/math` 的仓库,一次提交推了 722 篇数学手稿,归为 372 个结果族。产出这些手稿的模型没有开源,也没有命名。 > > 比规…
Anthropic 发布 Claude Haiku 5.5:自称最便宜最快的小模型,运行成本比 Haiku 4.5 低 75%
2026 年 10 月 7 日,Anthropic 在官方发布页《Introducing Claude Haiku 5.5》中推出新一代小模型,模型 ID 为 `claude-haiku-5-5`,并称它是公司迄今最…
什么是 AutoML(自动机器学习)?IBM 官方科普解读
AutoML(Automated Machine Learning,自动机器学习)要解决的问题很直接:把机器学习模型从数据到上线的整条链路自动化。它让不具备算法背景的人也能搭建和部署 AI 系统,同时把数据科学家和开…
Gemini 帮你代打电话:Pixel 11 上的「Call for Me」实测细节与限制
打电话这件事,很多人其实不太想干——确认营业时间、问有没有货、改个预约,就几句话的事,却要专门腾出时间。谷歌这次想替你把这段接过去:在 Pixel 11 系列上,Gemini 开始测试一项叫 **Call for M…
李飞飞团队发布 Atlas:一个能"生成、重建、模拟任何世界"的全模态世界模型
2026 年 9 月 1 日,李飞飞(Fei-Fei Li)联合创立的 World Labs 发布下一代世界模型 **Atlas**。官方给它的定位是 "omni world model for spatial in…
DeepSeek 发布 V4.1-Flash:更智能、更快速、更高效
9月10日,DeepSeek 正式发布其全新架构家族中体量最小的模型 **DeepSeek-V4.1-Flash**,原生支持视觉理解。该模型面向更强的能力、更快的推理、更高的吞吐量,并可平滑扩展至更大规模的模型。
图像风格提取InstantStyle
从文本生成与样例图像风格一致的图像。
微软静态图片视频生成框架VASA
微软公司最近推出了一种基于单一静态图像和语音音频剪辑的具有视觉情感技能(VAS)的虚拟人物逼真说话脸生成框架VASA。
OpenAI:马斯克希望我们与特斯拉合并或“完全控制”
据称,特斯拉和SpaceX的亿万富翁首席执行官埃隆·马斯克希望人工智能研究公司OpenAI要么与特斯拉合并,要么让他完全控制该组织。
Meta 通过 Nvidia 芯片大力投资人工智能未来
Meta 正在深入人工智能领域,这是一项雄心勃勃的举措,标志着重大战略转变。该合资企业的核心是对英伟达尖端计算机芯片的大规模投资,这是人工智能研发不可或缺的一部分。Meta 首席执行官马克·扎克伯格 (Mark Zu…
一种自动确定计算机游戏状态中可能动作的方法
由于手动彻底测试视频游戏软件非常困难,因此需要拥有能够自动探索不同游戏功能的人工智能代理。此类代理的关键要求是玩家动作的模型,代理可以使用该模型来确定不同游戏状态下的可能动作集,以及对代理策略选择的游戏执行选定的动作…
HierSpeech++:通过零样本语音合成新架构
基于大语言模型(LLM)的语音合成已广泛应用于零样本语音合成中。然而,它们需要大规模数据,并且具有与以前的自回归语音模型相同的局限性,包括推理速度慢和缺乏鲁棒性。本文提出了 HierSpeech++,一种快速、强大的…
拆解 OpenAI 的新董事会
在人工智能和技术领域掀起波澜的惊人事件中,人工智能领域的领先实体 OpenAI 最近的领导地位发生了重大转变。以萨姆·奥尔特曼 (Sam Altman) 戏剧性地重返首席执行官职位以及随之而来的董事会改组为标志,这些…
CIFAR-10--人工智能数据集
由 Krizhevsky 等人提出。从微小图像中学习多层特征
什么是小样本学习?
小样本学习是指使用极少量的训练数据来开发人工智能模型的各种算法和技术。少样本学习致力于让人工智能模型在接触相对较少的训练实例后识别和分类新数据。少样本训练与训练机器学习模型的传统方法形成鲜明对比,传统方法通常使用大量…
DevOps 中的 AI:简化软件部署和运营
就像一台运转良好的机器一样,您的组织正处于重大软件部署的边缘。您已经在尖端人工智能解决方案上投入了大量资金,您的数字化转型战略已经制定,并且您的目光坚定地瞄准了未来。然而,问题迫在眉睫——您能否真正利用人工智能的力量…
Zero123++:从单张图像推理出多个视图模型
Zero123++,这是一种图像条件扩散模型,用于从单个输入视图生成 3D 一致的多视图图像。为了充分利用预训练的 2D 生成先验,我们开发了各种条件和训练方案,以最大限度地减少现成图像扩散模型(例如稳定扩散)的微调…
在音频中将你的描述和内容分开模型AudioSep
语言查询音频源分离(LASS)是计算听觉场景分析(CASA)的新范例。LASS 旨在根据自然语言查询从音频混合物中分离出目标声音,这为数字音频应用程序提供了自然且可扩展的接口。最近的 LASS 工作尽管在特定源(例如…
OpenAI考虑加入AI芯片制造联盟
OpenAI是著名的ChatGPT背后的强大力量,可能很快就会深入研究人工智能芯片制造的动态世界。根据路透社的一份新报道,该公司正在积极考虑创建其独特的AI芯片,甚至正在考虑收购该领域的潜在目标。
什么是KNN 邻近算法
What is K-Nearest Neighbors (KNN)?
什么是边缘人工智能和边缘计算?
边缘人工智能是人工智能最引人注目的新领域之一,它的目标是让人们运行人工智能流程,而不必担心隐私或因数据传输而导致的速度减慢。边缘人工智能正在使人工智能得到更广泛、更广泛的使用,让智能设备无需访问云即可快速对输入做出反…
什么是集成学习?
集成