全部资讯
共 298 页,第 39 页
真正的AI竞赛或已不在前沿
在人工智能领域,一场关于模型开放性与前沿性的深刻辩论正在悄然展开。Hugging Face(一家以开源AI模型库闻名的公司)的首席执行官Clem Delangue近日指出,企业界对开放模型的需求正呈现出显著增长趋势,其背后的驱动力主要来自成本、可及性以及所有权这三个关键因素。这一观点引发了行业内的广泛思考:当绝大多数的生产级AI应用最终都运行在开放模型之上时,那些耗费巨资打造的、性能顶尖的“前沿模型”(Frontier Models)是否还像过去那样至关重要?
Delangue的观察并非空穴来风。长期以来,AI领域的竞争格局一直由少数几家科技巨头主导,它们通过闭源的前沿模型—...
Superhuman新自动草稿功能几乎让我爱上AI回复
在人工智能助手日益融入日常办公的今天,电子邮件的智能撰写功能始终是各大科技公司竞相争夺的焦点。然而,长期以来,用户对AI生成的邮件回复往往持保留态度——要么过于模板化,要么缺乏人情味,总需要花费大量时间进行二次修改。近日,知名邮件客户端Superhuman推出的最新AI邮件起草功能,却在测试中展现出令人意外的成熟度,其生成的回复在多数情况下几乎无需人工编辑,这标志着AI在自然语言处理领域迈出了坚实的一步。
Superhuman作为一款以“高效”著称的邮件应用,其用户群体主要为科技从业者、创业者和商务人士。这些用户对邮件沟通的效率和质量有着极高的要求。此前,市面上已有的AI邮件...
The Download: Claude’s inner workings, and the fut
This is today’s edition of The Download, our weekday newsletter that provides a daily dose of what’s going on in the world of technology. What Anthropic’s latest AI discovery does—and doesn’t—show —James O’Donnell When Anthropic announced last week that it had found a new window into its mo...
LLM评估框架对比:如何真正衡量模型表现
在人工智能领域,大型语言模型(Large Language Model, LLM)的应用正以前所未有的速度渗透到各行各业。从智能客服到代码生成,从内容创作到数据分析,这些模型正在重塑我们与技术交互的方式。然而,随着LLM应用的爆炸式增长,一个关键问题日益凸显:如何科学、系统地评估这些模型的性能与可靠性?传统的评估方法往往依赖于人工标注或简单的基准测试,但面对复杂多变的应用场景,这些方法显得力不从心。近日,行业专家指出,RAGAS、DeepEval和Promptfoo三大开源框架正成为评估LLM应用的主流工具,它们各自独特的评估逻辑与优势,正在为开发者提供一套全新的评估范式。
...
This Luddite Puppet Hopes You’re Not Reading This
在科技巨头主导数字生活的时代,一场关于“数字极简主义”的反思正在悄然兴起。本周,WIRED(《连线》杂志)高级文化编辑Manisha Krishnan(曼尼莎·克里希南)在其主持的播客节目《The Big Interview》(《重磅访谈》)中,与嘉宾Gowanus(高瓦努斯)展开了一场深度对话,探讨了当代人在大型科技公司(Big Tech)的包围下,如何选择“逃离”、拥抱户外生活,以及身处约会应用程序(Dating Apps)泛滥的“拒绝文化”中,个体所面临的情感挑战。
这场对话的核心,并非仅仅是技术层面的批判,而是对一种更健康、更自主生活方式的呼唤。Gowanus在访谈中...
The Chatbot That Foretold Why People Share Secrets
在人工智能发展的漫长历史中,某些看似简单的实验往往为整个行业埋下了深远的技术伏笔。上世纪60年代,麻省理工学院(MIT)教授约瑟夫·魏岑鲍姆(Joseph Weizenbaum)创造了一款名为ELIZA的聊天机器人,这一诞生于计算机实验室的早期程序,如今被业界视为现代对话式AI的鼻祖。尽管ELIZA的技术架构在今天看来极其原始,但它与人类用户之间产生的交互模式,却为后来数十年的聊天机器人发展奠定了不可忽视的行业基准。
ELIZA的诞生背景正值计算机科学从大型机向人机交互探索的转型期。当时,魏岑鲍姆教授的本意并非要打造一个“智能”助手,而是希望通过这个程序揭示人类在对话中如何轻...
智能体时代如何管理AI投资
在人工智能技术快速迭代的今天,企业正从单纯的模型部署阶段,迈入一个被称为“智能体时代”(Agentic Era)的新阶段。这一转变的核心,不再仅仅是追求模型参数规模的扩大,而是如何将AI投资转化为实实在在的生产力。近日,行业专家指出,企业若想在这一浪潮中保持竞争力,必须学会用“每美元有用工作量”(Useful Work per Dollar)这一全新指标来评估AI投资回报,并以此为基础优化效率、规模化高价值工作流。
长期以来,企业衡量AI投资效果的标准主要停留在技术指标层面,如模型推理速度、准确率或训练成本。然而,在智能体时代,AI系统被赋予了更多自主决策和执行任务的能力,它...
DOGE用AI制定住房政策,政府拒绝透露细节
美国住房和城市发展部(HUD)近日因拒绝公开一份与人工智能(AI)使用相关的政府文件而陷入争议。该机构在回应一项公共记录请求时,以一项并不存在的法律特权为由,扣留了有关“DOGE”项目使用AI技术的文件。这一事件不仅引发了公众对政府透明度的质疑,也再次将AI在公共管理中的角色推至风口浪尖。
据了解,此次争议源于一份由公民或组织提交的公共记录申请,要求HUD披露其与“DOGE”项目相关的AI使用细节。然而,HUD在回复中援引了一项所谓的“特权”,声称该文件属于保密范围。但法律专家和透明度倡导者指出,这一特权在美国法律体系中并无明确依据,实际上是一种“虚构的豁免权”。这一做法被批...
光量子计算新突破:百台超低温机柜打造百万光子计算机
The machine that could change the world will be housed in a room that looks like a data center crossed with an ice cream factory. Inside will be some 100 stainless-steel cabinets, each about six feet tall and connected to a supply of liquid helium that keeps them only a few degrees above absolute ze...
已富已成功,上一波科技赢家为何再拼搏
科技巨头因恐惧错过AI历史性机遇和巨额利润诱惑,正展开一场前所未有的竞赛。竞争已从技术比拼转向生态系统对抗,头部企业加速推出强大模型并嵌入各领域,初创公司也在细分领域寻求突破。高昂的模型训练成本迫使企业快速商业化,但长期盈利模式仍存挑战。AI被视为全球科技产业的下一个增长引擎,驱动各行业转型升级,但同时也引发对伦理、隐私和就业的广泛讨论。