计算机视觉
共 30 篇文章
因成本压力,Snap将AI视频团队剥离为新公司Dotmo
Snap公司正推进战略转型,将内部创新部门剥离成立独立新实体Dotmo,由前Snap员工组成,专注研发AI视频技术。此举是Snap的“内部创业”策略,旨在赋予团队更大灵活性,规避大公司官僚主义,在AI视频爆发前夜抢占先机,同时保留核心AI人才。Dotmo定位明确,有望结合Snap的AR积累探索商业应用。尽管面临激烈竞争与商业化风险,该布局反映了科技巨头趋向“模块化”创新的趋势,也是Snap寻求新增长引擎、决定未来十年行业地位的重要赌注。
General Intuition in talks to raise $300M at aroun
在人工智能技术飞速迭代的今天,如何让机器真正理解并模拟物理世界的运作规律,已成为业界最为前沿的挑战之一。近日,一家新兴的初创公司凭借其独特的战略布局,吸引了科技界的广泛关注。该公司正利用来自游戏数据平台Medal的海量视频资源,训练其所谓的“具身智能”(Embodied AI)与“世界模型”(World Model),试图为AI赋予更接近人类的感知与行动能力。
据知情人士透露,这家初创公司所使用的数据集规模令人瞩目。Medal平台拥有超过1000万的月活跃用户,这些用户每年贡献的视频内容总量高达20亿条。如此庞大的数据洪流,为训练复杂的人工智能模型提供了前所未有的“燃料”。与...
深藏山底与矿洞,暗物质搜寻迎来新突破
在意大利亚平宁山脉的深处、中国四川的锦屏山地下,以及美国南达科他州一座废弃矿井的底部,一场跨越国界与地层的宇宙级“追捕”正在悄然进行。在这厚重的岩层屏蔽之下,科学家们部署了装满液态氙的巨大探测器,试图首次直接捕捉暗物质的踪迹。这种长久以来被追寻的隐形物质,其引力犹如无形的雕塑家,塑造了我们今日所见的宇宙结构。
然而,这场旷日持久的狩猎最近却迎来了一个令人啼笑皆非的转折:探测器确实捕捉到了罕见的信号闪烁,但这并非来自暗物质,而是来自同样轻盈、无处不在却极其普通的亚原子粒子——中微子。恒星在核聚变过程中会产生海量中微子,它们如同幽灵般穿透普通物质,偶尔与探测器中的氙原子发生碰撞,...
Snap发布天价AR眼镜后股价大跌
Snap公司新一代智能眼镜首发未能提振股价,反而引发资本市场对其硬件战略与商业变现能力的深层忧虑。究其原因:一是硬件重资产低毛利与公司轻资产模式冲突,投资者担忧其陷入烧钱泥潭;二是面临Meta、苹果等巨头的强势竞争,先发优势被资源优势稀释;三是AR生态尚缺杀手级应用,社交驱动硬件逻辑存疑;四是供应链量产与成本控制难度大。这暴露了社交企业跨界硬科技面临的系统性挑战。未来Snap需证明硬件业务的商业可持续性,方能打破资本市场观望态度。
ChatGPT月活仍破11亿领跑全球,市占首度跌破50%释放何信号?
当前AI助手市场竞争激烈,ChatGPT以月活超11亿居首,得益于先发优势和通用对话能力;Google旗下Gemini以6.62亿月活紧随其后,依托生态整合和多模态能力快速追赶;Claude以2.45亿月活位列第三,凭借安全性和专业领域口碑差异化竞争。三者用户差距反映不同市场策略,但整体趋势显示用户从尝鲜转向日常依赖,市场仍存增长空间。未来竞争将转向多模态、个性化和隐私保护,转化流量为长期粘性成为关键。
大脑如何感知体内信号:揭秘你的内在第六感
人类大脑每秒处理约1100万比特感官信息,但意识仅能处理10至60比特。内感受(从内部感知自我的能力)研究正迎来爆发,揭示了身体信号如何影响情绪、决策与健康。科学家已发现PIEZO蛋白作为触觉分子入口,并正在解码迷走神经的复杂系统。研究显示,内感受是双向通讯闭环,通过训练可提升身体觉察力,为治疗焦虑、慢性疼痛等疾病提供新路径。直觉并非玄学,而是生理学,我们应同时立足于感受与事实。
Inside interoception: The hidden sense of how you
文章介绍“内感受”——大脑感知与解读身体内部信号的能力——如何成为理解身心连接的关键。1100万比特/秒的感觉信息中,仅极少数进入意识;大脑持续预测、调节并作出反应,维系健康与决策。文中追溯内感受的科学史:从概念提出、达马西奥与克雷格揭示情感—身体—理性间的互动,到2021年诺贝尔奖推动PIEZO通道等分子机制的发现。迷走神经、触觉与压力感应的研究正细化身体—大脑的双向通路。多学科协作与NIH推动使内感受成为热点,应用于抑郁、疼痛、肥胖等治疗及心理—行为训练。提升内感受敏锐度可改善情绪与决策,让“直觉”有生理依据,倡导在事实与感受之间取得平衡。
0.005美元/秒生成视频!Avataar AI如何以低成本与文化洞察征服印度市场?
在人工智能生成视频技术领域,一场关于成本与效率的竞赛正在悄然升温。近日,专注于3D和视觉AI的初创公司Avataar AI宣布推出其全新的蒸馏视频模型(distilled video model),并以极具冲击力的价格——每秒生成仅收费0.005美元——进入市场。这一定价策略不仅远低于行业主流水平,更引发了业界对AI视频生成商业化路径的重新审视。
Avataar AI的这款模型被定位为“蒸馏”版本,意味着它通过模型压缩和知识蒸馏技术,在保持较高生成质量的同时,大幅降低了计算资源和推理成本。相较于当前市场上许多依赖大规模扩散模型(diffusion models)的视频生成服务...
足球数据复兴重塑攻防逻辑,中国核电蓝图加速落地?
本文报道了科技领域的多项进展:计算机科学家通过AI和数据解析正在革新足球战术;中国以惊人速度建设大型核反应堆,预计2030年装机容量将超越美国和欧盟;此外,还涵盖了自主无人机首次疑似实战杀人、美国太阳能发电超越煤炭、俄罗斯FSB控制互联网、OpenAI指控中国利用ChatGPT进行舆论操作、SpaceX IPO预期、EPA科学家被施压淡化化学品风险、Anthropic调整AI研究政策、国会关注数据中心争议、搜索优化问题及人类偏好逆时针行走等科技新闻。
Multimodal Browser AI with Transformers.js for Ima
在人工智能技术飞速发展的今天,浏览器端的AI应用正逐渐从实验室走向大众视野。然而,一个不容忽视的现实是,目前绝大多数面向浏览器的AI教程和入门指南都聚焦于文本处理领域。这虽然是一个合乎逻辑的起点,因为文本数据易于获取、处理相对简单,且能直观展示模型的基本能力,但业内人士指出,这种“文本优先”的教学路径与用户实际渴望构建的应用场景之间存在着显著的脱节。
事实上,当人们畅想AI在浏览器中的潜力时,他们脑海中浮现的往往是更具沉浸感和交互性的体验——例如,实时图像识别、语音助手、视频内容分析、甚至结合摄像头与麦克风的增强现实应用。这些应用场景的核心特征是多模态数据的融合与处理,而不仅...