Nebius 宣布 Clarifai 核心团队加入,并授权其推理和计算编排技术,以增强 Nebius Token Factory 作为全栈推理平台的能力。
AI 新闻实时情报
实时监测
实时更新
实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。
实时更新
谷歌披露,它发现并破坏了一个犯罪团伙利用人工智能发现另一个公司未知漏洞的企图。这证实了安全专家多年来的警告:黑客正在利用AI加速攻击。与此同时,人工智能在漏洞发现方面的能力也在提升,引发了关于监管的讨论。
Diffflow是一款使用Rust、Svelte和AI技术构建的实时网页变化监控工具,旨在帮助用户忽略噪音,追踪关键更新。
金融服务公司在部署代理型AI时,必须确保数据的质量、安全性和可访问性。Elastic的Steve Mayzak指出,一个集中、可搜索的数据存储至关重要。从可管理的用例开始,逐步迭代,可以构建满足监管要求的可扩展AI系统。
普林斯顿大学因学生使用人工智能作弊,将于今年夏天开始对所有线下考试进行监考,结束了133年来的荣誉考试制度。学生和教师普遍认为作弊现象严重,且学生因担心网络暴力而不愿举报作弊。
本文探讨了一个悖论:大型语言模型(LLM)能通过律师考试、诊断罕见疾病,却连简单的数数任务都频频出错。这源于其概率预测的本质,而非传统计算。研究识别出三种幻觉类型:虚构型、回避型和过程不透明型。知识创新系统(KIS)通过将推理步骤外部化,实现了100%的计数准确率,并提供了可审计的轨迹。未来AI的可靠性关键在于可审计性,而非仅仅是准确性。
通过Edge移动应用,你现在可以请求多个标签页的摘要、将页面转换为播客,并访问你的浏览历史和之前的聊天记录。
Conductor 是微软开源的一个 CLI 工具,采用 YAML 定义多智能体工作流,使用确定性路由而非 LLM 动态编排,从而降低成本和延迟。它支持混合模型、并行执行、人类审核、脚本步骤和 Web 仪表板,适用于代码审查、研究综合等结构化工作流。
英国税务海关总署(HMRC)与英国科技公司Quantexa签订了一项价值1.75亿英镑、为期10年的合同,利用其人工智能技术提高绩效。该系统将结合HMRC收集的数据与外部来源,帮助快速识别欺诈和无意的错误。Quantexa表示,AI做出的自动决策仍需人工检查,数据将保持安全。
Mirage Security通过使用AI审查低风险拉取请求,将代码变更吞吐量提高了146%,同时保持SOC 2合规性。他们根据风险分类变化,高风险变更仍需人工批准,低风险变更由AI审查,并通过每周人工回顾确保控制有效。所有过程均通过CI/CD脚本实现可审计性。
谷歌AI和基础设施团队开发了一种多智能体AI系统,将TensorFlow模型迁移到JAX的速度提升了6倍以上。该系统包括规划器、协调器和编码器代理,结合静态分析和严格的验证流程,成功迁移了YouTube等大规模生产模型。
Meta的Ray-Ban第二代智能眼镜首次降价15%,第一代降价25%,Oakley联名款降价20%。第二代在摄像头和电池续航上有显著提升,但第一代价格更实惠,AI功能基本同步。
康奈尔大学研究人员开发了一种新决策工具,利用人工智能帮助人们做出复杂决策。不同于以往由人类检查AI结果,这次是AI反过来检查人类。
本文探讨了写作的本质,通过回顾古代思想家(如柏拉图、亚里士多德)以及神谕祭司的观点,论证了真正的写作不仅仅是字符排列,而是有意识的思想表达。作者认为,当前AI生成文本缺乏意图和灵魂,因此不能被视为真正的“写作”。
一款名为GLiNER2-PII的开源模型,仅有0.3B参数,在PII检测任务上取得了最先进性能,在SPY基准测试中超越了OpenAI的隐私过滤器。该模型能识别42种实体类型,并基于多语言合成语料库训练。模型已在Hugging Face上公开发布。
Doublespeed是一个AI驱动的社交媒体自动化平台,通过在美国真实设备上运行代理账户,实现大规模内容生成和分发,号称可以取代人类创作者团队。平台提供三种服务层级,并利用真实手机模拟人类行为以规避平台限制,但其本质是自动化内容农场,可能引发伦理争议。
德克萨斯大学奥斯汀分校的研究人员开发了一种石墨烯“纹身”,可以直接贴在植物叶片上实时监测水分含量。该传感器不仅可用于监测植物健康状况,还能充当人工突触,未来有望构建植物的神经网络,实现森林火灾和干旱风险的实时评估。
一名Twitter用户分享了一幅真实的克劳德·莫奈画作,却声称这是AI生成的,引发了关于艺术与AI鉴别的激烈讨论。
VibeServe是一个多代理系统,能够为特定的模型、硬件和工作负载端到端合成定制的大语言模型服务运行时。在标准设置上与vLLM和SGLang相当,在非标准场景中实现1.69倍到6.27倍的加速,展示了AI代理在系统构建中的潜力。
Halgorithem 是一种无需依赖AI即可检测AI幻觉的算法,通过将输入文件解析为树结构并与文件块树比较来标记不一致之处。该算法可轻松集成到LangGraph、CrewAI等Python AI工作流中,并在多项基准测试中展现出高准确率。
微软开发了名为MDASH的系统,通过让超过100个专业AI代理相互竞争来发现软件漏洞。仅在补丁星期二,该系统就发现了16个Windows安全漏洞,其中4个为严重漏洞。微软未透露该系统使用的AI模型。
ownyourwords.co 网站讨论AI在沟通中的问题:当双方都使用AI时,信息被无谓地膨胀,浪费大量能源和带宽,同时隐私暴露。解决方案是写回人类的方式——带错别字、粗话和情绪。
StyleRef 是一种可移植的风格规范,允许用户一次性定义创意风格,然后在 ChatGPT、Claude、Midjourney 等任何 AI 工具中粘贴使用,确保输出一致性。它包含 160 多个样式块,涵盖色调、色彩、排版、情绪等方面,并支持从图片或文档提取风格。
由于厌倦了AI幻觉,Robin在Rauno上构建了一个工具,让多个AI模型在同一屏幕内实时辩论和相互核查事实,以提高准确性。它支持Claude Sonnet 4.6、Gemini 3.1 Pro和ChatGPT 5.2等模型,并提供免费试用。
Action-path lab 是一个交互式地图工具,通过模拟从正常 PR 到隐藏路径、真实暴露和证明缺口的过程,展示 AI 编码代理如何可能引发安全风险。用户无需上传代码即可探索动作边界、凭证范围等。
加州大学河滨分校的计算机科学家发现,新一代AI代理在执行日常电脑任务时存在严重缺陷,可能导致数字灾难。这些代理旨在用户离开时自动处理电子邮件、整理文件、分析数据等,但其盲目行动可能引发意外后果。
Klent 是一个AI代理防护系统,位于代理和工具调用之间,允许、拒绝、修改或暂停每次调用,只需两行代码集成,并提供完整审计追踪。它能防止误操作导致的生产数据灾难,例如一次性修改数万行数据,支持人工审批、策略引擎、动作重写等功能。
本文作者分享了自己为了运行AI智能体而搭建的远程工作环境。他意识到,AI智能体的运行状态才是工作本身,而笔记本电脑的移动性会导致中断。因此,他使用Mac Studio作为主机,通过Cloudflare Tunnel和tmux构建了一个可从任何地方访问的持久化工作区。文章详细介绍了设置方法、优点以及尚未解决的问题。
前谷歌表格首席工程师扎克·劳埃德认为,AI编码智能体将使独立应用程序过时,价值转向数据和元应用。他回忆了几天内构建一个表格克隆的经历,并预测未来任何人都可以通过描述需求来构建自定义软件。
美国已批准约十家中国公司(包括阿里巴巴、腾讯和字节跳动)每家最多购买75,000块英伟达H200芯片,但尚未有一块芯片发货。商务部长卢特尼克称,北京方面阻止了这些购买以保护本国芯片产业。