个性化智能体强化学习框架上线,8B模型盲测第一
个性化智能体强化学习框架上线,8B模型盲测第一当个性化Agentic RL遇上现实用户平台场景时,一直存在一个常见难点:面对同样的query,不同用户往往偏好不同的规划策略、工具调用和最终表达。
搜索
当个性化Agentic RL遇上现实用户平台场景时,一直存在一个常见难点:面对同样的query,不同用户往往偏好不同的规划策略、工具调用和最终表达。
过去一年,具身智能的技术迭代明显加快。VLA、世界模型持续演进,强化学习重新成为机器人学习的重要技术路径,Sim2Real加速从仿真走向真机,全身控制能力也在快速突破。
数据从哪儿来?模型怎么做?落地在哪里?
如今的 AI 已经能顺畅地帮你写代码、跑实验、做评估。算法工程师的每一天,几乎变成了:让 LLM 整理昨天的实验结果,让 LLM 实现新想法,让 LLM 监控实验运行…… 似乎只需把需求告诉 AI,它就能完成大部分算法工作。
智谱宣布完成约50亿美元融资,募资净额约60%将用于下一代GLM基础模型及完全自训练体系(含递归式自我改进RSI)的研发,并支撑算力基础设施建设,同时约15%用于业务拓展与战略投资,约25%用于优化资本结构与补充营运资金。
奥特曼在《财富》专访中宣布OpenAI 2026年不会上市,理由是人类可能造出完全失控的AI,此时上市时机极不明智,公司宁愿牺牲万亿市值也要按下AI安全暂停键。
开发者chetaslua在MacBook上用NumPy和MaleCNS连接组数据模拟了13.8万个神经元的果蝇大脑,并将神经放电信号实时翻译成文字直接发送给ChatGPT,实现了生物神经信号与大语言模型的首次对话。
BuilderHub本周推荐6个AI项目,包括VIRSE、Stances、ACE、橡果Oaky、Citely和CCX,涵盖AI设计基础设施、语言学习与决策研究、AI音乐平台、个人内容系统、合规决策工具及多模型API网关等方向。
高通提前剧透下一代骁龙旗舰移动平台的核心升级:Oryon CPU首次实现5GHz主频并引入动态缓存架构FlexCache,Hexagon NPU推出Element Accelerator与更大共享内存,Adreno GPU首次加入Matrix Cores并集成AI图形渲染技术Adreno Neural Fusion,全面强化端侧智能体AI性能与体验。
Anthropic CEO Dario Amodei发表长文呼吁控制前沿AI能力提升节奏并引入嵌入式第三方安全评估机制,OpenAI CEO Altman随即表态支持,并以AI安全为由确认OpenAI今年不会进行IPO。