只用一张卡,做出了声称是100M参数以内最好的小模型?
只用一张卡,做出了声称是100M参数以内最好的小模型?近日,独立开发者 Harshal Singh 公布了一个仅有 3500 万参数的基础语言模型 BarunLM,并声称:「我预训练了世界上参数量小于 100M 的最好模型」。
搜索
近日,独立开发者 Harshal Singh 公布了一个仅有 3500 万参数的基础语言模型 BarunLM,并声称:「我预训练了世界上参数量小于 100M 的最好模型」。
2025 年秋天,Meta 上线了一名可以替商家卖货的“AI 员工”。商家不需要重新整理一套资料,它会直接读取品牌过去发布的社交媒体内容、广告、商品目录和网站信息,自动学会这家公司卖什么、用什么语气和顾客说话。
近日,由清华大学深圳国际研究生院智能机器人实验室刘厚德教授领衔、王立博博士后担任 AI 首席研究员的大模型团队,正式发布了 VeriLoop Coder-E1—— 一款基于 Qwen3.6-27B 构建、面向仓库级代码修复与智能体式软件工程任务的开源垂类代码模型。
8月,一年一度的ChinaJoy又在上海落幕了。今年的主题是“与AI同游”,近900家企业参展,AI成了游戏之外最热的词。当所有镜头都聚焦在游戏时,一个“逆流而上”的展台引起了我们的注意——WPS。
“怎么全世界都在陪着12星座胡闹啊!”AI练习生马上就在要网友们的“打投”中出道了。注意看,在一档名为《12星练赛》的AI选秀节目中,白羊、狮子和射手三位火象星座练习生正在初舞台上展示唱跳实力。
GPT-5.6 Sol 推翻 100 多年前的麦克斯韦猜想,下一代模型突破 10 个!数学家菲利普·阿拉图恩、加文·鲍尔和马修·D·克瓦尔海姆于 2026 年 7 月 29 日在 arXiv 上发表论文,提到由 GPT-5.6 Sol 找到了一个反例,证明了 100 多年前的麦克斯韦猜想是假的。
Seltz为Agent自建一套持续更新的Web索引,让它能够及时看见公开网络中正在发生什么;AnySearch聚合开放Web和20多个垂直数据源,让Agent知道面对不同问题应该去哪里查;Octen则重写索引、排序和服务层,让Agent可以同时展开几十甚至上百次查询,更快、更大规模地看见信息。
机器之心编辑部 一道困扰学界几十年的开放问题,需要多少成本才能取得关键突破? OpenAI 给出的答案是,十道题加起来,约 2000 美元。 昨天下午,OpenAI 公布了一份颇为惊人的成绩单。其下一
能套现就赶紧套现!一位账上压着70万美元OpenAI股权、刚从OpenAI离职的员工,不睡觉也要上网喊话老同事。眼看OpenAI的估值一路走高,他怎么反倒劝人赶紧落袋为安?
Factory 成立于 2023 年 4 月。彼时,企业市场连 GitHub Copilot 都尚未完全接受,更不用说完全自主的 AI 软件工程代理(Autonomous Agents)了。Matan 形容创业最初的两年是一场在沙漠中的跋涉:技术理念过于超前,工程师还没准备好改变习惯,企业采购团队也充满怀疑。