Hugging Face が「LoRAを超える手法はあるか」を公開 ── PEFTの世界は本当にLoRA一強なのか?
Hugging Faceが「LoRA一強で本当にいいのか?」を問う記事を公開。HubのPEFTモデル98.4%がLoRA使用という圧倒的シェアを示しつつ、他手法の検討を促している。
Hugging Faceが「LoRA一強で本当にいいのか?」を問う記事を公開。HubのPEFTモデル98.4%がLoRA使用という圧倒的シェアを示しつつ、他手法の検討を促している。
Google DeepMindがAIエージェントを安全に管理する「AI Control Roadmap」を公開。アライメントの不完全さを前提とした多重防御のアプローチとは。
Hugging Faceが提案する、AIエージェントが使いやすいソフトウェア設計。答えだけでなくプロセス全体を評価する新しいベンチマーク手法を解説。
OpenAIが生命科学のリアルな研究タスクを評価する新ベンチマーク「LifeSciBench」を発表。専門家が作成・レビューしたガチのテスト。
OpenAIとMolecule.oneがGPT-5.4を活用したほぼ自律的なAI化学者を発表。創薬における超難関の化学反応を改善する成果を示した。
エージェントが実行時に必要なツールや他エージェントを自ら検索・発見する新オープン標準「ARD」をHugging Faceらが発表。
Allen AIが公開したMolmoMotionは、テキスト指示と3Dポイントから未来のモーションを予測する新しいモデル。116万本規模のデータセットも同時リリース。
AWS Strands Robots SDKとLeRobotが統合。Hubのデータセットから実機SO-101まで、ひとつのエージェントで完結するロボット開発パイプライン。
GLM-5.2が100万トークンのコンテキストを安定処理。長期タスク能力でOpusやGPT-5.5に肉薄する驚異のモデル。
OpenAIが「Deployment Simulation」を発表。実際の会話データでリリース前のAI挙動をシミュレートし、安全性と評価精度を向上させる新手法。