AI求人検索 - 求人を自動的にマッチングして検索するオープンソースのAI求人検索フレームワーク。
AI Job Searchは、Claude CodeをベースにしたオープンソースのAI求人検索フレームワークです。`/setup`を使用して詳細な職務経歴を作成し、`/scrape`を使用して求人とのマッチングをインテリジェントに評価し、`/apply`を使用して「ドラフトレビュー」のデュアルエージェントワークフローを開始し、自動的に生成します。
AI Job Searchは、Claude CodeをベースにしたオープンソースのAI求人検索フレームワークです。`/setup`を使用して詳細な職務経歴を作成し、`/scrape`を使用して求人とのマッチングをインテリジェントに評価し、`/apply`を使用して「ドラフトレビュー」のデュアルエージェントワークフローを開始し、自動的に生成します。
HiDream-O1-Imageは、Zhixiang Futureが開発したオープンソースの8ビットピクセルレベルネイティブ統合画像生成モデルです。世界初のUiTアーキテクチャを採用しており、VAEや別途テキストエンコーダを必要とせず、単一のトークン空間内で直接生成が可能です。
OpenAI CLIは、OpenAIが公式にリリースしたコマンドラインインターフェースツールであり、Codexチームの開発者エクスペリエンスエンジニアであるJason Liu氏が開発を主導しました。
Camofox Browserは、Camoufox(フィンガープリンティング機能を備えた、大幅に改良されたC++版Firefox)をベースに構築されたオープンソースのAIエージェント向けアンチ検出ブラウザサーバーです。REST APIを介して、構造化されたウェブページのスナップショット(サイズを縮小したもの)をAIに提供します。
Multicaは、元TikTokエンジニアのJiayuan氏が設立したオープンソースのAIエージェントチームコラボレーションプラットフォームです。このプラットフォームは、Claude Code、Codex、Kimiといったコーディングエージェントを実際のチームメイトに変え、カンバンボード上でのコラボレーションを可能にします。
WebWorldは、アリババのQwenチームがオープンソース化した大規模なWebワールドモデルシリーズです。Qwen3プラットフォームでトレーニングされており、8B、14B、32Bバージョンがあります。このモデルは、シミュレートされたブラウザ環境内でWebページの状態を予測します。
TACOは、マンチェスター大学、北京航空航天大学、香港科技大学、およびMAPチームによって開発された、オープンソースでプラグアンドプレイ方式のエンドユーザー向けインテリジェントエージェント自己進化型観測圧縮フレームワークです。
Mirageは、strukto-aiチームが開発したAIエージェント向けの統合仮想ファイルシステムです。このツールは、S3、Slack、Gmail、GitHub、MongoDBなどの異種データソースを単一の仮想ファイルツリーにマウントします。
SkillClawは、AMAP-ML(高徳地図機械学習チーム)が開発したオープンソースのAIエージェントスキル集合進化フレームワークです。このフレームワークは、ローカルAPIプロキシを介してエージェントセッションを傍受し、実際のインタラクションからスキルを自動的に抽出してバックグラウンドで処理します。
GPT-5.5-Cyberは、OpenAIが開発したサイバーセキュリティに特化したモデルで、認証済みの防御者向けに限定的なプレビューを提供しています。GPT-5.5をベースに構築されており、信頼できるネットワークアクセスフレームワークを通じてセキュリティ上の制約を軽減し、脆弱性対策をサポートします。
StepAudio 2.5 Realtimeは、StepAudioが開発したエンドツーエンドのリアルタイム音声モデルで、人間のような自然な音声対話体験に重点を置いています。このモデルは、コンテンツレベルでの高度なインタラクションをサポートし、その音声パフォーマンスは実際の人間の声に非常に近く、最高レベルの機能を備えています。
Ring-2.6-1Tは、Ant Financialが発表した1兆パラメータの深層推論モデルです。Ringシリーズに属し、数学コンテストやコード生成などの複雑な認知タスクにおける、思考時間の長い処理能力に重点を置いています。このモデルはMoEハイブリッドエキスパートアーキテクチャを採用しており、高パラメータ環境で優れた性能を発揮します。
ERNIE 5.1は、Baiduの主力大規模言語モデルであり、ERNIE 5.0の知識蒸留とOnce-for-Allの弾力的なトレーニングフレームワークに基づいており、事前トレーニングコストを類似モデルの業界平均の6%にまで削減しています。
Doubao-Seed-2.0-liteは、ByteDanceのDoubaoチームが発表した初のフルモーダル理解モデルです。このモデルは、動画、画像、音声、テキストのネイティブかつ統一的な理解をサポートすると同時に、エージェント、コーディング、GUIの機能も強化しています。
GPT-Realtime-Translateは、OpenAIが開発したリアルタイム音声翻訳モデルです。70以上の入力言語から13の出力言語へのリアルタイム翻訳をサポートし、エンドツーエンドのアーキテクチャを採用して生の音声を直接処理し、中間的なテキスト処理を省略しています。
GPT-Realtime-Whisperは、OpenAIが発表したストリーミング音声認識モデルです。Whisperアーキテクチャをベースにした改良版で、ユーザーが話している最中にリアルタイムでテキストを出力でき、非常に低い遅延を実現します。
GPT-Realtime-2は、OpenAIの第2世代リアルタイム音声モデルであり、現在Realtime APIの中で最も強力な音声エージェントです。このモデルはGPT-5レベルの推論能力を誇り、音声会話中に聞き取りと推論を同時に行うことができます。
SenseNova 6.7 Flash-Liteは、SenseTime社が発表した新世代の軽量マルチモーダルインテリジェントエージェントモデルです。ネイティブなマルチモーダルアーキテクチャを採用し、実世界のワークフロー向けに設計されています。
Grok Voice Think Fast 1.0は、xAIの主力音声エージェントモデルであり、複雑で多段階の現実世界のシナリオに特化しています。このモデルはτ-voice Benchで1位を獲得し、25言語と全二重対話に対応し、低遅延を実現しています。
Realtime TTS-2は、Inworld AIが開発した次世代リアルタイム音声合成モデルで、特に会話型AIシナリオ向けに設計されています。このモデルはテキストを自然な音声に変換できるだけでなく、さらに重要なことに、会話の文脈における音声の感情、トーンなどを「理解」することができます。
GenericAgent (GA) は、A3 Lab が開発した汎用的な自己進化型 LLM エージェント システムであり、「コンテキスト情報密度の最大化」をコア設計原則としています。GenericAgent は、9 つの基本ツールと 30k のコンテキスト ウィンドウを使用します。
Models.devは、OpenCodeチームによるオープンソースのAIモデルデータベースです。Models.devは、OpenAI、Anthropic、Googleなど数十の主要ベンダーのモデル情報を標準化されたTOML形式で統合し、価格、モデル
Anthropic Skillsは、AnthropicがClaude向けに開発したスキルシステムです。基本的には、Claudeが特定のタスクのパフォーマンスを動的にロードして向上させるための指示、スクリプト、リソースを含むフォルダです。各スキルは…
Kamiは、tw93が開発したオープンソースのAIドキュメントデザインシステムで、Claude Code Skillとして配布されています。AI生成ドキュメントにおける単調なレイアウトや安っぽいビジュアルといった問題を解決するために特別に設計されています。このツールは、厳格な印刷制約セットを使用しています。